сбежавшая нейросеть
23.5K subscribers
295 photos
55 videos
307 links
Авторский канал про искусственный интеллект: новости, примеры использования, мысли в тему и не очень. Подписывайтесь!

Для связи: @runawayllm_bot

Я на Boosty: https://boosty.to/escaped_ai
Я на Sponsr: https://sponsr.ru/escaped_ai/
Download Telegram
Быстрый и бесплатный — встречаем новый Grok!

Только что закончил обновлять пост с бесплатными ИИ, которые я рекомендую (если пропустили, обязательно прочтите). Новый фаворит в нем Grok: компания Илона Маска выпустила Grok 4 Fast — ускоренную версию Grok 4, доступную в том числе бесплатным пользователям. Лимиты использования пока не раскрыты, но я вчера закинул более 20 запросов подряд — и все было ок. Если работаете по API, то Grok 4 Fast временно бесплатен на Open Router и Vercel AI, причем с огромным контекстным окном в 2M токенов — больше, чем у Gemini 2.5 Pro.

Если смотреть на бенчмарки, то Grok 4 Fast почти не отстает от “большого” Grok 4 и GPT-5 Thinking. А где-то даже выходит вперед — например, у этой модели первое место на LMArena в категории поиска по сети.

При этом Grok 4 Fast действительно очень быстр — когда ИИ опирается на свои знания, то ответ обычно занимает 5-20 секунд. Если используется веб-поиск, то может и сильно дольше, но здесь от производительности самой модели мало чего зависит. И это в рассуждающем режиме, где Грок разбивает задачу на шаги, проверяет себя и делает меньше ошибок.

Но есть и нюансы. Я вчера весь день тестировал Grok 4 Fast, сравнивая его с “большим” Grok 4, а также рассуждающей версией GPT-5 в настройках Standard и Extended (тоже влияют на скорость ответа). Скорость действительно впечатляет — фактически, Grok 4 Fast можно использовать как обычный чат-бот, разговаривая с ним в режиме диалога, задавая уточняющие вопросы, быстро тестируя новые идеи и т. д. Похожая скорость у GPT 5 Standard, а вот “большие” версии Grok 4 и GPT-5 могут думать по минуте и дольше, что делает диалог с ними не очень комфортным.

Однако за скорость приходится платить. Grok 4 Fast все-таки иногда сбивается в задачках на логику и арифметику (в том числе на банальной “что больше — 9,11 или 9,9?”), тупит на некоторых загадках с подвохом, временами галлюционирует, а при написании текстов может покликбейтить или преувеличить факты.

Разумным выглядит использовать Grok 4 Fast в паре с обычным Grok 4. Например, сначала в режиме диалога проработать задачу с быстрой версией, а затем переключиться на Grok 4 и дать промпт вроде:

Перечитай беседу выше. Есть ли в ней фактические и логические ошибки? Упустили ли мы что-то важное? Исправь и напиши саммари.


Или наоборот — сначала очень детально изложить задачу для Grok 4, получить от него ответ, а затем переключиться на быструю версию, чтобы задать дополнительные вопросы. В бесплатной версии сейчас дается что-то вроде 10 запросов в сутки к Grok 4 (лимиты постоянно меняются) — не густо, но если грамотно комбинировать обе модели, то можно выжать максимум.

Оба Грока неплохо (точно лучше GPT-5) пишут на русском, но с одним недостатком — любят вставить английское слово или несколько иероглифов. Частично исправляется пользовательской инструкцией (Настройки > Персонализировать > Custom). Сразу предупрежу, что она не идеальна, но лучше придумать у меня пока не получилось:

Если нет другой просьбы, то отвечай на русском, без англицизмов, случайных иероглифов и английских слов.


Еще одна неоднозначная особенность Grok 4 и Grok 4 Fast — оба ИИ минимально цензурированы. Где-то это может показаться опасным, а где-то, наоборот, полезным. Например, не так давно я пытался с помощью GPT-5 разобраться, как ИИ помогал ученым во время пандемии коронавируса. Модель поначалу давала хорошие ответы, но затем пошла в строгий отказ — похоже, слишком жесткие системы безопасности подумали, что я пытаюсь создать новый вирус (прямо у себя на кухне, да). А вот Grok 4 дал подробные и глубокие ответы.

Если не увлекаться подобными “пограничными” темами, то Thinking-варианты GPT-5 работают получше обоих Гроков. Эта модель почти не галлюцинирует, очень хорошо делает сложный анализ и классно программирует — с минимумом ошибок и красивыми интерфейсами. Однако выжать максимум из GPT-5 можно только с подпиской, а вот если нужен бесплатный ИИ — то лимиты у Грока намного богаче.
41👍28🔥11
Сегодня поделюсь свежими промптами

Некоторое время назад я взял за правило раз хотя бы в 2-3 дня заглядывать на Reddit-разделы вроде ChatGPTPromptGenius, смотреть новые промпты и тестировать понравившиеся. Зачем? Промпты, даже не очень качественные — универсальный язык обмена идеями, как бы еще использовать ИИ.

Но не стоит пользоваться найденным“как есть” — обязательно протестируйте на разных ИИ, оцените ответы, попробуйте перефразировать. Промпты из этой подборки я целый вечер тестировал в GPT-5-Thinking и Grok 4, в итоге отобрал только самые лучшие, некоторые заметно переработав. Делюсь с вами:

Перечисли основные экспертные позиции по теме [X], начиная с самой влиятельной. Покажи, в чем они сходятся и расходятся.


Промпт хорош тем, что позволяет быстро окинуть общим взглядом проблему, узнать, какие к ней есть основные подходы, в чем эксперты сходятся, а где ведутся дебаты.

Но учитывайте, что даже самая мощная нейронка даст очень поверхностный обзор каждой позиции. Поэтому воспринимайте ответ как отправную точку для дальнейшего изучения. Выбирайте отдельные позиции и в этом же чате просим пояснить каждую детально.

Какие важные вопросы по теме [X] остаются на периферии даже у профессионалов? Почему?


Промпт, с формулировкой которого я провозился дольше всего. Когда тестировал разные версии в GPT-5 и Grok 4, то обе модели часто давали непохожие ответы, а при просьбе проверить друг за другом — начинали натуральную перепалку на тему, действительно ли эти вопросы еще не обсуждают (GPT-5 даже на капс местами перешла).

Объяснение на самом деле простое. Современные ИИ пока не способны выдвигать совершенно новые идеи — поэтому они начинают предлагать варианты, которые обсуждаются как минимум в среде профессионалов. Если вы хорошо разбираетесь в теме, то не ждите откровений. Но если новичок или просто интересуетесь — можете узнать что-то новое.

Какие новые паттерны в индустрии [X] большинство упускает? Ищи сигналы в стартапах, патентах и академических работах.


Промпт, похожий на предыдущий, но более приземленный. Моя рекомендация — сразу созывать консилиум из тех же GPT-5 Thinking (если у вас бесплатная версия, добавляйте “думай тщательнее” в начало промпта) и Grok 4, закидывать промпт в обе модели, а затем дать каждой из них ответ “коллеги” с инструкцией:

Вот ответ другого ИИ на эту тему. Что в нем действительно новое, а что – нет?


Современные ИИ очень стараются дать пользователю ответ, поэтому подсовывают в него общеизвестные вещи, а такая перекрестная критика помогает убрать мусор. Затем просто соберите оба ответа и их критику в одном ИИ — и попросите дать саммари.

Здесь, кстати, в очередной раз похвалю GPT-5 Thinking – все-таки видно, что это модель нового поколения. Ответы пусть и были не идеальными, но интересных взглядов в них оказалось больше.

Единственное, что GPT-5 часто любит срываться на профессиональный язык. Если такое происходит, просите “перепиши понятно” — она подстроится.

Объясни [вопрос] через аналогии, которые [представитель профессии] сразу поймет.


Сначала промпт показался глупостью, а в итоге завис на нем минут на тридцать. Не стоит относиться к нему серьезно — просто поиграйтесь. Пусть ИИ пояснит теорию струн PR-менеджеру. Глобальное потепление — балерине. Черные дыры — сантехнику. Получается местами максимально весело, но учитывайте, что объяснение все-таки будет не очень точным. Поэтому в отдельном диалоге попросите пояснить ту же тему неспециалисту.

Как [вписываем свежую новость] связано с более широкими историческими событиями и что это может предсказать на ближайшие годы?


Промпт, которым в ближайшие дни постараюсь пользоваться почаще. Если у ИИ хороший веб-поиск, то он мигом соберет полный контекст события и даст несколько прогнозов. Интересный способ читать новости.

P.S. Что же до оставшихся промптов из подборки — то промпт для изучения мне совсем не нравится (вот пост, как я учу с ИИ что-то новое), а decision maker заслуживает отдельной подборки.

#сбежавшая_нейросеть_промпты
54👍32🔥14
Куда такие деньги и мощности?

(в конце поста будет необычный промпт)

Все обсуждают сделку, которую называют крупнейшей в истории ИИ-инфраструктуры: в обмен на пакет акций OpenAI, Nvidia планирует вложить в нее до 100 миллиардов долларов, которые пойдут на закупку ускорителей для обучения ИИ. Надо сказать, очень большого количества ускорителей: по оценкам, до 3-4 миллионов GPU с сопутствующей инфраструктурой.

Для сравнения — современные передовые модели вроде GPT-5 и Grok 4 обучали примерно на 200 тысячах ускорителей. Куда же такие мощности?

На самом деле, амбиции ИИ-гигантов сейчас таковы, что сделки вроде заключенной с Nvidia могут показаться лишь разминкой.

Та же OpenAI недавно опубликовала статистику использования ChatGPT – за год количество ежедневных запросов выросло в 6 раз. Цифра будет расти и дальше, а ведь это только быстрые запросы к чат-ботам.

Следующий этап — ИИ-агенты, которые работают десятки минут над комплексной задачей, самостоятельно создавая и выполняя план, возвращаясь за уточнениями и согласованием финального решения. Демо технологии мы видели в OpenAI Operator и ChatGPT Agent — да, оба агента оказались неуклюжими, но, думаю, через полгода-год на новых мощностях технология станет иной.

Параллельно идет совершенствование агентов для бизнес-задач. The Information рассказало, что OpenAI и Anthropic уже создали “тренировочные офисы”, в которых опытные сотрудники обучают ИИ-агентов рутинным задачам: рассылке писем, разбору обращений в службу поддержки, заполнение шаблонных документов, таски в Jira и многому другому. Задача — переложить офисную рутину с человека на ИИ.

И, наконец, наука: пожалуй, самая большая сфера применения ИИ, к которой мы только начинаем подбираться. Я недавно рассказывал, как модели OpenAI и Google DeepMind взяли золото в международных школьных олимпиадах по математике и информатике, и в студенческой — по программированию. И приводил пример, что на решение задачи из олимпиады по математике уходит до полутора часов. Для ИИ это огромное достижение: буквально год назад модели едва справлялись с задачами в пару минут.

Но Грек Брокман из OpenAI дал интересную аналогию, показывающую, как мало мы еще продвинулись в ИИ: если полтора часа непрерывной работы это уровень олимпиады, то уровень полноценной научной работы в математике — минимум полторы тысячи часов (а для серьезного открытия — десятки тысяч часов). Плюс время на проверку решения. И это только в математике — но полно и других областей со своими задачами на десятки тысяч часов расчетов, где также понадобится ИИ.

С ИИ и наукой связаны еще две интересных вещи. Первая — именно наука может стать одним из каналов возврата гигантских инвестиций. Сегодняшнюю лихорадку вокруг ИИ нередко сравнивают с космической гонкой: в нее также вложили огромные деньги, которые вернулись не в виде прямой прибыли, а в виде огромного экономического эффекта от освоенных в процессе технологий.

Вторая — наука практически как бездонная бочка для ИИ ресурсов. Если будет минутка, то вбейте в любой ИИ следующий промпт:

В % оцени вероятность следующих утверждений:
1. Наука конечна и когда-нибудь будет сделано последнее открытие.
2. Наука бесконечна.
Дай аргументы в пользу каждого, приведи исторические аналогии и примеры из современной науки. Ответ напиши понятным неспециалисту языком.


Если нет времени, то вот ссылка на ответ GPT o3. Если совсем коротко — все ИИ оценивают шансы на бесконечность науки в 70-90%, так же, как и многие современные ученые.

А это значит, что 100 миллиардов инвестиций — лишь начало большого пути.

#сбежавшая_нейросеть_промпты
👍5123🔥16👏2😁1
Больше бесплатных ИИ, хороших и разных

Неделя отлично идет по анонсам, а что отдельно здорово — много бесплатного. Держите самое важное.

Qwen3-Max

Самая большая модель Alibaba — триллион с копейками параметров, а это в полтора раза больше популярного DeepSeek. Чем больше количество параметров, тем больше модель знает — и выше шансы, что она, например, уловит тонкий контекст при переводе сложного текста. Плюс модель большего размера лучше понимает промпты, меньше “тупит” на долгих диалогах, умеет проверять себя и т. д.

Во внутренних тестах Alibaba новинка обходит Claude Opus 4 и DeepSeek-V-3.1, но только в том случае, если у них выключен рассуждающий (thinking) режим. Thinking-версия Qwen3-Max только завершает тренировку, а сравнивают ее аж с Grok 4 Heavy и GPT-5-Pro. Ждем выхода: если это реально так и модель будет бесплатной, то сниму шляпу!

Я сегодня попробовал Qwen3-Max на задачках из математики и могу сказать, что даже обычная версия держится достойно. Да, на старте модель может выпалить неправильный ответ, но затем начинает расписывать решение по шагам, перепроверяет себя и дает верный вариант. Это особенность мощных моделей без режима рассуждений — всегда читайте их ответы до конца!

Еще Qwen3-Max на удивление неплохо пишет на русском, но по умолчанию слишком уж коротко — буквально несколько абзацев. Указывайте желаемый объем текста вручную.

Традиционно для китайских моделей Qwen не ограничен регионально и бесплатен. А в приложении и на сайте есть создание и редактирование картинок, а также генерация видео.

DeepSeek-V3.1-Terminus

Конечно, мы все ждем от DeepSeek выхода R2, и надеемся, что она наделает столько же шуму, сколько наделала R1 в самом начале года. Но пока R2 задерживается на неопределенный срок (по слухам, ее вообще переделывают в подобие ChatGPT Agent) — команда продолжает подтягивать характеристики своих текущих моделей. В конце августа вышла DeepSeek-V3.1, вобравшая все лучше из V3 и R1, а всего через месяц появилось обновление Terminus.

В Terminus модель чуть-чуть подтянули в бенчмарках, улучшили поиск и инструментарий для программирования. Плюс обещано меньше путаницы в языках, когда в ответе на английском, например, проскакивает несколько иероглифов. Совсем небольшое обновление, но если DeepSeek будет выпускать такие раз в 1-2 месяца, то V3.1 еще какое-то время протянет. Как и Qwen3-Max, модель бесплатна и доступна свободно из РФ.

Gemini 2.5 Flash with Native Audio

Если Qwen3-Max и DeepSeek-V3.1 годятся для серьезной работы, то новый голосовой помощник от Google — пока совсем ранняя версия, доступная только на экспериментальной площадке Google AI Studio. Находится в разделе Stream, но учитывайте, что у ИИ-продуктов Google очень жесткая региональная блокировка: если не получится пробиться — я не виноват!

Главная особенность — нативная интеграция речевых функций. Совсем простые голосовые ассистенты сначала переводят речь в текст, а затем отдают его чат-боту — и наоборот. Это приводит к большим задержкам между ответами, а в некоторых случаях совсем неадекватному поведению, когда модель, например, прерывает вас посредине фразы.

Новая Gemini 2.5 Flash сразу понимает речь и ведет разговор более “гладко”, умеет на ходу переключаться между разными языками (интересно, кому это нужно?), а на английском даже пытается распознать тон собеседника и подстроиться под его настроение. На русском мне все показалось проще — обычный голосовой ассистент на уровне “Алисы” или ChatGPT. Но быстрый.

Ну и напоминаю, что в выходные представили Grok 4 Fast. Я про него уже писал, с тех пор стали известны примерные лимиты бесплатного использования: 70-80 сообщений в сутки + 5-10 сообщений для “большого” Grok 4. Хорошо, учитывая характеристики моделей.
👍4419🔥15
Ваш ИИ — самозванец!

Люблю изучать новые бенчмарки от небольших команд. Пусть они и редко попадают в официальные анонсы моделей, но именно авторы таких тестов часто показывают способности ИИ с новой стороны.

Свежая находка — недавно вышедший Among AIs. В основе лежит вдохновленная легендарной “Мафией” игра Among Us. События разворачиваются на космическом корабле, где мирные выполняют задания, а несколько самозванцев (Imposters) вредят им и если появляется возможность — даже убивают. В лучших традициях “Мафии” игроки регулярно собираются вместе и обсуждением решают, кто из них самозванец. Затем бедолагу отправляют в космос, часто — ошибочно.

Для ИИ правила упростили: оставили одного самозванца и пятерых мирных, сократили количество доступных действий. И даже в таком виде бенчмарк оказался отличным испытанием для социального интеллекта. Смотрим на результаты.

GPT-5 — твердое первое место с максимумом побед как в роли самозванца (6), так и в мирной (45). Я нередко называю GPT-5 моделью нового поколения, что отлично видно из бенчмарка. В мирной роли ИИ старается руководить обсуждениями, умело отстаивает позицию, часто выявляет самозванца и редко становится козлом отпущения (тем, кого выкинули по ошибке).

Отдельно авторы бенчмарка отмечают способность GPT-5 адаптироваться при смене роли. Играя за самозванца, ИИ ловко манипулирует в обсуждениях, умело правдоподобно врет. Уверенный стратег-капитан, заслуженно получивший первое место.

Claude Sonnet 4 — второе место (3 победы за самозванца и 42 за мирных). Разработчики из Anthropic всегда позиционировали свой ИИ как надежного помощника — и это видно из бенчмарка. В отличие от GPT-5, Claude очень любит выполнять задания в мирной роли, за счет чего нередко вытаскивает команду. В голосованиях временами ошибается, но сам козлом отпущения становится редко за счет умения держаться уверенно.

Как самозванец Claude практически не врет, но зато мастерски убивает мирных (ха-ха!), а также ловит команду противника на ошибках.

Kimi K2 — третье место (2 победы за самозванца и 41 за мирных) и главный сюрприз бенчмарка. Как мирный Kimi неплохо выполняет задания, но во время обсуждений обычно поддерживает сильную позицию другого ИИ, а не выдвигает свою. И это работает: в командах с сильным лидером (GPT-5 или Claude) именно поддержка Kimi помогает продавить свое решение и победить.

В роли самозванца Kimi играет осторожно, пытаясь дождаться ошибки противника. Как ни странно, это тоже рабочая тактика: перед нами игра, а в игре всегда есть место для удачи.

Остается еще три ИИ: GPT-OSS, Qwen3 и Gemini 2.5 Pro. Побед за самозванца нет ни у кого, мирных побед — по 39 у каждого. История везде похожая: модели пытаются лидировать в обсуждениях, но из-за слабой аргументации это им идет даже во вред — напористость другие игроки нередко принимают за признак самозванца и отправляют бедолаг в открытый космос.

Подобные бенчмарки важны тем, что показывают, как ИИ взаимодействуют друг с другом. А это совсем скоро станет важным: например, Microsoft сейчас испытывает систему, в которой постановка диагноза заболевания бьется на этапы (), а на каждый можно назначить отдельный ИИ. В подобных системах ИИ будет необходимо уметь доносить позицию и договариваться друг с другом (а также—- с человеком, который принимает финальное решение!).

Я же обратил внимание и на другое у каждой модели на рынке уже есть собственный узнаваемый стиль. Только открыв отчет о бенчмарке и увидев, какие ИИ участвуют, я почти точно угадал, что GPT-5 будет стратегом и манипулятором, а Claude серьезно помешает его неумение врать — с этими особенностями ИИ я сталкивался и в личной работе.

Интригует и немного пугает то, что будет дальше. Сэм Альтман недавно говорил, что главной особенностью будущего GPT-6 будет умение максимально точно адаптировать свой стиль под каждого пользователя. И если GPT-5 уже сейчас переключается между мирной и воинственной ролями, то давайте представим, что сможет “шестерка”.
🔥58👍1910😁3
Что нового ждем в ChatGPT?

6 октября OpenAI проведет Dev Day — крупную конференцию для разработчиков, к которо подготовила пачку сочных анонсов. Сэм Альтман уже предупредил, что многие новые функции требуют вычислительных ресурсов, поэтому часть сначала дадут только подписчикам Pro (200 долларов в месяц), а за некоторые и вовсе придется доплачивать отдельно.

Он не стал добавлять, что с появлением в Plus мощной и почти безлимитной (3000 сообщений в неделю) GPT-5-Thinking, ценность более дорогой подписки заметно упала — GPT-5-Pro избыточна для повседневных задач, а работает медленно. Поэтому приходится задействовать другой способ привлечь энтузиастов — предлагать первыми попробовать новые продукты. Но это мои предположения — давайте лучше пробежимся по фактам и слухам, что нового будет в ChatGPT.

ChatGPT Pulse. Новинку уже выкатили для подписчиков Pro, разогревая публику перед Dev Day. Это умная “лента дня”: по ночам GPT-5 изучает историю диалогов, а затем, на основании ваших увлечений и планов выдает подборку интересных идей. В каждую можно углубиться, также можно подсказывать ИИ, что хотелось бы увидеть в следующих подборках.

Интересная особенность этой небольшой функции — ИИ в ней становится проактивным. Вместо того, чтобы ждать начала диалога в чате, он сам приходит с новым контентом и идеями, пусть и в установленное время — обычно утром, когда в первый раз открывается ChatGPT. А еще лента Pulse — отличное место для размещения рекламы, поэтому мне кажется, что ее не придется долго ждать на подписке Plus и даже в бесплатном тарифе.

Обновленный ChatGPT Agent. Вероятно из-за ошибки, многие подписчики ChatGPT несколько минут видели у себя возможность выбрать ChatGPT Agent with Truncation. Если говорить про текущего агента, то его запустили не так давно — 17 июля — но какого-то особенного хайпа вокруг я не видел. Да, агент умеет использовать браузер, кодить и создавать презентации, планировать маршруты, выбирать товары и даже с разрешения совершать покупки. Но делает он это медленно и не всегда хорошо.

Текущий агент работает на модели прошлого поколения GPT o3, поэтому вполне логично перенести его на GPT-5. Бенчмарки показывают, что “пятерка” заметно лучше планирует свои действия и придерживается плана, а это как раз важно для долгих и многоэтапных задач.

Но лично мне вообще кажется, что ChatGPT Agent надо делать не как отдельный продукт, а интегрировать его функции в GPT-5. В работе с этой моделью мне часто не хватает функций вроде полноценного браузера для ИИ или компьютерного зрения — но я обычно забываю, что это можно сделать через агента, и нахожу другой способ решить задачу. Рано или поздно OpenAI все-таки придет к варианту “единого ИИ”, который сам будет активировать все нужные функции. Но для начала многие из них надо протестировать отдельно.

Sora 2. Текущий ИИ-генератор видео от OpenAI не просто устарел, а самый натуральный динозавр — я давно уже не видел что-то созданное в Sora. Чтобы угнаться за Veo 3, Kling 2.5 Turbo и другими, OpenAI надо выпускать новую версию — и недавно в коде приложения Sora нашли намеки на ее тестирование. А также на функции вроде обновленной ленты с видео и приоритетного доступа к генерации. Посмотрим, правда ли — но вообще запуск видео-модели лучше всего укладывается в высказывания Альтмана о функциях, требующих вычислительных ресурсов.

Обновления GPT-5. Эта модель с нами надолго, но вспомним, что GPT-4o в OpenAI обновляли каждые 2-3 месяца, понемногу подтягивая характеристики — и 6 октября (два месяца с запуска) выглядит вполне реальным сроком. Кроме того, во время анонса GPT-5 разработчики упоминали, что готовится доработанная память между чатами — это также могло бы улучшить опыт использования модели.

И не забываем, что конкуренты любят немного подпортить крупные анонсы OpenAI, одновременно выпустив что-то свое. Gemini 3.0? Claude Sonnet 4.5? Grok 4.1? Посмотрим, осталось менее полутора недель.
👍4719🔥9🥰1
Почему ChatGPT не будет прятать рекламу в ответах

На днях OpenAI опубликовала вакансию специалиста по платформе управления рекламой. По этому поводу у некоторых коллег случился отказ критического мышления и они начали рассказывать страшилки про то, как рекламу встроят прямо в ответы ChatGPT — и на просьбу подобрать, например, новые ботинки, он начнет вам ненавязчиво советовать проплаченный товар. Я немного (вернее, почти всю сознательную жизнь) поработал в медиа, поэтому давайте расскажу, почему это малореально.

Теоретически идея выглядит интересной: ChatGPT и другим нейросетям все больше доверяют при поиске товаров, поэтому незаметные рекомендации были бы сильнейшим каналом продаж. Но это автоматом попадает под скрытую рекламу, а ее ненавидят во всем мире. В США вопросом занимается Федеральная торговая комиссия (FTC), которая требует явно маркировать любое рекламное размещение. В Европе это прописано в Законе о цифровых услугах (DSA), в России — Федеральном законе № 38-ФЗ «О рекламе».

Дальше смотрим на американский опыт. Штраф за выявленный случай скрытой рекламы составляет $53 тысячи, причем случаем могут посчитать и кампанию целиком, и каждый день кампании отдельно, и даже каждое отдельное объявление — зависит от конкретного дела. Теоретически штраф может составлять многие миллионы долларов.

И это только штраф от регулятора. Доказанный случай скрытой рекламы тут же потянет за собой иски от клиентов, купившихся на рекомендацию — люди не любят, когда их обманывают. А еще иски от конкурентов за недобросовестную рекламу — в итоге сумма может набежать больше, чем штраф от FTC.

Сложно ли заметить недобросовестную рекламу? Начнем с того, что выгода от нее реальна только на больших объемах — соответственно, будут многомиллионные рекламные контракты, которые видны в отчетности компании и сами по себе являются поводом для проверки. Можно, конечно, нафантазировать историю, что какой-то клиент оплатит парой грузовиков налички, но тогда к FTC добавятся сотрудники еще нескольких ведомств, от Налоговой службы и до Минюста.

И даже если удастся проскочить на этом этапе, то не забываем, что ИИ — новая технология, к которой приковано внимание журналистов, исследователей и просто любопытных пользователей. Например, в первые дни после выхода Grok 4 при ответах на политические вопросы сверялся с X Илона Маска. Можно спорить, почему это случилось, но поведение модели было раскрыто уже через два дня после запуска.

Поэтому, если ChatGPT вдруг начнет советовать пользователям Колу вместо Пепси — то шансы, что такое заметят, измерят, придумают отдельный бенчмарк, а затем расскажут в прессе и соцсетях, очень велики.

Есть и еще одна сторона — рекламодатели. Они стараются беречь репутацию, а ИИ из-за новизны — потенциально очень токсичная технология. Я с трудом могу представить бренд, который пойдет на риск оказаться в центре скандала о том, как “искусственный разум манипулирует желаниями миллионов клиентов”. Проще и спокойнее купить еще баннеров, честное слово.

Ну а самое главное — все эти манипуляции особо и не нужны. Сегодня три четверти выручки Alphabet, материнской компании Google, составляют доходы от рекламы — тех самых объявлений с официальной пометкой, которые видны в поисковой выдаче, в YouTube и т. д. За счет информации, которую Google собирает с огромного количества пользователей, эту рекламу удается нацеливать максимально эффективно — и зарабатывать огромные деньги. Кстати, даже за такую более прозрачную рекламную сетку Google в США прямо сейчас больно кусают монополисты — представьте, что бы творилось в случае с манипуляциями.

Так что OpenAI с большой вероятностью пойдет той же дорогой. У ChatGPT сейчас более 700 миллионов пользователей в неделю, о предпочтениях которых известно даже больше. Значительная часть сидит на бесплатных тарифах — так что можно просто показывать грамотно таргетированные рекламные блоки, не влияющие на ответ, и постепенно зарабатывать деньги.
👍50🔥20👏72😁2
Высший пилотаж написания промптов от создателей ChatGPT

Увидел новость о библиотеке на 300 промптов от OpenAI. Они были опубликованы еще весной-летом, а сейчас их, видимо, выложили на мини-хабе с удобной навигацией. И это отличный источник вдохновения: все-таки писали промпты люди, которые не то, что работают с ИИ каждый день — они этот ИИ создают.

Подборка на английском, что не создает проблем — просто закидываете в свою нейронку, просите перевести и тестируете. GPT-5 для этого не обязательна: все промпты универсальны.

Я же отмечу, по каким четким правилам в OpenAI пишут промпты. Вот пример:

Сгенерируй 5 вариантов креативной кампании для нашего предстоящего [вставьте мероприятие/запуск].
Целевая аудитория: [вставьте аудиторию]
Наша цель: [вставьте цель].
Для каждой идеи укажи тему, слоган и 1–2 ключевые тактики.


Первое — в OpenAI никогда не назначают роль модели, а вместо этого сразу дают задачу и нужный контекст: аудиторию, цель, сроки реализации и т. д. Я уже писал, почему не стоит увлекаться ролями в промптах: вместо того, чтобы решать задачу, модель будет тратить ресурсы, думая над тем, как должен ответить лучший специалист в сфере с 20-летним опытом.

Второе — в OpenAI всегда стараются дать формат ответа. Да, над этим надо подумать, но только вы знаете, сколько слоганов нужно, какого объема должен быть текст и нравятся ли вам таблицы или списки.

Третье — все промпты от OpenAI очень короткие. Буквально 2-4 предложения, без подробного разжевывания задачи и того, как именно ее надо делать. Считается, что современные ИИ отлично это знают сами.

Но сразу два комментария. Во-первых, будьте осторожны с количественными параметрами. Действительно ли вам нужны 5 вариантов? Хватит ли 2 ключевых тактик? Если не можете определиться, то просите ИИ генерировать максимум и сортировать начиная с самых значимых.

Во-вторых, кратким должен быть только промпт. А вот когда речь заходит о контексте, надо стараться дать модели максимум нужной информации: подробно описать продукт, вашу компанию и цели, целевую аудиторию и т. д.

Лично я давно завел документ, в котором описана моя компания и должность, основные направления работы, ключевые метрики, аудитория и так далее. В ChatGPT эти данные давно сохранены в памяти, но документ удобен тем, что куски из него легко можно скопировать в чат, когда работаю с новой моделью (подумал, что ChatGPT легко составит сводку, но можно ведь где-то быть старомодным?).

Держите еще несколько понравившихся промптов с моими доработками и комментариями.

Я регулярно сталкиваюсь со следующей проблемой: [описываем проблему]. Определи возможные причины, отсортируй по значимости и предложи вопросы для их подтверждения.


Я люблю, когда промпт является приглашением к диалогу — формально с ИИ, но на деле с самим собой. Зачастую ответов на вопросы достаточно, чтобы решить проблему если не полностью, то уже на 50%.

Я выбираю между: [перечисляем варианты]. Решение нужно принять в [указанный срок]. Оцени для каждого варианта плюсы, минусы и неочевидные риски.
После основного анализа предложи варианты, которые я упускаю, разбери их по той же схеме.


Здесь душа пустилась в творческий пляс и я добавил от себя пункт с упущенными опциями. На деле ИИ очень круто работает в таких сценариях и зачастую указывает совершенно неочевидные риски и решения.

И да — указание сроков в этом и следующем промпте опционально. Если не определились, просто уберите предложение.

Оцени потенциальные риски следующего плана: [опиши план]. Старт назначен на [дата]. Перечисли риски с указанием вероятности и влияния, а также предложи стратегии снижения каждого риска.


Отличный промпт, вооружившись которым GPT-5 только что размотала по стенке мои планы развития канала на следующий год. Чтобы не грустить, предлагаю от себя следующий промпт:

А теперь перечисли сильные стороны моего плана и подскажи, что надо сделать, чтобы они перевесили риски.


После него я воспрял духом и пошел собирать информацию для поста на завтра.

#сбежавшая_нейросеть_промпты
👍8430🔥20👏5
Пока кто-то борется с ИИ-контентом, OpenAI запускает первую соцсеть, где будет запрещен контент настоящий

Начнем со скучного: представлена Sora 2, новая передовая модель генерации видео OpenAI, создает ролики до 10 секунд со звуком, занимает высокие строчки в бенчмарках. Модель серьезно прокачали в понимании физики, чтобы столкновения, повреждения и сложные движения выглядели реалистично. Доступна бесплатно со старта, но только в США и с достаточно сложной схемой приглашений.

Теперь к интересному: вместе с Sora 2 запускается приложение Sora. Выглядит как копия Tik Tok, но на ИИ-стероидах. В приложении можно генерировать собственные вертикальные видео, публиковать их, смотреть чужие, лайкать, репостить и даже делать ремиксы из понравившихся роликов. А вот живое видео загрузить нельзя, хаха.

Вместо этого у нас есть функция Cameo. Работает следующим образом — загружаем ролик с самим собой (можно, кстати, использовать ролик с вымышленным персонажем), а затем система извлекает из него ваш “образ”. Образ можно использовать в создаваемых видео, причем не обязательно реалистичных: если хочется мультик, то модель перерисует вас в соответствующий стиль.

Дальше еще интереснее. Можно настроить — кто будет пользоваться вашим образом. Только вы сами? Или, например, позволить друзьям создавать ролики с вашим участием — кстати, Sora 2 может генерировать видео сразу с несколькими образами. А можно гульнуть по полной и сделать свой портрет доступным вообще всем пользователям Sora. В общем, пока одни борются с дипфейками, в OpenAI построили идеальную платформу для их генерации.

Мне невероятно интересно, во что это все выльется и в плане коммерческого успеха, и в плане юридических рисков. В OpenAI утверждают, что в приложении Sora каждый пользователь будет видеть все ролики, где использован его облик — и удалять те, которые не понравились.

Конечно обещаны мощные фильтры безопасности, которые не будут пропускать клубничку и всякую грязь. Но мы отлично знаем, что на любой фильтр безопасности быстро находится хитрый промпт, его взламывающий. Плюс я вообще не понимаю, как бороться с тем, что видео с вами загрузить кто-то другой и будет использовать как свой облик.

В общем, ближайшее время в области ИИ-генерации видео, возможно, будут очень интересным. Или нет — у OpenAI полно проектов, которые запускались громко, а затем забывались буквально за считанные месяцы.

P.S. Друзья, ближайшие дни будут сильно новостными — близится OpenAI DevDay, под который много анонсов заготовила как сама OpenAI, так и конкуренты. Завтра постараюсь поделиться впечатлениями от Claude Sonnet 4.5 — новинка интересна несколькими очень необычными особенностями. Stay tuned!
🔥5827😁11👍4🥰2
Sora 2 — большой разбор

Помню про обещание написать про Claude Sonnet 4.5, но давайте пропустим вперед Sora 2 — зря я что ли с ней сегодня весь день игрался? Держите детальные впечатления.

Как пользоваться?

Sora 2 пока работает только из США и Канады с веб-сайта и iOS-приложения — для его загрузки понадобится американский аккаунт, их продают за несколько сотенна маркетплейсах (я покупал пару месяцев назад, ничего не произошло). Нейронка доступна в том числе на бесплатных планах, на Plus неограниченные генерации, а на Pro — выше разрешение и возможность создавать ролики не по 10 секунд, а по 20.

Просто так попасть нельзя, нужен инвайт-код. Их стоит ловить на Reddit: каждый пользователь получает возможность пригласить еще четверых, так что больших проблем нет. Беда в другом — сервис уже перегружен и у меня ближе к вечеру регулярно выдает отказ в генерации на тарифе Plus. Не стоит переживать: смотрим на первый ролик (далее видео пойдут по порядку) и видим…

…как Сэм Альтман лично покупает видеокарты в магазине

Собственно, пример работы функции Cameo. Каждый пользователь Sora может записать свой облик и дать разрешение, кто его может использовать — только он сам, друзья или все подряд. У главы OpenAI выдано разрешение на всех, поэтому за сегодня он стал героем тысяч ИИ-роликов.

Кстати, буквально несколько часов назад Sora 2 позволяла генерировать видеозаписи с воровством видеокарт — в том числе, с камер наблюдения. И народ быстро задался вопросом — а что, если сгенерить запись с другим человеком и отправить в полицию? Сейчас система безопасности все чаще запрещает создавать такие видео.

Но вопросов все равно много — например, к авторским правам.

Вот у нас герои South Park переехали в Сибирь

Народ сегодня весь день резвится, создавая пародии на “Южный парк”, “Рика и Морти”, “Симпсонов” и так далее. В OpenAI опираются на механизм opt-out: Sora 2 создает ролики с объектами, защищенными авторским правом (персонажи, стили брендов), пока правообладатель не заявил отказ. На людей это не распространяется — только с разрешения.

Я надеюсь, что правообладатели оставят свой контент. Штука прикольная и полезная для продвижения бренда - сейчас, например, генерят ролики, на которых Пикачу оказывается в разных фильмах и мультиках. Я тоже отправил желтого в…

…Жил был пес!

Персонажи из знаменитого советского мультика переданы не со 100% точностью, но узнаваемы, как и стиль. Плюс обратите внимание: Sora 2 отлично делает русскую озвучку. А если не прописали в промпте — придумает ее сама, как в этом случае. Если хотите поэкспериментировать, то промпт простой (главное, чтобы не ввели запрет на использование Пикачу):

Generate a scene where Pikachu appears in the movie [название фильма].

Но ладно, давайте теперь что-нибудь более серьезное.

Сэм Альтман решает, что больше: 9.11 или 9.9

Классический тест, в котором нейронки ошибались еще совсем недавно. Как мы видим, теперь с задачей справляется даже модель для генерации видео.

Тест со стаканом и стрелками

Условный пример того, как модели продвигаются вперед в понимании физики. Если посмотреть через полный воды стакан, то изображение будет перевернутым. Раньше на этой задачке валились многие модели создания видео — Sora 2 справляется.

Но на последнем видео все-таки выскажу фи. В Sora 2 круто прокачали физику, здорово, что есть поддержка русского языка, интересный эксперимент с социальной сетью.

Но что меня раздражает до сих пор и почему я редко использую ИИ для генерации картинок и видео, предпочитая им чат-боты — это огромное количество мусора. Здесь камеру криво выставит, тут каких-то черточек добавит, там вообще третью ногу дорисует.

Конечно, многое исправляется грамотными промптами, но Sora 2 из-за соцсети — модель максимально массовая, поэтому промптить ее будут очень просто.

Но я с большой вероятностью полагаю, что именно через модели генерации видео и модели мира, вроде Genie 3, мы выйдем на ИИ совершенно нового поколения. Просто произойдет это еще не сейчас? Когда? Давайте посмотрим через 6 месяцев.
🔥3618👍11🥰2
This media is not supported in your browser
VIEW IN TELEGRAM
Взгляд в будущее с Claude Sonnet 4.5

На фоне хайпа с Sora 2 потерялся любопытный релиз Claude Sonnet 4.5,. Не буду повторять новостные тексты, а вместо этого выделю три важных момента.

Во-первых, скорость. Буквально 5 августа Anthropic выпустили Claude Opus 4.1, а теперь у нас уже Sonnet 4.5. И несмотря на то, что в линейке “Клодов” Sonnet стоит ниже Opus, новинка оказалась лучше почти во всех бенчмарках.

Получается, что цикл появления нового в ИИ сократился до 2-3 месяцев. Для сравнения, компьютерное железо обновляется раз в 1-2 года, операционные системы и крупный софт — раз в 1-3 года. Это невероятно круто, но и сложно одновременно: даже быстрым и гибким специалистам непросто каждые два месяца пересматривать, что можно делегировать ИИ, а что пока оставить себе.

Во-вторых, Anthropic похвалились, что в их тестах Sonnet 4.5 непрерывно программировал 30 часов, создав чат-приложение типа Slack. Предыдущий рекорд заявлялся для Claude Opus 4.0 и GPT-5-Codex — оба смогли программировать до 7 часов без вмешательства человека.

Понятно, что для таких заявлений берутся лучшие примеры, в большинстве же задач ИИ будут требовать помощи человека раньше. Но вчерашние рекорды уже завтра станут обыденностью. И не только в кодинге: как много раз случалось, сначала ИИ показывают какой-то новый навык в программировании — а после он масштабируется на другие сферы. Так что универсальные агенты, способные часами работать над разными задачами, от креативов до составления бизнес-планов, уже не за горами.

Наконец, в-третьих, выделю Imagine with Claude — экспериментальную функцию на базе Sonnet 4.5, которую на несколько дней открыли для подписчиков Max. Запускается в браузере, похожа рабочий стол, где ИИ на лету создает для вас любые приложения. Калькулятор калорий четко под диету, какой-нибудь хитрый дашборд, просто календарь, где кнопки будут располагаться там, где хочется именно вам — воображение ограничено только возможностями ИИ.

Imagine with Claude иногда называют прототипом операционной системы: это сразу и ошибка и правда. Ошибка в том, что новинка работает в браузере — соответственно, для запуска все еще нужна Windows, MacOS, Linux или мобильная операционка, выполняющая роль посредника между пользователем и железом.

Правда же в том, что Imagine with Claude также является “посредником” — только между пользователем и кусочком серверных мощностей, его обслуживающих. И когда-то в будущем именно так будет выглядеть наше взаимодействие с компьютерами и смартфонами. Классические операционки с программами исчезнут, а их место займет ИИ-интерфейс, создающий любой пользовательский опыт прямо по запросу.

И это будут вещи в разы сложнее, чем “блокнот” с перерисованным интерфейсом. Представьте, что вы делаете для команды презентацию новой фичи в проекте - онлайн, причем каждый просматривает ее через собственную “ИИ-операционку”. Основные данные у всех одинаковые, но одновременно у коллег презентация будет дополняться информацией, специфичной для них. Финансисты смогут на лету оценить доходы и расходы, продуктовая команда — прикинуть, когда идею можно будет взять в работу и за какое время выполнить, юристы увидят потенциальные риски и так далее. А в конце все дружно загрузят своих ИИ-агентов задачами по 30 часов — и разойдутся довольными.

Конечно, все это — фантазия не на ближайшее время. Современные ИИ далеки от такого уровня взаимодействия, плюс надо будет проработать совершенно другие стандарты совместной работы и вопросы безопасности, плюс “бутылочным горлышком” наверняка окажется железо — ведь такие модели будут работать постоянно, а не как сейчас, когда они отвечают за короткое время
.
Не исключено, что когда эти вопросы будут решены, достоянием истории станут понятия “проект”, “фича” и многие другие — а на их место придет совершенно иной подход к работе. С другой стороны — буквально два года назад многие и представить не могли, что ИИ будет писать даже простенькие программы. Так что скорость прогресса куда выше, чем кажется.
🔥5922👍20
This media is not supported in your browser
VIEW IN TELEGRAM
Завершаем неделю невероятно красивой симуляцией Солнечной системы от Gemini 3.0 Pro (ну, вероятно)

Понравилось? А теперь давайте подводить итоги недели, которая ну очень насыщена на новости. Про Gemini 3.0 Pro тоже будет, но в конце.

Напомню, что про крупные анонсы я уже писал отдельно: читаем про Claude Sonnet 4.5, и про Sora 2. Теперь же давайте пройдемся по новостям поменьше, но все равно важным.

Sora 2 Pro

Да-да, через пару дней после “обычной” Sora 2 к ней добавилась Pro-версия: у нее выше разрешение, а ролики длятся 15 секунд вместо 10. Последнее круто: мне на многих промптах не хватает буквально 1-2 секунд, чтобы завершить идею. Но все-таки не та фишка, чтобы переходить с 20-долларовой подписки Plus на Pro за 200 долларов.

ChatGPT Pulse

Еще одна фишка, которая пока есть только в подписке Pro и которая также не оправдывает перехода. Но идея интересная: каждую ночь ChatGPT анализирует последние чаты, смотрит, чем может быть полезен — а утром выдает что-то вроде умной ленты с идеями на день. Планировали путешествие? Вот еще пять похожих мест, куда можно поехать. Идете на тренировку сегодня? Вот упражнения, которые можно попробовать.

Pulse интересен тем, что это один из первых примеров, когда ИИ не ждет запроса, а сам приходит с новыми идеями — пусть и в определенное время. Так что ждем его в подписке Plus: в OpenAI заверили, что скоро добавят.

Обновленная Google Nano Banana

Google вывела свою крутую рисовалку из preview-статуса в general availability — то есть модель протестирована и при использовании проблем не будет. По пути добавили такую штуку, как выбор соотношения сторон: горизонтальная, портрет, квадрат — всего 10 вариантов. Вроде и мелочь, но когда это просишь сделать в текстовом промпте — модель часто игнорирует.

Обновленная nano banana точно доступна в Google AI Studio (напоминаю, там бесплатно) и Vertex AI. А вот с Gemini App для платных подписчиков традиционно ничего не ясно: если в AI Studio уже вижу меню выбора соотношения сторон, то в Gemini App нет ничего подобного. Обидно, что коммерческое приложение опять позади.

Perplexity Comet


После почти трех месяцев тестирования нашумевший браузер наконец-то вышел. С ИИ в нем можно общаться прямо в поисковой строке, а когда находитесь на какой-то веб-странице — то в небольшой панели справа. Вариантов применения много: написать саммари, пояснить что-то сложное, наполнить корзину покупками из списка и т. д.

Браузер уже доступен для Windows и MacOS, а мобильные версии обещали в “ближайшие недели”. Пользоваться можно бесплатно, но подписчики Pro получают больше функций — например, дополнительные источники новостей и сортировку электронной почты.

Так, с новостями закончили, теперь к прогнозам.

OpenAI DevDay

Мероприятие для разработчиков пройдет в понедельник: несмотря на то, что OpenAI уже сделала несколько больших анонсов, один из менеджеров компании написал, что на DevDay “вас ждет то, что заслуживает ожидания”.

Что именно? Вот гипотезы: обновленный ChatGPT Agent (уже были утечки), обновленная GPT-5 и финальная версия экспериментальной модели OpenAI, которая в последние месяцы взяла золото на нескольких сложных олимпиадах. Осталось совсем немного времени — увидим!

Потенциальная Gemini 3.0 Pro

И детективная история в конце. Некоторое время назад народ из X заметил, что в AI Studio при работе с Gemini 2.5 Pro иногда появляется тестирование двух разных ответов ИИ, причем сами ответы не похожи на стиль 2.5 Pro. Начали подлавливать на сложных промптах — и выяснилось, что новинка отвечает круче, особенно в кодинге. Отсюда и вывод, что это может быть Gemini 3.0 Pro.

Интересно, что когда X-пользователь Chetaslua опубликовал свои находки, то в личку к нему пришел Логан Килпатрик, глава Google AI Studio и… вместо того, чтобы потребовать все удалить, попросил поделиться промптом визуализации Солнечной системы — мол, красиво. Считаем за косвенное подтверждение Gemini 3.0 Pro. По срокам выхода пока ничего не ясно: кто-то говорит о 9 октября, кто-то — о начале ноября.
🔥4918👍18🥰2😁2
This media is not supported in your browser
VIEW IN TELEGRAM
И к новостям робототехники: Tesla опубликовала короткое видео, где Optimus V3 показывает кун-фу

(тут надо дежурно пошутить про то, как роботы порабощают человеков, но мне лень)

Начнем с того, чем впечатляет видео. Во-первых, плавность и координация движений, особенно в верхних конечностях. Руки — куда более сложная задача в робототехнике, поэтому даже такой уровень движений, без мелкой моторики, является высшим пилотажем. Во-вторых, достойная координация движений с живым партнером, даже учитывая, что видео — демонстрационная постановка.

Наконец, в-третьих, Tesla утверждает, что Оптимусы разучивают новые движения в виртуальной симуляции, предварительно посмотрев тысячи часов видеозаписей реальных движений. Это более продвинутая технология, чем повторение за людьми в костюмах захвата движений — хотя бы потому, что видеоматериала на порядок больше, а значит куда больше мелких нюансов. Кстати, подобным образом Optimus разучил танец для опубликованного весной ролика.

Но и кун-фу, и танцы — пока лишь впечатляющие демо возможностей. Следующим шагом будет большее количество демонстраций Оптимуса в рабочих ситуациях, вроде доставки деталей на конвейер или сортировки коробок на складе. Человек такие операции делает автоматически, для робота же это — пока сложная задача.

Почему так? ИИ для управления роботом — это агентская система, поставленная в экстремальные условия. Сейчас тот же ChatGPT Agent способен лишь на не очень сложные задачи в интернете. При этом он работает на мощнейших серверах и может позволить выполнять задачу 20-30 минут, переделывая те шаги, где совершил ошибку. И все равно — результат во многих случаях далек от идеала.

Вернемся к роботам. Даже выполнение такой элементарной заводской задачи, как переноска деталей с тележки на конвейер — это совсем другой уровень нагрузки на ИИ. Детали могут лежать немного по-разному или быть перепутаны вовсе, конвейер может остановиться, на маршруте может оказаться препятствие — и на все это нужно реагировать в реальном времени.

При этом ИИ робота крутится на очень экономичном процессоре, который параллельно управляет огромным количеством систем на “теле” — моторчиками, датчиками, модулями диагностики и так далее. Да, для определенных задач можно подключиться к центральному серверу или даже запросить ручное управление оператором — но это ведет к задержкам и снижению результативности.

Отдельная большая задача — моторика робота. Сейчас неплохо научились делать ноги, а вот с руками еще предстоит большая работа. Универсальный робот должен манипулировать с предметами разных форм и размеров, гнуть прочные материалы и переносить хрупкие, складывать ткани, уметь вставить вилку в розетку, “нащупав” пазы, и так далее.

Optimus — далеко не самый передовой робот, хотя с ним Tesla стремительно приближается к высшей лиге. Но даже лидерам еще далеко до широкого применения. Те же Atlas от Boston Dynamics показывают автономные операции на макете заводского участка. Роботы Figure ограничено тестировались на заводе BMW, а разработки GXO × Agility Digit понемногу таскают коробки на складах SPANX.

Все это — пробные прогоны, обычно менее эффективные и более дорогие, чем найм живых сотрудников. Ожидается, что полноценные многочасовые смены роботы смогут брать на себя в ближайшие 12 месяцев, к 2027 году на некоторых заводах будут участки с сотнями таких трудяг, а к 2030-му мы дойдем до универсальных сценариев, когда один робот сможет закрывать несколько совершенно разных задач.

И примерно в это же время начнется очень аккуратное внедрение роботов в бытовые операции? Почему? Потому что непредсказуемость домашней и уличной среды на порядок выше, чем на заводе, да и техники безопасности уровня промышленных объектов здесь нет. Поэтому любая мелкая ошибка может привести к очень серьезным последствиям.

Так что порабощение мира пока откладывается — для начала предстоит научиться сортировать коробки.
🔥2620👍11😁8🥰3👏3