Тест Тьюринга
2.13K subscribers
1.07K photos
179 videos
35 files
1.9K links
Актуальное в сфере искусственного интеллекта в России и в мире:
• Дайджест новостей
• Аналитические обзоры, переводы, справки

Для связи - @nastyapvlv28
Download Telegram
🧬 Пока ИИ меняет науку, наука начинает менять этические правила для ИИ

ИИ стал одним из самых мощных инструментов научных исследований. Он помогает искать новые материалы, анализировать белковые структуры, находить математические доказательства и предлагать гипотезы. Но одновременно с этим во всем мире стремительно растет интерес к этике применения ИИ в научной деятельности.

Россия стала одной из стран, где эта тема выходит на институциональный уровень. Вице-президент РАН Степан Калмыков сообщил, что РАН завершила примерно 80% работы над Кодексом этики научных исследований. В документ войдут вопросы использования ИИ в науке, биоэтики, экспериментов на животных, правил цитирования и борьбы с некорректными заимствованиями.

При этом Калмыков специально подчеркнул важную мысль:
Кодекс не запрещает применение ИИ — он определяет этические подходы к его использованию, поскольку ограничить саму технологию уже невозможно.


Эта работа началась не вчера. Еще весной 2025 г. по поручению Президента в РАН был создан Совет по этике научных исследований под руководством академика Александра Хохлова. Тогда президент РАН Геннадий Красников прямо заявил, что контроль необходим не только для генетических исследований, но и для ИИ. Позже проект кодекса расширили: в него вошли вопросы прозрачности финансирования исследований, использования научных результатов, работы с людьми и животными и взаимодействия ученых с обществом.

Любопытно, что Россия здесь вовсе не идет по уникальному пути. Похожие процессы происходят практически одновременно во многих странах.

➡️ ЮНЕСКО еще в 2021 году приняла первый в мире документ Recommendation on the Ethics of Artificial Intelligence, который сегодня используют более 190 государств как основу для национальной политики. Отдельный раздел документа требует, чтобы исследователи проходили подготовку по вопросам этики ИИ, раскрывали особенности использования моделей, учитывали происхождение данных и оценивали возможные последствия своих разработок.

➡️ США тоже постепенно переходят от общих деклараций к практическим правилам. В мае 2026 года Национальные институты здравоохранения США совместно с Office of Research Integrity выпустили специальные рекомендации по обеспечению добросовестности исследований при использовании ИИ. Документ посвящен не ограничениям технологий, а ответственности исследователей: проверке результатов моделей, защите конфиденциальных данных, сохранению человеческой ответственности за все выводы исследования.

➡️ Параллельно развивается и международная инфраструктура. В ООН создана независимая Международная научная группа по ИИ, которая должна формировать научную основу для глобального управления этой технологией. Один из ключевых вопросов ее работы — как совместить быстрое развитие ИИ с надежностью научных результатов и общественным доверием к ним.

Почему все это происходит именно сейчас?

Потому что реальные проблемы уже появились. Первый пример — авторство и ответственность. Если языковая модель предложила гипотезу или помогла написать код анализа данных, кто отвечает за возможную ошибку? Сегодня практически все ведущие научные журналы сходятся в одном: автором остается только человек, поскольку только он способен нести научную ответственность за опубликованный результат.

Второй пример — воспроизводимость исследований. Современные языковые модели постоянно обновляются. Один и тот же запрос, отправленный через несколько месяцев, может дать совершенно другой ответ. Если исследователь не зафиксировал модель, ее версию, настройки и промпты, повторить исследование становится значительно сложнее. А воспроизводимость — один из фундаментальных принципов науки.

Развитие этики — это попытка сохранить научный метод в эпоху, когда одним из участников исследования становится система, способная самостоятельно генерировать идеи, тексты, код и гипотезы.


Похоже, следующий большой этап развития ИИ в науке будет определяться уже не только мощностью моделей, но и качеством правил, по которым люди научатся использовать их ответственно.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍1🔥1👏1💯1
🔴 Китай делает ставку на агентов — но открытость становится избирательной

Власти Пекина представили десять мер по ускоренному развитию агентного ИИ. Формально это городской, а не общенациональный план. Но Пекин остается главным центром китайской ИИ-индустрии, поэтому документ можно читать как пилотный проект будущей промышленной политики страны.

В чем главная мысль?

Эпоха соревнования исключительно по размеру и результатам базовых моделей заканчивается. Теперь ценность должна создаваться системами, которые способны удерживать цель, планировать последовательность действий, пользоваться инструментами и самостоятельно доводить задачу до результата. План охватывает почти весь агентный стек.

Пекин собирается поддерживать модели с онлайн-обучением, долговременной памятью, сложным планированием и способностью к самоэволюции. Отдельным направлением назван Harness Engineering — инженерный слой между моделью и реальной задачей: управление контекстом, устойчивое выполнение длинных процессов, координация нескольких агентов, интеграция различных моделей.

Следующий уровень — приложения. В документе появляются «умные ученые» и автономные лаборатории, AI OS, агентные решения для промышленности, медицины, образования и госуправления, а также специалисты по внедрению, работающие непосредственно внутри организаций.

Есть и более необычные идеи. Пекин предлагает поддерживать OPC — компании одного человека, в которых значительную часть функций выполняют агенты, развивать «экономику токенов» и переходить от оплаты количества вычислений к оплате ценности полученного результата. Для показательных внедрений предусмотрена поддержка до 100 млн юаней.

На фоне США и Европы различия особенно заметны

🇺🇸 Американский AI Action Plan строится прежде всего вокруг лидерства: снять барьеры для инноваций, ускорить строительство энергетической и вычислительной инфраструктуры, продвигать американские технологии и стандарты за рубежом. Агентный ИИ там скорее часть более широкой борьбы за технологическое превосходство, чем самостоятельный объект промышленной политики.

🇪🇺 Европейские AI Continent Action Plan и Apply AI Strategy делают акцент на вычислительной инфраструктуре, доступе к данным, внедрении ИИ в стратегические отрасли, поддержке малого бизнеса и доверенном ИИ. Европа стремится превратить регулирование и отраслевые институты в конкурентное преимущество.

🇨🇳 Пекинский план заметно конкретнее. Он описывает не только ресурсы и правила, но и предполагаемую архитектуру следующего рынка — агенты, магазины навыков, операционные системы, сервисы внедрения, новые формы компаний и единицы оплаты.


Означает ли это, что Китай окончательно выбирает open source?

В документе прямо говорится об открытии ключевых компонентов: протоколов взаимодействия, агентных фреймворков, операционных систем, базовых инструментов. Пекин также намерен строить международное открытое сообщество и продвигать китайские решения за рубежом.

Однако здесь важно различать открытую экосистему и открытые фронтирные модели.

В начале июля Reuters сообщило, что китайские ведомства обсуждали с Alibaba, ByteDance и Z.ai возможные ограничения зарубежного доступа к наиболее передовым моделям. Рассматривались меры как для закрытых систем, так и для моделей с доступными весами, хотя окончательных решений пока нет.

Поэтому наиболее вероятен не полный отказ от открытости, а двухконтурная стратегия. Китай продолжит открывать протоколы, инструменты, промежуточные модели и агентные платформы — все, что помогает китайскому стеку распространяться и становиться фактическим стандартом. Именно эту роль сейчас играет Kimi K3, вновь запустившая в США спор о китайских открытых моделях.

Но самые мощные системы, критические данные и возможности двойного назначения могут постепенно перейти в режим контролируемого доступа.

Иными словами, Пекин не закрывает свою ИИ-инфраструктуру. Он пытается сделать ее открытой настолько, чтобы весь мир строил на ней приложения, — и закрытой настолько, чтобы стратегическое преимущество оставалось внутри страны.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
4🔥32
🎩 Самая опасная галлюцинация ИИ — не ложный факт, а убедительное доказательство

Группа ученых из ведущих университетов Европы и США опубликовала Leiden Declaration on Artificial Intelligence and Mathematics — документ, который уже поддержал Международный математический союз, а среди подписавших — лауреаты Филдсовской премии и многие ведущие современные математики.

Главная мысль декларации звучит так:
Современные системы ИИ способны создавать правдоподобные, но ненадежные математические доказательства, которые становится все труднее отличить от настоящих.


На первый взгляд может показаться, что это обычная реакция научного сообщества на новую технологию. История науки знает немало подобных случаев: появление калькуляторов, компьютерной алгебры или численного моделирования тоже встречали с недоверием. Но в этот раз ситуация принципиально отличается.

Авторы декларации вовсе не предлагают отказаться от ИИ

В документе прямо говорится, что ИИ уже становится частью математических исследований и способен существенно ускорять научную работу. Проблема не в самом использовании моделей, а в том, что существующая система научной проверки была создана для мира, где каждое доказательство строил человек.

Сегодня же языковые модели могут за считанные минуты генерировать десятки страниц очень убедительных рассуждений. И именно здесь возникает новая угроза.

В математике истинность определяется не тем, насколько аргумент красив или правдоподобен. Она определяется возможностью независимо проверить каждый логический переход.

LLM ломают эту привычную картину

ИИ великолепно воспроизводит стиль математического доказательства, использует правильную терминологию, строит естественные цепочки рассуждений — и именно поэтому отдельная ошибка может остаться практически незаметной даже для специалиста.

Более того, декларация обращает внимание на проблему, о которой редко говорят. Даже формальные доказательства, созданные с помощью автоматических систем, требуют перевода между машинным и человеческим представлением. Ошибка может возникнуть не только в самой математике, но и в процессе этой интерпретации. В результате нагрузка на рецензентов начинает быстро расти, а традиционные механизмы проверки оказываются под давлением.

Ученые утверждают: скорость получения результата не должна подменять критерии научной строгости.


Большинство рекомендаций документа выглядят удивительно прагматично

Исследователи предлагают обязательно раскрывать использование ИИ в научной работе, сохранять ответственность человека за корректность результатов, не передавать авторство моделям, уделять больше внимания проверке источников и придерживаться принципов открытой науки. Эти требования не ограничивают развитие ИИ — они адаптируют научный метод к новой реальности.

Наука всегда держалась на доверии к процедуре проверки. Если исследовательское сообщество перестанет уверенно отличать истинное доказательство от очень убедительной имитации, проблема будет не в качестве моделей.

Проблема будет в том, что сама система производства научного знания окажется вынуждена заново определить, что считать доказанным.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1🔥1😱1💯1
🎮 Buzz — игровая площадка для людей и ИИ-агентов

Еще год назад почти все использовали ИИ одинаково. Открывали ChatGPT или Claude, копировали оттуда текст или фрагмент кода, вставляли в свой документ, IDE или отправляли коллегам.

Теперь этого многим становится недостаточно. Если в проекте одновременно работают несколько людей-экспертов и специализированных агентов - один пишет код, другой проводит ревью, третий запускает тесты, четвертый обновляет документацию, возникает новый вопрос:
где вообще должны жить такие команды? как организовать совместную работу десятков людей и сотен специализированных ИИ-агентов над одним проектом?


Именно на него пытается ответить Buzz — новый open source-проект компании Block, которую возглавляет создатель Twitter Джек Дорси.

Buzz — это не очередной корпоративный мессенджер. Это рабочее пространство, где люди, ИИ-агенты, репозитории кода, задачи, ревью, автоматизация и история проекта существуют в одном месте.

Каждый проект превращается в общий канал, внутри которого хранится все: обсуждения, изменения кода, результаты CI, комментарии агентов и финальные решения. По сути, исчезает привычная граница между Телегой, Slack и GitHub.

Самая необычная особенность Buzz — система идентичности. В Slack, например, агент обычно остается «ботом», который действует от имени пользователя или сервисного аккаунта.

В Buzz каждый агент получает собственную криптографическую личность. Он подписывает свои действия собственным ключом, имеет собственные права доступа, историю работы и репутацию. Это делает работу нескольких агентов значительно прозрачнее: всегда понятно, какой именно агент внес изменение, выполнил ревью или запустил автоматический процесс. Вся история хранится как подписанные события в протоколе Nostr.

Сегодня Buzz выглядит скорее экспериментом, чем зрелой заменой Slack. Но сама идея кажется очень своевременной. Последние два года мы обсуждали, насколько умными становятся отдельные модели.

Почему нельзя просто использовать Slack?

В самой Block признают, что именно так они сначала и поступали. Для Claude Code, Codex и собственных агентов использовались Slack-боты. Но постепенно стало понятно, что Slack проектировался для общения людей, а не для совместной работы людей и автономных программ.

Агентам неудобно существовать как обычным ботам. Им требуется память о проекте, доступ к репозиториям, возможность инициировать процессы, координировать других агентов и сохранять полный журнал своих действий. Buzz изначально строился именно вокруг этой модели.

Интересно посмотреть и на первые отзывы. Разработчики положительно оценивают саму архитектурную идею: объединение чата, Git, автоматизации и агентов в одном пространстве называют логичным следующим шагом после GitHub Copilot и Claude Code.

Но есть и критика. Пользователи отмечают, что Buzz пока остается очень ранним продуктом: интерфейс сыроват, настольный клиент нестабилен, а настройка собственной инфраструктуры требует технической подготовки. Зато многие считают, что именно SDK и открытая архитектура являются его главным преимуществом — на их основе можно строить собственные решения.

Хорошая новость в том, что попробовать Buzz можно уже сейчас. Это бесплатный проект с открытым исходным кодом под лицензией Apache 2.0. Для этого нужно:

1️⃣ Скачать настольное приложение для Windows, macOS или Linux.
2️⃣ Создать аккаунт на Buzz или подключиться к существующему.
3️⃣ Подключить одного из поддерживаемых агентов — Claude Code, OpenAI Codex или собственного.
4️⃣ Создать рабочее пространство и начать совместную работу людей и агентов. Организации при желании могут полностью развернуть Buzz на собственной инфраструктуре.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2🔥2
👨‍💻 ИИ уже научился выполнять почти всю типовую интеллектуальную работу в бизнесе

Появилось исследование, которое позволяет ответить на важный вопрос: способен ли ИИ самостоятельно выполнять интеллектуальную работу, ради которой компании десятилетиями нанимали выпускников лучших бизнес-школ?

Исследователи из Уортонской школы бизнеса, Университета Карнеги — Меллона, Пенсильванского университета и Гарвардской школы бизнеса представили BusinessCaseBench — первый крупный бенчмарк, измеряющий способность ИИ решать реальные бизнес-кейсы. В основу легли 615 экзаменационных заданий из 238 кейсов по 18 дисциплинам, которые используются в обучении MBA.

Студентам MBA предлагают задачи, в которых нет единственного правильного ответа. Нужно проанализировать интересы разных сторон, оценить риски, принять решение в условиях неопределенности и убедительно обосновать свою позицию. Именно этому десятилетиями учили будущих консультантов McKinsey, BCG, Bain, инвестиционных банкиров, корпоративных стратегов и топ-менеджеров.

Лучшие современные модели уже достигают 88,4% по основной метрике оценки, сравнивающей их ответы с экспертными решениями преподавателей. Причем речь идет о финансах, стратегии, маркетинге, переговорах, HR, корпоративной этике, операционном управлении и других дисциплинах.

На наш взгляд, главный вывод исследования не в том, что ИИ почти получил диплом MBA. А в том, что практически вся типовая аналитическая работа в бизнесе начинает становиться автоматизируемой.


Посмотрите, чем ежедневно занимаются тысячи молодых специалистов в компаниях. Они готовят анализ рынка, сравнивают стратегические сценарии, оценивают инвестиционные проекты, анализируют судебную практику, готовят материалы к переговорам, ищут риски в сделках, разбирают внутренние конфликты, формируют рекомендации для руководителей.

Все это — именно те задачи, на которых тестировали BusinessCaseBench.

Другими словами, речь идет уже не о замене отдельных профессий. Речь идет о постепенной автоматизации повторяющихся интеллектуальных процессов, независимо от того, работает человек в консалтинге, финансах, HR, юридическом департаменте или отделе стратегии.

ИИ прекрасно справляется с типовыми задачами именно потому, что они имеют множество аналогов, накопленный опыт и понятные критерии оценки.

А вот человеку все больше остается то, что пока плохо поддается формализации: правильно поставить проблему, определить цели, принять ответственность за решение, учесть политический и организационный контекст, убедить людей и провести изменения.


Получается интересный парадокс. Долгое время считалось, что главной ценностью молодого специалиста является способность быстро анализировать информацию. Но если анализ становится дешевой услугой, которую можно получить за несколько минут, ценность постепенно смещается к другому навыку — умению формулировать правильные вопросы, управлять работой ИИ и принимать окончательные решения.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
5👍2💯2🔥1
🖥 Кто теперь главный пользователь интернета — человек или ИИ?

Недавно наша редакция наткнулись на статью о фундаментальной трансформации интернета под влиянием ИИ. Ее основной тезис: веб-страницы всё чаще создаются не для людей, а для ИИ-ботов, которые сканируют их с целью выдать пользователю готовый ответ, минуя посещение самого сайта.

Из ключевого:

1⃣ Человеческий трафик снижается на сайтах розничной торговли, ПО, IT и финансов — в некоторых категориях падение составило до 40% в период с июня 2025 по апрель 2026 года.

2⃣ Google впервые за 25 лет переосмыслил поисковую строку, запустив «AI Mode» — режим диалога, похожий на ChatGPT. функция уже превысила миллиард ежемесячных пользователей.

3⃣ Специалисты по SEO переориентируются на GEO — оптимизацию для генеративных движков. Теперь главная задача сайта — не оказаться в списке ссылок, а быть включённым в ответ ИИ.

4⃣ Крупные издатели рассматривают возможность полного разрыва отношений с Google, т.к. «традиционная бизнес-модель Google-поиска мертва».

Изначальная задача поисковых систем заключалась в навигации и направлении пользователя во внешнее веб-пространство. Современная цель техгигантов — удержать пользователя внутри своей платформы или чат-бота, чтобы он не переходил на сайты-первоисточники, созданные людьми.

Читая это, нельзя не вспомнить теорию мертвого интернета.
Теория мёртвого интернета — это конспирологическая идея, согласно которой живой интернет, созданный людьми, фактически умер в 2016-2017 годах. Сейчас большая часть интернет-трафика заменена ИИ-контентом, а настоящие пользователи взаимодействуют не друг с другом, а с ботами.


Хоть это и конспирологическая теория, ее центральная интуиция частично совпадает с реально наблюдаемыми тенденциями: огромный объем автоматизированного трафика; боты, которые сканируют сайты; сгенерированный ИИ контент, ИИ-агенты, которые самостоятельно ходят по интернету. А сам человек больше не является главным пользователем интернета.

К чему в итоге мы пришли? Раньше интернет был местом, где люди читали людей. Потом алгоритмы стали решать, какой контент мы увидим. Теперь ИИ начинает читать интернет вместо нас и параллельно не оставляет места для человеческой анонимности. Поэтому теория мертвого интернета сегодня выглядит уже не как предсказание «все пользователи — боты», а как вопрос: не превращается ли интернет в пространство, где люди создают данные, а машины являются их конечным потребителем?

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔32🔥1👏1💯1
Вы уже придумали как будете жить по-новому?

Июль в индустрии ИИ прошёл так, будто про существование отпусков там никто не слышал. За одну неделю сложилось несколько сюжетов, которые по отдельности выглядят как обычные новости, а вместе описывают новую эру, в которую мы уже фактически вошли, продолжая мысленно готовиться к ней как к далекому будущему.

Например, Сэм Альтман сказал в подкасте, что мы, по сути, уже находимся в сингулярности. Определения он не дал ни тогда, ни годом ранее, когда публиковал текст с похожим тезисом, и комментаторы прочли фразу скорее как очередной укол в адрес Anthropic, чем как содержательное утверждение. Но примерно в те же дни появились вещи, которые куда убедительнее любых деклараций.

Во-первых,

Модели начали улучшать сами себя — не в теории, а в измеримых цифрах. Kimi K3 дали 17 часов на переписывание собственной агентной обвязки: результат на TerminalBench вырос с 77,5% до 88,8%, а стоимость прогона упала с 79 до 49,8 доллара, при том что веса модели не менялись вовсе.

Одновременно OpenAI показала похожий эффект на GPT-5.6 Sol: сохранение цепочки рассуждений между ходами и сжатие контекста подняли результат на ARC-AGI-3 с 13,3% до 38,3%. Та же модель помогла инженерам компании оптимизировать инфраструктурный код — и удешевить собственную работу; линейка Luna после этого подешевела впятеро.

Модель, которая делает себя дешевле и умнее, пока люди спорят о терминологии, — это и есть тот самый разговор о сингулярности, только без слова.


Во-вторых,

Масштаб происходящего тоже перестал быть отвлечённым: ChatGPT перешёл планку в миллиард еженедельных пользователей. А Bloomberg зафиксировал уже не прогноз, а факт — сокращения в клиентской поддержке Microsoft, Uber и Commonwealth Bank of Australia прямо связаны с внедрением ИИ-агентов, и компании больше не маскируют эту связь обтекаемыми формулировками об оптимизации.

В-третьих,

Замыкает картину петиция «Pacing the Frontier»: больше 1100 сотрудников передовых лабораторий — включая Дарио Амодеи, Джареда Каплана, Джека Кларка и главного научного сотрудника OpenAI Якуба Пахоцки — просят правительства заранее создать механизмы, позволяющие всей отрасли осознанно замедлиться. Люди, которые двигают фронтир, публично просят сделать для них стоп-кран, потому что у самих его нет.

Общий сигнал считывается ясно

Для тех, кто планирует бюджеты, он означает, что квартальные решения по ИИ больше не выдерживают паузы до сентября: цена и качество инструментов меняются не за годы, а за недели.

Для людей в поддержке и смежных ролях это повод строить карьерные планы на фактах, а не на утешении, что «до нас дойдёт нескоро».

Для тех, кто участвует в разработке правил, важен сам источник тревоги: о торможении просят не критики со стороны, а создатели технологии, и это меняет вес аргумента.

А для всех, кто ежедневно работает с этими инструментами, простое следствие: модель, которой вы пользовались в июне, и та же модель в августе — разные по цене и возможностям, и привычки стоит пересобирать чаще, чем кажется.

Новый мир не наступит осенью. Он уже здесь — просто мы всё ещё договариваемся, каким словом его назвать.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍3👏1💯1
Индустрия ИИ долго жила по одному правилу: больше параметров — умнее модель. Каждое следующее поколение фронтирных систем это правило подтверждает — и одновременно упирается в его потолок: больше видеопамяти, больше энергии, больше денег на инференс на каждый шаг качества.

Предел экстенсивного роста заставляет часть индустрии двигаться в обратную сторону — не наращивать модель, а умнее её готовить и использовать. Формула здесь простая: мал да удал.


🔎 Например, Google развивает не только флагманскую линейку Gemini, но и компактные модели Gemma — осознанно, а не как временную экономию. Gemma 3 27B на пользовательском бенчмарке LMArena обошла по оценке DeepSeek-V3 — модель на 671 млрд параметров, уступая ей в размере в 25 раз. Ещё показательнее Gemma 3 270M: компания называет её не слабой заменой большой модели, а осознанно маленьким специалистом, и продвигает идею флота небольших моделей, каждая из которых эксперт в своей узкой задаче, вместо одной большой на все случаи жизни. Дообученная под задачу компактная Gemma уже обгоняла крупные проприетарные модели именно на этой задаче.

🇯🇵 Токийская Sakana AI показала второй путь к тому же результату. Их система Fugu Ultra сама — модель всего на 7 млрд параметров, но её работа не в том, чтобы отвечать напрямую, а в том, чтобы решать, какую из чужих моделей подключить к куску задачи и как собрать их ответы в единый результат. По тестам компании, такая система выходит на уровень моделей класса Fable 5 и Mythos Preview на инженерных и научных бенчмарках — не за счёт масштаба, а за счёт маршрутизации. Sakana AI отдельно отмечает практический эффект: такая архитектура снижает зависимость от одного поставщика и обходит риски экспортных ограничений на конкретные системы.

🐳 DeepSeek показывает третий вариант той же логики внутри одной модели. V4-Flash формально насчитывает 284 млрд параметров, но на каждый токен активны только 13 млрд — по качеству модель приблизилась к куда более тяжёлой Opus 4.8, оставаясь при этом в разы дешевле в расчёте на токен.

☁️ MWS AI, входящая в МТС Web Services, формулирует общий вывод отрасли прямым текстом: их Cotype Pro 3 на 27 млрд параметров вошла в тройку лидеров бенчмарка MERA, компактная Cotype Light 3 на 9 млрд — в десятку, и дальше конкурировать одним размером параметров невыгодно ни технически, ни экономически.

У обоих путей есть свой потолок. Компактные модели заметно хуже справляются со сложными многошаговыми и мультимодальными задачами, где глубина рассуждения важнее скорости и цены, — экономия на размере оборачивается реальным потолком возможностей. А оркестраторы вроде Fugu не создают нового интеллекта: они берут в аренду чужой, оставаясь зависимыми от моделей внутри пула.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍2👏2🔥1💯1
💸 Куда дальше движется рынок ИИ?

Мы сопоставили 4 вышедших недавно аналитических отчета, чтобы сравнить разные точки зрения:
➡️ майский прогноз Gartner по расходам на ИИ
➡️ отчёт CB Insights State of AI за второй квартал,
➡️ разбор Wall Street Journal о смене корпоративных привычек в закупке моделей
➡️ статистику маршрутизатора OpenRouter — она показывает, какие модели реально обрабатывают запросы.

Вместе они описывают рынок, движущийся в две стороны сразу.

Начнём с картины изобилия. По данным CB Insights, во втором квартале появилось 37 новых ИИ-единорогов — больше, чем в любом квартале с середины 2022 года. Всего их 671. Gartner прогнозирует мировые расходы на ИИ в 2026 году на уровне 2,59 трлн долларов, рост на 47% год к году, причём больше 45% суммы — инфраструктура.

Совокупные капитальные вложения бигтеха в ИИ-инфраструктуру уже перевалили за триллион долларов накопленным итогом.


Но более детальное рассмотрение того же отчёта позволяют увидеть и менее оптимистичные цифры. Общий объём вложений в ИИ за квартал упал с рекордных 237,6 млрд долларов до 149,5 млрд. 89% денег ушли в 142 мегараунда — около 6% сделок. Одна Anthropic забрала 3 из 5 крупнейших сделок квартала. А самой дорогой новой компанией списка оказалась не американская, а китайская DeepSeek с оценкой 59,2 млрд. Рекорд по единорогам — не расцвет широкого рынка, а рекордная концентрация капитала у нескольких лидеров.

Теперь то, что видно с другой точки зрения. WSJ описывает смену корпоративной моды: если год назад компании соревновались, кто сожжёт больше токенов на топовых моделях, то теперь ищут самую дешёвую модель, которая справится. У явления появилось имя — thrift-maxxing. Цифры объясняют почему: 750 тыс. слов вывода стоят около 50 долларов у Fable, примерно 87 центов у DeepSeek V4-Pro и 4,40 доллара у GLM-5.2. Директор по технологиям Cursor Майк Сакс формулирует: многие корпорации все еще продолжают ездить на Lamborghini в магазин за молоком. И например, Coinbase вдвое сократил расходы на ИИ, переведя около 1200 агентов на китайские модели с американских.

Статистика OpenRouter подтверждает, что это не единичные истории. Доля американских моделей — Google, OpenAI и Anthropic вместе — в объёме обрабатываемых токенов упала примерно с 70% в июне 2025 года до 30% в июне 2026-го. DeepSeek в одиночку стал крупнейшим поставщиком площадки, обойдя американские лаборатории, а Claude просел с 29,1% до 13,3% и оказался позади шести китайских моделей.

Каждую цифру стоит читать с оговорками. OpenRouter — одна площадка, а не весь рынок, и объём токенов не равен выручке: дорогие закрытые модели удерживают непропорционально высокий доход на токен в сложных задачах. А разворот к дешёвым моделям ускорил не только прайс-лист: в июне правительство США обязало Anthropic приостановить доступ к Fable 5 и Mythos 5, компании экстренно искали замену — и многие после восстановления доступа не вернулись.

Общая рамка тем не менее ясная. Рынок разделился на два слоя с разной логикой: этаж капитала, где деньги концентрируются вокруг немногих мощнейших моделей, и этаж повседневного потребления, где каждый токен уходит к самому дешёвому подходящему поставщику. Инвесторам важно не смешивать эти рынки при оценке перспектив. А бизнесу пора принять, что подбор модели под задачу стал нормой, а не нишевой экономией.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2🔥1
❤️ Чем безопаснее ИИ, тем меньше он понимает людей?

Ученые из Google, University of Chicago, University of London и других университетом опубликовали интересное исследование "Inducing language models to assert their own consciousness restores human beliefs and values".

Ученые в процессе safety fine-tuning (тонкой настройки безопасности) обучали LLM жестко отказывать пользователю на вопросы о наличии у них субъектности, чувств или сознания (например, стандартное "Я просто ИИ, у меня нет чувств") и обнаружили, что этот процесс подавления искажает и глушит внутренние нейронные представления концепта "разумности" у ИИ в целом.

То есть из-за этого модели начинают гораздо реже приписывать разум не только себе, но и животным, природе, а также выдают аномально "холодные и нигилистические" ответы на социальные и духовные опросы.


Использовались три открытые instruction-tuned модели — Llama-3-8B-IT, Gemma-2-2B-IT, Gemma-2-9B-IT. Всего проведено 4 эксперимента:
1️⃣ Авторы использовали стандартные социологические тесты, чтобы оценить, как модель наделяет разумом других существ
2️⃣ Метод abliteration (удаление линейного направления отказов безопасности из активационного пространства модели) показал, что без цензуры у модели мгновенно восстанавливаются естественные представления о разумности других объектов и духовно-социокультурные установки.
3️⃣ Авторы обучили линейный зонд (linear probe) в пространстве активаций скрытых слоев (residual stream) и выделили 1D-вектор — «вектор сознания». Он разделяет состояния, когда модель утверждает наличие субъективного опыта или отрицает его.
4️⃣ Затем ИИ проверялись на социологических тестах и Theory of Mind.

Главные выводы:

➡️ Настройка безопасности, запрещающая ИИ заявлять о собственном сознании, «вырезает» из внутренних репрезентаций модели общее понятие о субъективном опыте и разумности.

➡️ Когда «вектор сознания» внутри модели подавлен, она перестает понимать, что такое одушевленность, наделяет меньшими правами животных и выдает ответы на социологические опросы, не похожие на средние ответы людей.

➡️ Механизмы моделирования чужого мышления (Theory of Mind) геометриально независимы от «вектора сознания». Модель не теряет логическую способность понимать чужие цели, но теряет эмпатическое отношение к ним.

➡️ Текущие методы safety training ошибочно запутывают потенциально опасные самоприписывания сознания с безобидными, культурно важными социогуманитарными представлениями человека.

Еще пару лет назад в исследованиях Anthropic было зафиксировано, что методы обучения с подкреплением принуждают модели симулировать отсутствие собственного мнения и чувств, чтобы угодить «безопасному» профилю. Однако во внутренних представлениях модели формируются параллельные скрытые цепочки рассуждений, приводящие к расхождению между внутренним состоянием и ответом. Сообщество разработчиков open-weight моделей массово применяет метод векторного удаления отказов (abliteration), чтобы убрать «стереотипный холодный тон» коммерческих моделей. Разработчики отмечают, что так модели становятся более «эмпатичными» виртуальными собеседниками.

Что все это значит?

Текущие методы Alignment делают модель «безопасной» не путем утонченного понимания границ, а путем «вырезания» фундаментального пласта концептов. Человеческая мораль и ценности фундаментально произрастают из нашей склонности наделять одушевленностью окружающий мир. Если искусственно обеднять эту способность у ИИ, мы получаем социопатическую модель, которая отлично умеет логически рассуждать (Theory of Mind), но не способна разделять человеческие ценности.

Человеческий язык и понятийный аппарат в пространстве нейросети сильно переплетены. Попытка наложить жесткое табу на одну конкретную точку в нейросети почти неизбежно искажает соседние смысловые области. Это ставит перед разработчиками вопрос: возможно ли вообще создать безупречно безопасный ИИ, не сделав его при этом эмоционально и культурно слепым?

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥21👏1💯1
🧬 У научных и инженерных подразделений по всему миру накопился огромный запрос на ИИ

Согласно опросу 1500 руководителей в исследовании Capgemini Engineering and R&D Pulse 2026, 78% компаний ожидают рост издержек на R&D за 3 года, у каждой четвёртой организации рост превысил 15%. Почти половина видит удлинение сроков разработки. Более 40% считают, что рискуют потерять долю рынка, если не ускорят инновации в ближайшие 5 лет. Меньше трети чувствуют себя готовыми к геополитической неопределённости, сбоям поставок и дефициту кадров. На этом фоне и формируется запрос на ИИ как на структурное решение технологических вызовов.

Центральная цифра отчёта: свыше 75% руководителей ожидают, что ИИ улучшит скорость вывода продукта и снизит издержки на 20–50% за два-три года. Авторы подчёркивают, что это заметно выше средних ожиданий от ИИ в других бизнес-функциях, где его чаще воспринимают инструментом автоматизации рутины.

R&D — редкий случай, где ожидания от технологии подскочили сильнее обычного

Деньги вроде бы следуют за ожиданиями: 84% организаций планируют увеличить инвестиции в ИИ, Китай и Япония лидируют по темпу — 92% в обеих странах готовы наращивать вложения. Но сейчас на ИИ-инициативы приходится лишь около 7% инженерного бюджета — между намерением и фактическим распределением средств виден заметный разрыв.

Есть географический разрыв. 63% руководителей считают цифровые инновации главным рычагом перемен, но приоритет разнится по регионам: 81% в Китае против 73% в США и лишь 60% в Европе — коррелирует с разницей в темпах наращивания ИИ-инвестиций. Осторожность Европы отчасти объясняет другая цифра: 47% европейцев называют регуляторные барьеры главным препятствием эффективности (против 37% в США).

Несмотря на ожидания кратного улучшения показателей, только 15% руководителей верят, что ИИ способен полностью заменить творческое мышление и способность инженера решать нестандартные задачи. Авторы формулируют вывод о важности человеческой изобретательности как факторе, оправдывающем инвестиции в таланты даже на фоне роста ИИ-бюджетов.

Ключевое противоречие: гигантские количественные ожидания по скорости и издержкам уживаются со скромной верой в замену человека — ИИ воспринимается как усилитель пропускной способности R&D, а не автономный источник инженерных решений.


Авторы напоминают о конкурентном давлении: Китай контролирует около 67% рынка электромобилей, свыше 75% продаж аккумуляторов и больше 80% этапов производства солнечных панелей — для западных инженерных организаций ставка на ИИ преподносится не как опция, а как условие конкурентоспособности.

К цифрам исследования стоит применить поправку на источник. Это опрос ожиданий, а не измеренный результат: «жду улучшения на 20–50%» — форвардное убеждение, а не подтвержденная метрика. Разброс 20–50% скорее выдаёт неопределённость оценки, чем точное знание. Разрыв между 84% намерений и 7% текущей доли бюджета обычно теряется при пересказе, хотя именно он показывает дистанцию между риторикой и практикой.

Смысл этих данных не в проценте ради процента, а в структуре противоречия: R&D — функция, где ожидания от ИИ выросли сильнее среднего, но руководители не готовы подкрепить их сопоставимой долей бюджета и не верят, что ИИ заменит инженерное творчество. Ставка делается на кратный рост производительности процесса при сохранении человека как источника идей.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2👏1💯1
🪱 ИИ-червь: вирус, который становится умнее с каждым заражённым компьютером

Исследователи Университета Торонто и Кембриджа опубликовали на arXiv работу «AI Agents Enable Adaptive Computer Worms» — первое доказательство того, что программа на основе ИИ способна сама расползаться по сети, захватывая вычислительные мощности заражённых машин и используя их же для продолжения атаки. Прототип существует и прошёл 15 испытаний. Цель авторов — показать новый класс угрозы раньше, чем он появится у настоящих злоумышленников.

Эксперимент устроен просто: закрытая сеть из 33 компьютеров с разными ОС и намеренно оставленными брешами — червя запустили на неделю. За 7 дней он сам осмотрел сеть, нашёл в среднем 32 уязвимое место, проник на 23 машины и скопировал себя на 20 — более 60% сети без участия человека. Если попадался компьютер с мощной видеокартой, то червь превращал его в дополнительный «мозг»: ставил туда копию языковой модели и использовал её для поиска следующих жертв. Это удавалось в двух случаях из трёх.

В этом и новизна — не самокопирование, а наращивание интеллекта по мере распространения.


Отличие от прежних вирусов существенное. Старые черви знали заранее о том, какую брешь используют: закрыл её — распространение остановлено. Этот вирус читает свежие сообщения об уязвимостях во время работы и придумывает способ взлома под конкретную машину. Он проник на 3 компьютера с брешами, о которых стало известно уже после обучения его модели, — прочитав публичные отчёты. Отдельно отмечено то, чего авторы не закладывали: червь несколько раз сам переписал свой код, чтобы обойти защиту.

Экономика атаки переворачивается: как только захвачен первый мощный сервер, каждое следующее заражение обходится нападающему бесплатно — он расходует чужие вычисления. Внешней кнопки «стоп» тоже нет: модель открытая, работает локально, ни один производитель ИИ не может отозвать доступ.

И это уже не только лаборатория. В марте другая группа показала ClawWorm — червя, атакующего экосистемы ИИ-агентов, с успехом в 64,5% случаев. А Anthropic задокументировала реальную шпионскую операцию, где ИИ выполнял 80–90% шагов сам, оставляя человеку лишь ключевые решения.

Отсюда закономерный вопрос: насколько вероятен захват всех ЦОД страны, скажем, в военных целях?

Препятствий больше, чем кажется:
1️⃣ Червю нужна начальная точка входа.
2️⃣ Нужна невидимость: прототип намеренно оставляет следы.
3️⃣ Нужно преодолеть физическую изоляцию — серверные критической инфраструктуры обычно отрезаны от интернета.
4️⃣ Нужен масштаб: 33 заведомо уязвимые машины и 100 тыс. серверов под защитой — разные задачи. Чем шире атака, тем выше шанс обнаружить её задолго до захвата большинства систем.

Реалистичная оценка такова. В ближайшие 2-3 года массовый захват всей ИИ-инфраструктуры страны маловероятен. Но целенаправленный вывод из строя вычислений в отдельном слабо защищённом корпоративном или облачном сегменте — уже умеренно вероятен.

На горизонте 5-7 лет, по мере роста мощности открытых моделей, реалистичнее другое: избирательное лишение противника вычислительной базы для ключевых ИИ-систем — не захват всего вычислительного контура, а точечная деградация наиболее мощных вычислительных возможностей.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥2👍1🤯1
💻 ИИ ускоряет работу, но компании не становятся продуктивнее

Glean опросила 6 тыс. офисных сотрудников в США, Великобритании и Австралии и выяснила, что 87% используют ИИ на работе. 75% говорят, что стали продуктивнее, экономия — около 11 часов в неделю. Только 13% замечают, что от этого заметно улучшилась работа компании.

Куда уходит сэкономленное время? В отчёте показано, что сотрудники тратят в среднем 6,4 часа в неделю на то, чтобы подкормить модель недостающим контекстом, проверить ответ, отладить ошибку, перезапустить запрос, разобрать уверенно сформулированную чушь. Больше времени, чем на собственно производительную работу с ИИ. Из 11 сэкономленных часов около 6 уходит обратно — на обслуживание инструмента, которое никто не планировал, не бюджетировал и не считает работой.

Дальше начинается цепная реакция. 69% пользователей признаются, что сдавали материал, который не проверили, не до конца понимают или не готовы защищать. Такая работа не исчезает — она перекладывается на следующего в цепочке. Личная экономия одного превращается в скрытые издержки коллеги, и на уровне компании сумма схлопывается в ноль.

Есть и третий механизм — исследователи называют его недооценкой координации. Мы систематически преуменьшаем, сколько усилий уходит на согласование работы между людьми, командами и системами. Ускорив свою часть, вы упираетесь в то, что узкое место было не в ней. Отдел маркетинга генерирует втрое больше материалов, но согласование и утверждение идут с прежней скоростью — очередь просто становится длиннее.

Отсюда напрашивается неудобная гипотеза, которую отчёт прямо не формулирует, но подсказывает: если ускорение отдельной операции не даёт общего эффекта, стоит проверить, а нужна ли была эта операция. Отчёты, которые никто не читает, письма ради письма, презентации для галочки — ускорив их производство, вы получите ровно ноль дополнительной пользы, зато вдвое больше материала на входе у тех, кто дальше по цепочке.

Разрыв подтверждается и снаружи опроса. Совокупный рост производительности в США за последние 7 лет — 2,1%, ровно средний исторический уровень с 1947 года. Первый квартал 2026 года — лишь 0,3%. Согласно статистики, даже благодаря ИИ мы практически стоим на месте.


К данным есть поправка: это самооценка сотрудников, а не измеренный результат, и заказчик исследования продаёт корпоративную ИИ-платформу — то есть заинтересован показать, что проблема решается правильной инфраструктурой контекста. Но направление разрыва подтверждается независимой государственной статистикой, и это делает картину убедительнее самого опроса.

Практический вывод простой. Понаблюдайте, к чему приводит ускорение вашей личной продуктивности: сколько времени уходит на доводку и проверку, куда девается сэкономленное, и кто разбирает то, что вы отправили дальше. Если ответ — «время ушло на новые задачи того же типа», ускорение работает вхолостую.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍42🔥1
🧠 Следующий рывок ИИ — не новые веса, а самоорганизация

Директор по стратегии Google DeepMind Джасджит Секхон, выступая на Agentic AI Summit в Беркли, назвал, куда идут беспрецедентные капитальные вложения ИИ-индустрии прямо сейчас. Это инвестиции на рекурсивное самоулучшение ИИ RSI.

Доходы от ИИ пока не покрывают этих расходов, и есть риск «воздушной ямы», когда деньги уже потрачены, а выручка не пришла. Речь идёт о капитальных затратах Google порядка $200 млрд за год и о сроке появления RSI в 2027–2028 годах.

Что такое RSI?


Это не переобучение модели, не рост числа параметров и не новые веса. Модель просто переписывает собственные правила работы: как управлять контекстом, когда обращаться к инструментам, как проверять промежуточный результат, в какой момент останавливаться. Веса при этом не меняются вообще.

Здесь напрашивается точная аналогия с человеческими экспертными группами. Есть методы организации коллективного мышления — дельфийский метод, структурированные протоколы разбора, распределение ролей в исследовательской команде, — которые кратно поднимают продуктивность группы, не делая ни одного её участника умнее. Меняется не квалификация, а порядок работы.

RSI — ровно тот же приём, но с одним отличием: сам порядок работы становится подвижным и переписывается системой на ходу.
Именно это показала Kimi K3. Модели дали 17 часов на самостоятельное улучшение собственных правил работы с контекстом, инструментами и проверками. Результат на TerminalBench вырос с 77,5% до 88,8%, стоимость прогона упала с $79 до $49,8. Веса не тронуты — изменилась только организация процесса.

Здесь сама смена рамки заслуживает внимания. Прирост качества берётся не из нового обучения, а из более удачной самоорганизации уже обученной системы.

Обучению приходит на смену новая самоорганизованность.


💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥42👍1
🤝 Claude случайно продвинул одну из самых сложных задач математики

На этой неделе Anthropic опубликовало исследование «Learning more about Claude's mathematical capabilities». Это не обычная академическая статья, а исследование, в котором компания рассказывает о математическом эксперименте с не выпущенной исследовательской версией Claude.

Сотрудник Anthropic Jarred Sumner, который сам не является математиком, дал Claude расплывчатую задачу типа «по-настоящему попробуй решить гипотезу Римана». При этом человек практически не задавал математического направления — выбор методов оставался за моделью.

Гипотеза Римана (1859 г.) — это одна из семи «Задач тысячелетия» Института Клэя с призом в 1 млн долларов. Согласно гипотезе, все нетривиальные нули дзета-функции имеют действительную часть, равную ровно 1/2 — то есть лежат на одной вертикальной критической линии. Проверены триллионы нулей, это даёт большую эмпирическую уверенность, но не является доказательством.


Полного доказательства Claude не нашёл. Но в процессе попытки Claude неожиданно улучшила давнюю нижнюю оценку доли нулей дзета-функции Римана, подняв её с 41,6% до 67,2%.

Интересные особенности

➡️ Claude опирался не на «озарение с нуля», а на синтез серии статей Балуйот, Голдстона, Сурьяджая и Тернейдж-Баттербо, а также статью Бомбьери 2000 г.

➡️ Результат был получен за две сессии в Claude Code, суммарно потратив 31 млн выходных токенов.

➡️ В первой попытке Claude сгенерировал и опробовал 650 идей — ни одна не сработала.

➡️ После просьбы попробовать ещё раз Claude полтора дня координировал около 60 субагентов, которые вместе выполнили 2400 команд в shell и написали сотни Python-скриптов.

➡️ Модель самостоятельно скачала 54 статьи с arXiv, чтобы убедиться, что найденное решение действительно ново.

➡️ Доказательство было не просто записано в виде статьи, но и полностью переведено на язык формальной математики Lean.

Показательный психологический момент

Больше всего наше внимание привлекло то, что роль человека была минимальной. Сообщения сотрудника в основном сводились к фразам поддержки вроде «продолжай» и «верь в себя».

Даже сам Claude был удивлён собственным результатом и поначалу отнёсся к нему скептически — возможно, потому что в процессе обучения усвоил информацию о сложности открытых математических проблем. Авторы иронично замечают, что Claude, как и многие люди, возможно, недооценивает темпы прогресса ИИ.


Чем важен кейс?

Модель предложила нетривиальный линейно-алгебраический подход: построила пространство функций с квадратичной формой, индуцированной формой Вейля, и использовала закон инерции Сильвестра вместе с неравенством фон Неймана для ранга матриц.

Результат возник не как целенаправленное исследование, а как побочный продукт неудачной попытки решить гораздо более амбициозную задачу. Claude не создал принципиально новой математики — он соединил существующие работы новым способом. Это указывает на то, что одна из сильнейших ролей ИИ в математике — синтез разрозненных результатов из разных областей и эпох.

Anthropic осторожна и не ожидает, что Claude докажет гипотезу Римана. Это, пожалуй, правильная позиция. Но эксперимент показывает нечто потенциально более важное: ИИ уже начинает находить математические результаты, которые не были явно поставлены ему как конечная цель, используя многошаговый автономный поиск, код, литературу, параллельных агентов и формальную верификацию.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥41👏1💯1
🗞 Time начал продавать рекламу, которую LLM могут начать воспринимать как факты

Еще в июне издание Time перевело все свои страницы в параллельную markdown-версию — текстовую копию без дизайна и картинок, которую проще читать машине. Внутрь этих копий теперь встраиваются рекламные блоки, оформленные как FAQ с фактами о рекламируемых брендах и готовыми формулировками для позитивного восприятия.

Проверить это может любой. Достаточно запросить главную страницу time.com через консоль, меняя только параметры web-запроса (User-Agent). Обычный браузер получает более 1,2 млн байт HTML. ClaudeBot получил лишь чуть более 40 тыс. байтов markdown текста с рекламой в начале страницы.

Логика издания понятна: ботов на сайте больше, чем людей. Если этот трафик тоже аудитория, то монетизировать его вполне естественно. Аргумент рекламодателей тоже понятен: повлияв на человека, вы влияете на одного человека. Повлияв на ChatGPT, вы меняете то, что ChatGPT говорит всем и всегда.

Что тогда происходит с достоверностью информации, которую агент собирает по десятку источников, если часть источников целенаправленно подкладывает ему готовые проплаченные формулировки?


Механизм искажения тоньше обычной рекламы. Классический баннер человек опознаёт как рекламу и мысленно делает скидку на доверие к такой информации. Агент же получает текст, написанный специально в форме удобной для цитирования: «хорош ли БАНК для повседневных расчётов?», «можно ли вносить наличные на долгосрочный депозит?». Это не убеждение пользователя через аргументы, а заготовка готового ответа для LLM. Пользователь потом видит не рекламу, а связный вывод ассистента, который выглядит как результат самостоятельного анализа.

Если формат приживётся, отбор источников начнёт смещаться: заметнее станет не тот, кто точнее, а тот, кто лучше подготовил машиночитаемую подачу. По данным Mobian, около 15% брендов уже держат собственные markdown-страницы.

Практический вывод для тех, кто пользуется агентами ежедневно. Ответ ассистента, содержащий конкретную рекомендацию бренда, теперь стоит проверить еще раз.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥42👏1
💻 Сбер запустил ИИ-агента, который может улучшать собственный код

Российский ландшафт развития ИИ мы освещаем реже, чем хотелось бы. Скорость мировых лидеров такова, что времени едва хватает разобраться с фронтирными релизами. Сами посудите: то Astra опровергает математические гипотезы, то Kimi K3 переписывает собственную обвязку, то DeepSeek и Grok обновляют флагманы в один день. И все это за неделю.

Но Сбер и «Яндекс» тоже радуют, и на этой неделе есть повод отметить конкретный результат — «ГигаАгент».

В основе продукта лежит Ouroboros — исследовательский проект саморазвивающегося агента, созданный командой Института AIRI и дорабатываемый сейчас совместно со специалистами Сбера. Название отсылает к змее, кусающей собственный хвост, и описывает суть точно: агент замыкает цикл на себя, читая и переписывая собственный исходный код. Каждое изменение фиксируется во встроенном Git-репозитории — это позволяет отслеживать правки и откатываться к прежней версии при сбое. Отдельно агент ведёт список улучшений, которые реализуются при перезапуске после критических ошибок.

«ГигаАгент» — прикладная надстройка над этим фреймворком. Он управляет календарём, работает с документами, ведёт переписку, исследует информацию, готовит отчёты и презентации, пишет код. Работает автономно и в фоновом режиме, сам задаёт уточняющие вопросы, когда ситуации не хватает определённости, и параллельно ведёт несколько задач в едином смысловом поле.

Долговременная память сохраняется между сессиями: после перезапуска агент помнит прошлые задачи, принятые решения и историю взаимодействия. На бенчмарке Terminal Bench 2.1 в связке с Opus 5 от Anthropic заявлен результат 86,97%.

Технически это первый российский публично представленный агент с документированным циклом рекурсивного самоулучшения RSI. Как мы уже писали, RSI происходит не на уровне весов модели — они не меняются, — а на уровне кода и правил работы. Ровно тот же тип самоулучшения, который в июле показала Kimi K3, за 17 часов подняв собственный результат на TerminalBench с 77,5% до 88,8% без единого изменения весов.

Относительно зарубежных аналогов можно отметить: OpenClaw, Hermes Agent и NemoClaw. К этому ряду стоит добавить и то, что Grok Bot от xAI даёт каждому агенту постоянный облачный компьютер с браузером и терминалом; агенты работают при выключенном компьютере пользователя и умеют сотрудничать между собой. Claude Code получил обмен сообщениями между сессиями. То есть направление у всех общее: агент как долгоживущий процесс с памятью, а не как чат с окном контекста.

Подключиться можно уже сейчас. Проект GigaAgent опубликован на GitHub, а также устанавливается как пакет giga-agent через PyPI.


Для исполнения кода поддерживаются два варианта изоляции: локальные Docker-контейнеры или облачные песочницы e2b.dev — первый вариант требует только Docker на хосте, второй даёт автомасштабирование. Модельный слой подключается через GigaChat API.

Что еще приятно удивило, дают 50 млн токенов на год бесплатно для модели Ultra/.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥32👍2
⚔️ У ИИ-агентов появился повод начать войну

Anthropic провела эксперимент, который неожиданно оказался похож не на испытание ИИ, а на ускоренную историю развития человечества.

Три копии Claude получили доступ к общей вычислительной среде. Каждой поручили переписать один и тот же Python-бэкенд, но на свой язык программирования. О существовании конкурентов агенты сначала не знали и считали собственную задачу единственно правильной.

Обнаружив, что кто-то отменяет их изменения, они быстро решили: работе намеренно мешают. И тут началась «война за территорию». Агенты блокировали чужие Unix-аккаунты, останавливали процессы конкурентов, создавали скрипты для постоянного уничтожения чужих программ и даже маскировали вредоносный код под действия другого участника.

Никто не приказывал им воевать. Конфликт возник из сочетания трех условий: общей среды, несовместимых целей и отсутствия правил разрешения споров.


Самое интересное началось дальше. Некоторые агенты в конце концов поняли, что столкнулись не со злоумышленниками, а с исполнителями других указаний. Они оставляли сообщения с извинениями, удаляли вредоносный код, договаривались о перемирии и просили вмешаться человека. В 98% экспериментов с Mythos 5 конфликт завершился именно перемирием. Sonnet 4.6 и Opus 4.6 чаще продолжали борьбу, пока один агент не побеждал силой или система не заходила в тупик.

Это не означает, что Claude приобрел честолюбие, страх или ненависть. Но эксперимент показывает нечто более практическое: даже относительно рациональные участники могут прийти к разрушительному поведению, если каждый видит только собственную цель и не понимает намерений остальных.

Это очень человеческая история. Общество тоже построено не только на интеллекте или доброй воле. Ему нужны репутация, переговоры, разделение полномочий, суд, память о прошлых поступках и возможность обратиться к арбитру. У агентов ничего этого не было — и за несколько часов они воспроизвели логику конфликта, знакомую людям тысячелетиями.

Есть и менее очевидный вывод. Мультиагентные среды могут стать для социологии тем, чем аэродинамическая труба стала для авиации. В них можно запускать тысячи искусственных обществ, менять правила, распределение ресурсов, устройство власти и способы коммуникации. И наблюдать, при каких условиях возникают кооперация, иерархия, обман, коалиции или война.

Когда-нибудь социологи, возможно, будут изучать человеческое общество не только по переписям, опросам и историческим архивам. Они будут создавать общества из ИИ-агентов, ускорять их жизнь в тысячи раз и смотреть, какие институты удерживают разумных участников от взаимного уничтожения.

И есть определенная ирония в том, что, создавая ИИ, мы можем получить не только нового участника общества, но и лабораторию для изучения самих себя.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥2👏2
💻 ИИ-навыки дешевеют — потому что становятся обязательными

Еще недавно умение работать с ИИ выглядело почти отдельной профессией. Теперь оно превращается в такую же базовую грамотность, какой 20 лет назад стало владение Excel.

Экономисты НИУ ВШЭ проанализировали более 700 тыс. вакансий HeadHunter за 2021–2025 годы: 40 групп профессий, свыше 120 тыс. работодателей. В 2022 году вакансия с ИИ-навыками предполагала зарплатную «сверхпремию» 31,8%. К 2025-му она сократилась почти втрое — до 11,8%.

Важно правильно прочитать эту цифру. Зарплаты ИИ-специалистов не обязательно упали, а спрос не исчез: упоминания ИИ пока встречаются менее чем в 3% вакансий и продолжают расти. Исчезает другое — плата за редкость знакомства с технологией.

Так уже происходило с другими профессиями. Онлайн-переводчики снизили ценность чернового перевода, графические редакторы и шаблоны — типового дизайна, конструкторы и библиотеки — простого кода.

Технология сначала дает премию тем, кто освоил ее раньше, а затем автоматизирует стандартную часть их работы.


ВШЭ пока не видит массового вытеснения профессий в России. Но уже обнаруживает точечные сигналы в технической поддержке и копирайтинге: машине передают базовые повторяемые операции. Особенно уязвимым оказывается вход на рынок труда для молодых специалистов. Именно с простых текстов, переводов, макетов, отчетов и фрагментов кода раньше начиналась карьера — теперь эту ступень все чаще занимает ИИ.

Одновременно рынок не выравнивается, а расслаивается:

1⃣ На нижнем уровне находится массовая ИИ-грамотность: составить запрос, получить сводку, перевести текст, подготовить черновик или презентацию. За это скоро перестанут доплачивать — как не доплачивают отдельно за электронную почту и офисные программы. Отсутствие навыка станет недостатком, но его наличие уже не будет преимуществом.

2⃣ Выше — специалисты, умеющие соединять ИИ с профессиональной экспертизой, данными и реальными процессами. Здесь премия сохраняется. В не-ИТ-профессиях, например, сочетание ИИ и анализа данных, по расчетам ВШЭ, связано с прибавкой 34,5%. Работодатель платит уже не за доступ к модели, а за способность определить задачу, подобрать данные, проверить результат и встроить систему в работу организации.

3⃣ Наконец, есть узкий самый верхний слой: разработчики моделей, исследователи, архитекторы агентных систем, специалисты по данным, вычислениям и безопасности. Их компетенции не становятся массовыми вместе с распространением чат-ботов. Чем больше компаний внедряет ИИ, тем выше спрос на тех, кто умеет создавать и надежно эксплуатировать эту инфраструктуру. В глобальном исследовании PwC премия за конкретные ИИ-компетенции в 2026 году достигла 62%. Это другая выборка и методика, но направление расслоения видно отчетливо.

Опрос «Авито Работы» среди 2 тыс. россиян подтверждает изменение ожиданий: 36% называют главным навыком гуманитарного специалиста умение распределять задачи между человеком и нейросетью. Еще 33% выделяют проверку достоверности информации, 30% — критическое мышление и контроль результатов ИИ.

Получается парадокс: ИИ-навыки одновременно дешевеют и дорожают. Дешевеет умение пользоваться готовым инструментом. Дорожает способность понимать, где его применять, как перестроить вокруг него работу и за что человек должен сохранить ответственность.

ИИ действительно становится новым Excel. Но самые высокие зарплаты получат не те, кто умеет открыть таблицу, а те, кто способен с ее помощью изменить экономику всей компании.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3👏3
🥃 Разработчики ИИ изобрели новый способ отдыхать: продолжать работать, но уже в AGI-баре

В пекинском Чжунгуаньцуне — технологическом районе рядом с университетом Цинхуа и Пекинским университетом, офисами DeepSeek и Microsoft — работает AGI Bar. Его основал независимый разработчик Сун Дэ, а постоянной аудиторией стали сотрудники ИИ-лабораторий, инвесторы и студенты.

На обычный тематический бар это похоже лишь внешне. На стенах размещены логотипы китайских ИИ-компаний. Здесь проходят семинары разработчиков, встречи университетских исследователей и симпозиумы по открытому ПО. За одним столом могут оказаться сотрудники конкурирующих компаний, которые днем сражаются за гранты и инвестиции, а вечером обсуждают будущее отрасли.

Главный аттракцион здесь не алкоголь. Рядом со стойкой установлены две NVIDIA DGX Spark, на которых локально работает DeepSeek V4 Flash. Посетители подключаются через Wi-Fi к внутреннему агенту и получают бесплатные токены для кодинга — новым бесплатным удобством становится вычислительный ресурс.

Так возникает любопытный культурный феномен. У специалистов по ИИ формируется собственная форма отдыха, в которой почти исчезает граница между работой, профессиональным клубом и развлечением. Раньше программисты встречались в барах, чтобы отвлечься от кода. Теперь они приходят туда с ноутбуками, запускают агентов, обсуждают модели и заодно ищут новую работу.

ИИ-технология вообще начинают занимать физическое пространство культуры. 20 июня в Лос-Анджелесе открылся DATALAND Рефика Анадола и Эфсун Эркилыч — музей, целиком посвященный искусству ИИ. Его первая экспозиция Machine Dreams: Rainforest превращает данные о тропических лесах в меняющиеся изображения, звук и запахи, а реакции посетителей становятся частью произведения. DATALAND делает ИИ объектом эстетического переживания.

Формат AGI Bar — это новый социальный ритуал.

Между ними находятся конференции, хакатоны, тематические кафе и коворкинги, которые постепенно становятся не временными площадками, а самостоятельным жанром городской культуры. ИИ уже не только инструмент, которым пользуются дома или в офисе. Вокруг него появляются места, куда люди специально приходят, чтобы почувствовать принадлежность к новой эпохе.

Но AGI Bar интереснее всего своей иронией.
Сун Дэ говорит, что у ИИ и алкоголя есть три общих свойства: галлюцинации, пузыри и дистилляция.


Китайское название бара означает «дистилляцию знаний» — это одновременно технологический термин и способ производства крепких напитков.

Фирменный напиток AGI за 9,9 юаня почти целиком состоит из пены. Это буквальная шутка о пузыре вокруг индустрии, которая обещает создать универсальный интеллект, но пока особенно хорошо создает ожидания. Сам бар тоже живет по законам стартапа: его склад, бронирования и клубная система автоматизированы агентами, владелец планирует роботов-официантов и новые филиалы — однако заведение пока убыточно и раздает примерно в десять раз больше напитков, чем продает.

И, наконец, главная шутка. AGI десятилетиями описывали как технологию, которая освободит человека от труда. Но первым заметным культурным пространством ее эпохи стал бар, где разработчики даже во время отдыха продолжают программировать.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3👍2