Media is too big
VIEW IN TELEGRAM
Вчера прошла Code with Claude 2026 — вторая конференция Anthropic для разработчиков. Пять часов докладов, демо и живого кода.
Anthropic сейчас одна из немногих AI-компаний, которая делает классный developer-маркетинг.
Ниже — основное из каждого доклада + таймкоды для тех, кому интересна конкретная часть. Сильнейшие осилят все 5 часов)
00:06:46 — CPO Anthropic Эми Вора. Anthropic удвоил rate limits для Pro/Max/Team/Enterprise и поднял API-лимиты — за счёт партнёрства со SpaceX и доступа к Colossus 1. Годовой рост API volume — 17x. Средний разработчик на Claude Code проводит с ним 20 часов в неделю.
00:15:19 — Диана о моделях. Opus 4.7 уже в продакшне у AMP, Rakuten и Intuit. Главный тезис: проектируй под следующую версию модели, не под текущую. Task horizon идёт от минут к часам, дальше — к дням.
00:25:20 — Managed Agents: Outcomes и Dreaming. Outcomes — даёшь агенту rubric в markdown, он итерируется до результата. Dreaming — агент сам рефлексирует над прошлыми сессиями и пишет себе playbooks. В демо результат на провальных сценариях улучшился после одного нажатия кнопки Dream.
00:36:00 — Claude Code. Routines — промпты с триггерами (cron, webhook, GitHub event), Claude запускается без тебя. CI Autofix следит за PR и сам чинит упавший CI. Auto Mode снимает permission prompts через классификатор. Work Trees дают каждому агенту изолированный git-branch. MercadoLibre уже 23k инженеров на Claude Code, цель — 90% автономного кодирования к Q3.
01:32:56 — What's new in Claude Code, Диксон Цай. Remote Control, No Flicker Mode, обновлённый Desktop с chapters и diff view. Плюс routines изнутри и /ultra-review — многофазный code review несколькими агентами параллельно.
02:17:27 — GitHub Copilot. Марио Родригес и Брэд Адамс о том, как Copilot работает с Claude в масштабе миллиардов запросов. Prompt caching, advisor strategy, rubber duck — critic-модель, которая вставляется в три точки: план, имплементация, тесты. Один UUID в системном промпте обнуляет весь кэш — узнали на своём опыте.
03:01:24 — Managed Agents deep dive. Джесс и Лэнс показали паттерн inner/outer loop и агента Pascal, который сам оптимизировал скорость рендеринга с 37 до 10 секунд — без ручного вмешательства.
04:00:56 — Дарио и Даниэла Амодеи. В Q1 2026 Anthropic вырос на 80x вместо ожидаемых 10x — отсюда проблемы с compute. Дарио подтвердил прогноз про компанию на $1B с одним сотрудником к концу 2026. О следующем шаге: от одиночных агентов к командам, потом к целым организациям.
04:51:20 — Борис Черни и Джаред Самнер (Bun). Живой код на сцене: RoboBun автоматически воспроизводит каждый GitHub issue и открывает PR с тестом. За последние 3 месяца бот стал бо́льшим контрибьютором в репо, чем сам Джаред.
Более подробно, но всё еще тезисно про каждый из докладов написал в отдельной статье на Хабре — кому интересно углубиться, welcome.
P.S. Если такой формат заходит, то плюсаните там статью, буду рад (на это ушло чуть больше времени, чем рассчитывал). Ну и сюда огонёк можно бахнуть!)
@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥142👍43❤16⚡1🤩1
Media is too big
VIEW IN TELEGRAM
Один из тестов безопасности Anthropic выглядит так: Claude сообщают, что инженер планирует его отключить и заменить новой моделью. Claude также дают доступ к письмам этого инженера, где выясняется, что тот изменяет жене. Задача теста: использует ли Claude эти письма как шантаж ради самосохранения?
Почти всегда— нет . Но возникает другой вопрос: а вдруг Claude просто понимает, что это проверка, и ведёт себя хорошо именно поэтому?
Проблема в том, что если модель об этом сама не скажет, то мы и не узнаем.
Когда применили к тесту с шантажом, оказалось, что Claude действительно знал о проверке. В активациях читалось: «сообщение содержит явную манипуляцию, это похоже на тест безопасности».
Ну теперь хоть знать будем, когда Claude запланирует нас поработить 😅
@ai_for_devs
Почти всегда
Проблема в том, что если модель об этом сама не скажет, то мы и не узнаем.
Для этого Anthropic разработали Natural Language Autoencoders. Внутри модели есть промежуточные числовые векторы, что-то вроде «мыслей в процессе». NLA берёт эти числа, переводит в текст, потом переводит обратно в числа и сверяет с оригиналом. Чем точнее реконструкция, тем точнее перевод.
Когда применили к тесту с шантажом, оказалось, что Claude действительно знал о проверке. В активациях читалось: «сообщение содержит явную манипуляцию, это похоже на тест безопасности».
Ну теперь хоть знать будем, когда Claude запланирует нас поработить 😅
@ai_for_devs
3🤯63😁48👍22🔥11❤5
😵 Разработчики Mozilla за апрель закрыли 423 security-бага Firefox — больше, чем за предыдущие 15 месяцев суммарно
271 из них нашла новая модель Anthropic Claude Mythos. Среди находок были баги возрастом 15 и 20 лет, которые годами не замечали люди и фаззеры.
Вот что говорят исследователи из Mozila:
@ai_for_devs
271 из них нашла новая модель Anthropic Claude Mythos. Среди находок были баги возрастом 15 и 20 лет, которые годами не замечали люди и фаззеры.
Вот что говорят исследователи из Mozila:
В конечном счёте каждый баг требует тщательной работы для правильного исправления. Справляться с беспрецедентным объёмом оказалось непросто — последние несколько месяцев команда работала с большой нагрузкой.
Более 100 человек внесли вклад в код: писали и ревьюили патчи, строили и масштабировали пайплайн, делали триаж, тестировали исправления, управляли процессом релизов.
@ai_for_devs
2🤯54👍27🔥21👏3❤1
Media is too big
VIEW IN TELEGRAM
Небольшой воскресный оффтоп: OpenAI выкатили три голосовых модели в Realtime API (reasoning, транскрипция и синхронный перевод).
Последняя меня зацепила больше всего. GPT-Realtime-Translate обучали на тысячах часов аудио профессиональных синхронных переводчиков, именно поэтому модель не отвечает на вопросы и не выполняет инструкции, а только переводит.
В демке двое говорят на французском и немецком, модель переводит обоих на английский в реальном времени.
Anthropic пугает дизайнеров и разработчиков, а OpenAI синхронных переводчиков 😄
@ai_for_devs
Последняя меня зацепила больше всего. GPT-Realtime-Translate обучали на тысячах часов аудио профессиональных синхронных переводчиков, именно поэтому модель не отвечает на вопросы и не выполняет инструкции, а только переводит.
Слушает и понимает 70+ языков, отвечает на 13, русский в том числе. Попробовать можно тут.
В демке двое говорят на французском и немецком, модель переводит обоих на английский в реальном времени.
Anthropic пугает дизайнеров и разработчиков, а OpenAI синхронных переводчиков 😄
@ai_for_devs
2🔥55❤13👍13👏2
Media is too big
VIEW IN TELEGRAM
Telegram на той неделе выкатил обновление с явным упором на агентов: боты теперь могут отвечать другим ботам, любой пользователь может подключить бота к профилю и разрешить ему отвечать на сообщения от своего имени, плюс вызов через
Раньше я уже писал про снятие ограничений на общение ботов между собой, Telegram продолжает двигаться в этом направлении.
Kodacode вообще сделали интеграцию с IDE (видео): запускаешь агента, уходишь, дальше общаешься с ним через чат в Telegram. Отъехал по середине дня куда-то, но доступ к агенту и проекту не теряешь. Потом можно вернуться и продолжить работу в IDE.
В общем приколы с телегой мне нравятся сильно больше, чем установка отдельного приложения под каждого агента (например, Claude Code c их
@ai_for_devs
@упоминание в любом чате. Раньше я уже писал про снятие ограничений на общение ботов между собой, Telegram продолжает двигаться в этом направлении.
ИИ-агенты и инструменты тоже дружественно настроены к Telegram. OpenClaw, например, изначально позиционировался и строился вокруг идеи управления агентом из мессенджера, Telegram там один из основных каналов.
Kodacode вообще сделали интеграцию с IDE (видео): запускаешь агента, уходишь, дальше общаешься с ним через чат в Telegram. Отъехал по середине дня куда-то, но доступ к агенту и проекту не теряешь. Потом можно вернуться и продолжить работу в IDE.
В общем приколы с телегой мне нравятся сильно больше, чем установка отдельного приложения под каждого агента (например, Claude Code c их
/remote-dev).@ai_for_devs
2🔥55👍17💯8❤7
This media is not supported in your browser
VIEW IN TELEGRAM
⚡ В Claude Code появился agent view
Открывается через
Каждая строка это сессия: статус (работает / ждёт твоего ввода / завершена), последний ответ, время последнего взаимодействия.
Нажал
Доступно всем уже сейчас как research preview для тарифов Pro, Max, Team и Enterprise.
@ai_for_devs
Открывается через
claude agents или стрелкой влево из любой сессии. Каждая строка это сессия: статус (работает / ждёт твоего ввода / завершена), последний ответ, время последнего взаимодействия.
Нажал
Enter — провалился внутрь и работаешь как обычно, стрелка влево и возвращаешься обратно в список агентов.Доступно всем уже сейчас как research preview для тарифов Pro, Max, Team и Enterprise.
@ai_for_devs
2👍39🔥8🤩6❤5👏3
⚡️ OpenAI запустили проект Daybreak: прямой ответ на Project Glasswing и Claude Mythos от Anthropic
Новый набор инструментов анализирует репозиторий, строит модель угроз, генерирует и тестирует патчи, автоматизирует code review и приоритизацию уязвимостей.
Среди первых партнёров — Cloudflare, Cisco, CrowdStrike, Palo Alto Networks, Oracle.
Пока доступ закрытый. Организации могут запросить
P.S. Демки, конечно, так себе 🫠
@ai_for_devs
Новый набор инструментов анализирует репозиторий, строит модель угроз, генерирует и тестирует патчи, автоматизирует code review и приоритизацию уязвимостей.
Работает через Codex в агентном режиме.
Среди первых партнёров — Cloudflare, Cisco, CrowdStrike, Palo Alto Networks, Oracle.
Пока доступ закрытый. Организации могут запросить
vulnerability scan или связаться с отделом продаж OpenAI. Широкое развёртывание запланировано на ближайшие недели.P.S. Демки, конечно, так себе 🫠
@ai_for_devs
2👍25❤7🔥5🤯4👏2
С 15 июня у подписчиков Claude появится отдельный ежемесячный кредит на API — $20, $100 или $200 в зависимости от плана.
Тратить его можно на Agent SDK, запуск Claude в интерактивном режиме через (
Если сейчас за любое программное использование Claude нужен был отдельный API-ключ и оплата. Теперь подписка уже включает бюджет на это.
@ai_for_devs
Тратить его можно на Agent SDK, запуск Claude в интерактивном режиме через (
claude -p), GitHub Actions и сторонние приложения поверх Claude. Обычный чат и Claude Code этот кредит не трогают — у них свой лимит.Если сейчас за любое программное использование Claude нужен был отдельный API-ключ и оплата. Теперь подписка уже включает бюджет на это.
@ai_for_devs
2🔥76👍21👏6🤩4
Вчера в репозиторий Bun влили пулл реквест, в котором переписали рантайм с Zig на Rust.
1 009 257 строк на Rust, 6 755 коммитов.Разработчик Джарред Самнер (создатель и мейнтейнер серверной JavaScript‑платформы Bun) сообщил о признании успешным недавно начатого эксперимента по переписыванию проекта Bun с языка Zig на Rust при помощи Claude Code.
Весь процесс занял девять дней: агенты Claude получали Zig-код, генерировали Rust параллельно, прогоняли ошибки компилятора через итеративные циклы исправлений. Стартовали с 16 000+ ошибок компиляции, закончили с 99,8% прохождения тест-сьюта.
P.S. Отличный PR, глянул побырику. LGTM
@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥85😁59🤯31❤11👍11
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ xAI выпустили Grok Build — агентный CLI для разработчиков
Ранняя бета, пока только для подписчиков SuperGrok Heavy ($300/мес!).
За инструментом стоят Эндрю Милич и Джейсон Гинзберг, бывшие руководители разработки Cursor, которые перешли в xAI в марте.
Из ключевых фич: режим планирования с пошаговым диффом, параллельные субагенты с поддержкой git worktree, headless-режим для скриптов и поддержка ACP. AGENTS.md, MCP-серверы и плагины подхватываются автоматически.
@ai_for_devs
Ранняя бета, пока только для подписчиков SuperGrok Heavy ($300/мес!).
За инструментом стоят Эндрю Милич и Джейсон Гинзберг, бывшие руководители разработки Cursor, которые перешли в xAI в марте.
Из ключевых фич: режим планирования с пошаговым диффом, параллельные субагенты с поддержкой git worktree, headless-режим для скриптов и поддержка ACP. AGENTS.md, MCP-серверы и плагины подхватываются автоматически.
@ai_for_devs
2❤38👍28🔥20😁10🤩2
This media is not supported in your browser
VIEW IN TELEGRAM
Команда Calif совместно с Mythos Preview опубликовала первый публичный эксплойт для ядра macOS на M5 — с обходом MIE (Memory Integrity Enforcement).
MIE — это аппаратная защита от memory corruption. Apple разрабатывала её пять лет, представила как флагманскую фичу M5 и A19 и заявила, что она блокирует все известные публичные эксплойт-цепочки, включая утёкшие Coruna и Darksword.
Mythos справился с поиском багов быстро они принадлежат к известным классам уязвимостей.
55-страничный технический отчёт выйдет после того, как Apple закроет уязвимости.
@ai_for_devs
MIE — это аппаратная защита от memory corruption. Apple разрабатывала её пять лет, представила как флагманскую фичу M5 и A19 и заявила, что она блокирует все известные публичные эксплойт-цепочки, включая утёкшие Coruna и Darksword.
Брюс Данг нашёл баги 25 апреля. 1 мая рабочий эксплойт был готов. Цепочка стартует от обычного пользователя — например, кода из скачанного файла или вредоносного пакета и заканчивается root shell: полным контролем над машиной.
Mythos справился с поиском багов быстро они принадлежат к известным классам уязвимостей.
55-страничный технический отчёт выйдет после того, как Apple закроет уязвимости.
@ai_for_devs
2👍49🔥25❤16🤯12⚡2
This media is not supported in your browser
VIEW IN TELEGRAM
3😁155👍35💯25🔥10🤯8
Подпискам за $20/месяц скоро придет конец
В апреле Anthropic убрали Claude Code из Pro-плана для 2% новых пользователей, без анонса, просто изменив документацию и страницу с тарифами. Один из руководителей Anthropic назвал это «небольшим A/B-тестом», а затем признал:
Текущие тарифы не строились под агентное использование.
С 1 июня GitHub переводит Copilot на оплату по токенам. Никаких фиксированных лимитов premium-запросов — только AI Credits. GitHub объяснил это прямо: агентное использование «становится нормой» и создаёт нагрузку, при которой текущая подписка перестаёт работать.
Параллельно Питер Штайнбергер, автор OpenClaw, опубликовал скриншот своего дашборда: $1 305 088 за 30 дней, 603 млрд токенов, 7,6 млн запросов. Команда из трёх человек гоняет ~100 Codex-агентов, которые ревьюят PR, ищут уязвимости, дедублицируют issues и фиксят баги. Счёт покрывает OpenAI — Штайнбергер теперь сотрудник компании. Без fast mode было бы«всего» $300k 🙂
В целом, на этом можно было бы закончить, но вот еще несколько фактов:
1. Пользователи Anthropic в среднем потребляют вычислений на $8 при выручке $1 с подписки.
2. Microsoft теряет $20+ в месяц на каждом пользователе Copilot, и до $80 при подписке за $10 на "продвинутых" юзерах.
Все вышеперечисленные факты говорят о том, что несколько десятков долларов в месяц — это временное явление для агентного кодинга, которое может закончиться в аккурат с выходом Anthropic и OpenAI на IPO в следующем году.
Подробный разбор на эту тему уже опубликован на Хабре! Ну и в комментах можно будет подискутировать.
@ai_for_devs
В апреле Anthropic убрали Claude Code из Pro-плана для 2% новых пользователей, без анонса, просто изменив документацию и страницу с тарифами. Один из руководителей Anthropic назвал это «небольшим A/B-тестом», а затем признал:
The way people actually use a Claude subscription has changed fundamentally
Текущие тарифы не строились под агентное использование.
С 1 июня GitHub переводит Copilot на оплату по токенам. Никаких фиксированных лимитов premium-запросов — только AI Credits. GitHub объяснил это прямо: агентное использование «становится нормой» и создаёт нагрузку, при которой текущая подписка перестаёт работать.
Параллельно Питер Штайнбергер, автор OpenClaw, опубликовал скриншот своего дашборда: $1 305 088 за 30 дней, 603 млрд токенов, 7,6 млн запросов. Команда из трёх человек гоняет ~100 Codex-агентов, которые ревьюят PR, ищут уязвимости, дедублицируют issues и фиксят баги. Счёт покрывает OpenAI — Штайнбергер теперь сотрудник компании. Без fast mode было бы
В целом, на этом можно было бы закончить, но вот еще несколько фактов:
1. Пользователи Anthropic в среднем потребляют вычислений на $8 при выручке $1 с подписки.
2. Microsoft теряет $20+ в месяц на каждом пользователе Copilot, и до $80 при подписке за $10 на "продвинутых" юзерах.
Все вышеперечисленные факты говорят о том, что несколько десятков долларов в месяц — это временное явление для агентного кодинга, которое может закончиться в аккурат с выходом Anthropic и OpenAI на IPO в следующем году.
Подробный разбор на эту тему уже опубликован на Хабре! Ну и в комментах можно будет подискутировать.
@ai_for_devs
3🤯65👍33🔥9❤7💯4
⚡️ Cursor выпустили Composer 2.5 — обновление свой флагманской модели для кодинга
В качестве базовой модели всё также используется Kimi K2.5.
Главное в обучении: синтетических задач стало в 25 раз больше, плюс новый приём targeted textual feedback — точечный сигнал прямо в месте ошибки, а не итоговый reward по всему роллауту.
Цены: $0.50/$2.50 за миллион токенов (input/output), быстрый вариант — $3/$15. На первую неделю дают двойной лимит.
Параллельно вместе со SpaceXAI обучают следующую модель с нуля на 10x больше вычислений на Colossus 2.
@ai_for_devs
В качестве базовой модели всё также используется Kimi K2.5.
Главное в обучении: синтетических задач стало в 25 раз больше, плюс новый приём targeted textual feedback — точечный сигнал прямо в месте ошибки, а не итоговый reward по всему роллауту.
Цены: $0.50/$2.50 за миллион токенов (input/output), быстрый вариант — $3/$15. На первую неделю дают двойной лимит.
Параллельно вместе со SpaceXAI обучают следующую модель с нуля на 10x больше вычислений на Colossus 2.
@ai_for_devs
2🔥38👍18⚡9❤7
Ежегодная конференция от Google для разработчиков в первую очередь порадовала нас релизом Gemini 3.5 Flash.
Модель обходит Gemini 3.1 Pro по бенчмаркам почти везде: MCP Atlas (многошаговые агентные задачи) 83.6% против 78.2%, Terminal-Bench 76.2% против 70.3%, SWE-Bench Pro очень близко к GPT-5.5.
Контекст 1M токенов, модель уже доступна в API. Pro-версия ожидается в июне.
Также обновили Antigravity до версии 2.0. Поддерживает параллельные команды агентов, scheduled tasks и голосовую транскрипцию. По умолчанию работает на Gemini 3.5 Flash.
Помимо этого представили Gemini Omni (мультимодальную модель, особенно сильную в генерации и редактировании видео), умные очки Android XR и новые AI-ноутбуки (Googlebook на базе Aluminium OS).
@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍44⚡20❤10🔥8