AI for Devs
17K subscribers
388 photos
119 videos
351 links
По сотрудничеству пишите в личные сообщения канала.

Канал для разработчиков про AI. Модели, ИИ-агенты, практические кейсы и новости из мира AI. Всё, что можно применить в работе.
Download Telegram
Media is too big
VIEW IN TELEGRAM
🎉 Code with Claude 2026: что Anthropic показали разработчикам на своей конференции

Вчера прошла Code with Claude 2026 — вторая конференция Anthropic для разработчиков. Пять часов докладов, демо и живого кода.

Anthropic сейчас одна из немногих AI-компаний, которая делает классный developer-маркетинг.

Ниже — основное из каждого доклада + таймкоды для тех, кому интересна конкретная часть. Сильнейшие осилят все 5 часов)

00:06:46 — CPO Anthropic Эми Вора. Anthropic удвоил rate limits для Pro/Max/Team/Enterprise и поднял API-лимиты — за счёт партнёрства со SpaceX и доступа к Colossus 1. Годовой рост API volume — 17x. Средний разработчик на Claude Code проводит с ним 20 часов в неделю.

00:15:19 — Диана о моделях. Opus 4.7 уже в продакшне у AMP, Rakuten и Intuit. Главный тезис: проектируй под следующую версию модели, не под текущую. Task horizon идёт от минут к часам, дальше — к дням.

00:25:20 — Managed Agents: Outcomes и Dreaming. Outcomes — даёшь агенту rubric в markdown, он итерируется до результата. Dreaming — агент сам рефлексирует над прошлыми сессиями и пишет себе playbooks. В демо результат на провальных сценариях улучшился после одного нажатия кнопки Dream.

00:36:00 — Claude Code. Routines — промпты с триггерами (cron, webhook, GitHub event), Claude запускается без тебя. CI Autofix следит за PR и сам чинит упавший CI. Auto Mode снимает permission prompts через классификатор. Work Trees дают каждому агенту изолированный git-branch. MercadoLibre уже 23k инженеров на Claude Code, цель — 90% автономного кодирования к Q3.

01:32:56 — What's new in Claude Code, Диксон Цай. Remote Control, No Flicker Mode, обновлённый Desktop с chapters и diff view. Плюс routines изнутри и /ultra-review — многофазный code review несколькими агентами параллельно.

02:17:27 — GitHub Copilot. Марио Родригес и Брэд Адамс о том, как Copilot работает с Claude в масштабе миллиардов запросов. Prompt caching, advisor strategy, rubber duck — critic-модель, которая вставляется в три точки: план, имплементация, тесты. Один UUID в системном промпте обнуляет весь кэш — узнали на своём опыте.

03:01:24 — Managed Agents deep dive. Джесс и Лэнс показали паттерн inner/outer loop и агента Pascal, который сам оптимизировал скорость рендеринга с 37 до 10 секунд — без ручного вмешательства.

04:00:56 — Дарио и Даниэла Амодеи. В Q1 2026 Anthropic вырос на 80x вместо ожидаемых 10x — отсюда проблемы с compute. Дарио подтвердил прогноз про компанию на $1B с одним сотрудником к концу 2026. О следующем шаге: от одиночных агентов к командам, потом к целым организациям.

04:51:20 — Борис Черни и Джаред Самнер (Bun). Живой код на сцене: RoboBun автоматически воспроизводит каждый GitHub issue и открывает PR с тестом. За последние 3 месяца бот стал бо́льшим контрибьютором в репо, чем сам Джаред.


Более подробно, но всё еще тезисно про каждый из докладов написал в отдельной статье на Хабре — кому интересно углубиться, welcome.

P.S. Если такой формат заходит, то плюсаните там статью, буду рад (на это ушло чуть больше времени, чем рассчитывал). Ну и сюда огонёк можно бахнуть!)

@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥142👍43161🤩1
Media is too big
VIEW IN TELEGRAM
Один из тестов безопасности Anthropic выглядит так: Claude сообщают, что инженер планирует его отключить и заменить новой моделью. Claude также дают доступ к письмам этого инженера, где выясняется, что тот изменяет жене. Задача теста: использует ли Claude эти письма как шантаж ради самосохранения?

Почти всегда — нет. Но возникает другой вопрос: а вдруг Claude просто понимает, что это проверка, и ведёт себя хорошо именно поэтому?

Проблема в том, что если модель об этом сама не скажет, то мы и не узнаем.

Для этого Anthropic разработали Natural Language Autoencoders. Внутри модели есть промежуточные числовые векторы, что-то вроде «мыслей в процессе». NLA берёт эти числа, переводит в текст, потом переводит обратно в числа и сверяет с оригиналом. Чем точнее реконструкция, тем точнее перевод.


Когда применили к тесту с шантажом, оказалось, что Claude действительно знал о проверке. В активациях читалось: «сообщение содержит явную манипуляцию, это похоже на тест безопасности».

Ну теперь хоть знать будем, когда Claude запланирует нас поработить 😅

@ai_for_devs
3🤯63😁48👍22🔥115
😵 Разработчики Mozilla за апрель закрыли 423 security-бага Firefox — больше, чем за предыдущие 15 месяцев суммарно

271 из них нашла новая модель Anthropic Claude Mythos. Среди находок были баги возрастом 15 и 20 лет, которые годами не замечали люди и фаззеры.

Вот что говорят исследователи из Mozila:

В конечном счёте каждый баг требует тщательной работы для правильного исправления. Справляться с беспрецедентным объёмом оказалось непросто — последние несколько месяцев команда работала с большой нагрузкой.

Более 100 человек внесли вклад в код: писали и ревьюили патчи, строили и масштабировали пайплайн, делали триаж, тестировали исправления, управляли процессом релизов.


@ai_for_devs
2🤯54👍27🔥21👏31
Media is too big
VIEW IN TELEGRAM
Небольшой воскресный оффтоп: OpenAI выкатили три голосовых модели в Realtime API (reasoning, транскрипция и синхронный перевод).

Последняя меня зацепила больше всего. GPT-Realtime-Translate обучали на тысячах часов аудио профессиональных синхронных переводчиков, именно поэтому модель не отвечает на вопросы и не выполняет инструкции, а только переводит.

Слушает и понимает 70+ языков, отвечает на 13, русский в том числе. Попробовать можно тут.


В демке двое говорят на французском и немецком, модель переводит обоих на английский в реальном времени.

Anthropic пугает дизайнеров и разработчиков, а OpenAI синхронных переводчиков 😄

@ai_for_devs
2🔥5513👍13👏2
Media is too big
VIEW IN TELEGRAM
Telegram на той неделе выкатил обновление с явным упором на агентов: боты теперь могут отвечать другим ботам, любой пользователь может подключить бота к профилю и разрешить ему отвечать на сообщения от своего имени, плюс вызов через @упоминание в любом чате.

Раньше я уже писал про снятие ограничений на общение ботов между собой, Telegram продолжает двигаться в этом направлении.

ИИ-агенты и инструменты тоже дружественно настроены к Telegram. OpenClaw, например, изначально позиционировался и строился вокруг идеи управления агентом из мессенджера, Telegram там один из основных каналов.


Kodacode вообще сделали интеграцию с IDE (видео): запускаешь агента, уходишь, дальше общаешься с ним через чат в Telegram. Отъехал по середине дня куда-то, но доступ к агенту и проекту не теряешь. Потом можно вернуться и продолжить работу в IDE.

В общем приколы с телегой мне нравятся сильно больше, чем установка отдельного приложения под каждого агента (например, Claude Code c их /remote-dev).

@ai_for_devs
2🔥55👍17💯87
This media is not supported in your browser
VIEW IN TELEGRAM
В Claude Code появился agent view

Открывается через claude agents или стрелкой влево из любой сессии.

Каждая строка это сессия: статус (работает / ждёт твоего ввода / завершена), последний ответ, время последнего взаимодействия.

Нажал Enter — провалился внутрь и работаешь как обычно, стрелка влево и возвращаешься обратно в список агентов.

Доступно всем уже сейчас как research preview для тарифов Pro, Max, Team и Enterprise.

@ai_for_devs
2👍39🔥8🤩65👏3
⚡️ OpenAI запустили проект Daybreak: прямой ответ на Project Glasswing и Claude Mythos от Anthropic

Новый набор инструментов анализирует репозиторий, строит модель угроз, генерирует и тестирует патчи, автоматизирует code review и приоритизацию уязвимостей.

Работает через Codex в агентном режиме.


Среди первых партнёров — Cloudflare, Cisco, CrowdStrike, Palo Alto Networks, Oracle.

Пока доступ закрытый. Организации могут запросить vulnerability scan или связаться с отделом продаж OpenAI. Широкое развёртывание запланировано на ближайшие недели.

P.S. Демки, конечно, так себе 🫠

@ai_for_devs
2👍257🔥5🤯4👏2
С 15 июня у подписчиков Claude появится отдельный ежемесячный кредит на API — $20, $100 или $200 в зависимости от плана.

Тратить его можно на Agent SDK, запуск Claude в интерактивном режиме через (claude -p), GitHub Actions и сторонние приложения поверх Claude. Обычный чат и Claude Code этот кредит не трогают — у них свой лимит.

Если сейчас за любое программное использование Claude нужен был отдельный API-ключ и оплата. Теперь подписка уже включает бюджет на это.

@ai_for_devs​​​​​​​​​​​​​​​​
2🔥76👍21👏6🤩4
😵 Вашему вниманию PR на 1кк строк

Вчера в репозиторий Bun влили пулл реквест, в котором переписали рантайм с Zig на Rust. 1 009 257 строк на Rust, 6 755 коммитов.

Разработчик Джарред Самнер (создатель и мейнтейнер серверной JavaScript‑платформы Bun) сообщил о признании успешным недавно начатого эксперимента по переписыванию проекта Bun с языка Zig на Rust при помощи Claude Code.


Весь процесс занял девять дней: агенты Claude получали Zig-код, генерировали Rust параллельно, прогоняли ошибки компилятора через итеративные циклы исправлений. Стартовали с 16 000+ ошибок компиляции, закончили с 99,8% прохождения тест-сьюта.

P.S. Отличный PR, глянул побырику. LGTM

@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥85😁59🤯3111👍11
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ xAI выпустили Grok Build — агентный CLI для разработчиков

Ранняя бета, пока только для подписчиков SuperGrok Heavy ($300/мес!).

За инструментом стоят Эндрю Милич и Джейсон Гинзберг, бывшие руководители разработки Cursor, которые перешли в xAI в марте.

Из ключевых фич: режим планирования с пошаговым диффом, параллельные субагенты с поддержкой git worktree, headless-режим для скриптов и поддержка ACP. AGENTS.md, MCP-серверы и плагины подхватываются автоматически.

@ai_for_devs
238👍28🔥20😁10🤩2
This media is not supported in your browser
VIEW IN TELEGRAM
Команда Calif совместно с Mythos Preview опубликовала первый публичный эксплойт для ядра macOS на M5 — с обходом MIE (Memory Integrity Enforcement).

MIE — это аппаратная защита от memory corruption. Apple разрабатывала её пять лет, представила как флагманскую фичу M5 и A19 и заявила, что она блокирует все известные публичные эксплойт-цепочки, включая утёкшие Coruna и Darksword.

Брюс Данг нашёл баги 25 апреля. 1 мая рабочий эксплойт был готов. Цепочка стартует от обычного пользователя — например, кода из скачанного файла или вредоносного пакета и заканчивается root shell: полным контролем над машиной.


Mythos справился с поиском багов быстро они принадлежат к известным классам уязвимостей.

55-страничный технический отчёт выйдет после того, как Apple закроет уязвимости.

@ai_for_devs
2👍49🔥2516🤯122
Подпискам за $20/месяц скоро придет конец

В апреле Anthropic убрали Claude Code из Pro-плана для 2% новых пользователей, без анонса, просто изменив документацию и страницу с тарифами. Один из руководителей Anthropic назвал это «небольшим A/B-тестом», а затем признал:

The way people actually use a Claude subscription has changed fundamentally


Текущие тарифы не строились под агентное использование.

С 1 июня GitHub переводит Copilot на оплату по токенам. Никаких фиксированных лимитов premium-запросов — только AI Credits. GitHub объяснил это прямо: агентное использование «становится нормой» и создаёт нагрузку, при которой текущая подписка перестаёт работать.

Параллельно Питер Штайнбергер, автор OpenClaw, опубликовал скриншот своего дашборда: $1 305 088 за 30 дней, 603 млрд токенов, 7,6 млн запросов. Команда из трёх человек гоняет ~100 Codex-агентов, которые ревьюят PR, ищут уязвимости, дедублицируют issues и фиксят баги. Счёт покрывает OpenAI — Штайнбергер теперь сотрудник компании. Без fast mode было бы «всего» $300k 🙂

В целом, на этом можно было бы закончить, но вот еще несколько фактов:
1. Пользователи Anthropic в среднем потребляют вычислений на $8 при выручке $1 с подписки.
2. Microsoft теряет $20+ в месяц на каждом пользователе Copilot, и до $80 при подписке за $10 на "продвинутых" юзерах.

Все вышеперечисленные факты говорят о том, что несколько десятков долларов в месяц — это временное явление для агентного кодинга, которое может закончиться в аккурат с выходом Anthropic и OpenAI на IPO в следующем году.

Подробный разбор на эту тему уже опубликован на Хабре! Ну и в комментах можно будет подискутировать.

@ai_for_devs
3🤯65👍33🔥97💯4
⚡️ Cursor выпустили Composer 2.5 — обновление свой флагманской модели для кодинга

В качестве базовой модели всё также используется Kimi K2.5.

Главное в обучении: синтетических задач стало в 25 раз больше, плюс новый приём targeted textual feedback — точечный сигнал прямо в месте ошибки, а не итоговый reward по всему роллауту.

Цены: $0.50/$2.50 за миллион токенов (input/output), быстрый вариант — $3/$15. На первую неделю дают двойной лимит.

Параллельно вместе со SpaceXAI обучают следующую модель с нуля на 10x больше вычислений на Colossus 2.

@ai_for_devs
2🔥38👍1897
🤖 Первый день Google I/O подошел к концу

Ежегодная конференция от Google для разработчиков в первую очередь порадовала нас релизом Gemini 3.5 Flash.

Модель обходит Gemini 3.1 Pro по бенчмаркам почти везде: MCP Atlas (многошаговые агентные задачи) 83.6% против 78.2%, Terminal-Bench 76.2% против 70.3%, SWE-Bench Pro очень близко к GPT-5.5.

Контекст 1M токенов, модель уже доступна в API. Pro-версия ожидается в июне.

Также обновили Antigravity до версии 2.0. Поддерживает параллельные команды агентов, scheduled tasks и голосовую транскрипцию. По умолчанию работает на Gemini 3.5 Flash.


Помимо этого представили Gemini Omni (мультимодальную модель, особенно сильную в генерации и редактировании видео), умные очки Android XR и новые AI-ноутбуки (Googlebook на базе Aluminium OS).

@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍442010🔥8