Claude AI Dev Broadcast
2.17K subscribers
130 photos
10 videos
112 links
Всё про разработку с использованием AI технологий

Наш канал про Android - @android_broadcast
Видео как работать с AI - abdev.by/broadcast_ai_plus
Download Telegram
🧠 Держите бесплатный курс по Claude Code. Включает 14 модулей.

#AI #ClaudeCode #ИИ
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21👎8
🧠 Вышла модель Claude Opus 4.8, который во всем лучше Claude Opus 4.7 и остается по тем же ценам что был раньше. Уже доступен по подписке

#AI #ClaudeCode
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8👎6
🧠 Динамические воркфлоу — это новая возможность Claude Code, которая позволяет ИИ автономно управлять самыми сложными задачами от начала и до конца. То, что раньше планировалось на кварталы, теперь выполняется за дни. Claude динамически пишет оркестрационные скрипты, которые в рамках одной сессии запускают от десятков до сотен параллельных саб-агентов и проверяют результат до того, как он попадет к вам.

#AI #ClaudeCode #ИИ
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10👎5
🤯 Гипотеза агента заблокировала поиск реального ответа и стоила миллионов токенов

Пишу приложение для записи экрана и внешней камеры на macOS. Нужна поддержка 4K через AVFoundation. Камера анонсирует формат 420v 3840×2160@30fps.

Opus 4.8 с extended thinking посчитал bandwidth "в уме", получил 3.7 Gbps (видно ограничение камеры), решил что не влезает в кабель и выдал "невозможно". Без единого практического теста. Просто гипотеза, оформленная как факт.

Дальше агент десятки раундов защищал этот вывод. Я запускал отдельный research-агент и он тоже ходил по кругу, потому что искал подтверждение невозможного, а не причину.

Новая сессия. Подключил документацию, заставил проверять практически. И только тогда нашлась реальная причина: AVFoundation всегда скидывает разрешение внешней камеры до Full HD. Это ограничение фреймворка, не железа. Вывод "невозможно" оказался верным, но агент пришёл к нему только через практику, не через расчёт в уме.

Если бы первый агент не застрял на непроверенной гипотезе и сразу пошёл тестировать и реальная причина нашлась бы за один прогон.

По итогу зашил правило в инструкции проекта: любое "невозможно" требует практического подтверждения. Эмпирика - это гипотеза для проверки, не аргумент для остановки.

Какая бы модель ни стояла под капотом — без этого правила агент будет уверенно защищать собственные предположения вместо поиска ответа. Со стороны пользователя требуется постоянная настройка и улучшение настроек в проекте и глобально.

#AIdev #ClaudeCode #Opus #macOS
👍33👎6
🪙 Хотел уйти с Claude Code, а Claude Design затянул ещё глубже

Девятый выпуск ИИ-дневника. Садился записывать про то, как слезаю с Claude Code на что-то другое: открытые модели, китайцев, локальный запуск. За неделю экспериментов вышло наоборот: подсел на подписку ещё сильнее, и виноват в этом Claude Design.

Внутри разбираю честно: почему меня не убеждают «у меня на нём лучше выходит» и «он дешевле» и какая метрика тут вообще единственная осмысленная. Чем реально держит Claude Design (под него я снёс Figma) и чем он отличается от того же Claude Code на тех же моделях под капотом. И зачем при всём этом я продолжаю смотреть на MiniMax M3, DeepSeek V4 и своё железо.

⚠️ Отдельно про то, что пугает: vendor lock-in и сценарий, где внешние модели в какой-то момент просто перекрывают сверху.

🪙 Весь выпуск смотреть на Boosty

Все выпуски дневника тут

#AI #ClaudeCode #ClaudeDesign
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8👎6
🐱 Плагин, который учит агента спрашивать "а нафига?"

Агент пишет код, не задав базового вопроса: а нужно ли его вообще писать?

Ponytail
это исправляет через лестницу:
нужно ли вообще (YAGNI)
→ есть в stdlib
→ нативная фича платформы
→ есть в зависимостях
→ одна строка
→ только потом пишем минимум.

Классический пример: просишь date picker. Агент ставит flatpickr, пишет wrapper-компонент, добавляет стили, начинает дискуссию о таймзонах. С Ponytail:

<input type="date">

Бенчмарк показывает 80-94% меньше кода и 47-77% дешевле. Задачи в тесте простые (debounce, email validator), цифры идеализированные. Принцип, впрочем, правильный.

Для Claude Code:

/plugin marketplace add DietrichGebert/ponytail
/plugin install ponytail@ponytail


Ещё есть /ponytail-review: ревьюит текущий diff и возвращает список лишнего на удаление. Вот его хочу потрогать в первую очередь.

13.6k звёзд, поддерживает 13 агентов.

#ClaudeCode #AIAgents #YAGNI
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍26👎3
🤯 GLM-5.2: первый open-source coding агент выше 80% на Terminal-Bench

Z.ai (Zhipu AI) выпустила полный релиз GLM-5.2 — weights под MIT на HuggingFace, API и бенчмарки. 753B MoE, 40B активных параметров, 1M контекст.

Надёжные внешние числа:
👉 SWE-bench Pro 62.1 против 58.6 у GPT-5.5 и 69.2 у Opus 4.8
👉 Terminal-Bench 2.1: 81.0, первый open-source выше 80% — Cline IDE подтвердили независимо

По вендорским бенчмаркам (Z.ai) — вплотную к Opus 4.8 на FrontierSWE (74.4 vs 75.1) и MCP-Atlas (77.0 vs 77.8), выше GPT-5.5 на обоих.

Ценовой аргумент простой: $4.40/M output против $25 у Opus 4.8. API совместим с Anthropic — в Claude Code меняется через ~/.claude/settings.json:

"CLAUDE_CODE_AUTO_COMPACT_WINDOW": "1000000",
"ANTHROPIC_DEFAULT_SONNET_MODEL": "glm-5.2[1m]",
"ANTHROPIC_DEFAULT_OPUS_MODEL": "glm-5.2[1m]"


/effort max, GLM Coding Plan стоит от $12.60/мес.

Буду тестировать на реальных задачах. Выложу на Boosty — 1M контекст при такой цене интересен для длинных агентных сессий.

🔗 Бенчмарки тут

#AI #OpenSource #ClaudeCode
2👍15👎3
🧠 Claude Design и Claude Code наконец связали в обе стороны

Anthropic выкатил большое обновление Claude Design, и зацепило меня там ровно одно: дизайн и код теперь связаны одним флоу, без скриншотов и пересборки. Доступно на всех платных тарифах.

В Claude Code завезли команду /design-sync: она подтягивает твою дизайн-систему (GitHub-репо, файлы или локальный кодбейз) в Claude Design, и Claude рисует уже на твоих настоящих компонентах, сверяясь с системой ещё до того, как покажет результат. Закончил дизайн, отдаёшь его обратно в Claude Code, и тот подхватывает ровно с того места, где ты остановился, а не разгадывает интерфейс по картинке.

Можно и наоборот: /design прямо в терминале заводит, правит и синхронит дизайн-проект, консоль покидать не надо.

🥲 Из неприятного - Claude Design теперь ест из общего лимита с чатом, Cowork и Claude Code, отдельной квоты больше нет.

Зачем нужна теперь Figma?

Кто смотрит мой дневник ИИ кодера на Boosty, знает, что я этого ждал. Хотелось, чтобы всё держалось в одной цепочке: достал данные из Claude Code, прогнал доработку, получил дизайн, и нигде по пути не пришлось руками перекидывать скриншоты и собирать PR. А веб-канвас пусть остаётся витриной: туда удобно заглянуть тем, кто в терминале не сидит, показать результат заказчику, потыкать интерактив, оценить глазами. По сути вся работа живёт в терминале, а канвас нужен, чтобы на неё посмотреть. Вот этой развилки мне и не хватало.

‼️ Это бета, раскатывают постепенно (часть апдейтов «сегодня»), у Enterprise по умолчанию выключено. Так что обещанную бесшовность передачи на серьёзных проектах пока никто не обкатал, включая меня, это обещание дня релиза. Но движется туда, куда надо.

#ClaudeCode #ClaudeDesign #AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10👎8
🧠 Релизнули Claude Sonnet 5: впервые Sonnet реально дышит в спину Opus

Sonnet 5 уже дефолтная модель в Free и Pro, доступна в Max, Team, Enterprise, в Claude Code и через API под именем claude-sonnet-5.

По бенчмаркам (BrowseComp, OSWorld-Verified) Sonnet 5 вплотную подходит к Opus 4.8. Цифры вендора, но разрыв между Sonnet и Opus раньше был намного больше. Скорость и реальная глубина на живых задачах — проверю сам, собираюсь пересесть на неё как на основную в ближайшие дни.

Контекст — 1M токенов. Sonnet 4.6 работал на 200k. Это уже другой класс задач.

Цена. Вводная $2 / $10 за Mtok (вход/выход) до 31 августа, дальше $3 / $15.

Токенайзер. Поменяли (как с Opus 4.7): тот же текст кодируется в 1.0–1.35x больше токенов. Вводная цена это компенсирует, но только до конца августа. Плюс — effort по умолчанию стоит на high, бюджет при переходе стоит пересчитать.

Extended thinking — нет. Только adaptive thinking. Если завязан на extended thinking, Sonnet 5 его не даст.

Буду садиться и пробовать её как основную, потому что пора думать о снижении расходов с аналогичным уровнем качества ответов. Как думаете что выйдет?

🔗 Анонс
🔗 Доки

#AI #ClaudeCode #Anthropic
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14👎7
Если провести сравнение Sonnet 5 и Opus 4.7 то разница становится меньше, а Opus 4.7 позволяла мне достигать результатов

#AI #ClaudeCode #Anthropic
👎12👍5
🧠 1/3 Что Claude Code имеет в виду под циклом (loop) и почему это не то же самое, что промптинг

В комьюнити гуляет тезис «дизайнь луп вместо промпта», но что такое луп — трактуют кто во что горазд. Выпустили гайд от команды Claude Code по 4 типам loop:

Turn-based — базовый агентный цикл. Пишешь промпт, Claude читает контекст, редактирует, гоняет тесты, отчитывается, ты проверяешь руками. Улучшить можно, зашив ручную верификацию в SKILL.md, чтобы Claude сам проверял результат (открыл браузер, кликнул, посмотрел консоль), а не просто отчитался «готово».

Goal-based (`/goal`) — когда одного захода мало. Задаёшь достигаемый и измеримый критерий готовности, и отдельный агент evaluator гоняет Claude по кругу, пока критерий не выполнен или не достигнут лимит по кол-ву попыток:

/goal get the homepage Lighthouse score to 90 or above, stop after 5 tries.


Работает лучше всего с детерминированными метриками: число прошедших тестов, конкретный порог, кол-во минорных багов и др..

#ClaudeCode #AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11👎5
🧠 2/3 Time-based: /loop и /schedule

Если часть работы завязана не на запрос, а на внешнюю систему или периодичность, например PR-ы ждут ревью или сделать rebase чтобы влится, появляются креши в Crashlytics и другие, тогда можно пробовать периодические запуски.

/loop перезапускает промпт с заданным интервалом, пока работает у тебя на машине:

/loop 5m check my PR, address review comments, and fix failing CI


Чтобы вынести это в облако и не держать сессию живой, есть /schedule — уже отдельная Claude routine в облаке Anthropic, а не процесс на твоём компе.

⚠️ Момент, который стоит держать в голове: `/schedule` и связанные с ним dynamic workflows пока в статусе research preview и не доступна всем. Подавать как «уже можно поставить на прод и забыть» рано.


#ClaudeCode #AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👎6👍5
🧠 3/3 Proactive loops — когда человека в контуре нет вообще

Самая интересный для меня вариант loop, потому что не нужно вообще участия, а только запуск и приемка результата.

Событие или расписание триггерит работу, /goal описывает, что считать сделанным, dynamic workflows раскидывают агентов по подзадачам (триаж, фикс, ревью), auto mode не спрашивает разрешения на каждый шаг.

Пример из документации — почасовой разбор бэклога багов с ревью фикса в параллельных worktree.

Источник и подробности с примерами SKILL.md: Getting started with loops

#ClaudeCode #AI #Agents
Please open Telegram to view this post
VIEW IN TELEGRAM
👎6👍5
😂 Caveman обещал -65% токенов агенту. JetBrains проверили — вышло в разы меньше

Популярный скилл Caveman заставляет агента отвечать в стиле "мало слов, много дело", код и команды не трогает. JetBrains прогнали его на реальных тестах с Claude Code:
😂 уменьшения потребления output токенов с 592k до 542k, то есть -8.5% и совсем далеко от заявленных цифр
👍 качество остается на том же уровне
💰 выигрыша по стоимости нету: в теории должна была падать на ~10%, но один таск перевалил за 200k-контекст и по итогу счет на $8.29

65% в рекламе Caveman честные только для чатов
. В агенте токены — это код, диффы и вызовы тулов, а не болтовня между ними, их скилл и не трогает.

#AI #ClaudeCode
👍15👎6
🧠 В Claude Code появился checkup — самопроверка и уборка конфигурации

Борис Черны анонсировал команду, которая за один прогон делает то, что раньше руками: чистит неиспользуемые скиллы, MCP и плагины (экономит контекст), убирает дубли между локальным и закоммиченным CLAUDE.md, режет разросшийся корневой CLAUDE.md на вложенные файлы + скиллы, отключает медленные хуки, обновляет сам Claude Code, включает auto mode по умолчанию и заранее одобряет read-only команды, которые вы обычно отклоняете вручную.

В официальных release notes подтверждено: /doctor стал полноценным чекапом окружения с автофиксом, /checkup — его алиас.

‼️ ВАЖНО: пункты про auto mode и pre-approve команд — это не просто уборка, а изменение доверительных настроек сессии. Команда спрашивает подтверждение перед каждым шагом, но именно эти два пункта стоит прогонять осознанно, а не жать y на автомате.

Разросшийся CLAUDE.md и забытые MCP-серверы — знакомая боль всем, кто держит Claude Code в проекте месяцами. Здесь я, честно, буду смотреть на предложенные правки руками: авточистка конфигурации это не автопамять агента, ошибка тут стоит дороже, чем забытый факт.

#ClaudeCode #AIDev
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8👎6
Claude AI Dev Broadcast
😂 Caveman обещал -65% токенов агенту. JetBrains проверили — вышло в разы меньше Популярный скилл Caveman заставляет агента отвечать в стиле "мало слов, много дело", код и команды не трогает. JetBrains прогнали его на реальных тестах с Claude Code: 😂 уменьшения…
Кстати, раз зашла речь про фильтрацию вывода для агентов — есть еще одно популярное решение, RTK. CLI-прокси на Rust перехватывает Bash-вызовы агента и переписывает git status, cargo test, grep и еще сотню команд в компактные версии, обещая экономить 60–90% токенов.

От него я отказался быстро, и вот почему. На синтетических тестах все работает красиво: git push в 15 строк превращается в ok main, тесты показывают только фейлы. Но RTK режет вывод по жестким правилам для команд, без понимания того, что агенту реально нужно для конкретной задачи.

Если он срезал важное, агент это чувствует и обходит: либо дергает исходную команду напрямую (Read/Grep/Glob у Claude Code вообще не проходят через Bash-хук, RTK их даже не видит), либо перевызывает с дополнительными флагами, чтобы дотащить недостающий контекст. В итоге токенов уходит больше, чем без фильтра вообще ⚠️

Можно форсить жестче, есть режим -l aggressive, который вообще режет тела функций, оставляя сигнатуры. Но тогда агент начинает реально хуже решать задачу. Обход или потеря качества, третьего не дано.

Идея правильная, но фильтровать вывод нужно с обратной связью от задачи, а не по статичным правилам для команд. Поэтому пока пользуюсь Context Mode. Там агент сам решает, что убрать в песочницу, а не теряет данные вслепую на входе.

#AI #ClaudeCode
👍8👎5
🐱 dcg: хук, который блокирует деструктивные команды AI-агентов до их выполнения.

Rust утилита перехватывает shell-команды агента (Claude Code, Codex CLI, Cursor, Gemini CLI и других) через хук PreToolUse и блокирует выполнение команд вроде git reset --hard, rm -rf, DROP TABLE и подобных до запуска, а не после.

Из коробки включены только пакеты core.filesystem, core.git и system.disk — самые катастрофичные и невосстановимые. Всё остальное (Docker, Kubernetes, облака, базы данных, S3) — опционально, настраивается через конфиг:

[packs]
enabled = ["database.postgresql", "containers.docker", "cloud.aws"]


Нюанс, о котором в README не кричат: дизайн fail-open. Если анализ команды не укладывается в таймаут или парсинг падает, поведение по умолчанию — пропустить команду, а не заблокировать. Это осознанный компромисс, чтобы хук не тормозил работу, но это не полноценный security-барьер, а именно страховка от типичных ошибок агентов.

Если вы работаете с Claude Code и хотите подстраховаться от git reset --hard в 3 часа ночи, утилита устанавливается одной командой, но сразу включайте пакеты под свой стек, так как защита по умолчанию узкая.

#AI #ClaudeCode #AIDev
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11👎7
🧠 iOS симулятор прямо в Claude Desktop. В beta-сборки появилась возможность собрать и проверить приложение в iOS-симуляторе. Кажется, они замахнулись на классическую IDE, но Xcode не так легко отступит. Закрытость сломает всех!

#Claude #iOS #ClaudeCode #AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8👎3
🐱 quickai - инструмент для анализа куда уходят ваши токены, деньги и время в Claude Code. Работают полностью оффлайн. Автор - Алексей Гладков

#ClaudeCode
Please open Telegram to view this post
VIEW IN TELEGRAM
👎19👍11
This media is not supported in your browser
VIEW IN TELEGRAM
🧠 Для Claude появился плагин для сканирования проектов на безопасность. Пока в Beta и полностью бесплатно.

Ставим в Claude Code
/plugin install claude-security@claude-plugins-official


#ClaudeCode #Безопасность
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14👎2