Claude AI Dev Broadcast
2.17K subscribers
130 photos
10 videos
112 links
Всё про разработку с использованием AI технологий

Наш канал про Android - @android_broadcast
Видео как работать с AI - abdev.by/broadcast_ai_plus
Download Telegram
Почему самая маленькая квантизированная модель оказалась медленнее — разбор на бенчмарках

Chris Merrick прогнал MobileNetV2 в трёх квантизациях (FP32/INT8/INT4) на Pixel 10. Результат - самая лёгкая по весу INT4 на CPU оказалась медленнее INT8. Вывод: размер файла не главный критерий быстродействия.

Полезно, если делаешь on-device inference и оптимизируешь модели под мобилки.

#AI #Android #OnDeviceAI
👍6👎5
От гонки OpenAI и Anthropic выигрвают пользователи - ночью с 15 на 16 июля снова сбросили лимиты!

#Claude
👍15👎4
🧠 Курсор выложили пачку скиллов для агентов, cursor-team-kit

Практически все там - обычная GitHub-рутина, которую любая команда и так закрыла себе через Actions и скрипты (CI, PR, конфликты, статус работы). Если у вас это уже настроено, открытий тут не будет.

Но пара штук реально цепляет:
verify-this: агент не пишет "готово", а доказывает результат на паре baseline/treatment. Дисциплина вместо доверия на слово, принцип стоит утащить к себе независимо от Cursor.

⚠️ deslop: самое интересное название, но полез смотреть реальный файл скилла, там пять пунктов и три гардрейла, ни одного примера до/после. Без конкретики агент может резать не то что нужно, перед тем как тащить к себе, погоняйте на своём коде и проверьте.

Чего-то сокровенного вы не узнаете из наработок, это срез того, как команда Cursor вообще мыслит про то, что заворачивать в скилл. Смотреть как источник вдохновения.

#AI #Cursor #AIAgents #DevTools
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6👎4
Вышла Kimi K3 - опенсорсная китайская модель которая

• Сильнейшая в мире по фронтенд-дизайну
• Стоит как Sonnet, а по уровню превосходит Opus 4.8 во всём (который стоит втрое дороже)
• По уровню чуть ниже Fable, в ~половине бенчмарков побеждает 5.6 Sol
• На 20% меньше токенов тратит чем 2.6
• Контекстное окно 1М токенов

Это удар по антропик невероятного масштаба... Домашний Fable за 1/10 цены с открытыми весами и на своей инфре. Я хз как они от этого оправятся, если в реальном пользовании модель будет такая же, как по бенчам. Дистилляция не прошла даром.
👍23👎2
This media is not supported in your browser
VIEW IN TELEGRAM
Пример работы с Claude Code
2👍33👎2
🧠 Fable оставляют в подписке бессрочно на Max и Team Preimium тарифах, а других дадут компенсацию 100$ на токены (какого черта?)

Страх перед GPT 5.6 и KIMI K3 дает о себе знать. На мой взгляд, компания теряет уверенность в своих силах и подходах

#Claude #Anthropic #Fable5
Please open Telegram to view this post
VIEW IN TELEGRAM
👍19👎3
Please open Telegram to view this post
VIEW IN TELEGRAM
👍26👎8
⭐️ Google выпустил три модели Flash: 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber

3.6 Flash — рабочая лошадка линейки. По данным Google на 17% меньше выходных токенов на задачу, чем у 3.5 Flash.

3.5 Flash-Lite — самая быстрая и предзначена для тех кому нужен быстрый ответ: 350 токенов в секунду. По собственным бенчам Google, по качеству обгоняет даже 3 Flash на части агентных задач.

⚠️ 3.5 Flash Cyber (поиск и патч уязвимостей) публично не доступна только правительствам и «доверенным партнёрам» в закрытом пилоте, что уже становится трендом. И это не разовая история — у крупных вендоров всё чаще самые мощные и специализированные модели закрываются от обычных разработчиков сразу на старте, а не спустя время после релиза. Тенденция, за которой стоит следить отдельно от самих моделей.

Бенчмаркам на анонсе я доверяю слабо в принципе, и это касается не только Google: любой вендор на релизе подбирает цифры так, чтобы показать себя с лучшей стороны.

Главный вопрос качество/цена работы а не цена за токены в отрыве от скорости и качества.

Я это уже проходил с GLM 5.2 недавно: дешёвый токен ничего не гарантирует, если модель тратит их в разы больше на ту же задачу, и итоговая стоимость решения оказывается выше, чем у дорогой, но эффективной модели. Смотреть надо на стоимость выполнения задачи целиком, а не на прайс-лист за 1M токенов.

3.6 Flash и Flash-Lite уже можно пробовать в Android Studio через Gemini API и оценить на ваших задачах.

#AI #Gemini #LLM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5👎4
🤯 KIMI K3 больше не оформить. Компания теперь принимает заявки только в лист ожидания, а на торговых площадках подписку продают в 2-5 раз дороже от её официальной цены. Кажется - это лучший индикатор того, что у ребят получилось!

#kimi #k3 #ai
👍12👎1
🧠 iOS симулятор прямо в Claude Desktop. В beta-сборки появилась возможность собрать и проверить приложение в iOS-симуляторе. Кажется, они замахнулись на классическую IDE, но Xcode не так легко отступит. Закрытость сломает всех!

#Claude #iOS #ClaudeCode #AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8👎3
🐱 quickai - инструмент для анализа куда уходят ваши токены, деньги и время в Claude Code. Работают полностью оффлайн. Автор - Алексей Гладков

#ClaudeCode
Please open Telegram to view this post
VIEW IN TELEGRAM
👎19👍11
This media is not supported in your browser
VIEW IN TELEGRAM
🧠 Для Claude появился плагин для сканирования проектов на безопасность. Пока в Beta и полностью бесплатно.

Ставим в Claude Code
/plugin install claude-security@claude-plugins-official


#ClaudeCode #Безопасность
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14👎2
🐱 OpenCodex позволит вам использовать различные LLM в Codex и Claude (да, название выбрали неудачно на старте). ХЗ, насколько это удачная затея, но кажется, что Codex и Claude завязаны на свои модели, и пытаться «натянуть совы на глобус» — мне так себе идея. Почему не взять OpenCode или ещё что?

#Claude #Codex #AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6👎4
Начали банить аккаунты Kimi Code с подозрительной активностью. Когда мощностей не хватает начинают искать их всеми способами!

#Kimi
👎10👍5
Дядя Бок сказал самую правильную вещь: "Зачем проверять человеку код от ИИ?" Это в самую точку. Обвесьте проект проверками, тестами и всем, что важно для проверки того, что код работает как надо и с приемлемым качеством (скорость, расход памяти и т.д.)
👍26👎10
🧠 Вышел Claude Opus 5. Сильнее, выше, дороже... Вообщем как всегда. На удивление, смог обогнать Fable 5 во многих тестах

Самое ценное в выходе новой модели - сброс лимитов недели, но его не сделали

#Claude #AI
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9👎5