Data Secrets
91.8K subscribers
7.17K photos
809 videos
20 files
3.26K links
Главный по машинному обучению

Сотрудничество: @veron_28

РКН: clck.ru/3FY3GN
Download Telegram
Amazon внезапно отказался выпускать почти доснятый фильм про Сэма Альтмана

Речь про ту самую картину под названием Artificial про увольнение Сэма осенью 2023, в которой Альтмана играет Эндрю Гарфилд, а Илью Суцкевера – Юра Борисов. Изначально фильм снимался в партнерстве с Amazon, но те сначала откладывали выпуск, а теперь и вовсе разорвали контракт.

Забавное совпадение: Amazon отказались от выпуска фильма сразу после того как компания заключила с OpenAI крупную сделку на 50 миллиардов долларов.

Свой отказ они, фактически, не объяснили, заявив просто, что фильм «больше подойдет другому дистрибьютору».
1😁26653163🔥1🤔1😍1🍓1
Spotlight на ICML: ускоряем графовые нейросети

Начинается ежегодный марафон по чтению статей с ICML 2026, которая в этом году пройдет 6-11 июля. Приятно, что попадается много инженерных статей с практическими результатами.

Среди таких – работа Яндекса и ШАДа. Она получила статус Spotlight: это статьи, которым программный комитет дал самые высокие оценки. Таких работ на конференции всего 536, 2.2% от всех поданных заявок.

В статье исследователи из Yandex Research, команд ML-инфраструктуры и инференса и студенты ШАД работали над ускорением Graph Neural Networks. Дело в том, что вычисления на графах неэффективно ложаться на парадигму GPU-вычислений, данные лежат в памяти неравномерно, и поэтому видеокарта значительную часть времени ждет загрузки данных вместо того, чтобы выполнять вычисления, которые представляют собой достаточно простые операции. Как раз из-за этого скорость работы ограничена чтением и записью данных, и грамотная работа с GPU-памятью — это главный источник ускорения таких операций.

Авторы атакуют именно это узкое место, фактически минимизируя лишние перемещения данных между памятью и вычислительными блоками GPU. Также авторы переносят часть алгоритмов на тензорные ядра, что позволяет ускорится на графах с большой плотностью.

Они разработали новые готовые GPU-кернелы для популярных семейств графовых нейросетей, и добились потрясающего ускорения в 3–10 раз в зависимости от архитектуры. Потребление памяти в отдельных сценариях сокращается более чем на порядок.

Поздравляем команду с заслуженным Spotlight и прекрасной работой!

Статья уже доступна на arXiv, а код выложили вот здесь.
👍12237🔥26👌5😁4😍4🗿3🍓2🤔1
Data Secrets
Один из самых мощных и известных ученых Google DeepMind Ноам Шазир ушел в OpenAI Ноам – настоящий ветеран Google: он пришел в компанию в 2000 году и работал над ранними поисковыми системами, включая AdSense. В 2017 он стал одним из соавторов легендарной статьи…
Директор DeepMind Technologies ушел работать в Anthropic

Из Google уходит вторая легенда за два дня – Джон Джампер.

Это человек, который создал AlphaFold и в 2024 получил за это Нобелевскую премию вместе с Демисом Хассабисом и Дэвидом Бейкером. Ему, кстати, всего 39, он один из самых молодых обладателей Нобелевки.

Чем конкретно он займется в Anthropic, и кто встанет на его место в DeepMind – пока непонятно, но это однозначно крупнейшая потеря для Google
212🔥52🤯43🗿109🍾5😎43👨‍💻3🎄3🤨2
Директор робостартапа Figure AI объявил, что они произвели столько роботов, что их количество превзошло количество людей в компании 😐

Интересно, они Терминатора вообще смотрели?
Please open Telegram to view this post
VIEW IN TELEGRAM
203😁127🗿1811🔥8👍64🍓3💯21
Феномен GLM-5.2

Кажется, Z.ai – это новый DeepSeek. По крайней мере, их свежая модель GLM-5.2 навела не меньше шума, чем R1 в свое время.

Это реально опенсорс нового уровня: на арене модель обошла Opus 4.8 на кодинге, а на Design Arena (приготовьтесь) забрала первое место у Claude Fable 5.

Плюсом контекст до 1М токенов и отличные показатели при работе с длинными многошаговыми задачами.

Три варианта, как попробовать модель:

1. Если вдруг вы – обладатель 8хH100, то можете запустить локально, веса лежат вот тут под лицензией MIT.

2. В чате chat.z.ai, но только по подписке GLM Coding Plan.

3. Самый простой и дешевый вариант: в API. В нашем сервисе DS Lab API цена на GPM-5.2 прямо сейчас снижена в два раза, до 25 июня она ниже, чем у официального провайдера. Пользуйтесь: dslab.tech/ai/models/llm/glm-5.2
155🔥68🤯36👍18🗿13😁10😎7🤔6🎄42😍1
Sakana AI выпустили в общий доступ систему оркестрации агентов Fugu. В некоторых конфигурациях она превосходит Fable 5.

Sakana Fugu была анонсирована еще в апреле, мы подробно о ней писали вот тут: t.me/data_secrets/9104. Два месяца система провела в бете, и вот, наконец, ей можно свободно пользоваться.

https://sakana.ai/fugu/

Сама по себе Fugu является небольшой языковой моделью, которая обучена вызывать другие LLM. То есть вместо того чтобы вручную прописывать механизмы, роли и рабочие процессы моделей (как это обычно делают), Sakana обучили модельку, которая хорошо умеет решать, кого вызвать, в какой роли и с какими подзадачами – и делает это адаптивно под конкретный запрос. Если интересно закопаться в механику, то почитайте вот эти две статьи: Trinity и Conductor.

По поводу оплаты. Если вы используете обычный Fugu, то платите только за одну используемую топовую модель, . Fugu Ultra – тот самый, который обгоняет Fable и Mythos – стоит $5/$30 за миллион input/output. Плюс есть подписки.

В общем-то, довольно демократично. Ну и бенчмарки красивые. Надо пробовать.
81👍36🔥16😁8🗿4🍾322🤯1💯11
Потокенмаксили и хватит?
😁28639😎16🔥95🕊2🍓2👍1😍1💯1
Data Secrets
Sakana AI выпустили в общий доступ систему оркестрации агентов Fugu. В некоторых конфигурациях она превосходит Fable 5. Sakana Fugu была анонсирована еще в апреле, мы подробно о ней писали вот тут: t.me/data_secrets/9104. Два месяца система провела в бете…
⚡️ Обновления в DS Lab API: Fugu Ultra и новые цены

Добавили Sakana Fugu Ultra. Модели пока нет даже на OpenRouter. Цена: 500 ₽ / 3000 ₽ за 1M входных и выходных токенов.

Снизили цены на DeepSeek V4 Pro. Теперь 43 ₽ / 87 ₽ вместо 191 ₽ / 382 ₽ за 1M входных и выходных токенов.

До 1 июля DeepSeek V4 Flash доступна на 50% дешевле официальных цен. Стоимость составляет 4 ₽ / 8 ₽ за 1M входных и выходных токенов.

Пробуйте: dslab.tech/ai
Please open Telegram to view this post
VIEW IN TELEGRAM
53👍31🤯11🔥9🤨7🗿5🤩2🕊1🎄1
Интересно. Google DeepMind заключили партнерство с киностудией A24

Это та студия, которая выпустила «Марти Великолепный», «Все везде и сразу» и «Закулисье реальности».

Google вкладывают в них 75 миллионов долларов и объявили, что будут вместе заниматься разработкой ИИ-технологий для всех этапов производства кино.

Ждем Gemini Omni Pro…
2127👍34🔥23🗿8🤯63🍾2🆒1
This media is not supported in your browser
VIEW IN TELEGRAM
Два твита == минус 250 миллиардов долларов

После того, как о своем уходе из DeepMind в OpenAI и Anthropic объявили два ключевых сотрудника (Ноам Шазир и Джон Джампер) акции компании упали аж на 6%. Это один из худших дней акций Alphabet за последний год.

F 😐
Please open Telegram to view this post
VIEW IN TELEGRAM
😁16475🤯1614🐳5👍3🔥3💯3😎32🏆1
Обновленная GPT‑5.5‑Cyber обошла Mythos на поиске уязвимостей в коде

openai.com/index/daybreak-securing-the-world/

OpenAI объявили, что выводят модель из превью, и теперь партнерам и отдельным кибербезопасникам будет доступна полная версия GPT-5.5-Cyber.

На CyberGym – основном крупном бенче по работе с уязвимостями – модель набрала 85.6%. Mythos на нем же набирает 83.8%.

Самое интересное, что в списке партнеров, которым предоставляется модель, фигурируют не только американские компании. Наверное, правительство США должно это ограничить, как и в случае с Anthropic. Правда? Правда же?…
😁334🤯35🔥21👍1264👌44🍾2🍓1🤗1
Мы

Не отрицайте
😁56581🔥31💯2117🫡5👍42🤯2🍾2🆒1
Почему AI не ускорил разработку в 10 раз

Последние два года все обсуждают, как агенты пишут код. Но в реальных больших продуктах выясняется неожиданная вещь: даже после массового внедрения AI ускорение часто составляет не иксы, а только десятки процентов. Встает вопрос: почему?

Вот тут нашли совсем свежий интересный доклад на эту тему. Выступает Артур Василов, руководитель мобильной разработки Яндекс Браузера. Он рассказал, что они разными способами измеряли эффекты от ИИ, и увидели похожую картину: да, разработчики действительно работают быстрее, но нет, революции пока не произошло.

Причина в том, что кодинг – лишь одна часть большого конвейера. Помимо него есть менеджеры, дизайн, тестирование, кодревью, релизы и множество других этапов. Если ускорить только написание кода, узкое место просто смещается дальше по цепочке.

Поэтому глобально новый тренд в бигтехах, в том числе в Яндексе, не столько на ИИ-агентов как ассистентов, сколько на автоматизацию целых процессов. Команда выделяет повторяющиеся инженерные задачи, которые раньше никто не автоматизировал из-за высокой стоимости разработки, и автоматизирует их с помощью ИИ.

Например, в Яндексе куча людей работают над конфликтами и ошибками при выходе новых версий Chromium. Раньше почти вся эта работа выполнялась вручную. Теперь для таких сценариев строятся специализированные AI-пайплайны, которые помогают разбирать и исправлять подобные проблемы автоматически.

Именно в автоматизации вот таких больших кусков инженерной рутины и лежит основной резерв для ускорения разработки, и это уже действительно будет ускорение в разы.
🤔10138👍34🗿28💯7🤨5🔥3🤯31🕊1🆒1
Ходят слухи, что Anthropic собираются выпускать новую модель

Пару дней назад какие-то инсайдеры говорили, что у них якобы уже готов Mythos 5.1 и соответствующая версия Fable, но по понятным причинам эти модели пока будут жить только внутри стартапа.

Теперь пишут, что на этой неделе антропики собираются выпускать Sonnet 5: модель уже заметили в логах у некоторых провайдеров. Ожидаем 1М контекста, хорошие показатели в кодинге и выгодное соотношение цена/качество.

Решили долго не горевать, дистиллировать Fable в "Sonnet 5" и выпустить заново 👨‍🦯
Please open Telegram to view this post
VIEW IN TELEGRAM
😁28158👍2716😎3🤔2👌1💯1🎄1
Media is too big
VIEW IN TELEGRAM
Anthropic выпустили Claude Tag, и Андрей Карпаты назвал это третьим мощным редизайном UX в истории LLM

Теперь Claude можно добавить как члена команды в канал Slack, вызывать его через @ и делегировать ему задачи.

Он тут же пойдет выполнять таску и вернется с результатами в тот же чат, где можно продолжить диалог и смерджить готовый код, не отрываясь от основной переписки с коллегами. Причем разговор с Claude может перехватить любой человек из канала. Пример ⬆️

Обновление создано для более проактивного и бесшовного стиля работы агента. По словам Anthropic, теперь 65% кода внутри стартапа создается именно благодаря внутренней версии Claude Tag.

www.anthropic.com/news/introducing-claude-tag

А Андрей Карпаты написал про Claude Tag следующее:

Это новая парадигма для взаимодействия с Claude. Имхо, это 3-й крупный редизайн LLM UIUX. Первый заключался в том, что LLM - это веб-сайт, на который вы заходите; второй – в том, что это приложение, которое вы загружаете на свой компьютер. Третий же про то, что это автономная, стойкая, асинхронная сущность с общеорганизационными инструментами и контекстом, работающая вместе с командами людей. Понимание этого займет некоторое время, но это работает, и это потрясающе.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥16157🔥25🤯22😁15👍11🤔1174🎉1🦄1
This media is not supported in your browser
VIEW IN TELEGRAM
GLM-5.2 теперь можно запустить локально

Unsloth сделали отличные GGUF 2-bit и 4-bit. Модель 2-bit сохраняет ~82% точности модели и при этом уменьшает потребление памяти на 84%. Запускается на 256GB Mac.

Можно взять даже 1-bit, и все равно будет норм. На простом примере по сравнению с Claude 4.8 Opus и GPT-5.5 модель ведет себя удивительно хорошо ⬆️

huggingface.co/unsloth/GLM-5.2-GGUF

Инструкция по запуску
Please open Telegram to view this post
VIEW IN TELEGRAM
🕊10059👍36🔥23🤨10😁8🤔4🍾31💯1🫡1
Топовая работа для инженера 🥰🤚
😁131🍓23🔥853👍2😍1🆒1
⚡️ OpenAI сделали собственный чип

Архитектура разработана с нуля вместе с Broadcom, а назвали чип Jalapeño. Предназначен халапеньо специально для инференса LLM и соответсвующих систем а-ля Codex.

Сейчас чип проходит стадию тестирования, но ранние внутренние замеры уже показали, что он перформит лучше текущей SOTA на целый ватт.

openai.com/index/openai-broadcom-jalapeno-inference-chip/
Please open Telegram to view this post
VIEW IN TELEGRAM
297🤯29👍22😁10🍾4🔥3👏3😎1
Авито открыли набор на две магистратуры по ML, разработанные совместно с МФТИ и ВШЭ

Самые интересные образовательные программы получаются, когда бигтех приходит в университет не только с финансированием, а еще и с собственными задачами, данными и экспертами. И это как раз случай Авито.

Прямо сейчас открылась отличная возможность поступить в их магистратуры на ML-программы «Прикладное машинное обучение и анализ данных» с МФТИ и «Машинное обучение в цифровом продукте» с ФКН ВШЭ. В основе программ – реальные кейсы компании, а часть занятий будут вести действующие специалисты Авито. Всего в подготовке материалов участвовали более 300 сотрудников.

Стек довольно широкий: это и классический ML, и компьютерное зрение, и рекомендательные системы, и аналитика, и генеративный ИИ. При этом речь идет не про абстрактное изучение алгоритмов, а про применение всего, что вы проходите, в продуктовой среде.

Отдельный плюс: поступать можно из любого региона России. Ждут всех, кто готов всерьез погружаться в ML и перенимать знания из первых рук, от практикующих специалистов.

Подробнее о программах:
«Машинное обучение (ML) в цифровом продукте» в ФКН НИУ ВШЭ
«Прикладное машинное обучение и анализ данных» в МФТИ
😁32🗿1510👍7🤯4🤨21🔥1🎉1🆒1