Data Secrets
91.8K subscribers
7.17K photos
809 videos
20 files
3.26K links
Главный по машинному обучению

Сотрудничество: @veron_28

РКН: clck.ru/3FY3GN
Download Telegram
СМИ сообщают, что Белый Дом потребовал от Anthropic «полностью устранить возможность любых джейлбрейков модели» для восстановления доступа

Да, именно в такой формулировке 😐😐😐

Нагляднее демонстрации того, что судьбу ИИ решают люди, абсолютно ничего в нем не понимающие, и не придумаешь
Please open Telegram to view this post
VIEW IN TELEGRAM
😁340🤯41👍3632🤨9🫡9🐳5🔥21🎉1🍓1
Claude смог полностью автономно управлять робопсом

Мы все ближе и ближе к миру из научно-фантастических романов. Anthropic запустили эксперимент, в котором Claude Opus 4.7 должен был самостоятельно подключиться к роботу, разобраться со всеми датчиками и камерами, написать код для управления и научить пса автономно приносить мячик.

Показательно, что еще недавно, в 2024, в стартапе запускали похожий проект. Тогда они собрали две команды сотрудников, которые не разбирались в робототехнике, дали обеим робо-собаку и ту же задачу научить ее приносить мяч. При этом одна команда могла пользоваться Claude, а вторая нет. Первая, конечно же, справилась быстрее.

Сам Claude решить задачу в то время не мог и застревал уже на этапе подключения к роботу.

Теперь же, абсолютно без помощи человека, агент выполнил весь набор задач примерно в 20 раз быстрее, чем лучшая команда людей из прошлой версии эксперимента. Прошло менее двух лет.

И, кстати, обратите внимание: перед нами снова пример, когда автономный ИИ обучает другую автономную систему. Только теперь это уже физический мир.

www.anthropic.com/research/project-fetch-phase-two
👍177🤯5547🔥15🤔8😁764😍3🆒1
Ян Лекун снова раскритиковал Илона Маска

Слов он вообще не пожалел: назвал стартап xAI провалом и сказал, что у Маска с ИИ все закончится крахом, потому что уже сейчас тот не может полноценно конкурировать с ведущими лабами.

Кроме того, Илон «проявляет слабость», сдавая свои дата-центры Colossus конкурентам (Anthropic и Google). Лекун считает, что это единственный способ покрыть расходы.

Лекун также заявил, что Илон не сможет привлекать топ-таланты, потому что с прошлой командой он поступил «плохо» (это, видимо, про то, что все 11 сооснователей xAI, кроме Маска, покинули компанию).

Ответку ждем?
😁17175🗿108💯5👍4🍾3💘3🤔2👏1🕊1
От 30 до 50% инженеров из ключевых продуктовых команд Meta* теперь размечают данные

Повальное число экспертов компании на этой неделе перевели во внутренний отдел ADO (Agent Data Optimisation), где они занимаются разметкой. Например, просматривают репозитории, сгенерированные ИИ, и дают обратную связь для RLHF.

Больше всего пострадали кибербезопасники и инженеры из инфраструктурных и продуктовых команд. В общей сложности сейчас примерно каждый пятый или шестой инженер в компании занимается разметкой на фул-тайм.
😁210🤯96🫡2215😎3👍2😍2🤔1💯1🏆1
This media is not supported in your browser
VIEW IN TELEGRAM
1 июля в Москве пройдет большое мероприятие для всех, кому интересны рекомендательные системы и персонализация

Команда AI VK собирает на митап инженеров и исследователей, чтобы подробно обсудить технологии для рекомендательных систем в продуктах с многомиллионной аудиторией. В программе:

Доклады о трансформерных моделях и LLM-агентах для поиска и рекомендаций.

Рассказ о том, как внедряются технологии в продукты с помощью единой Discovery-платформы.

Презентация нового исследовательского направление в команде, AI VK Research, и проектов в области генеративных рекомендаций, графовых моделей, а также AI-инфраструктуры.

Неформальное общение с лидерами, исследователями и разработчиками AI VK.

Отличный шанс за один вечер собрать в голове актуальную картину мира рекомендательных систем и понять, что реально работает, куда движется индустрия и как все это выглядит в больших продуктах на практике.

1 июля, ДК «Кристалл» в Москве.

Регистрация – здесь
Please open Telegram to view this post
VIEW IN TELEGRAM
😁49🗿297👍6🔥2🤯1😍1🏆1🍓1🎄1
Amazon внезапно отказался выпускать почти доснятый фильм про Сэма Альтмана

Речь про ту самую картину под названием Artificial про увольнение Сэма осенью 2023, в которой Альтмана играет Эндрю Гарфилд, а Илью Суцкевера – Юра Борисов. Изначально фильм снимался в партнерстве с Amazon, но те сначала откладывали выпуск, а теперь и вовсе разорвали контракт.

Забавное совпадение: Amazon отказались от выпуска фильма сразу после того как компания заключила с OpenAI крупную сделку на 50 миллиардов долларов.

Свой отказ они, фактически, не объяснили, заявив просто, что фильм «больше подойдет другому дистрибьютору».
1😁26653163🔥1🤔1😍1🍓1
Spotlight на ICML: ускоряем графовые нейросети

Начинается ежегодный марафон по чтению статей с ICML 2026, которая в этом году пройдет 6-11 июля. Приятно, что попадается много инженерных статей с практическими результатами.

Среди таких – работа Яндекса и ШАДа. Она получила статус Spotlight: это статьи, которым программный комитет дал самые высокие оценки. Таких работ на конференции всего 536, 2.2% от всех поданных заявок.

В статье исследователи из Yandex Research, команд ML-инфраструктуры и инференса и студенты ШАД работали над ускорением Graph Neural Networks. Дело в том, что вычисления на графах неэффективно ложаться на парадигму GPU-вычислений, данные лежат в памяти неравномерно, и поэтому видеокарта значительную часть времени ждет загрузки данных вместо того, чтобы выполнять вычисления, которые представляют собой достаточно простые операции. Как раз из-за этого скорость работы ограничена чтением и записью данных, и грамотная работа с GPU-памятью — это главный источник ускорения таких операций.

Авторы атакуют именно это узкое место, фактически минимизируя лишние перемещения данных между памятью и вычислительными блоками GPU. Также авторы переносят часть алгоритмов на тензорные ядра, что позволяет ускорится на графах с большой плотностью.

Они разработали новые готовые GPU-кернелы для популярных семейств графовых нейросетей, и добились потрясающего ускорения в 3–10 раз в зависимости от архитектуры. Потребление памяти в отдельных сценариях сокращается более чем на порядок.

Поздравляем команду с заслуженным Spotlight и прекрасной работой!

Статья уже доступна на arXiv, а код выложили вот здесь.
👍12237🔥26👌5😁4😍4🗿3🍓2🤔1
Data Secrets
Один из самых мощных и известных ученых Google DeepMind Ноам Шазир ушел в OpenAI Ноам – настоящий ветеран Google: он пришел в компанию в 2000 году и работал над ранними поисковыми системами, включая AdSense. В 2017 он стал одним из соавторов легендарной статьи…
Директор DeepMind Technologies ушел работать в Anthropic

Из Google уходит вторая легенда за два дня – Джон Джампер.

Это человек, который создал AlphaFold и в 2024 получил за это Нобелевскую премию вместе с Демисом Хассабисом и Дэвидом Бейкером. Ему, кстати, всего 39, он один из самых молодых обладателей Нобелевки.

Чем конкретно он займется в Anthropic, и кто встанет на его место в DeepMind – пока непонятно, но это однозначно крупнейшая потеря для Google
212🔥52🤯43🗿109🍾5😎43👨‍💻3🎄3🤨2
Директор робостартапа Figure AI объявил, что они произвели столько роботов, что их количество превзошло количество людей в компании 😐

Интересно, они Терминатора вообще смотрели?
Please open Telegram to view this post
VIEW IN TELEGRAM
203😁127🗿1811🔥8👍64🍓3💯21
Феномен GLM-5.2

Кажется, Z.ai – это новый DeepSeek. По крайней мере, их свежая модель GLM-5.2 навела не меньше шума, чем R1 в свое время.

Это реально опенсорс нового уровня: на арене модель обошла Opus 4.8 на кодинге, а на Design Arena (приготовьтесь) забрала первое место у Claude Fable 5.

Плюсом контекст до 1М токенов и отличные показатели при работе с длинными многошаговыми задачами.

Три варианта, как попробовать модель:

1. Если вдруг вы – обладатель 8хH100, то можете запустить локально, веса лежат вот тут под лицензией MIT.

2. В чате chat.z.ai, но только по подписке GLM Coding Plan.

3. Самый простой и дешевый вариант: в API. В нашем сервисе DS Lab API цена на GPM-5.2 прямо сейчас снижена в два раза, до 25 июня она ниже, чем у официального провайдера. Пользуйтесь: dslab.tech/ai/models/llm/glm-5.2
155🔥68🤯36👍18🗿13😁10😎7🤔6🎄42😍1
Sakana AI выпустили в общий доступ систему оркестрации агентов Fugu. В некоторых конфигурациях она превосходит Fable 5.

Sakana Fugu была анонсирована еще в апреле, мы подробно о ней писали вот тут: t.me/data_secrets/9104. Два месяца система провела в бете, и вот, наконец, ей можно свободно пользоваться.

https://sakana.ai/fugu/

Сама по себе Fugu является небольшой языковой моделью, которая обучена вызывать другие LLM. То есть вместо того чтобы вручную прописывать механизмы, роли и рабочие процессы моделей (как это обычно делают), Sakana обучили модельку, которая хорошо умеет решать, кого вызвать, в какой роли и с какими подзадачами – и делает это адаптивно под конкретный запрос. Если интересно закопаться в механику, то почитайте вот эти две статьи: Trinity и Conductor.

По поводу оплаты. Если вы используете обычный Fugu, то платите только за одну используемую топовую модель, . Fugu Ultra – тот самый, который обгоняет Fable и Mythos – стоит $5/$30 за миллион input/output. Плюс есть подписки.

В общем-то, довольно демократично. Ну и бенчмарки красивые. Надо пробовать.
81👍36🔥16😁8🗿4🍾322🤯1💯11
Потокенмаксили и хватит?
😁28639😎16🔥95🕊2🍓2👍1😍1💯1
Data Secrets
Sakana AI выпустили в общий доступ систему оркестрации агентов Fugu. В некоторых конфигурациях она превосходит Fable 5. Sakana Fugu была анонсирована еще в апреле, мы подробно о ней писали вот тут: t.me/data_secrets/9104. Два месяца система провела в бете…
⚡️ Обновления в DS Lab API: Fugu Ultra и новые цены

Добавили Sakana Fugu Ultra. Модели пока нет даже на OpenRouter. Цена: 500 ₽ / 3000 ₽ за 1M входных и выходных токенов.

Снизили цены на DeepSeek V4 Pro. Теперь 43 ₽ / 87 ₽ вместо 191 ₽ / 382 ₽ за 1M входных и выходных токенов.

До 1 июля DeepSeek V4 Flash доступна на 50% дешевле официальных цен. Стоимость составляет 4 ₽ / 8 ₽ за 1M входных и выходных токенов.

Пробуйте: dslab.tech/ai
Please open Telegram to view this post
VIEW IN TELEGRAM
53👍31🤯11🔥9🤨7🗿5🤩2🕊1🎄1
Интересно. Google DeepMind заключили партнерство с киностудией A24

Это та студия, которая выпустила «Марти Великолепный», «Все везде и сразу» и «Закулисье реальности».

Google вкладывают в них 75 миллионов долларов и объявили, что будут вместе заниматься разработкой ИИ-технологий для всех этапов производства кино.

Ждем Gemini Omni Pro…
2127👍34🔥23🗿8🤯63🍾2🆒1
This media is not supported in your browser
VIEW IN TELEGRAM
Два твита == минус 250 миллиардов долларов

После того, как о своем уходе из DeepMind в OpenAI и Anthropic объявили два ключевых сотрудника (Ноам Шазир и Джон Джампер) акции компании упали аж на 6%. Это один из худших дней акций Alphabet за последний год.

F 😐
Please open Telegram to view this post
VIEW IN TELEGRAM
😁16475🤯1614🐳5👍3🔥3💯3😎32🏆1
Обновленная GPT‑5.5‑Cyber обошла Mythos на поиске уязвимостей в коде

openai.com/index/daybreak-securing-the-world/

OpenAI объявили, что выводят модель из превью, и теперь партнерам и отдельным кибербезопасникам будет доступна полная версия GPT-5.5-Cyber.

На CyberGym – основном крупном бенче по работе с уязвимостями – модель набрала 85.6%. Mythos на нем же набирает 83.8%.

Самое интересное, что в списке партнеров, которым предоставляется модель, фигурируют не только американские компании. Наверное, правительство США должно это ограничить, как и в случае с Anthropic. Правда? Правда же?…
😁334🤯35🔥21👍1264👌44🍾2🍓1🤗1
Мы

Не отрицайте
😁56581🔥31💯2117🫡5👍42🤯2🍾2🆒1
Почему AI не ускорил разработку в 10 раз

Последние два года все обсуждают, как агенты пишут код. Но в реальных больших продуктах выясняется неожиданная вещь: даже после массового внедрения AI ускорение часто составляет не иксы, а только десятки процентов. Встает вопрос: почему?

Вот тут нашли совсем свежий интересный доклад на эту тему. Выступает Артур Василов, руководитель мобильной разработки Яндекс Браузера. Он рассказал, что они разными способами измеряли эффекты от ИИ, и увидели похожую картину: да, разработчики действительно работают быстрее, но нет, революции пока не произошло.

Причина в том, что кодинг – лишь одна часть большого конвейера. Помимо него есть менеджеры, дизайн, тестирование, кодревью, релизы и множество других этапов. Если ускорить только написание кода, узкое место просто смещается дальше по цепочке.

Поэтому глобально новый тренд в бигтехах, в том числе в Яндексе, не столько на ИИ-агентов как ассистентов, сколько на автоматизацию целых процессов. Команда выделяет повторяющиеся инженерные задачи, которые раньше никто не автоматизировал из-за высокой стоимости разработки, и автоматизирует их с помощью ИИ.

Например, в Яндексе куча людей работают над конфликтами и ошибками при выходе новых версий Chromium. Раньше почти вся эта работа выполнялась вручную. Теперь для таких сценариев строятся специализированные AI-пайплайны, которые помогают разбирать и исправлять подобные проблемы автоматически.

Именно в автоматизации вот таких больших кусков инженерной рутины и лежит основной резерв для ускорения разработки, и это уже действительно будет ускорение в разы.
🤔10138👍34🗿28💯7🤨5🔥3🤯31🕊1🆒1
Ходят слухи, что Anthropic собираются выпускать новую модель

Пару дней назад какие-то инсайдеры говорили, что у них якобы уже готов Mythos 5.1 и соответствующая версия Fable, но по понятным причинам эти модели пока будут жить только внутри стартапа.

Теперь пишут, что на этой неделе антропики собираются выпускать Sonnet 5: модель уже заметили в логах у некоторых провайдеров. Ожидаем 1М контекста, хорошие показатели в кодинге и выгодное соотношение цена/качество.

Решили долго не горевать, дистиллировать Fable в "Sonnet 5" и выпустить заново 👨‍🦯
Please open Telegram to view this post
VIEW IN TELEGRAM
😁28158👍2716😎3🤔2👌1💯1🎄1