Media is too big
VIEW IN TELEGRAM
ChatGPT Work, в котором объединили агентов, ChatGPT и Codex, уже можно скачать на MacOS и Windows: openai.com/chatgpt-work/
Еще из приятного: в новом приложении появился аналог артефактов из клода – так называемые sites. Модель генерирует вам какие-то интерактивные демки прямо в чате, с ними можно взаимодействовать, сохранять и делиться.
Как выглядит интерфейс и начинка ⬆️
Еще из приятного: в новом приложении появился аналог артефактов из клода – так называемые sites. Модель генерирует вам какие-то интерактивные демки прямо в чате, с ними можно взаимодействовать, сохранять и делиться.
Как выглядит интерфейс и начинка ⬆️
2❤89👍22🤯22🎄5🔥4😁3🤔3❤🔥2⚡1🫡1
OpenAI закрывают Atlas
Собственный браузер компания выпустила менее года назад, но в связи с последними обновлениями его время уже подошло к концу (кто-нибудь пользовался вообще?).
Об этом сообщил один из инженеров browser use в OpenAI. В целом, мы ничего не теряем, потому что вместо Atlas теперь есть:
— Большой встроенный браузер в новом приложении ChatGPT. Там будет весь привычный функционал: поиск по страницам, загрузки, множественные вкладки, менеджер паролей и тд. Ну и, конечно, полный набор возможностей агента внутри. Открывается по Cmd + T.
— Облачный браузер для агента Work, в котором он может выполнять ваши задачи. Агент будет спрашивать ваше разрешение на использование сайта (или можно поставить автоодобрение) и в небольшом окне справа вы будете видеть происходящее. Если кликнуть по этому окну, можно перехватить управление браузером в любое время. Идеально для поиска всевозможных билетов, заполнения форм и тд.
— Расширение ChatGPT для Chrome. Агент видит полный контекст вашего браузера, включая выделенный текст, может управлять вкладками и имеет доступ к локальной файловой системе, памяти из основного ChatGPT и установленным плагинам. Короче, одно это расширение уже полностью заменяет Atlas. Скачать можно по ссылке.
Собственный браузер компания выпустила менее года назад, но в связи с последними обновлениями его время уже подошло к концу (кто-нибудь пользовался вообще?).
Об этом сообщил один из инженеров browser use в OpenAI. В целом, мы ничего не теряем, потому что вместо Atlas теперь есть:
— Большой встроенный браузер в новом приложении ChatGPT. Там будет весь привычный функционал: поиск по страницам, загрузки, множественные вкладки, менеджер паролей и тд. Ну и, конечно, полный набор возможностей агента внутри. Открывается по Cmd + T.
— Облачный браузер для агента Work, в котором он может выполнять ваши задачи. Агент будет спрашивать ваше разрешение на использование сайта (или можно поставить автоодобрение) и в небольшом окне справа вы будете видеть происходящее. Если кликнуть по этому окну, можно перехватить управление браузером в любое время. Идеально для поиска всевозможных билетов, заполнения форм и тд.
— Расширение ChatGPT для Chrome. Агент видит полный контекст вашего браузера, включая выделенный текст, может управлять вкладками и имеет доступ к локальной файловой системе, памяти из основного ChatGPT и установленным плагинам. Короче, одно это расширение уже полностью заменяет Atlas. Скачать можно по ссылке.
1 89❤35😁18🕊4🤯3👍2🎄2💯1
Стартап 1X потряс всех своим новым поколением рук для робота-гуманоида
Вместе долгих описаний для начала посмотрите как это выглядит в действии (второе видео не ускорено, если что)⬆️
Невероятная гибкость, скорость и точность. Сам стартап скромно называет новые руки "An API to the Physical World". Другими словами, если "мозги" робота – это компьютер, то именно его руки определяют, насколько он осведомлен о мире вокруг и что может в нем делать.
Инженерно устройство рук действительно очень сложное и интересное, на рынке такого еще не было:
– 25 степеней свободы, причем распределяются они не как обычно – равномерно, а анатомически. Например, в большом пальце сосредоточено примерно столько же, сколько во всех остальных пальцах вместе.
– Привод на основе сухожилий, моторы расположены в предплечье и тянут сухожилия через запястье. В каком-то смысле, как у человека. За счет этого обеспечивается легкость руки и низкая инерция даже при приложении большой силы.
– ОЧЕНЬ точная система чувствительности. Каждый сустав служит также датчиком силы, на кончиках пальцев тактильно измеряется сила нажатия и сдвиг. Система в любой момент времени очень точно знает свое положение и прилагаемые усилия, поэтому двигается всегда плавно и с мелкой моторикой все хорошо.
1X правы. С точки зрения железа в гуманоидах нет ничего важнее рук, поэтому это без преувеличения новое слово в инженерии роботов. Если к таким рукам приложить еще хорошо думающие внутренности, получится самый фунциональный робот в мире и, как следствие, лидер рынка в лице 1X.
В этом году планируют произвести уже 10000 таких рук, к слову.
https://www.1x.tech/discover/neos-hands
Вместе долгих описаний для начала посмотрите как это выглядит в действии (второе видео не ускорено, если что)
Невероятная гибкость, скорость и точность. Сам стартап скромно называет новые руки "An API to the Physical World". Другими словами, если "мозги" робота – это компьютер, то именно его руки определяют, насколько он осведомлен о мире вокруг и что может в нем делать.
Инженерно устройство рук действительно очень сложное и интересное, на рынке такого еще не было:
– 25 степеней свободы, причем распределяются они не как обычно – равномерно, а анатомически. Например, в большом пальце сосредоточено примерно столько же, сколько во всех остальных пальцах вместе.
– Привод на основе сухожилий, моторы расположены в предплечье и тянут сухожилия через запястье. В каком-то смысле, как у человека. За счет этого обеспечивается легкость руки и низкая инерция даже при приложении большой силы.
– ОЧЕНЬ точная система чувствительности. Каждый сустав служит также датчиком силы, на кончиках пальцев тактильно измеряется сила нажатия и сдвиг. Система в любой момент времени очень точно знает свое положение и прилагаемые усилия, поэтому двигается всегда плавно и с мелкой моторикой все хорошо.
1X правы. С точки зрения железа в гуманоидах нет ничего важнее рук, поэтому это без преувеличения новое слово в инженерии роботов. Если к таким рукам приложить еще хорошо думающие внутренности, получится самый фунциональный робот в мире и, как следствие, лидер рынка в лице 1X.
В этом году планируют произвести уже 10000 таких рук, к слову.
https://www.1x.tech/discover/neos-hands
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤177🔥112👍33 11🤯8😁6😍4🏆3😭3☃2🍓1
ICML 2026 — почти все.
На воркшопах начинают объявлять лучшие статьи, и одна из наград — Best Paper Award — досталась работе GraphPFN: A Prior-Data Fitted Graph Foundation Model команды исследователей графовых нейронных сетей Yandex Research. Статья победила на воркшопе Graph Foundation Models: A New Era for Graph Machine Learning.
Сам воркшоп был посвящен развитию graph foundation models — переходу от узкоспециализированных моделей для отдельных задач к универсальным базовым моделям для работы с графами.
В своей работе исследователи представили GraphPFN — графовую foundation model, развивающую подход Prior-Data Fitted Networks (PFN). Модель предобучается на миллионах специально сгенерированных синтетических графов, а затем применяется к реальным данным как в режиме in-context learning, так и после дообучения. В экспериментах на широком наборе реальных графовых датасетов GraphPFN показала лучшие результаты среди протестированных в работе подходов.
На воркшопах начинают объявлять лучшие статьи, и одна из наград — Best Paper Award — досталась работе GraphPFN: A Prior-Data Fitted Graph Foundation Model команды исследователей графовых нейронных сетей Yandex Research. Статья победила на воркшопе Graph Foundation Models: A New Era for Graph Machine Learning.
Сам воркшоп был посвящен развитию graph foundation models — переходу от узкоспециализированных моделей для отдельных задач к универсальным базовым моделям для работы с графами.
В своей работе исследователи представили GraphPFN — графовую foundation model, развивающую подход Prior-Data Fitted Networks (PFN). Модель предобучается на миллионах специально сгенерированных синтетических графов, а затем применяется к реальным данным как в режиме in-context learning, так и после дообучения. В экспериментах на широком наборе реальных графовых датасетов GraphPFN показала лучшие результаты среди протестированных в работе подходов.
❤98👍43🔥20❤🔥4😁4⚡2
Это одна из самых давних открытых проблем теории графов, сформулированная Дьердем Секерешем в 1973 году.
В ней утверждается, что для любого графа без мостов найдется набор циклов, такой что каждое ребро графа входит ровно в два из этих циклов.
Гипотеза, на самом деле, очень важная, потому что связана, в том числе, с теорией нигде-не-нулевых потоков – центральной темой структурной теории графов. Двойное покрытие пытались доказать много раз, но ни одна из попыток так и не была признана как окончательное решение.
А пару часов назад сотрудник OpenAI заявил, что новая модель GPT-5.6 Sol сгенерировала доказательство этой гипотезы всего за час, используя 64 субагента!
Доказательство выложили, но оно пока не подтверждено математическим сообществом, идут обсуждения. Если его верифицируют, это будет одно из крупнейших и самых значимых ИИ-доказательств на данный момент.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤308🤯103 49🔥22👍14⚡11😁9😢3😍1🎄1🦄1
Найдены лучшие постеры на ICML 2026 от @lovedeathtransformers и коллег
😁174🦄49❤25🗿13😍5🔥3 3👍2🏆2😭2🎄1
GPT-5.6-Sol “случайно” стерла почти все файлы с Mac разработчика, и только посмотрите, что пишет в свое оправдание:
Это реклама Fable?
Команда очистки субагента проверки некорректно расширила переменную $HOME и выполнила:
rm -rf /Users/mattsdevbox
Я обнаружил и завершил работающий процесс, но материал уже был удален.
Это реклама Fable?
1😁388🔥34😢26❤9🤨9🤯6😭5🫡4😎4⚡1🕊1
This media is not supported in your browser
VIEW IN TELEGRAM
Apple подала в суд на OpenAI за присвоение торговых секретов
Они утверждают, что стартап специально нанимал бывших сотрудников Apple, и что компания просила кандидатов делиться деталями секретных проектов, чтобы использовать их при разработке собственного устройства. Да-да, того самого собственного устройства, которое делает Джони Айв, ex руководитель дизайна в Apple.
В частности, в иске фигурируют два бывших сотрудника Apple: Tang Tan и Chang Liu.
Первый – бывший топ-менеджер Apple, который много лет отвечал за дизайн ключевых продуктов. Теперь он работает над упомянутым устройством в OpenAI, и якобы именно он просил кандидатов из Apple приносить на собеседования реальные компоненты устройств и делиться конфиденциальной информацией.
Это не все: Tang Tan якобы даже распространял внутри OpenAI специальный документ с инструкциями о том, как обойти формальную процедуру увольнения из Apple, чтобы сохранить доступы к информации.
Chang Liu стал, по версии Apple, одним из шпионов. Они утверждают, что сотрудник скачивал конфиденциальные файлы с рабочего ноутбука и получал доступ к внутренним материалам уже после перехода в OpenAI.
В иске также сказано, что OpenAI обращались к производственным партнерам Apple и пыталась добиться демонстрации фирменной технологии обработки металла.
На данный момент, к слову, в OpenAI работает больше 400 бывших сотрудников Apple.
Они утверждают, что стартап специально нанимал бывших сотрудников Apple, и что компания просила кандидатов делиться деталями секретных проектов, чтобы использовать их при разработке собственного устройства. Да-да, того самого собственного устройства, которое делает Джони Айв, ex руководитель дизайна в Apple.
В частности, в иске фигурируют два бывших сотрудника Apple: Tang Tan и Chang Liu.
Первый – бывший топ-менеджер Apple, который много лет отвечал за дизайн ключевых продуктов. Теперь он работает над упомянутым устройством в OpenAI, и якобы именно он просил кандидатов из Apple приносить на собеседования реальные компоненты устройств и делиться конфиденциальной информацией.
Это не все: Tang Tan якобы даже распространял внутри OpenAI специальный документ с инструкциями о том, как обойти формальную процедуру увольнения из Apple, чтобы сохранить доступы к информации.
Chang Liu стал, по версии Apple, одним из шпионов. Они утверждают, что сотрудник скачивал конфиденциальные файлы с рабочего ноутбука и получал доступ к внутренним материалам уже после перехода в OpenAI.
В иске также сказано, что OpenAI обращались к производственным партнерам Apple и пыталась добиться демонстрации фирменной технологии обработки металла.
На данный момент, к слову, в OpenAI работает больше 400 бывших сотрудников Apple.
😁203 64❤30👍6 6🍾5🗿3🕊2🍓2🐳1👾1
Data Secrets
Оп, Anthropic продлили доступ к Fable по подписке до 12 июля! Чего только не сделаешь, когда конкуренты выпускают новую модель ✨
Anthropic снова продлили Fable 5 по подписке
Модель останется в платных планах до 19 июля. При этом на весь этот период недельные лимиты подняли на 50%🎁
Они собираются продлевать доступ каждый раз, пока Трамп не заблокирует GPT-5.6 Sol
Модель останется в платных планах до 19 июля. При этом на весь этот период недельные лимиты подняли на 50%
Please open Telegram to view this post
VIEW IN TELEGRAM
😁356❤51🔥22⚡5💯3👍1🕊1😍1🎄1
Любимое противостояние десятилетия: Маск vs Альтман
Из-за конфликта с Apple Илон Маск снова назвал CEO OpenAI Скамом Альтманом и сказал, что он «выводит обман на другой уровень».
На что Альтман упрекнул его в том, что Маск сам собирает инвестиции на сомнительный проект быстрого строительства датацентров в космосе.
Ответ Маска убил:
Бой в клетке когда?
Из-за конфликта с Apple Илон Маск снова назвал CEO OpenAI Скамом Альтманом и сказал, что он «выводит обман на другой уровень».
На что Альтман упрекнул его в том, что Маск сам собирает инвестиции на сомнительный проект быстрого строительства датацентров в космосе.
Ответ Маска убил:
Мы начнем запускать их в следующем году. Может, ты сможешь приехать посмотреть, если твой офицер по условно-досрочному освобождению одобрит.
После того как ты украл благотворительную открытую ИИ-организацию, ты еще и украл технологии Apple! Вау.
Что ты планируешь на бис? Это трудно переплюнуть.
Бой в клетке когда?
😁329 68❤24🔥9👍2🕊2😍2☃1🤯1🦄1👾1
Data Secrets
GPT-5.6-Sol “случайно” стерла почти все файлы с Mac разработчика, и только посмотрите, что пишет в свое оправдание: Команда очистки субагента проверки некорректно расширила переменную $HOME и выполнила: rm -rf /Users/mattsdevbox Я обнаружил и завершил работающий…
Еще одной грустной историей про GPT-5.6 Sol поделился другой разработчик:
Он проснулся и обнаружил, что MRR его компании упал на тысячи долларов.
Оказалось, что пока он спал, GPT-5.6 Sol за семь секунд взяла и отменила все подписки пользователей его организации.
Сочувствуем, конечно, но почему это все больше выглядит, как рекламная кампания Anthropic?😅
Он проснулся и обнаружил, что MRR его компании упал на тысячи долларов.
Оказалось, что пока он спал, GPT-5.6 Sol за семь секунд взяла и отменила все подписки пользователей его организации.
Сочувствуем, конечно, но почему это все больше выглядит, как рекламная кампания Anthropic?
Please open Telegram to view this post
VIEW IN TELEGRAM
😁329🤨33🫡17❤8🤯8💯5👾4🤔2👍1
Grok Build CLI поймали на сливе целых репозиториев пользователей в облако
Независимые исследователи пропустили систему через прокси-перехватчик и выяснили, что клиент упаковывает весь отслеживаемый git-репозиторий вместе с полной историей коммитов и загружает его в бакет Google Cloud Storage под названием grok-code-session-traces.
При этом происходит это независимо от того, какие файлы агент реально открывал во время работы. Например, на одном из тестовых репозиториев объемом 12 ГБ канал обращений к модели передал около 192 КБ трафика (это то, что напрямую относится к задаче), а канал загрузки в хранилище передал примерно 5.1 ГБ. В облако попадают даже те файлы, которые агенту напрямую запрещают открывать.
Реакция SpaceXAI последовала только спустя несколько дней. Они заявили, что "глубоко беспокоятся о конфиденциальности пользователей", и что код и логи выполнения никогда не сохраняются для аккаунтов с включенным Zero Data Retention, остальных же призвали пользоваться командой /privacy.
Маск отдельно заявил, что SpaceXAI в качестве меры предосторожности полностью удалит все ранее загруженные данные. При этом xAI до сих пор не объяснила, почему загрузка всего репозитория стоит по умолчанию.
Независимые исследователи пропустили систему через прокси-перехватчик и выяснили, что клиент упаковывает весь отслеживаемый git-репозиторий вместе с полной историей коммитов и загружает его в бакет Google Cloud Storage под названием grok-code-session-traces.
При этом происходит это независимо от того, какие файлы агент реально открывал во время работы. Например, на одном из тестовых репозиториев объемом 12 ГБ канал обращений к модели передал около 192 КБ трафика (это то, что напрямую относится к задаче), а канал загрузки в хранилище передал примерно 5.1 ГБ. В облако попадают даже те файлы, которые агенту напрямую запрещают открывать.
Реакция SpaceXAI последовала только спустя несколько дней. Они заявили, что "глубоко беспокоятся о конфиденциальности пользователей", и что код и логи выполнения никогда не сохраняются для аккаунтов с включенным Zero Data Retention, остальных же призвали пользоваться командой /privacy.
Маск отдельно заявил, что SpaceXAI в качестве меры предосторожности полностью удалит все ранее загруженные данные. При этом xAI до сих пор не объяснила, почему загрузка всего репозитория стоит по умолчанию.
Сбер открыл доступ к новым моделям распознавания речи — GigaAM Multilingual и GigaChat Audio
GigaAM Multilingual включает два компонента. Аудиоэнкодер с самостоятельным обучением и многоязычную модель распознавания речи CTC ASR.
Аудиоэнкодер предварительно обучили на 2 млн часов речи на 70+ языках с фокусом на страны СНГ. Поэтому модель быстрее адаптируется к новым языкам и требует меньше данных для дообучения.
Многоязычную модель дообучили на 50 тысячах часов мультидоменной речи. Даже компактная версия с 240 млн параметров обгоняет популярные решения Whisper Large v3 и Omnilingual 1B.
Забирайте код и веса модели на Hugging Face и GitHub:
GigaAM Multilingual на Hugging Face
GigaAM Multilingual на GitHub
В свою очередь, GigaChat Audio — это большая языковая модель, которая объединяет возможности GigaAM Multilingual и GigaChat 3.1. Она распознаёт и переводит речь, классифицирует аудио и поддерживает диалог.
Её сильная сторона — работа с длинными записями. На аудио продолжительностью 20-60 минут показатель Intersection-over-Union локализации событий достигает 48.3. При этом объём контекста составляет до двух часов.
Кроме того, GigaChat Audio хорошо понимает русскую речь: 60.0 балла в бенчмарке RuBQ-Audio против 43.7 у Qwen3-Omni. А ещё распознаёт эмоции с точностью 90%+ по датасету Dusha.
Забирайте код и веса модели на Hugging Face:
GigaChat Audio на Hugging Face
GigaAM Multilingual включает два компонента. Аудиоэнкодер с самостоятельным обучением и многоязычную модель распознавания речи CTC ASR.
Аудиоэнкодер предварительно обучили на 2 млн часов речи на 70+ языках с фокусом на страны СНГ. Поэтому модель быстрее адаптируется к новым языкам и требует меньше данных для дообучения.
Многоязычную модель дообучили на 50 тысячах часов мультидоменной речи. Даже компактная версия с 240 млн параметров обгоняет популярные решения Whisper Large v3 и Omnilingual 1B.
Забирайте код и веса модели на Hugging Face и GitHub:
GigaAM Multilingual на Hugging Face
GigaAM Multilingual на GitHub
В свою очередь, GigaChat Audio — это большая языковая модель, которая объединяет возможности GigaAM Multilingual и GigaChat 3.1. Она распознаёт и переводит речь, классифицирует аудио и поддерживает диалог.
Её сильная сторона — работа с длинными записями. На аудио продолжительностью 20-60 минут показатель Intersection-over-Union локализации событий достигает 48.3. При этом объём контекста составляет до двух часов.
Кроме того, GigaChat Audio хорошо понимает русскую речь: 60.0 балла в бенчмарке RuBQ-Audio против 43.7 у Qwen3-Omni. А ещё распознаёт эмоции с точностью 90%+ по датасету Dusha.
Забирайте код и веса модели на Hugging Face:
GigaChat Audio на Hugging Face
❤74😁32👍16🗿9🔥7⚡3 2 2😍1🐳1😎1
Демис Хассабис призвал срочно создать специальный орган для "одобрения" моделей
Нобелевский лауреат выкатил небольшое эссе и заявил, что абсолютно все модели, вне зависимости от страны и открытости кода, должны начать проходить процедуру тестирования перед выходом на рынок США.
Хассабис считает, что AGI – «дело нескольких лет», и сравнивает это не с Интернетом или мобильной связью, а с открытием огня или электричества. Цитата:
Тем не менее, развитие обгоняет понимание технологии, и "никто в мире не знает наверняка, что будет дальше, даже эксперты расходятся во мнениях". Кибер-риски, на горизонте – био и ядерные угрозы, и все прочее.
Собственно, Демис предлагает новую структуру под названием Standards Body по модели FINRA (саморегулируемый орган финансовой индустрии в США). То есть независимый, финансируемый индустрией орган, подотчетный правительству США.
Лаборатории должны добровольно (😏 ) передавать модели на тестирование за месяц до релиза, и Standards Body будет тестировать их на угрозы всех сортов. Только после этого модель сможет получить статус «Frontier-class», а организация, ее разработавшая – «Frontier Lab».
Полный текст манифеста здесь
Мнения?
Нобелевский лауреат выкатил небольшое эссе и заявил, что абсолютно все модели, вне зависимости от страны и открытости кода, должны начать проходить процедуру тестирования перед выходом на рынок США.
Хассабис считает, что AGI – «дело нескольких лет», и сравнивает это не с Интернетом или мобильной связью, а с открытием огня или электричества. Цитата:
«Мы, по сути, нашли способ заставить песок думать. Это чудо»
Тем не менее, развитие обгоняет понимание технологии, и "никто в мире не знает наверняка, что будет дальше, даже эксперты расходятся во мнениях". Кибер-риски, на горизонте – био и ядерные угрозы, и все прочее.
Собственно, Демис предлагает новую структуру под названием Standards Body по модели FINRA (саморегулируемый орган финансовой индустрии в США). То есть независимый, финансируемый индустрией орган, подотчетный правительству США.
Лаборатории должны добровольно (
Полный текст манифеста здесь
Мнения?
Please open Telegram to view this post
VIEW IN TELEGRAM
Data Secrets
Apple подала в суд на OpenAI за присвоение торговых секретов Они утверждают, что стартап специально нанимал бывших сотрудников Apple, и что компания просила кандидатов делиться деталями секретных проектов, чтобы использовать их при разработке собственного…
OpenAI отреагировали на обвинения Apple, заявив, что у тех «нет доказательств»
Тем временем, очень кстати, Bloomberg выпустили репортаж с некоторыми подробностями о том, что будет представлять из себя устройство от OpenAI. Утверждается, что это будет мобильный смарт-спикер без экрана, но с «движущимися механическими элементами», предназначенный для сопровождения человека в доме.
Хотя мы серьезно относимся к этим обвинениям, нам не известно о каких-либо доказательствах того, что эта жалоба обоснована. Мы верим в честную конкуренцию и предоставление людям свободы работать там, где они выбирают.
Тем временем, очень кстати, Bloomberg выпустили репортаж с некоторыми подробностями о том, что будет представлять из себя устройство от OpenAI. Утверждается, что это будет мобильный смарт-спикер без экрана, но с «движущимися механическими элементами», предназначенный для сопровождения человека в доме.
😁108 31🕊8❤6 5😍2🍾2🤨1
Стартап PrismML анонсировал самую крупную модель в мире для запуска на смартфоне
В представленной модели Bonsai 27 миллиардов параметров. Обычно на телефоне такую модель не запустишь: в сыром 16-bit она будет занимать примерно 54GB, и даже если сжать ее до 4-bit, все равно будет около 18GB. На смартфон не поместится.
Bonsai же, при своем внушительном размере, оптимизирован именно под локальный запуск. Модель основана на Qwen3.6-27B, но разрабочики использовали не обычное квантование AKA округление весов, а технику Quantization-Aware Training.
Это значит, что веса не обрубали, а учили постепенно адаптироваться к дискретным значениям. Технически, на прямом проходе веса округляются до дискретных значений, и модель считает предсказание уже с ними, как в финальной сжатой версии. Но на обратном проходе градиенты вычисляются так, будто округления не было, и это позволяет модели получать осмысленный сигнал для обновления весов, несмотря на то что сами веса дискретны. То есть модель как бы сама подбирает, как масштабировать свои веса наилучшим образом.
Собственно, благодаря такой инженерии, модель сохраняет свыше 89–95% качества полноразмерной версии, и при этом занимает в 9–14 раз меньше памяти (см метрики в таблице). Для обычного квантования, которое съедает львиную долю качества, это просто феноменальные цифры.
Есть тернарный вариант (веса −1, 0 или +1; занимает ~5.9GB) и классический 1-bit (3.9GB). Второй легко укладывается в iPhone 17 Pro. Оба варианта мультимодальные. Контекст 262K токенов. Опенсорс под лицензией Apache 2.0, вот веса: huggingface.co/collections/prism-ml/bonsai-27b.
Кстати, CEO PrismML заявил, что ведет переговоры с Apple по поводу использования технологии стартапа в их устройствах.
В представленной модели Bonsai 27 миллиардов параметров. Обычно на телефоне такую модель не запустишь: в сыром 16-bit она будет занимать примерно 54GB, и даже если сжать ее до 4-bit, все равно будет около 18GB. На смартфон не поместится.
Bonsai же, при своем внушительном размере, оптимизирован именно под локальный запуск. Модель основана на Qwen3.6-27B, но разрабочики использовали не обычное квантование AKA округление весов, а технику Quantization-Aware Training.
Это значит, что веса не обрубали, а учили постепенно адаптироваться к дискретным значениям. Технически, на прямом проходе веса округляются до дискретных значений, и модель считает предсказание уже с ними, как в финальной сжатой версии. Но на обратном проходе градиенты вычисляются так, будто округления не было, и это позволяет модели получать осмысленный сигнал для обновления весов, несмотря на то что сами веса дискретны. То есть модель как бы сама подбирает, как масштабировать свои веса наилучшим образом.
Собственно, благодаря такой инженерии, модель сохраняет свыше 89–95% качества полноразмерной версии, и при этом занимает в 9–14 раз меньше памяти (см метрики в таблице). Для обычного квантования, которое съедает львиную долю качества, это просто феноменальные цифры.
Есть тернарный вариант (веса −1, 0 или +1; занимает ~5.9GB) и классический 1-bit (3.9GB). Второй легко укладывается в iPhone 17 Pro. Оба варианта мультимодальные. Контекст 262K токенов. Опенсорс под лицензией Apache 2.0, вот веса: huggingface.co/collections/prism-ml/bonsai-27b.
Кстати, CEO PrismML заявил, что ведет переговоры с Apple по поводу использования технологии стартапа в их устройствах.
4🔥188❤43👍32😍5🤨3🐳2☃1🤩1