SpaceXAI выложили исходный код своего агента Grok Build
Непонятно, было ли это решение запланированным, или на него повлиял недавний скандал с утечками целых репозиториев пользователей, но факт остается фактом: https://github.com/xai-org/grok-build.
В качестве бонуса сбросили лимиты всем пользователям.
По поводу утечек, к слову, ситуацию объяснили так:
Непонятно, было ли это решение запланированным, или на него повлиял недавний скандал с утечками целых репозиториев пользователей, но факт остается фактом: https://github.com/xai-org/grok-build.
В качестве бонуса сбросили лимиты всем пользователям.
По поводу утечек, к слову, ситуацию объяснили так:
С момента запуска пользователи всегда могли отключить загрузку данных в CLI, и этот выбор соблюдался. Однако в раннем бета-тестировании сохранение данных было включено по умолчанию для не-ZDR пользователей — по вашим просьбам мы это изменили. С 12 июля сохранение данных по умолчанию отключено для всех пользователей, а все ранее сохраненные данные удалены.
❤69👍36🔥12🤔7😁5🕊4⚡2☃2
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥219👍22😁21❤13🤯11👾8🫡6😎4🕊2💘2
Сертификат ответственной разработки ISO/IEC 42001 добрался до всей линейки Alice AI: что вообще можно проверять в нейросети
По ISO/IEC 42001 оценивают не саму модель, а процессы ее создания и внедрения. Хороший повод разобрать механику на примере генеративных моделей Яндекса – Alice AI VLM и Alice AI ART, которые прошли такой аудит вслед за языковой моделью, сертифицированной год назад. Аудиторов интересуют процессы: пайплайн данных от происхождения до ограничений использования, документация по целям и сценариям применения моделей, процедуры оценки правовых ограничений, мониторинг аномалий. Логика та же, что у ISO 27001 в инфобезе: стандарт не гарантирует, что модель никогда не ошибется, – он подтверждает, что весь жизненный цикл устроен по воспроизводимым и проверяемым процедурам.
Получить такой сертификат непросто: аудит требует раскрыть всю внутреннюю кухню разработки – от подготовки данных до обучения сотрудников. Далеко не каждая компания готова к такому уровню прозрачности. Среди тех, кто на это пошел, – Amazon, Anthropic, Microsoft и теперь Яндекс.
По ISO/IEC 42001 оценивают не саму модель, а процессы ее создания и внедрения. Хороший повод разобрать механику на примере генеративных моделей Яндекса – Alice AI VLM и Alice AI ART, которые прошли такой аудит вслед за языковой моделью, сертифицированной год назад. Аудиторов интересуют процессы: пайплайн данных от происхождения до ограничений использования, документация по целям и сценариям применения моделей, процедуры оценки правовых ограничений, мониторинг аномалий. Логика та же, что у ISO 27001 в инфобезе: стандарт не гарантирует, что модель никогда не ошибется, – он подтверждает, что весь жизненный цикл устроен по воспроизводимым и проверяемым процедурам.
Получить такой сертификат непросто: аудит требует раскрыть всю внутреннюю кухню разработки – от подготовки данных до обучения сотрудников. Далеко не каждая компания готова к такому уровню прозрачности. Среди тех, кто на это пошел, – Amazon, Anthropic, Microsoft и теперь Яндекс.
😁134🗿51❤32👍19🔥5😎5🤨4🤔3⚡1🕊1
This media is not supported in your browser
VIEW IN TELEGRAM
OpenAI выпустили миниатюрную клавиатуру специально под Codex
https://openai.com/supply/co-lab/work-louder/
Есть клавиши принять, отклонить, включить push-to-talk, начать новый чат и прочее. Джойстик в углу отвечает за мгновенный запуск типичных сценариев типа отладки, ревью и рефакторинга. А в другом углу – это регулятор уровня рассуждений.
https://openai.com/supply/co-lab/work-louder/
Есть клавиши принять, отклонить, включить push-to-talk, начать новый чат и прочее. Джойстик в углу отвечает за мгновенный запуск типичных сценариев типа отладки, ревью и рефакторинга. А в другом углу – это регулятор уровня рассуждений.
😁198 32🔥16 16❤7👌3👍2🍓2💯1🗿1
Внезапно выяснилось, что сегодня в США празднуют Национальный День Искусственного Интеллекта
О как
IMB поздравили оригинально
О как
IMB поздравили оригинально
😁180❤40🔥10😍6👍1🤔1💯1🍓1🍾1🎄1
Kimi K3 здесь
2.8T параметров, 1М контекста. Официальных бенчмарков пока нет, но вроде как модель бьет Fable и Sol на BrowseCamp и выходит на 3 место на GDPval.
https://www.kimi.com/
Модель также доступна по API у нас на платформе DS Lab: https://dslab.tech/ai/models/llm/kimi-k3
2.8T параметров, 1М контекста. Официальных бенчмарков пока нет, но вроде как модель бьет Fable и Sol на BrowseCamp и выходит на 3 место на GDPval.
https://www.kimi.com/
Модель также доступна по API у нас на платформе DS Lab: https://dslab.tech/ai/models/llm/kimi-k3
1🤯217🔥54🤔25❤19👍17😁6⚡2☃1
Data Secrets
Kimi K3 здесь 2.8T параметров, 1М контекста. Официальных бенчмарков пока нет, но вроде как модель бьет Fable и Sol на BrowseCamp и выходит на 3 место на GDPval. https://www.kimi.com/ Модель также доступна по API у нас на платформе DS Lab: https://dsla…
Про Kimi K3. В итоге модель уверенно бьет Opus 4.8*, но до Fable и Sol дотягивает далеко не везде. Так или иначе, это новая открытая SOTA, и она как никогда близка к закрытым лидерам.
Из интересного также первое место на Frontend Code Arena, с достаточно большим отрывом от Fable и Sol.
А еще, помните то видео, которое Moonshot выпускали как тизер? Так вот его из 56 сырых видео полностью смонтировала сама K3.
* Цена при этом почти в два раза меньше Opus 4.8: $3 input / $15 output за миллион токенов.
Из интересного также первое место на Frontend Code Arena, с достаточно большим отрывом от Fable и Sol.
А еще, помните то видео, которое Moonshot выпускали как тизер? Так вот его из 56 сырых видео полностью смонтировала сама K3.
* Цена при этом почти в два раза меньше Opus 4.8: $3 input / $15 output за миллион токенов.
🔥237❤36👍33🤯7☃4🤨3❤🔥2😁1💯1🤗1
This media is not supported in your browser
VIEW IN TELEGRAM
В Шэньчжэне стартовал первый в мире MMA чемпионат среди роботов – Ultimate Robot Knock-out Legeng
Выглядит достаточно эпично. Главный приз – полтора миллиона долларов, кстати.
Выглядит достаточно эпично. Главный приз – полтора миллиона долларов, кстати.
1❤185😁145🔥46🤯14👏6🏆6⚡3👍3☃2💯1🍓1
Список обещаний Илона Маска пополнился: он пообещал сделать X полностью опенсорсным
Речь не о рекомендательном или каком-то отдельном алгоритме, он имеет в виду буквально X целиком.
Речь не о рекомендательном или каком-то отдельном алгоритме, он имеет в виду буквально X целиком.
Кроме того, мы пригласим независимых экспертов для проверки системы, которая сейчас работает, чтобы подтвердить, что открытый исходный код соответствует тому, что действительно запущено. Доверие через полную прозрачность – это единственное, чему стоит верить.
1🔥254🤔65😁29❤23🤯13👍10 8🫡3🗿2☃1🍾1
Forwarded from Data Secrets | Карьера
Hugging Face × alphaXiv запустили крутой челлендж
В качестве задачи разработчикам и исследователям предлагают взять любую интересующую научную работу и попытаться воспроизвести ее ключевые результаты с помощью агентов.
Цель проекта – создать публичную базу проверок научных работ, чтобы сделать их более прозрачными и воспроизводимыми. Особенно учитывая, что около 70% работ в ИИ не воспроизводятся.
Из приятного: организаторы предлагают GPU-кредиты на 4000$ + отдельные призы от OpenResearch. А сам челлендж закончится 2 августа, так что не упустите возможность поучаствовать.
В качестве задачи разработчикам и исследователям предлагают взять любую интересующую научную работу и попытаться воспроизвести ее ключевые результаты с помощью агентов.
Цель проекта – создать публичную базу проверок научных работ, чтобы сделать их более прозрачными и воспроизводимыми. Особенно учитывая, что около 70% работ в ИИ не воспроизводятся.
Из приятного: организаторы предлагают GPU-кредиты на 4000$ + отдельные призы от OpenResearch. А сам челлендж закончится 2 августа, так что не упустите возможность поучаствовать.
🔥157❤32👍12😁5🤯2
Т-Технологии выпустили опенсорс-модель T-Search
Сегодня команда Data Secrets посещает ML Conf. Послушали доклад Анатолия Потапова, руководителя группы фундаментальных технологий LLM в Центре искусственного интеллекта Т-Банка, где как раз презентовали модель.
T-Search это первая открытая русскоязычная модель для Agentic RAG, заточенная на многошаговый поиск для бизнеса.
В отличие от классического RAG с одним запросом, T-Search – агент-ретривер: внутри ReAct-цикл с тремя инструментами – search_corpus, save_and_advance (сохранение чанков, новый раунд) и finalize_ranking (финальный ранжированный список). Ответ модель не генерирует, только отдает evidence-чанки, генерацию берет на себя любая LLM. Это сокращает стоимость инференса на 20–50%.
Агент работает раундами: внутри раунда каждого вот такой ReAct-loop с бюджетом ~32K токенов; при заполнении 75% окна поиск блокируется, и агент либо сохраняет память и переходит в новый раунд, либо финализирует результат. Между раундами передается не вся история вызовов, а сжатое состояние поиска, так контекст остается в разумных пределах даже при глубоком поиске.
Бюджетом поиска можно управлять гибко: один быстрый прогон или несколько параллельных роллаутов с RRF-объединением.
Модель построена на Qwen3.6-35B-A3B, для запуска хватает одной H100. По recall T-Search обходит более крупные открытые модели, включая Qwen3.5-397B, GLM-5.2 и Kimi-K2.6. Вместе с ней выложили два бенчмарка: собранный вручную русскоязычный TRuST и синтетический SynthComp.
Модель уже опубликована на Hugging Face под лицензией Apache 2.0
Сегодня команда Data Secrets посещает ML Conf. Послушали доклад Анатолия Потапова, руководителя группы фундаментальных технологий LLM в Центре искусственного интеллекта Т-Банка, где как раз презентовали модель.
T-Search это первая открытая русскоязычная модель для Agentic RAG, заточенная на многошаговый поиск для бизнеса.
В отличие от классического RAG с одним запросом, T-Search – агент-ретривер: внутри ReAct-цикл с тремя инструментами – search_corpus, save_and_advance (сохранение чанков, новый раунд) и finalize_ranking (финальный ранжированный список). Ответ модель не генерирует, только отдает evidence-чанки, генерацию берет на себя любая LLM. Это сокращает стоимость инференса на 20–50%.
Агент работает раундами: внутри раунда каждого вот такой ReAct-loop с бюджетом ~32K токенов; при заполнении 75% окна поиск блокируется, и агент либо сохраняет память и переходит в новый раунд, либо финализирует результат. Между раундами передается не вся история вызовов, а сжатое состояние поиска, так контекст остается в разумных пределах даже при глубоком поиске.
Бюджетом поиска можно управлять гибко: один быстрый прогон или несколько параллельных роллаутов с RRF-объединением.
Модель построена на Qwen3.6-35B-A3B, для запуска хватает одной H100. По recall T-Search обходит более крупные открытые модели, включая Qwen3.5-397B, GLM-5.2 и Kimi-K2.6. Вместе с ней выложили два бенчмарка: собранный вручную русскоязычный TRuST и синтетический SynthComp.
Модель уже опубликована на Hugging Face под лицензией Apache 2.0
1👍131❤56🔥31😁17😢5❤🔥4🤯2🕊2😎2☃1🎉1
Alibaba анонсировали Qwen 3.8
Будет 2.4T параметров, и разработчики утверждают, что уступать модель будет разве что Fable.
Qwen3.8-Max-Preview уже можно попробовать в Token Plan, Qoder и QoderWork. Скоро раскатят глобально и выложат веса.
Еще один убийца американского лидерства⌨️
Будет 2.4T параметров, и разработчики утверждают, что уступать модель будет разве что Fable.
Qwen3.8-Max-Preview уже можно попробовать в Token Plan, Qoder и QoderWork. Скоро раскатят глобально и выложат веса.
Еще один убийца американского лидерства
Please open Telegram to view this post
VIEW IN TELEGRAM
1⚡190🔥82👍35😁14 12🤯7🗿5🏆2❤🔥1🍓1🫡1
Fable 5 опровергла известную гипотезу Якобиана
Она формулируется так: если у полиномиального отображения постоянный ненулевой якобиан, то у него должен существовать полиномиальный обратный. Надо понимать, что это не очередная узкая проблема математки, а буквально центральный вопрос обратимости полиномиального отображения, который с 30-х годов прошлого века оброс кучей литературы и споров.
До сегодняшнего дня были доказаны только некоторые частные случаи. Найденный Fable пример гипотезу окончательно опровергает.
О решении объявили математики Levent Alpöge и Akhil Mathew, его уже проверили в автоматических верификаторах и подтвердили некоторые независимые математики.
Math is solved?
Она формулируется так: если у полиномиального отображения постоянный ненулевой якобиан, то у него должен существовать полиномиальный обратный. Надо понимать, что это не очередная узкая проблема математки, а буквально центральный вопрос обратимости полиномиального отображения, который с 30-х годов прошлого века оброс кучей литературы и споров.
До сегодняшнего дня были доказаны только некоторые частные случаи. Найденный Fable пример гипотезу окончательно опровергает.
О решении объявили математики Levent Alpöge и Akhil Mathew, его уже проверили в автоматических верификаторах и подтвердили некоторые независимые математики.
Math is solved?
1🔥279🤯99❤22😁12👍8🤔5💯5🤨5🫡2😎2🎄1