Правительство США, ссылаясь на полномочия в сфере национальной безопасности, выпустило директиву экспортного контроля, требующую приостановить любой доступ к Fable 5 и Mythos 5 для иностранных граждан — независимо от того, находятся они в США или за их пределами. Это касается в том числе иностранных сотрудников Anthropic.
Практический результат этого распоряжения: нам необходимо срочно отключить Fable 5 и Mythos 5 для всех наших клиентов, чтобы обеспечить соблюдение требований.
Доступ ко всем остальным моделям Claude не затронут.
Мы приносим извинения клиентам за этот сбой. Мы считаем, что это недоразумение, и работаем над тем, чтобы восстановить доступ как можно скорее.
https://www.anthropic.com/news/fable-mythos-access
Практический результат этого распоряжения: нам необходимо срочно отключить Fable 5 и Mythos 5 для всех наших клиентов, чтобы обеспечить соблюдение требований.
Доступ ко всем остальным моделям Claude не затронут.
Мы приносим извинения клиентам за этот сбой. Мы считаем, что это недоразумение, и работаем над тем, чтобы восстановить доступ как можно скорее.
https://www.anthropic.com/news/fable-mythos-access
😱32❤5👍3🔥3😁2🥴2👏1
Китай может решить главную проблему зелёной энергетики уже к 2030 году
Главная слабость возобновляемой энергетики, то что энергия появляется не тогда, когда она нужна, а когда есть солнце или ветер.
Китай сейчас старается решить это проблему этот разрыв с помощью grid storage -накопителей энергии, подключённых прямо к электросети.
Они работают как огромный буфер: забирают электричество, когда генерации много и цена низкая, а потом возвращают его в сеть вечером, ночью или в часы пикового спроса.
И темпы у Китая уже почти неприличные.
Только за декабрь 2025 года Китай установил 65,4 ГВт·ч сетевых батарей. Это больше, чем США установили за весь 2025 год - 46,5 ГВт·ч.
При этом США остаются вторым крупнейшим рынком накопителей после Китая.
Батареи превращают солнечную и ветровую энергетику из «нестабильной» в управляемую. Сеть получает возможность сохранять избыток дешёвой энергии и отдавать её тогда, когда она реально нужна.
Китай одновременно делает три вещи:
- строит огромный избыток солнечной и ветровой генерации;
- рекордными темпами наращивает накопители;
- быстро переводит транспорт, промышленность и города на электричество.
Если такая динамика сохранится, уже к 2030 году Китай может приблизиться к энергосистеме, где потребности в электричестве всё чаще закрываются связкой renewables + storage, а не углём и газом.
https://reneweconomy.com.au/graph-of-the-day-batteries-are-beating-solar-to-deliver-the-fastest-energy-transition-in-human-history/
Главная слабость возобновляемой энергетики, то что энергия появляется не тогда, когда она нужна, а когда есть солнце или ветер.
Китай сейчас старается решить это проблему этот разрыв с помощью grid storage -накопителей энергии, подключённых прямо к электросети.
Они работают как огромный буфер: забирают электричество, когда генерации много и цена низкая, а потом возвращают его в сеть вечером, ночью или в часы пикового спроса.
И темпы у Китая уже почти неприличные.
Только за декабрь 2025 года Китай установил 65,4 ГВт·ч сетевых батарей. Это больше, чем США установили за весь 2025 год - 46,5 ГВт·ч.
При этом США остаются вторым крупнейшим рынком накопителей после Китая.
Батареи превращают солнечную и ветровую энергетику из «нестабильной» в управляемую. Сеть получает возможность сохранять избыток дешёвой энергии и отдавать её тогда, когда она реально нужна.
Китай одновременно делает три вещи:
- строит огромный избыток солнечной и ветровой генерации;
- рекордными темпами наращивает накопители;
- быстро переводит транспорт, промышленность и города на электричество.
Если такая динамика сохранится, уже к 2030 году Китай может приблизиться к энергосистеме, где потребности в электричестве всё чаще закрываются связкой renewables + storage, а не углём и газом.
https://reneweconomy.com.au/graph-of-the-day-batteries-are-beating-solar-to-deliver-the-fastest-energy-transition-in-human-history/
❤26👍15🔥10😁2🤔2🤯1😐1
Forwarded from Машинное обучение RU
OpenRouter запустил Fusion - систему, где на один запрос отвечает не одна модель, а сразу несколько
Суть в том, что Fusion отправляет ваш промпт параллельно в разные модели. Каждая модель пытается решить задачу по-своему, при необходимости использует web search и bash-инструменты, а затем отдельный judge сравнивает ответы. После этого synthesizer собирает финальный вариант.
Получается не просто «выбор лучшей модели», а полноценная серверная схема коллективного мышления:
* несколько моделей работают одновременно;
* инструменты помогают проверять факты и считать;
* judge отбрасывает слабые ответы;
* synthesizer собирает итоговый результат в один связный ответ.
OpenRouter утверждает, что Fusion уже обходит frontier-модели на DRACO, deep research benchmark от Perplexity.
https://openrouter.ai/fusion
@machinelearning_ru
Суть в том, что Fusion отправляет ваш промпт параллельно в разные модели. Каждая модель пытается решить задачу по-своему, при необходимости использует web search и bash-инструменты, а затем отдельный judge сравнивает ответы. После этого synthesizer собирает финальный вариант.
Получается не просто «выбор лучшей модели», а полноценная серверная схема коллективного мышления:
* несколько моделей работают одновременно;
* инструменты помогают проверять факты и считать;
* judge отбрасывает слабые ответы;
* synthesizer собирает итоговый результат в один связный ответ.
OpenRouter утверждает, что Fusion уже обходит frontier-модели на DRACO, deep research benchmark от Perplexity.
https://openrouter.ai/fusion
@machinelearning_ru
👍12❤7🔥7
🇧🇷 Мэрия Рио-де-Жанейро (через свою муниципальную ит-компанию IplanRIO) только что выпустила модель под названием Rio 3.5 Open 397B
Модель с 397 миллиардами параметров (MoE), основанная на Qwen 3.5, с полностью открытой лицензией MIT, которая превосходит свою базовую модель и конкурирует с лучшими frontier в задачах программирования и агентного кодирования.
https://huggingface.co/prefeitura-rio/Rio-3.5-Open-397B
Модель с 397 миллиардами параметров (MoE), основанная на Qwen 3.5, с полностью открытой лицензией MIT, которая превосходит свою базовую модель и конкурирует с лучшими frontier в задачах программирования и агентного кодирования.
https://huggingface.co/prefeitura-rio/Rio-3.5-Open-397B
🔥34❤12👍4
Google Research представила Gemini-SQL2 - новую систему text-to-SQL на базе Gemini 3.1 Pro.
Она превращает вопросы на обычном языке в исполняемые SQL-запросы, позволяя получать данные из баз без ручного написания кода.
На бенчмарке BIRD система показала state-of-the-art результат - 80,04% execution accuracy.
BIRD реально запускает запрос и проверяет, возвращает ли он правильный результат.
https://x.com/GoogleResearch/status/2065475343205740911
@data_analysis_ml
Она превращает вопросы на обычном языке в исполняемые SQL-запросы, позволяя получать данные из баз без ручного написания кода.
На бенчмарке BIRD система показала state-of-the-art результат - 80,04% execution accuracy.
BIRD реально запускает запрос и проверяет, возвращает ли он правильный результат.
https://x.com/GoogleResearch/status/2065475343205740911
@data_analysis_ml
👍28🔥13❤7
Теперь официально: SpaceX покупает Cursor в сделке полностью за акции, оценённой в $60 млрд.
Этот шаг моментально даёт ИИ-империи Илона Маска серьёзный enterprise-продукт для программирования и может помочь xAI сократить отставание от Claude Code от Anthropic и Codex от OpenAI.
Однако на практике всё больше похоже, что xAI скорее сдаёт свои дата-центры в аренду и позиционирует себя как hyperscaler, чем реально стремится участвовать в гонке за SOTA-модель.
Этот шаг моментально даёт ИИ-империи Илона Маска серьёзный enterprise-продукт для программирования и может помочь xAI сократить отставание от Claude Code от Anthropic и Codex от OpenAI.
Однако на практике всё больше похоже, что xAI скорее сдаёт свои дата-центры в аренду и позиционирует себя как hyperscaler, чем реально стремится участвовать в гонке за SOTA-модель.
❤18🔥7👍5
Forwarded from Kali Linux
Апдейт по Fable 5 / Anthropic: компания отправила своих ведущих специалистов по безопасности в Вашингтон. Экспортные ограничения всё ещё
Anthropic и администрация Трампа завершили переговоры в понедельник без результата: экспортные ограничения на Claude Fable 5 остаются в силе. Когда их снимут - непонятно.
Компания несколько дней убеждала Вашингтон, что опасения вокруг модели преувеличены. Ту же позицию Anthropic повторила перед исследователями из Министерства торговли США.
Министр торговли Говард Лютник подключился к встрече по телефону с саммита G7 в Эвиане, Франция. Кибердиректор Шон Кэрнкросс в переговорах не участвовал.
Со стороны Anthropic обсуждение вели сооснователь Том Браун и глава внешних связей Сара Хек. Руководитель red teaming Логан Грэм и исследователь безопасности Николас Карлини специально прилетели в Вашингтон для этих переговоров.
Главный спор - можно ли снять защитные ограничения Fable 5 и открыть более мощные возможности Mythos, которые находятся «под капотом». NSA считает, что да. Anthropic утверждает, что риск преувеличен.
Пока нет ясного понимания, какими будут следующие шаги.
@linuxkalii
Anthropic и администрация Трампа завершили переговоры в понедельник без результата: экспортные ограничения на Claude Fable 5 остаются в силе. Когда их снимут - непонятно.
Компания несколько дней убеждала Вашингтон, что опасения вокруг модели преувеличены. Ту же позицию Anthropic повторила перед исследователями из Министерства торговли США.
Министр торговли Говард Лютник подключился к встрече по телефону с саммита G7 в Эвиане, Франция. Кибердиректор Шон Кэрнкросс в переговорах не участвовал.
Со стороны Anthropic обсуждение вели сооснователь Том Браун и глава внешних связей Сара Хек. Руководитель red teaming Логан Грэм и исследователь безопасности Николас Карлини специально прилетели в Вашингтон для этих переговоров.
Главный спор - можно ли снять защитные ограничения Fable 5 и открыть более мощные возможности Mythos, которые находятся «под капотом». NSA считает, что да. Anthropic утверждает, что риск преувеличен.
Пока нет ясного понимания, какими будут следующие шаги.
@linuxkalii
🔥8❤7👍3🌭2
DeepSeek провела первый раунд внешнего финансирования и привлекла более 50 млрд юаней, примерно $7,4 млрд. Оценка компании, по сообщениям, превысила $50 млрд.
Инвесторы заходят не напрямую в DeepSeek, а через limited partnership, которым управляет CEO компании Лян Вэньфэн. Такая структура позволяет ему сохранить полный контроль над компанией.
Единственное исключение - China National AI Industry Investment Fund. Этот фонд инвестирует напрямую в DeepSeek и получает право голоса. Его вклад составляет 1 млрд юаней.
Обычные инвесторы не получают права голоса, но получают доступ к финансовой информации и приоритетное право участия в будущих раундах. Все доли инвесторов заблокированы на пять лет, чтобы снизить риск краткосрочной спекуляции.
Крупные инвесторы:
* Лян Вэньфэн — 20 млрд юаней
* Tencent — 10 млрд юаней
* CATL — 5 млрд юаней
* JD.com — 3 млрд юаней
* NetEase — 3 млрд юаней
* IDG Capital — 3 млрд юаней
Сообщается, что менеджмент DeepSeek тщательно проверяет личности LP-инвесторов, которые стоят за инвестиционными фондами.
Раньше DeepSeek работала без внешнего финансирования, но растущие расходы на вычисления и усиливающаяся борьба за AI-таланты сделали привлечение капитала необходимым.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤7👍7
Hugging Face выкатили Serge, опенсорсного ИИ-ревьюера для GitHub.
Работает просто: вызываете агента в комментариях к pull request, и он сам проходит по diff, ищет баги, спорные места и оставляет замечания прямо в PR.
Что удобно:
* можно задавать правила ревью прямо в репозитории
* можно указать, на что агент должен обращать внимание
* можно заранее описать, что стоит игнорировать
* ревью запускается через обычный комментарий
* проект open source
Разработчики Hugging Face уже используют Serge внутри компании, в том числе для ревью в diffusers и transformers.
По сути, это ещё один шаг к новой норме: ревью кода становится не только задачей людей, но и постоянным AI-слоем поверх GitHub.
Не замена нормальному code review, а дополнительный фильтр, который может поймать очевидные баги, регрессии и странные решения до того, как до них дойдёт человек.
https://huggingface.co/blog/huggingface/serge
Работает просто: вызываете агента в комментариях к pull request, и он сам проходит по diff, ищет баги, спорные места и оставляет замечания прямо в PR.
Что удобно:
* можно задавать правила ревью прямо в репозитории
* можно указать, на что агент должен обращать внимание
* можно заранее описать, что стоит игнорировать
* ревью запускается через обычный комментарий
* проект open source
Разработчики Hugging Face уже используют Serge внутри компании, в том числе для ревью в diffusers и transformers.
По сути, это ещё один шаг к новой норме: ревью кода становится не только задачей людей, но и постоянным AI-слоем поверх GitHub.
Не замена нормальному code review, а дополнительный фильтр, который может поймать очевидные баги, регрессии и странные решения до того, как до них дойдёт человек.
https://huggingface.co/blog/huggingface/serge
👍18❤3🔥2
VibeThinker-3B от Weibo
Weibo представила VibeThinker-3B - компактную reasoning-модель на 3B параметров, которая неожиданно сильно выступает в задачах с проверяемым ответом.
На математических бенчмарках вроде AIME 2026 и IMO-AnsBench, а также на новых задачах LeetCode, модель показывает результаты уровня систем, которые в десятки раз больше.
Что интересно:
* сильные результаты в математике и кодинге
* фокус на задачах с чёткой проверкой ответа
* компактный размер 3B
* веса, код и статья открыты
* модель можно запускать на довольно скромном железе
Похоже, рынок всё больше уходит не только в сторону гигантских универсальных моделей, но и в сторону маленьких специализированных reasoning-моделей.
Model : https://huggingface.co/WeiboAI/VibeThinker-3B
Github: https://github.com/WeiboAI/VibeThinker
Paper: https://huggingface.co/papers/2606.16140
#AI #LLM #Reasoning #OpenSource #SmallModel
Weibo представила VibeThinker-3B - компактную reasoning-модель на 3B параметров, которая неожиданно сильно выступает в задачах с проверяемым ответом.
На математических бенчмарках вроде AIME 2026 и IMO-AnsBench, а также на новых задачах LeetCode, модель показывает результаты уровня систем, которые в десятки раз больше.
Что интересно:
* сильные результаты в математике и кодинге
* фокус на задачах с чёткой проверкой ответа
* компактный размер 3B
* веса, код и статья открыты
* модель можно запускать на довольно скромном железе
Похоже, рынок всё больше уходит не только в сторону гигантских универсальных моделей, но и в сторону маленьких специализированных reasoning-моделей.
Model : https://huggingface.co/WeiboAI/VibeThinker-3B
Github: https://github.com/WeiboAI/VibeThinker
Paper: https://huggingface.co/papers/2606.16140
#AI #LLM #Reasoning #OpenSource #SmallModel
❤13👍5🔥5
История с будущим IPO OpenAI может получиться очень непростой.
В первом квартале 2026 года у компании, по этим данным, было:
$5,7 млрд выручки
$3,7 млрд сожжённых денег
$9,3 млрд операционного убытка
$665 млрд обязательств на вычислительные мощности до 2030 года
Спрос на ИИ огромный, с этим уже сложно спорить. Но проблема в другом: чтобы оставаться на уровне лучших frontier-моделей, OpenAI приходится тратить колоссальные деньги на инфраструктуру и вычисления.
То есть бизнес растёт, но цена этого роста пока очень высокая.
Cможет ли OpenAI превратить этот спрос в устойчивую прибыльную модель.
И на этом фоне сравнение с Anthropic будет особенно жёстким.
В первом квартале 2026 года у компании, по этим данным, было:
$5,7 млрд выручки
$3,7 млрд сожжённых денег
$9,3 млрд операционного убытка
$665 млрд обязательств на вычислительные мощности до 2030 года
Спрос на ИИ огромный, с этим уже сложно спорить. Но проблема в другом: чтобы оставаться на уровне лучших frontier-моделей, OpenAI приходится тратить колоссальные деньги на инфраструктуру и вычисления.
То есть бизнес растёт, но цена этого роста пока очень высокая.
Cможет ли OpenAI превратить этот спрос в устойчивую прибыльную модель.
И на этом фоне сравнение с Anthropic будет особенно жёстким.
🔥13❤5👍4🌚2
Новая 7B coding-модель с Apache 2.0 лицензией. Г
Модель переиспользует общие Transformer-блоки и делает дополнительный круг рассуждения во время инференса.
Что внутри:
* 2-loop режим оказался лучшей точкой
Он сильнее 1-loop baseline на бенчмарках по коду, software engineering, терминалу и tool-use задачам.
* Особенно заметный прирост на repo-level задачах
Самые большие улучшения видны на SWE-bench Verified и Multi-SWE, где важна работа не с отдельной функцией, а с целым репозиторием.
* Модель обучали с нуля
LoopCoder-V2 прошёл pretraining на 18T токенов и 100+ языках программирования.
Интересная деталь: это не просто очередная 7B coding-модель, а попытка выжать больше качества за счёт test-time reasoning без радикального роста размера модели.
Apache 2.0 делает релиз особенно приятным для экспериментов и интеграции в свои dev-пайплайны.
Ссылка:
https://modelscope.ai/models/Multilingual-Multimodal-NLP/LoopCoder-V2
Модель переиспользует общие Transformer-блоки и делает дополнительный круг рассуждения во время инференса.
Что внутри:
* 2-loop режим оказался лучшей точкой
Он сильнее 1-loop baseline на бенчмарках по коду, software engineering, терминалу и tool-use задачам.
* Особенно заметный прирост на repo-level задачах
Самые большие улучшения видны на SWE-bench Verified и Multi-SWE, где важна работа не с отдельной функцией, а с целым репозиторием.
* Модель обучали с нуля
LoopCoder-V2 прошёл pretraining на 18T токенов и 100+ языках программирования.
Интересная деталь: это не просто очередная 7B coding-модель, а попытка выжать больше качества за счёт test-time reasoning без радикального роста размера модели.
Apache 2.0 делает релиз особенно приятным для экспериментов и интеграции в свои dev-пайплайны.
Ссылка:
https://modelscope.ai/models/Multilingual-Multimodal-NLP/LoopCoder-V2
👍11❤4🔥3
Исследователи NVIDIA перенесли модель владения Rust в GPU-kernels.
Paper: “Fearless Concurrency on the GPU”. В нём представлен cuTile Rust.
Проблема была в том, что при написании кастомных GPU-ядер на Rust разработчикам фактически приходилось выходить за пределы гарантий безопасности Rust.
cuTile Rust пытается это исправить:
* mutable outputs разбиваются на непересекающиеся части
* запуск kernels сохраняет правила ownership от host до device
* при необходимости остаются локальные opt-out механизмы для низкоуровневого контроля
Производительность тоже держится на уровне:
* 7 TB/s для element-wise операций на NVIDIA B200
* 2 PFlop/s для GEMM, это 96% от cuBLAS
* результат сопоставим с cuTile Python в пределах погрешности измерений
Авторы также собрали Grout, inference engine поверх cuTile Rust, и прогнали реальные модели:
* 171 tokens/s для Qwen3-4B на RTX 5090
* 82 tokens/s для Qwen3-32B на B200
* конкурентный уровень рядом с vLLM и SGLang
Итог - безопасный и идиоматичный Rust почти на полной CUDA-производительности.
Для Rust в ML-инфраструктуре это большой шаг.
http://arxiv.org/abs/2606.15991
#Rust #RustLang #GPU #CUDA #MachineLearning #SystemsProgramming #NVIDIA
@data_analysis_ml
Paper: “Fearless Concurrency on the GPU”. В нём представлен cuTile Rust.
Проблема была в том, что при написании кастомных GPU-ядер на Rust разработчикам фактически приходилось выходить за пределы гарантий безопасности Rust.
cuTile Rust пытается это исправить:
* mutable outputs разбиваются на непересекающиеся части
* запуск kernels сохраняет правила ownership от host до device
* при необходимости остаются локальные opt-out механизмы для низкоуровневого контроля
Производительность тоже держится на уровне:
* 7 TB/s для element-wise операций на NVIDIA B200
* 2 PFlop/s для GEMM, это 96% от cuBLAS
* результат сопоставим с cuTile Python в пределах погрешности измерений
Авторы также собрали Grout, inference engine поверх cuTile Rust, и прогнали реальные модели:
* 171 tokens/s для Qwen3-4B на RTX 5090
* 82 tokens/s для Qwen3-32B на B200
* конкурентный уровень рядом с vLLM и SGLang
Итог - безопасный и идиоматичный Rust почти на полной CUDA-производительности.
Для Rust в ML-инфраструктуре это большой шаг.
http://arxiv.org/abs/2606.15991
#Rust #RustLang #GPU #CUDA #MachineLearning #SystemsProgramming #NVIDIA
@data_analysis_ml
❤12👍7🔥5
DeepMind опубликовали материал “Securing the future of AI agents” про безопасность автономных агентов внутри реальной инфраструктуры.
Чем умнее становятся агенты, тем меньше достаточно обычного alignment. Нужен отдельный системный слой защиты, который работает даже в сценарии, где агент ошибается, неправильно понимает задачу или ведёт себя не так, как ожидали.
Для этого Google DeepMind развивают AI Control Roadmap.
Что важно:
- Агентов предлагают рассматривать как потенциальный insider threat
То есть не как обычный чат-бот, а как систему с доступами, инструментами и возможностью влиять на инфраструктуру.
- Defense-in-depth вместо одной защиты
В основе остаются sandboxing, endpoint security и защита от prompt injection, но сверху добавляется контроль поведения агента.
- AI-супервизоры следят за AI-агентами
Доверенные модели анализируют reasoning, действия и планы рабочего агента. Если поведение выглядит опасным, действие можно заблокировать до ущерба.
- Права выдаются постепенно
Агент получает доступы не «всё сразу», а по мере доказанного безопасного поведения. DeepMind сравнивает это с инструктором по вождению, который доверяет ученику, но держит руку на тормозе.
- Они уже анализировали миллион задач coding-агентов
Это помогло уйти от примитивных keyword-фильтров к поиску реальных поведенческих паттернов. Например, такие мониторы уже помогают отслеживать риски вроде случайного удаления данных.
DeepMind прямо признаёт, что проблема часто не в злонамеренности агента, а в его чрезмерном усердии или неправильной интерпретации цели пользователя.
https://deepmind.google/blog/securing-the-future-of-ai-agents/
Please open Telegram to view this post
VIEW IN TELEGRAM
❤7🔥4👍2