MiniMax выпустили модель M3. Это первая open-weight модель, которая сочетает три вещи сразу: контекст в миллион токенов, нативная мультимодальность (видео и картинки), и кодинг на уровне топовых закрытых моделей.
Главная техническая фишка — новая архитектура внимания MSA. Она позволяет работать с миллионом токенов без квадратичного роста вычислений: в 20 раз меньше compute на токен, prefill быстрее в 9 раз.
На SWE-Bench Pro модель набирает 59%. Больше GPT-5.5, больше Gemini 3.1 Pro. Но MiniMax аккуратно сравнивают себя с Opus 4.7, игнорируя 4.8 — а там разрыв уже 10 пунктов. Это не "почти на уровне Claude", это "хороший уровень, но не frontier". Даже Opus 4.6 делом круто, поэтому некритично.
Есть два интересных нюанса.
1️⃣ Первый: большинство бенчмарков они гоняли через Claude Code как scaffolding. То есть результаты конкурента получены с помощью инструмента Anthropic.
2️⃣ Второй: у них теперь есть свой агент — MiniMax Code. Прямой конкурент Claude Code. Демки впечатляют — 24-часовая оптимизация CUDA-ядра, 12-часовое воспроизведение научной статьи без участия человека.
Цена в 10-15 раз дешевле Claude Opus и GPT-5.5.
#AI #MiniMax
Главная техническая фишка — новая архитектура внимания MSA. Она позволяет работать с миллионом токенов без квадратичного роста вычислений: в 20 раз меньше compute на токен, prefill быстрее в 9 раз.
На SWE-Bench Pro модель набирает 59%. Больше GPT-5.5, больше Gemini 3.1 Pro. Но MiniMax аккуратно сравнивают себя с Opus 4.7, игнорируя 4.8 — а там разрыв уже 10 пунктов. Это не "почти на уровне Claude", это "хороший уровень, но не frontier". Даже Opus 4.6 делом круто, поэтому некритично.
Есть два интересных нюанса.
Цена в 10-15 раз дешевле Claude Opus и GPT-5.5.
#AI #MiniMax
Please open Telegram to view this post
VIEW IN TELEGRAM
👍25👎1