Data Science by ODS.ai 🦜

Forwarded from Machine learning Interview

🧠 One RL to See Them All

MiniMax-AI представили Orsta-7B и Orsta-32B — мощные мультимодальные модели, обученные по новой методике V-Triune:

🔧 V-Triune объединяет:
• форматирование данных на уровне задач,
• расчет награды через кастомные верификаторы,
• мониторинг метрик по источникам.

💥 Результаты?
📈 Orsta-32B даёт **+14.1% прирост** на MEGA-Bench Core по сравнению с QwenVL-2.5!
От OCR и распознавания объектов до визуального рассуждения и математических задач — одна RL-схема покрывает всё.

📦 Модели уже доступны:
- huggingface.co/collections/One-RL-to-See-Them-All/one-rl-to-see-them-all-6833d27abce23898b2f9815a
- github.com/MiniMax-AI/One-RL-to-See-Them-All

Открытая, мощная, готовая к запуску.

#AI #Orsta #MiniMax #VisionLanguage #RLHF #VLM #Multimodal #OpenSource #HuggingFace

👍4❤1🔥1

3.35K views15:12

Data Science by ODS.ai 🦜

Forwarded from Китай.AI

🤖 Китайская модель MiniMax M2 лидирует в тесте на «сообразительность» AI-агентов

Китайский открытый ИИ MiniMax M2 показал лучший результат среди конкурентов в специализированном бенчмарке для программных инженеров. Секрет успеха — новая архитектура мышления модели.

Mini-SWE-agent — это тест, который проверяет способность больших языковых моделей выполнять реальные задачи по разработке ПО: планировать, взаимодействовать со средой и использовать инструменты.

🎯 Что такое Interleaved Thinking (Перекрёстное мышление)?

Это технология, которая позволяет модели не просто думать, а думать в процессе действия. Вместо того чтобы сначала полностью продумать план, а потом выполнить его, модель чередует этапы:

Размышление → Действие (вызов инструмента) → Наблюдение за результатом → Корректировка плана

Представьте инженера, который не пишет весь код сразу, а постоянно тестирует и правит его по ходу работы. Именно так теперь «работает» передовой ИИ.

🧠 Почему это важно? Решение проблемы «дрейфа состояния»
В сложных задачах, где нужно много шагов, у агентов была ключевая проблема — «дрейф состояния» или «забывчивость». Модель вызывала инструмент, получала результат, но забывала, зачем она это сделала и какой был общий контекст. Это как потерять нить рассуждений в середине сложного объяснения.

Interleaved Thinking решает эту проблему, сохраняя цепочку рассуждений живой на протяжении всей задачи.

📈 Тренд становится стандартом
Технологию внедряют и другие ведущие модели:
• Kimi K2 thinking — поддерживает «Thinking-in-Tools».
• Gemini 3 Pro — использует внутренний режим мышления с «подписью мысли».
• DeepSeek V3.2 — реализовал механизм «Thinking in Tool-Use».

💎 Вывод
Interleaved Thinking перестаёт быть экзотикой и становится must-have фичей для AI-агентов, которым предстоит работать в сложных, многошаговых сценариях.

GitHub

#КитайскийИИ #КитайAI #MiniMax #AIагенты #InterleavedThinking

GitHub

GitHub - MiniMax-AI/Mini-Agent: A minimal yet professional single agent demo project that showcases the core execution pipeline…

A minimal yet professional single agent demo project that showcases the core execution pipeline and production-grade features of agents. - MiniMax-AI/Mini-Agent

👍3

841 views12:00

About

Blog

Apps

Platform