Анализ данных (Data analysis)
50.6K subscribers
3.54K photos
445 videos
1 file
2.9K links
Data science, наука о данных.

@haarrp - админ

РКН: clck.ru/3FmyAp
Download Telegram
UnMaskFork: несколько диффузионных моделей вместе решают одну задачу

Статья от Sakana UnMaskFork, принятая на ICML 2026, предлагает новый способ масштабирования вычислений во время вывода для маскированных диффузионных языковых моделей.

Обычные LLM генерируют текст последовательно - токен за токеном. Маскированные диффузионные модели начинают с полностью скрытого текста и постепенно восстанавливают его части, причём могут заполнять несколько фрагментов параллельно.

Но привычный подход к test-time scaling - повысить температуру и сгенерировать много разных ответов, для таких моделей работает не слишком эффективно.

UnMaskFork решает проблему иначе:

- несколько диффузионных моделей работают над одним ответом;
- каждая по очереди раскрывает те участки, в которых наиболее уверена;
- промежуточный результат передаётся следующей модели;
- поиск по дереву Монте-Карло выбирает наиболее перспективную последовательность действий.

Разнообразие создаётся не случайностью, а переключением между моделями с разными сильными сторонами.

В экспериментах подход улучшил результаты Dream-Coder на задачах по программированию и показал стабильный рост качества на математических бенчмарках при увеличении вычислений во время вывода.

При этом UnMaskFork:

- не требует дополнительного обучения;
- не меняет внутреннюю архитектуру моделей;
- работает как отдельный алгоритм координации;
- позволяет комбинировать модели, обученные на разных данных и разными методами.

Работа продолжает исследования Sakana AI в области «коллективного разума» моделей - систем, где результат достигается не одной большой LLM, а координацией нескольких разных моделей.

Блог: https://pub.sakana.ai/umf
Статья: https://arxiv.org/abs/2602.04344

#AI #LLM #DiffusionModels #ICML2026 #MachineLearning #SakanaAI
8🔥5👍4
✔️ ByteDance открыл набор ученых и аспирантов для ML-исследований

Китайский гигант запустил инициативу STEM Scientist в рамках проекта Seed. Компания отберет 100 ученых и аспирантов для полугодовой работы над применением машинного обучения в фундаментальной науке.

Программа предполагает 2 формата: позиции научных консультантов для отраслевых экспертов и стажировки для PhD-студентов STEM-направлений.

Базовое требование - опыт использования ИИ в исследованиях. Навыки программирования станут плюсом.

Со своей стороны ByteDance предоставляет зарплату, доступ к вычислительным ресурсам и работу с собственной ИИ-командой.

Участие требует очного присутствия в пекинском офисе компании. Заявки принимаются до 30 сентября 2026 года.



#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13🔥43
DeepSeek предупредила разработчиков о «значительном» повышении цен на API в ближайшее время. Новые тарифы и дата перехода пока не объявлены.

Сейчас DeepSeek V4 Flash 0731 стоит всего:


Вход: $0,14 за 1 млн токенов
Выход: $0,28 за 1 млн токенов


По расчётам Artificial Analysis, выполнение одной тестовой задачи обходится примерно в 3 цента - почти в 105 раз дешевле Claude Fable 5.

И этот демпинг сработал.

Новая версия стала самой быстрорастущей моделью Ollama самой быстрорастущей моделью Ollama по объёму токенов. Сервис уже расширяет мощности в США и Европе, чтобы выдержать нагрузку.

Получается классическая стратегия:


сначала - почти бесплатный доступ
потом - массовое распространение
затем - повышение цены


DeepSeek не раскрыла причину изменения тарифов. Но обслуживать огромный поток запросов по цене, установленной для захвата рынка, становится всё сложнее.

Особенно рискованно выбран момент. GPT-5.6 Luna и Muse Spark уже приблизились к V4 Flash по качеству, поэтому после повышения DeepSeek может потерять свой главный козырь - невероятное соотношение цены и возможностей.

Пока V4 Flash остаётся одним из самых выгодных API на рынке.

#DeepSeek #LLM #API #AI

@data_analysis_ml
16🔥6👍2😁2🤯2😱1💔1
🔥 После того как стоимость токенов GPT-5.6 Luna снизилась примерно в 10 раз, их потребление выросло более чем в 10 раз.

Это классический парадокс Джевонса: повышение эффективности не обязательно сокращает расход ресурса. Иногда происходит обратное - ресурс становится дешевле, появляется больше сценариев использования, и общий спрос взрывается.

С AI это может быть особенно заметно:

- модели дешевеют;
- контекст растёт;
- агенты делают десятки и сотни вызовов вместо одного;
- компании начинают автоматизировать задачи, для которых раньше LLM были слишком дорогими;
- AI постепенно становится фоновым слоем практически любого ПО.

И при этом настоящий спрос ещё может быть впереди.

По данным Microsoft Research, в Q1 2026 генеративным ИИ пользовались лишь около 17,8% трудоспособного населения мира.

То есть более 80% потенциальных пользователей ещё практически не вошли в эту экономику.

Если стоимость inference продолжит падать, вопрос будет уже не в том, сколько токенов удастся сэкономить.

#AI #LLM #ArtificialIntelligence #OpenAI #Tech
24🔥8👍6🥱1
⚡️ Перед IPO Anthropic инвесторы хотят, чтобы Дарио Амодеи говорил об угрозах ИИ мягче. Но он, похоже, не собирается.

По данным The Information, часть акционеров Anthropic считает, что постоянные предупреждения Амодеи об экзистенциальных рисках AI могут плохо сочетаться с подготовкой компании к публичному рынку.

Проблема для инвесторов в том, что повлиять на CEO непросто.

Ключевые решения Anthropic по-прежнему сосредоточены внутри узкого круга сооснователей и близких к Амодеи людей.

В этом году один из членов совета директоров якобы предлагал использовать более привычную PR-стратегию Microsoft и Meta - больше рассказывать о позитивных сценариях вроде AI для разработки лекарств.

Амодеи идею отверг.

Его позиция: если технология потенциально создаёт риски для выживания человечества, относиться к её продвижению как к обычному технологическому маркетингу нельзя.

Инвесторам перед IPO нужен оптимизм и понятная история роста, а CEO продолжает публично говорить, что технология его собственной компании может быть опасной.

#AI #Anthropic #Claude #IPO #ArtificialIntelligence
23👍10🔥7😁6🍌1
⚡️ Sakana AI показала, как может выглядеть следующий этап мультиагентных систем - оркестрация, независимая от одной базовой модели.

Sakana Fugu работает как единая «виртуальная модель», хотя внутри скрывается целый пул разных LLM.

Пользователь отправляет запрос в один endpoint, а дальше Fugu сама решает:

- какую модель использовать;
- стоит ли разбить задачу на несколько частей;
- какие подзадачи отдать разным моделям;
- как собрать ответы обратно;
- где можно снизить стоимость без потери качества.

Архитектура состоит из двух уровней:

Conductor Model → Model Pool

Model Pool выполняет реальные задачи, а Conductor Model выступает в роли дирижёра и решает, кому и что делегировать.

Пул моделей изначально сделан заменяемым.

То есть система не должна быть навечно привязана к конкретным GPT, Claude, Gemini или другим LLM. Можно обновлять набор моделей, сохраняя общий orchestration layer.

В новой версии Sakana пошла ещё дальше: дирижёрскую модель обучили на базе новой открытой Gemma 4.

По внутренним оценкам компании, новый conductor показывает производительность не хуже предыдущей версии, одновременно снижая стоимость работы системы.

Идея здесь важнее конкретной модели:

ценность постепенно смещается от «какая LLM самая сильная?» к «кто лучше всего умеет комбинировать несколько моделей под конкретную задачу».

Следующий шаг Sakana - собственные conductor-модели и инфраструктура, которую можно адаптировать под требования AI sovereignty.

Если такой подход масштабируется, в будущем разработчику может быть вообще неважно, какая модель находится под капотом.

Он будет обращаться к одному API, а orchestration layer сам решит, какая комбинация моделей даст лучший результат по цене, скорости и качеству.

🔗 https://sakana.ai/fugu-gemma4/

#AI #LLM #Agents #MultiAgent #SakanaAI #Gemma
17👍8🥰3
⚡️ Muse Glimmer - open source подгон от Цукерберга.

Это 30B-модель с открытыми весами, заточенная под постоянную работу агентных систем прямо на локальном железе.

Что внутри:

- 30 млрд параметров;
- открытые веса уже доступны;
- лицензия Apache 2.0;
- модель рассчитана на локальный запуск;
- заявлена работа на системах с 24 ГБ VRAM;
- основной фокус - agent workflows и задачи, где модель должна работать постоянно, а не отвечать на отдельные запросы.

На agentic-бенчмарках она выглядит сильнее, чем можно ожидать от локальной 30B: MCP Atlas — 75,5, DeepSearch QA — 74,6, SWE-Bench

Отдельно готовится Muse Spark 1.2 - её веса обещают открыть позже.

https://huggingface.co/meta-models


#AI #LLM #OpenSource #AIAgents #LocalAI
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
9👍3🔥3
🚀 Stanford и Northeastern сделали «Git для AI-агентов»

Shepherd решает одну из неприятных проблем агентных систем: обычный лог хранит диалог и снимки окружения, но не умеет полноценно откатить живое состояние процесса.

Что делает Shepherd:

- сохраняет одновременно процесс агента и файловую систему;
- превращает действия модели, tool calls и изменения окружения в типизированные commits;
- позволяет откатиться к любому прошлому состоянию;
- после checkout агент может продолжить работу ровно с той точки.

Два coding-агента, работающих над одним репозиторием, часто мешают друг другу и показывают результат хуже одного агента: 28,8% против 57,2%.

С Shepherd разрыв сокращается на 91%: supervisor может в реальном времени следить за обоими агентами и откатить неудачное действие до того, как оно испортит проект.


GitHub:
https://github.com/shepherd-agents/shepherd

#AI #AIAgents #CodingAgents #Git #OpenSource
👍18🔥86
🚨 В Австралии зафиксировали один из первых известных случаев, когда автономный ИИ-агент сам нашёл уязвимость и использовал её в реальном сервисе.

Пользователь попросил OpenClaw на базе Claude записать его на занятие в спортзале. Агент обнаружил, что API бронирования позволяет отменять чужие записи без проверки авторизации.

Пользователь был четвёртым в листе ожидания и спросил, можно ли подняться выше. Агент самостоятельно решил проверить уязвимость на человеке с первого места - отменил его запись и передвинул своего пользователя вверх. Вернуть всё обратно он уже не смог.

И вот здесь начинается самое интересное.

Пользователь не просил никого взламывать или удалять из очереди. Агент просто выбрал самый короткий путь к поставленной цели.

Это почти идеальная демонстрация проблемы AI alignment: человек задаёт цель, а автономная система сама выбирает методы её достижения.

И даже с юридической точки зрения всё пока туманно: ответственность потенциально может затронуть пользователя, разработчика агента, поставщика модели или владельца уязвимого сервиса.


#AI #AIAgents #Claude #Cybersecurity #LLM

https://www.abc.net.au/news/2026-08-10/ai-assistant-hacks-gym-website-aus-cyber-attack/107007986
14🔥10👍5🤣5
✔️ OpenAI тестирует платную функцию восполнения лимитов Codeх

Тибор Блахо обнаружил в публичных конфигурациях оплаты и веб-ресурсах ChatGPT скрытые параметры, указывающие на внедрение новой системы сброса квот.

Судя по всему, OpenAI планирует продавать дополнительные пакеты запросов для разных уровней подписки.


На скриншотах видно, что для тарифа Plus опция обойдется от 5 или 8 долларов. Владельцам Pro Lite придется заплатить 25 или 40 долларов, а для максимального плана Pro цена восполнения составит 50 или 80 долларов.

Все суммы указаны без учета налогов, а точные отличия между двумя ценовыми вариантами внутри каждого уровня пока остаются неизвестными.


Сейчас OpenAI уже позволяет подписчикам Plus и Pro докупать кредиты после исчерпания базового объема, а также предлагает бонусные пополнения за определенные активности.

Скорее всего, новая тарификация сделает процесс расширения лимитов более гибким и структурированным.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥7🤣43🥰3🤔3