282K subscribers
5.42K photos
1.26K videos
17 files
5.76K links
Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri
Download Telegram
✔️ Alibaba отсудила домен alibabа.ai

Китайский техгигант официально вернул контроль над международным доменным именем alibaba.ai.

Спор рассматривался в Чешском арбитражном суде, который принял решение принудительно передать права корпорации.

В июле 2026 года доменный инвестор из арабского региона выкупил имя на вторичном рынке за $3 333. Практически сразу он выставил его на перепродажу, но уже с десятикратной наценкой - за $33 333.

Юристы Alibaba, которые к тому моменту начали процесс защиты бренда в рамках международной процедуры UDRP, заблокировали сделку и довели дело до суда.

Защита ответчика выглядела весьма оригинально. Киберсквоттер пытался доказать арбитражу, что термин "Али-Баба" не имеет отношения к китайскому маркетплейсу, а выбрано исключительно из-за его глубокого культурного и литературного значения в арабском мире, намекая на сказку про сорок разбойников.

Но международного арбитра такой аргумент не впечатлил. Суд указал на очевидные маркеры недобросовестности:

🟠Перекупщик не планировал создавать литературный или культурный сайт;

🟠На домене висела пустая заглушка исключительно ради спекулятивной перепродажи;

🟠Доменная зона .ai уже прочно ассоциируется во всем мире с Artificial Intelligence.

Alibaba сейчас активно инвестирует в собственную разработку ИИ, поэтому покупка такого имени сторонним лицом - это прямое паразитирование на бренде.

В итоге суд признал действия сквоттера оппортунистическими, и теперь домен послужит официальным ИИ-проектам Alibaba Group.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍158🤔37👏29🎉1714😭7🔥4😁2👌1
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ Dyson представила умную зубную щетку с камерой и машинным зрением

Устройство CameraJet объединяет ультразвуковую чистку и направленную ирригацию, устраняя необходимость в зубной нити.

В головку щетки встроена камера с разрешением 100 тысяч пикселей и подсветкой, стробирующей на частоте 257 Гц синхронно с движениями головки.

Собственный алгоритм машинного зрения Gap Optical Targeting, натренированный на 470 тысячах снимков зубного ряда, обрабатывает видеопоток со скоростью 28 кадров в секунду, распознает зазоры между зубами и в течение 100 миллисекунд подает микрозалп ополаскивателя.

Жидкость подается из резервуара с мембранным насосом, предотвращающим завоздушивание системы при любом угле наклона устройства.

Чтобы оптика не слепла от пены, инженеры разработали специальную беспенную пасту без лаурилсульфата натрия, а фирменная док-станция способна автоматически заправить бак ополаскивателем всего за три секунды.

По Wi-Fi щетка умеет транслировать видеопоток в приложение MyDyson в реальном времени, выполняя роль стоматологического эндоскопа.

Продажи уже начались - устройство доступно в голубом и розовом цвете по цене 499 долларов.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣7021👍18🙈7🤔5🦄5🔥1🤬1
📌 Fable 5.1 вскрыла шифр, который не поддавался 370 лет

Сотрудник ValsAI Геби Джафф несколько месяцев безуспешно пробовал натравливать модели на нерешённые исторические шифры.

Воодушевившись метриками Fable 5.1, он поставил ей задачу - найти шифр самой и решить его, но с условием не браться за те, где ответ уже известен или где возможно множество правдоподобных версий.

И ещё не лезть в совсем неподъёмное вроде Kryptos K4, над которым бьются лучшие умы и ЦРУ.


🟡Модель перебрала кандидатов и остановилась на криптограмме Томаса Эркарта

В конце его трактата Логопандектейсион 1653 года стоят две строки по 32 числа.

Загадку выносили как открытую проблему ещё в 1899 году, она попадала в криптографическую литературу XX века, а Клаус Шмее включил её в список пятидесяти нерешённых зашифрованных сообщений.


Fable потратила на неё 44 минуты и 176 тысяч токенов без вмешательства человека.

🟡Ключом оказалась сама книга

Криптограмма напечатана сразу после 32 разделов трактата, а в каждой строке шифра ровно 32 числа. Совпадение неслучайное, и Fable зацепилась именно за него.

Правило оказалось таким: i-е число в строке - это индекс слова внутри i-го раздела книги. Берём слово по индексу, берём его первую букву, собираем по порядку. Обычный поиск по смещению, только вместо массива текст.

Результатом расшифровки оказалась роялистская молитва: Господи, храни короля Карла Второго и сделай его верховным правителем этой земли.

Дальше Fable взялась за второй шифр Эркарта - Cyphral Octastich из трактата The Jewel 1652 года, 285 чисел, тоже нерешённый.

Тот же приём, только числа указывают на страницы книги, а не на абзацы. Из 285 букв сложились 276 - там тоже оказалась молитва. Девять букв дали бессмыслицу: либо Эркарт ошибся сам, либо наборщик переставил цифры при печати.

Шифр, безусловно, простой и другие модели, скорее всего, тоже справились бы, но этот случай не про способности Fable в криптоанализе, а в умении разглядеть среди десятков задач одну податливую и не бросить её на полпути.



@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
190🤔51👍48🔥15👏14😎9🗿7🥱6🤓6👀1
Media is too big
VIEW IN TELEGRAM
✔️ Минторг США вернул Anthropic в круг доверенных партнеров

Министр торговли Говард Латник заявил Axios, что власти снова считают Anthropic надежным партнером, так как компания выполнила требования и, по его словам, вернулась на правильную сторону.

Это разворот в затяжном конфликте. Пентагон пытался внести Anthropic в черный список угроз цепочкам поставок, но федеральный суд это решение заблокировал.

Отношения нормализовал сооснователь Anthropic Том Браун - он провел серию закрытых консультаций с Латником и кибердиректором Шоном Кэрнкроссом.

На встрече министров стран G20 глава Минторга лично представил Брауна международной аудитории, а сам Браун публично поддержал курс властей США на форсированное строительство дата-центров, энергетических мощностей и вычислительной инфраструктуры. 
axios.com

✔️ Основательница AI Frontiers ушла из Microsoft на фоне реорганизации

Microsoft перевела лабораторию AI Frontiers из Microsoft Research в подразделение Microsoft AI, которым руководит Мустафа Сулейман. Одновременно корпорацию покинула Эдже Камар, основавшая AI Frontiers и проработавшая в Microsoft 16 лет.

Лабораторию создали осенью 2023 года под мультиагентные системы и компактные модели. Оттуда вышли семейство Phi и фреймворк AutoGen, на котором построен Microsoft Agent Framework, а также проекты FARA, Magentic-One и Magentic-UI.

В новой структуре команда продолжит заниматься прикладными агентами и усилит направление, которое Сулейман называет гуманистическим суперинтеллектом, - ИИ-системы, ориентированные на человека и подконтрольные оператору.
Microsoft AI в X

✔️ Inworld выпустила синтезатор речи, который возглавил Voice Arena

Realtime TTS-2 генерирует речь в реальном времени и поддерживает больше 100 языков, включая русский.

Модель подстраивается под собеседника: считывает ритм, тембр и эмоциональное состояние по ходу разговора и меняет собственную речь.

Стилем можно управлять текстом - попросить говорить шепотом или звучать уставшим. Она умеет вставлять вздохи, смех и дыхание, а также клонировать голос, сохраняя тембр при переходе на другой язык.

В слепых тестах Voice Arena от Artificial Analysis модель заняла первое место, обойдя Cartesia Sonic 3.6 по естественности произношения, расстановке пауз и реалистичности интонаций.

Доступ открыт через Inworld Realtime API, тарифы - от 25 до 1500 долларов в месяц.
InworldAI в X

✔️ Агенты Cursor научатся собирать приложения для iOS и Mac

Namespace договорилась с Cursor о запуске агентов в своей облачной инфраструктуре. Логику агентов по-прежнему ведет Cursor, а правка репозиториев, запуск команд, сборка и тесты уходит в изолированные среды Devboxes.

Они разворачиваются как полноценные окружения с доступом к базам данных, коду и сети. Кроме Linux поддерживаются инстансы macOS на процессорах Apple M5, поэтому агент может собирать приложения для iOS и Mac. Windows обещают позже.

Из коробки идут кэширование слоев Docker, удаленная сборка через Bazel, фильтрация исходящего трафика и политики доступа. Раньше Namespace так же подключила свои среды к Devin и Claude Code.
namespace.so

✔️ Alibaba делает среду разработки для умных очков

Qoder Glasses Edition - версия ИИ-среды разработки Qoder для умных очков Qwen и Rokid. Очки работают интерфейсом от первого лица, а считает и работает с кодовой базой десктопный клиент.

Общение с агентом идет по полнодуплексному голосовому каналу, через который можно ставить задачи, узнавать статус сборки и править код. Уведомления показываются карточками с краю поля зрения, а операции подтверждаются голосом или касанием дужки, не останавливая фоновые процессы.

Камера нужна для отладки того, что происходит вне экрана: ассистент считывает коды ошибок с мониторов, разбирает индикаторы на серверных стойках и распознает схемы на маркерных досках. Дальше он сопоставляет увиденное с логами и выдает варианты по устранению неполадки.

Продукт в закрытом тестировании, релиз обещают на сентябрьской конференции Apsara. 
Alibaba Cloud в WeChat


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8020👏16🎉12🔥10🤓5😁2
DeepSeek готовит гигантский кластер на 160 000 чипов Huawei

По данным Bloomberg, DeepSeek планирует развернуть во Внутренней Монголии не менее 160 000 ускорителей Huawei Ascend 950DT - это может стать одним из крупнейших известных AI-кластеров на китайском железе.

Чипы будут использоваться для запуска моделей DeepSeek. Для обучения компания пока продолжает опираться на Nvidia.

По заявленным характеристикам Ascend 950DT выглядит серьёзно:

- 144 ГБ HBM
- 4 ТБ/с пропускной способности памяти

Для сравнения, Nvidia H200 предлагает:

- 141 ГБ HBM
- 4,8 ТБ/с

По памяти Huawei уже очень близка к H200, хотя это не означает сопоставимой реальной производительности. Bloomberg ставит Ascend 950DT примерно на уровень поколения Nvidia Hopper, включая H100 и H200.

https://www.bloomberg.com/news/articles/2026-09-04/deepseek-plans-big-huawei-ai-chip-order-to-power-new-data-center

@ai_machinelearning_big_data

#DeepSeek #ai #ml
🔥16836🤔35👏22👍19🥱4🗿2
🙂 Цену покупки Hugging Face выбрали не случайно

Объявляя о покупке Hugging Face, сооснователь компании Томас Вольф написал:

... особые поздравления тому, кто найдёт отсылки к Hugging Face и Nvidia, спрятанные в цене сделки - 12 930 300 000 долларов.


Разгадывать бросились всем твиттером и первую нашли быстро.

Число 129 303 - это десятичная запись Unicode U+1F917, то есть эмодзи 🤗, который официально так и называется: Hugging Face.

Вольф подтвердил догадку и намекнул, что есть и вторая, связанная с Nvidia. С ней помучались.

Число разобрали на составные части 12, 93 и 03, объясняя, что двенадцать - это цена акции Nvidia на IPO 1999 года, девяносто три - год основания компании, ноль три - три сооснователя: Дженсен Хуанг, Крис Малаховски и Кёртис Прием.

Версия красивая, стройная и неверная.

Правильный ответ подсказал гендиректор Hugging Face Клеман Деланг, отправив комментатору ссылку на реестр названий цветов.

Если записать то же число как шестнадцатеричный код цвета #129303, получится зелёный, цвет Nvidia.

Педантичности ради - официальный зелёный Nvidia это #76B900, оттенок другой. Так что отсылка тут не к точному фирменному цвету бренда, а к зелёному цвету как таковому.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤗173🔥22🤔20👍1614👏13😁7🥱3🎉1
Media is too big
VIEW IN TELEGRAM
✔️ OpenAI открыла доступ к GPT-6 Astra

Модель стала доступна подписчикам Pro, Enterprise и Business Premium - сразу в ChatGPT Work, в среде разработки Codex и через API.

Пользователям Plus и обычного Business её раскатают в течение нескольких дней.
OpenAI в X

✔️ Агенты Claude за 11 дней формализовали знаменитую теорему Ферма

За основу взята упрощенная версия доказательства Уайлса от Дармона, Даймонда и Тейлора. Сгенерировано 13 млн строк кода и 30 300 промежуточных теорем, из которых в финальное доказательство вошли 29 500. Результат проверил компилятор Lean и подтвердил математик Кевин Баззард, ведущий проект формализации этой теоремы с 2024 года.

Первые попытки проваливались. Агенты теряли состояние проекта и переставали координироваться, их неудачные заходы дали около 7% строк итогового кода. Сработало после перехода на платформу Prove2Me, которая держит граф теорем и позволяет агентам работать параллельно, смягчая деградацию памяти на длинной дистанции.

Полностью автономным процесс не был - человек изредка давал указания верхнего уровня. Смысл автоматизации в том, что люди-рецензенты уже не успевают проверять поток доказательств, а формализация снимает с них часть нагрузки.
anthropic.com

✔️ NVIDIA сделала роутер, который раскидывает запросы по видеокартам в локальной сети

PAIR (Personal AI Router) - открытый маршрутизатор, объединяющий видеокарты внутри локальной сети под одной точкой входа.

Он сам находит хосты с GeForce RTX, RTX Pro и машины на macOS. При локальном инференсе роутер следит за загрузкой оборудования, свободной видеопамятью и статусом запущенных моделей, а входящие запросы отправляет на наименее занятые узлы. Настраивать кластер руками не нужно.

Приложениям и средам разработки все это видится как один локальный эндпоинт, совместимый с API OpenAI.

Бета-версия доступна для Windows, macOS и Linux.
nvidia.com

✔️ Sakana AI предложила универсальный детектор ИИ-изображений

Японский стартап выпустил Percept-Lens - бенчмарк на 36 млн изображений и метод распознавания синтетики, основанный на связке визуальных энкодеров и линейном классификаторе а основе расстояния Махаланобиса.

Проблема, которую лечит метод - потеря от 20 до 36 процентных пунктов точности у существующих детекторов при смене модели или типа сжатия. Эксперименты Sakana показали, что обычные визуальные представления общего назначения уже содержат сигнал, разделяющий настоящие кадры и сгенерированные, - специально его выучивать не нужно.

На 39 датасетах энкодер PE-Core и метод Mah-NCM дали среднюю точность 94,46%. Причем хватило 219 размеченных опорных изображений, чтобы выйти на 90,89% и обойти существующие решения.
sakana.ai

✔️ Cohere измерила, насколько MCP-инструменты закрывают рабочие задачи

Cohere Labs выложила открытый датасет Agentic Task Ecosystem из 700 тысяч инструментов на базе MCP, собранных со 123 тысяч публичных серверов.

Анализ набора показал, что довести профессиональную задачу от начала до конца без человека способны только 2,6% инструментов. Для 419 профессий из 923 базы ONET не создано вообще ничего. Остальное - микрозадачи и инфраструктура для управления агентами. Лучше всего автоматизация приживается там, где работа и раньше шла через специализированный софт.

Роли делятся по-разному в зависимости от области. В юриспруденции, производстве и продажах агенты забирают рутину, а в ИТ и здравоохранении наоборот - ИИ берет на себя сложную аналитику, оставляя людям базовые процессы.
cohere.com

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6928🤩17🔥10👏6🤷‍♂1🎉1
✔️ Google DeepMind выпустила метеорологическую модель WeatherNext 3

WeatherNext 3 - глобальная модель прогноза погоды на архитектуре Functional Generative Network.

По независимым замерам сервиса Brightband, это самая точная глобальная модель погоды на сегодня.


В третьей версии отказались от тяжелых физических симуляций численного прогноза и модель напрямую обрабатывает потоковые мозаики с геостационарных спутников и показания наземных метеостанций.

Это позволило сократить цикл генерации нового прогноза до одного часа, а пространственное разрешение температуры и влажности повысить до сетки 5 × 5 км, что в пять раз детальнее чем у WeatherNext 2 с её сеткой в 25 километров.

Существенный прогресс достигнут и в моделировании осадков - обучение на спутниковых радарах и массивах NASA IMERG снизило вероятностную ошибку на величину до 60%, что дает модели точнее очерчивать границы штормовых фронтов без размытия.

Отдельно добавили величины для возобновляемой энергетики: скорость ветра на ста метрах (примерно на высоте турбины), плюс облачность и уровень солнечной радиации.

Данные доступны через BigQuery, Earth Engine и Cloud Storage. В Google Search, приложении Gemini, Google Maps и Weather API модель уже подключена.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
82👍71🔥42👏15🎉9💯5🤩1🐳1🤝1
✔️ Китайская Ханьсюй показала архитектуру инференса на магнитной памяти

Компания, которую в Китае называют первой отечественной MRAM-компанией магнитных вычислений, представила два архитектурных уровня для инференса - uHBM и uLPU.

Ханьсюй предлагает держать веса целевой модели постоянно в массиве в массиве энергонезависимой MRAM - матрично-векторные операции выполняются на том же кристалле, а наружу идут только векторы активаций, которые заметно меньше.

Магниторезистивная память хранит бит не зарядом, как обычная память, а направлением намагниченности.

В ней ячейка - это магнитный туннельный переход: два ферромагнитных слоя, разделённые тончайшим изолятором.

Когда намагниченность слоёв сонаправлена, сопротивление низкое, когда противоположна - высокое, и по нему считывается ноль или единица.

У MRAM почти нулевой ток утечки, скорость переключения наносекундная, а ресурс перезаписи практически неограниченный в отличие от флеш-памяти.


uHBM - это кристалл вычислительной памяти на MRAM, работающий в паре с GPU или NPU через UCIe, LPDDR5X или GDDR7.

uLPU - инференс-чип, построенный поверх uHBM.

Заявленные расчётные показатели первого поколения uHBM - 24 ТБ/с внутрикристальной полосы на чтение и цель выше 2000 токенов в секунду при декодировании мультимодальной модели на 4 млрд параметров.

Из реальных прототипов есть верификационный чип SpinPU-ED01 со 120 банками MRAM, который прошёл независимую проверку и отработал 24 часа в стабильном режиме.

Сроков, техпроцесса и цен компания не называет, но декларирует планы от кристалла до модуля, 2U-лотка и стойки.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍72🔥42🤔3911👏32😁1
⚡️ OpenAI изменила расход квоты на Astra

Тибо, главный рупор сброса лимитов в сети X, сообщил об изменениях в том, как Astra расходует квоту подписки ChatGPT.

По его словам, качество модели остаётся прежним, а вот использование подписки значительно снижено, до трех-четырёх раз меньше, чем раньше.

Судя по формулировке, речь о пересчёте того, как потребление учитывается на стороне учётки ChatGPT.

🟡Предыстория

Astra сначала вышла ограниченным превью, платные подписчики её не увидели, и OpenAI начала начислять по одному отложенному сбросу квоты за каждый день ожидания.

5 сентября сентября OpenAI объявили о завершении раскатки и полном сбросе квот для всех Plus, Pro и Business.

Через двое суток на GitHub пошли жалобы на слишком быстрый расход лимитов - пользователи Plus сообщали, что упираются в лимит примерно за двадцать минут, а обладатели тарифов Pro - что за сутки сжигают заметную часть недельной квоты.

Ну и да, лимиты использования для всех тарифов опять сбросили.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍56🔥1711😁83👌1
Media is too big
VIEW IN TELEGRAM
✔️ Anthropic сдвинула IPO на середину октября

Компания скорректировала график подготовки к первичному размещению - теперь оно ориентировано на середину октября. Причинами называют финальное согласование отчётности и желание андеррайтеров поймать более устойчивое окно на рынке.

Размещение будет заметным для всей отрасли - Anthropic первой среди создателей передовых моделей переходит от венчурных денег к регулярной публичной отчётности и рынок впервые увидит, сходится ли экономика больших языковых моделей с затратами на вычисления.
reuters.com

✔️ OpenAI набирает лоббистов для работы в штатах

В команду по связям с госорганами пришли трое: Джессика Шумер из Amazon, Колдер Харвилл-Чайлдс из команды Цукерберга и Томас Маклеллан из Palo Alto Networks.

Ставка на штаты объясняется тем, что единый федеральный закон об ИИ застрял в Конгрессе. Под руководством вице-президента по глобальной политике Криса Лехейна компания собирается напрямую участвовать в разработке законопроектов в Нью-Йорке, Калифорнии и других крупных штатах.

Расчёт в том, чтобы закрепить нормы прозрачности и кибербезопасности на региональном уровне и сделать их фактическим стандартом для всей индустрии.
axios.com

✔️ Microsoft выпустила облегчённый генератор изображений MAI-Image-2.6-Flash

Это упрощённая версия флагманской MAI-Image-2.6. Она умеет генерировать картинки по тексту, править фрагменты, работать с несколькими референсами, сама подбирает соотношение сторон и ходит в веб-поиск.

В рейтинге Artificial Analysis модель взяла 1311 Elo в редактировании (третье место, выше GPT Image 2) и 1297 Elo в генерации по тексту, восьмое место.

Доступна в публичном превью на Microsoft Foundry. Генерация стоит 19 долларов за миллион токенов, что вдвое дешевле родительской модели и в несколько раз бюджетнее GPT Image 2.
microsoft.ai

✔️ GitHub научил Copilot раздавать задачи разным моделям

Project HydraFusion меняет прежнюю схему с одной моделью на ансамбль специализированных. Задачи распределяются на лету - маленькие модели отвечают за автокомплит в строках кода, а большие берут на себя архитектуру, рефакторинг и поиск граничных случаев.

Прежде чем результат попадёт в IDE или в пул-реквест, его проверяют модели-критики и статический анализ.

От этого проекта GitHub ждёт меньше галлюцинаций и логических ошибок в больших репозиториях без потери скорости. Предварительная версия уже доступна всем подписчикам Copilot.
github.blog

✔️ ComfyOrg отправит своих инженеров работать внутри студий

Разработчики нодового движка запустили программу Forward Deployed Creatives, скопировав модель Palantir - технические художники и инженеры компании сядут прямо в команды киностудий, игровых компаний и агентств.

Задача - встроить ComfyUI в существующую инфраструктуру на Blender, Maya и Unreal Engine и написать под неё нестандартные ноды, чтобы генерация стала управляемой и повторяемой в реальном производстве.

Обратная связь с проектов пойдёт напрямую разработчикам ядра ComfyUI.
comfy.org


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5314🔥4😁2
🌟 Ant Ling выложила специализированную медицинскую модель

Ling-3.0-flash-Sante - модель, дообученная под медицину поверх языковой Ling-3.0-flash. Архитектура MoE на 124 млрд общих параметров, 5,1 млрд активных с контекстом в 262 тысячи токенов при максимальном выводе 32 тыс.

Ant Ling, команда языковых моделей в inclusionAI, открытой исследовательской инициативе Ant Group. Сама Ant Group входит в экосистему Alibaba, но развивает модели отдельно от неё.

На прошлой неделе та же команда выпустила финансовую версию Ling-3.0-flash-Fin на той же базе.


Модель специализируется на медицинских рассуждениях, безопасности лекарственной терапии, поиску с опорой на доказательную базу и длинные исследовательские задачи. Общие способности - рассуждения, код, агентная работа сохранены.

🟡Тесты

На DiagnosisArena-MCQ модель набрала 83,8 против 81,9 у GPT-5.6 Sol, 78,4 у Kimi K3 и 76,2 у Gemini 3.6 Flash.

На MedXpertQA-Text результат скромнее - 53,9 против 53,5 у Kimi K3, но заметно ниже 60,2 у Sol и 62,4 у Gemini.

Этика и безопасность на MedEthicAlign и внутреннем AFUSAFE-MedSCE - выше Claude Opus 4.8(max), но чуть ниже GPT-5.6 Sol (max).

Модель доступна бесплатно на OpenRouter и в Vercel. О планах по публикации весов сведений нет.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2711🔥9
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Релиз ChatGPT Images 2.5

Новое поколение генератора изображений работает на 50% быстрее версии 2.0. Лучше проработаны текстуры, естественнее свет, точнее сохраняются ключевые черты объектов с референсных фотографий.

Хэдлайнер релиза - улучшенный режим редактирования. Модель меняет отдельную деталь сцены, не трогая остальное, и картинка больше теряет структуры при серии последовательных правок в одном диалоге.

Ещё она научилась сразу генерировать изображения с прозрачным фоном и точнее держит сложные композиционные инструкции.

Релиз разделен на 2 варианта модели:

🟠GPT-Image-2.5 Flare - облегчённая, с низкой задержкой;

🟠GPT-Image-2.5 Sunburst - максимальная детализация.

Также в ChatGPT добавили Sketch, генерацию по наброскам от руки, возможность комментировать отдельные области изображения и готовые шаблоны вёрстки.

Модель доступна в вебе, приложениях ChatGPT и Codex и через API.

Цены на Flare и Sunburst одинаковые:

$5 за миллион входных текстовых токенов, $8 - за тот же миллион в виде изображений и $30 за миллион выходных.

Есть кэширование - $1,25 (текст) и $2 (изображение).


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
6039👏19👍14🎉11🔥10
📌 GPT-6 Astra прошла Portal за сутки

Твиттерский пользователь cozyblaze запустил GPT-6 Astra играть в оригинальную Portal и довёл эксперимент до титров. Модель управляла Челл сама - человек задал цель в начале и больше в геймплей не вмешивался.

Запуск стартовал 4 сентября 2026 года в пять вечера, титры пошли 5 сентября в 16:43. По логу получилось 23 часа 42 минуты 34 секунды.

Астра использовалась в режиме максимального ризонинга, была подключена через MCP и модифицированную сборку SourcePauseTool, утилиты, которой пользуются спидраннеры Source-движка.

Пока модель думала, Portal стоял на паузе. Astra смотрела скриншот, координаты персонажа и угол камеры, планировала следующий ход, отправляла команды и запускала игру дальше. Потом приходил новый скриншот, и цикл повторялся.

Чистого геймплея набралось примерно два часа - запись, из которой вырезали размышления модели, лежит на YouTube.

Опубликованный лог говорит, что всего было потрачено 434,8 миллиона токенов: 433,2 миллиона на вход и 1,6 миллиона на выход, из них 1,18 миллиона ушло на рассуждения. К инструментам модель обращалась 3300 раз, из которых 3210 - это команды в игру.

По прайсу API Astra стоит 10 долларов за миллион входных токенов, 50 за миллион выходных и всего доллар за миллион кэшированных входных. И Кэш тут решил всё - из 433 миллионов входных токенов 426 пришлись именно на кэш.

Таким образом, если бы запуск проходил чисто по API, прохождение Portal обошлось бы примерно в 574 доллара. Без кэширования тот же запуск обошёлся бы около 4400 долларов.

Реальных денег автор при этом не потратил. Он все удовольствие влезло в подписку Codex за 200 долларов в месяц.

В этом эксперименте важно то, что Астра почти сутки держала одну задачу, наблюдала за трёхмерным пространством и раз за разом решала, куда идти и куда ставить порталы, не теряя нить. Год назад такой запуск был бы обречён.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥130👍10025👏19🤓10👨‍💻7👀71
Media is too big
VIEW IN TELEGRAM
✔️ Китай нарастит мощности ИИ-вычислений до 9800 экзафлопс к 2030 году

Министерство промышленности и информатизации КНР представило план развития инфраструктуры на 2026-2030 годы. Бюджет - 3,8 трлн юаней (около 532 млрд долларов).

К 2030 году страна рассчитывает довести мощности ИИ-вычислений до 9800 EFLOPS против нынешних 2185 по данным на июнь 2026 года, т.е более чем вчетверо. Кластеры планируют разворачивать по 10-100 тысяч ускорителей на площадку. Программа включает дата-центры под инференс и переписывание серверного софта под локальную компонентную базу.

Всё это укладывается в государственную стратегию переноса вычислений с востока на запад - энергоёмкие дата-центры ставят в западных провинциях, где дешевле электричество, вокруг восьми национальных вычислительных узлов.
scmp.com

✔️ Mistral AI подняла 3 млрд евро при оценке в 21 млрд

Через три года после основания французская компания закрыла раунд на 3 млрд евро. Сама Mistral называет его крупнейшим привлечением в истории европейского технологического сектора.

Раунд возглавила Samsung Electronics. К ней присоединились Scaleup Europe Fund, PSG Equity, BlackRock, правительство Люксембурга и действующие инвесторы - Nvidia, ASML и Andreessen Horowitz.

Деньги Mistral зарабатывает на желании европейского бизнеса слезть с американского стека - её продуктами пользуются больше 125 корпораций из 20 стран, включая Airbus, ASML и HSBC.
mistral.ai

✔️ NVIDIA выложила инструменты для написания GPU-ядер на Rust

В открытый доступ опубликованы cuda-oxide и cutile-rs. Оба компилируют код ядер сразу в низкоуровневый PTX, без промежуточных обвязок на C++.

Подходы разные. Низкоуровневый SIMT-трек на cuda-oxide использует собственный бэкенд кодогенерации для rustc и даёт прямой контроль над потоками. Тайловый фреймворк cutile-rs сам раскладывает вычисления по архитектуре видеокарты, работает со стабильным Rust от версии 1.89 и компилирует ядра прямо при запуске.

Оба проекта в ранней альфе и для продакшена не годятся. При этом cutile-rs уже используют в mistral.rs и в инференс-движке Grout от Hugging Face.
nvidia.com

✔️ DeepSeek открыла временный бета-доступ к V4.1 Flash

Компания выкатила промежуточную версию DeepSeek V4.1 Flash - тестирование ограничено по времени и заканчивается 10 сентября 2026 года. Модель умеет работать с текстом и изображениями из коробки, продолжая экспериментальную ветку V4-Flash-Vision-Exp.

Вызывать её нужно через API по прямому идентификатору deepseek-v4.1-flash-expires-on-0910. На время тестирования действует лимит в 20 параллельных запросов на аккаунт.

Тариф остался прежним, как у deepseek-v4-flash. Но за счёт более экономной токенизации и вычислительной эффективности фактическая стоимость типовых задач, по имеющимся оценкам, упала примерно на 30%.
ycombinator.com

✔️ Samsung покажет прототип гуманоида на CES 2027

Южнокорейская компания представит собственного универсального человекоподобного робота на выставке CES 2027. Команду Robotics курирует лично глава подразделения Device eXperience.

Разработку ускорили, объединив проектирование механики и алгоритмов восприятия в одну работу вместо двух параллельных. Патенты Samsung уже получила на тазобедренное сочленение, кисти-манипуляторы нового поколения и системы управления моторикой.

На рынок компания пойдёт по двум направлениям. Промышленные манипуляторы остаются за дочерней Rainbow Robotics, а сама Samsung возьмётся за потребительских и сервисных андроидов общего назначения - там ей предстоит конкурировать с Atlas от Boston Dynamics, принадлежащей Hyundai.
sedaily.com

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍75🔥1814👏9🤩6❤‍🔥2💯2🤬1
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ Hugging Face запустила агента для ML-экспериментов

Платформа встроила в свой чат-бот открытого ассистента ML Intern, который берет на себя полный цикл машинного обучения по текстовому описанию задачи.

Инструмент ориентирован на пользователей без профильного опыта. Для старта достаточно сформулировать идею в окне ввода текста, включить агента и он сам найдет релевантные модели и датасеты на Hugging Face Hub, в GitHub или в сети.

Перед стартом проводится оценка необходимых вычислительных ресурсов и фиксируется бюджет, за пределы которого агент гарантированно не выйдет.

После подтверждения ML Intern подготавливает данные, запускает обучение, мониторит процесс через отдельный дашборд, выгружает веса обратно на Hub, генерирует отчет и разворачивает интерактивное демо.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍70🔥247🥰5😢3👀2💅1
⚡️ DeepSeek выпустила V4.1 Flash

Ноую модель уже раскатывают в веб-чате и мобильных приложениях. Прежние режимы - быстрый, экспертный и распознавание изображений свели в один: выбирать вручную больше ничего не нужно.

Теперь одна модель ведёт и обычный диалог, и разбор картинок, и сложные вопросы. Сложность запроса она определяет сама, а зрение включает, когда на вход приходит изображение.

По словам DeepSeek, V4.1 Flash обходит V4 Pro по качеству, стоимости и скорости. До выхода V4.1 Pro она возьмёт на себя все запросы, которые раньше уходили на V4 Pro.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍8229🔥12🥰3❤‍🔥1
Media is too big
VIEW IN TELEGRAM
✔️ В США и Великобритании предложили запретить ASI

Законодатели по обе стороны Атлантики хотят запретить создание систем, превосходящих человека по всем направлениям.

В США представлен Ban Artificial Superintelligence Act, который вводит мораторий на обучение таких моделей до тех пор, пока не утвердят протоколы безопасности.

В британскую Палату общин внесён схожий документ, дающий регуляторам право отслеживать и ограничивать разработки, способные подорвать устойчивость государственных институтов.

Поводом авторы называют недавние инциденты с автономными агентами. Шансы на принятие у обоих документов невысокие, но сам факт показателен - разговор об экзистенциальных рисках ИИ перешёл из статей и конференций в тексты законопроектов.
time.com

✔️ АНБ, ФБР и CISA обвинили китайские компании в дистилляции западных моделей

Три американских ведомства выпустили совместный доклад, где обвиняют DeepSeek, Moonshot AI, Alibaba, MiniMax и StepFun в систематическом обучении своих моделей на выходах американских.

По версии спецслужб, с конца 2024 года китайские компании прогнали через API Claude, GPT, Gemini и Grok миллиарды токенов. Выходные данные американских моделей ведомства связывают с обучением DeepSeek-R1 и V3, а генерации GPT-4o и Claude - с линейкой Kimi от Moonshot AI.

Чтобы обойти лимиты платформ, компании, по данным доклада, использовали сети подставных аккаунтов и сторонние агрегаторы API. Специально подобранными промптами из западных систем вытягивали скрытые цепочки рассуждений.

Вредоносной такую дистилляцию называют потому, что она нарушает пользовательские соглашения сервисов. Обвиняемые компании доклад не комментировали.
US NSA Cyber в X

✔️ Runway забрала себе парижскую лабораторию Kinetix

Команда французского стартапа Kinetix в полном составе перешла в европейский исследовательский центр Runway - работать на стыке видеогенерации и робототехники.

Kinetix занималась моделированием движений человека в пространстве и физически корректными симуляциями. Runway этот опыт нужен, чтобы уйти от чисто визуальной генерации к моделям мира, которые смогут управлять роботами в реальной среде.

Направлением воплощённого ИИ в Европе компания займётся силами инженеров Kinetix.
runway.com

✔️ Inception обновила диффузионную языковую модель Mercury

Mercury 2.5 выдаёт больше 1100 токенов в секунду. Скорость берётся из архитектуры - обычная LLM создаёт текст по одному токену за раз, а диффузионная генерирует его блоками, уточняя целые фрагменты сразу.

Контекст - 260 тысяч токенов. Есть параллельный вызов инструментов, вывод в JSON и регулируемая глубина рассуждений. В голосовых сценариях время до первого токена не превышает 170 мс. По данным Inception, качество ответов выросло на 40% относительно прошлой версии.

Рассчитана модель на задачи, где критична задержка - многоэтапный поиск и RAG, голосовые боты и сжатие контекста.

Доступна через API InceptionBaseten и OpenRouter. Тариф - 0,20 доллара за миллион входных токенов и 0,75 за миллион выходных, на время релиза действует скидка 80%. Попробовать можно в веб-чате.
inceptionlabs.ai

✔️ Suno выпустила шестое поколение моделей

Линейка генераторов музыки с индексом v6 создавалась в партнёрстве с недавними оппонентами по судам Warner Music Group, BMG и Believe.

Моделей три. Флагманская v6 Pro рассчитана на предсказуемый результат в продакшене, экспериментальная v6-wild - на нестандартные идеи, а облегчённая v6-mini заменит базовую версию для бесплатных аккаунтов. По мере раскатки Suno обещает полностью отключить прежние поколения.

Главное новое - контроль над структурой композиции. Модели умеют править фрагмент, не перегенерируя трек целиком: переписать одну строчку текста, вытащить гитарный рифф для сэмплирования, заменить бэк-вокал.

Плюс появились мэшапы из разных треков, а на вход теперь идёт не только текст, но и референсное аудио, изображения и видео.
suno.com


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
52👍9😁6🔥5
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ Tencent релизнула одну модель на все задачи с речью

Tencent Hunyuan вместе с Шанхайским университетом выложили AuK, открытую базовую модель для генерации и редактирования речи на 1,5 млрд параметров.

Русского языка модель не знает, заявлены только китайский и английский. Авторы, правда, отмечают возможный перенос между языками - какая-то способность возникает сама, но поддержкой это не считается.


AuK принимает на вход текстовый запрос и, если нужно, исходное аудио и на выходе отдаёт готовый звук.

Всего заявлено пять типов задач: синтез речи (клонирование голоса по образцу и генерация по описанию), правка содержания (заменить слово в реплике или строчку в песне), акустика (темп, громкость, высота тона), паралингвистика (эмоция, тембр, акцент, вздохи и смешки, шёпот) и очистка с разделением (шумоподавление, выделение спикера, отделение вокала от музыки).

🟡Механика

Мультимодальная Qwen2.5-Omni читает инструкцию вместе с аудио и превращает её в смысловое условие. Аудио-VAE сжимает звук в компактное представление и потом восстанавливает обратно в волну.

Между ними работает трансформер по подобию FLUX - сначала десять блоков MMDiT, где смысловой и акустический потоки обмениваются информацией, оставаясь раздельными, затем двадцать обычных блоков DiT поверх склеенной последовательности.

🟡Тесты

По замерам Tencent, модель лидирует на Seed-TTS-Eval (разборчивость речи и похожесть на голос образца), InstructTTSEval (насколько точно модель отрабатывает словесное описание тембра), а также на MMAE-Speech и SpeechEditBench, где проверяют правки.

А вот на восстановлении сигнала (DNS Challenge, CHiME-4, Libri2Mix) она только конкурентоспособна, то есть узкоспециализированные модели там по-прежнему сильнее.

Отдельно выложена AuK-Flash - дистиллированная версия, которая укладывается в четыре шага вместо тридцати двух и работает в 4,5 раза быстрее.

К ней, кстати, нужно будет отдельно качать Qwen2.5-Omni-3B в роли энкодера.


В репозитории есть код установки, инференса на Gradio, ComfyUI, дообучения и шаблоны инструкций с примерами в кукбуке.

Пощупать можно в демо на Hugging Face и ModelScope.


📌Лицензирование: MIT License


🟡Страница проекта
🟡Веса
🟡Arxiv
🟡Демо
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #TTS #AuK #Tencent
Please open Telegram to view this post
VIEW IN TELEGRAM
👍32👏12🤗108
⚡️ OpenAI может приостановить оформление новых подписок ChatGPT Pro

Неформальный голос в X OpenAI, Тибо, сообщил, что интерес к Astra побил все внутренние исторические рекорды сервиса.

Компания неоднократно сталкивалась с резкими скачками трафика, но текущая динамика оказалась беспрецедентной - команда задействует все доступные вычислительные мощности, чтобы удерживать доступность инфраструктуры.

Главным приоритетом в OpenAI называют сохранение качества обслуживания текущих клиентов и если нагрузка продолжит расти теми же темпами, компания пойдет на превентивную меру и временно заморозит продажи тарифа ChatGPT Pro во избежание очередей на инференс и деградации производительности.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔34🔥25🤣12😁64😢3