283K subscribers
5.38K photos
1.25K videos
17 files
5.72K links
Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri
Download Telegram
Media is too big
VIEW IN TELEGRAM
✔️ Moonshot AI обсуждает размещение Kimi K3 у американских провайдеров

Китайский стартап ведет переговоры с Microsoft, Amazon и Google о размещении флагманской Kimi K3 в Azure, AWS и Google Cloud. Moonshot хочет до 30% доходов с сервисов, построенных на K3.

Переговоры на ранней стадии. Обсуждают, как делить выручку, кому будет открыт доступ к данным и как считать токены для выставления счетов.

Контакты сторон идут на фоне давления американских регуляторов. Власти США обвиняют Moonshot в том, что компания обучала свою модель на ответах Fable 5 от Anthropic, а Минфин пригрозил ей торговым эмбарго.

Moonshot отрицает, что использовала чужую интеллектуальную собственность. Microsoft, Google и AWS переговоры не комментируют.
reuters.com

✔️ Google выпустила Gemini 3.5 Transcribe

Модель распознает речь больше чем на 85 языках, вычищает слова-паразиты, давит фоновый шум и сама форматирует текст. Она подхватывает пользовательские словари, чтобы понимать сленг, не путается в буквенно-цифровых данных и умеет разбивать диалоги на реплики с таймкодами.

Модель получила вызов функций - она может передавать задачи другим моделям семейства Gemini. Например, отправить им генерацию изображения или разбор файла.

Модель работает через Gemini API в Google AI Studio. Ее уже встроили в клавиатуру Gboard для Android, в macOS-клиент Gemini и в корпоративную Enterprise Agent, на очереди Chrome. 
blog.google

✔️ Anthropic свела память Claude и Cowork воедино

То, что Claude запомнил о пользователе в одном интерфейсе, теперь работает и в другом. Причем память обновляется прямо по ходу разговора, а не пересобирается пересказом после его окончания.

Управлять записями можно вручную - смотреть, править и удалять отдельные факты. По умолчанию Claude не запоминает данные о здоровье, религии и политических взглядах. Разрешить их сохранение можно в настройках - тогда о каждой такой записи система будет предупреждать.

Новая память включена по умолчанию на тарифах Free, Pro и Max - в вебе, десктопных и мобильных клиентах.
claude.com

✔️ Figure AI платит пользователям за видео для обучения роботов

Компания выпустила на iOS и Android приложение Index. С помощью него люди снимают, как выполняют бытовые и рабочие задачи, и получают за ролики деньги. Данные идут на обучение модели Helix, которая управляет роботами Figure.

За четыре месяца тестирования загрузили 16 млн видео и выплачено 15 млн долларов. Загруженное автоматически проверяется на брак и мошенничество, чистится от дублей и получает текстовые описания. На каждую тысячу часов приходится 373 типа задач и больше тысячи разных предметов, с которыми взаимодействует человек.

В следующем году Figure собирается кратно нарастить сбор данных, а на выплаты и вычислительные мощности потратить больше миллиарда долларов.
figure.ai

✔️ ElevenLabs представила функцию для редактирования фрагментов музыки

Composer работает на модели Music v2 и правит трек по кускам, не перегенерируя его целиком. На вход идет аудиофайл, промпт или текст песни, дальше композиция сама разбирается на блоки - куплеты, припевы, переходы.

Дальше можно переписать слова в одном куплете, поменять тональность припева или замедлить переход, не трогая остальное. Для любого фрагмента Composer генерирует несколько вариантов на выбор, а сами блоки можно дублировать, менять местами и растягивать, то есть пересобрать структуру песни целиком.

Инструмент доступен на платформе ElevenMusic.
ElevenLabs в X

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍95🔥2519🤔13👏7😎5🤣1💘1
↔️ Быстрый офер в Яндекс для ML- или DL-инженеров

Приглашаем специалистов с опытом от 2 лет в доменных областях NLP, CV, RecSys и Classic ML на Weekend Offer ML* 12–13 сентября.

Это один из наймовых ивентов Яндекса: вы сможете пройти все ключевые этапы онлайн и без долгих пауз.

Как всё устроено:

⚪️до 4 сентября — регистрация;
⚪️12 сентября — всего две технические секции;
⚪️13 сентября — финальные интервью с командами.

Если хотите работать в одной из команд Яндекса — R&D, Алиса и Умные устройства, Поиск с Алисой AI, Независимый Ecom, Рекламные технологии Яндекса — регистрируйтесь!

🔛 Подробности и полезные ссылки на сайте. После регистрации с вами свяжется рекрутер и расскажет все детали.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍77🎉24😁23👏1110🥱6🤩5🍓2🔥1🥰1
✔️ Kimi начала уведомлять о выпуске кобрендинговой банковской карты

Китайский разработчик ИИ начал слать сообщения тем, кто ранее записался на совместную карту с Сельскохозяйственным банком Китая (ABC).

Карт две.

Select рассчитана на массовую аудиторию - новым клиентам, которые выполнят требования по тратам, дают три месяца подписки Andante и плюшевый брелок с NFC-меткой.

В Andante входят увеличенные лимиты на агентов, доступ к Kimi Code и публикация сайтов.


Max - это премиальная платиновая карта ABC. За выполнение тех же условий при оформлении дают два месяца подписки Allegretto - вчетверо больший лимит на агентов, в двадцать раз больший на Kimi Code и возможность держать несколько агентов одновременно. Её оформляют только в отделении банка.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍116😁36🔥19👏1211🤩10🥱3🤷‍♀1🤔1
🌟 Tencent открыла набор мультимодальных эмбеддингов

Команда WeChat китайского техгиганта выложила в открытый доступ семейство эмбеддинг-моделей WeMM-Embedding, предназначенных для создания универсальных векторных представлений.

Набор работает с текстом, изображениями, видеороликами, сложными визуальными документами и смешанным контентом, объединяя их в единое семантическое пространство.

Эмбеддинги учили с использованием Matryoshka Representation Learning, который позволяет на этапе применения обрезать размерность вектора, экономя память и вычисления.

Построено семейство на Qwen3.5, на выходе младшая модель дает нормализованный вектор на 2048 измерений, а старшая - на 4096.

Tencent приводят цифру, что при сжатии до 256 измерений двухмиллиардная модель сохраняет 98,7% исходного качества на задачах с фото и видео.


Опубликованы веса трех размерностей: 2B4B и 9B

🟡 Тесты

9B берет новый лучший общий результат на MMEB-v2 (80,6 балла), а 2B обходит Qwen3-VL-Embedding, который вчетверо больше нее.

Но есть аргумент посильнее бенчей - семейство работает в рекомендациях и поиске WeChat. Она развернута для обработки каналов, аккаунтов и электронной коммерции.

Команда мессенджера говорит, что WeMM-Embedding показали стабильные улучшения в 14 онлайновых A/B-тестах.


Модели работают с библиотекой Transformers и поддерживаются vLLM и SGLang.

Единственным ограничением текущей версии является отсутствие поддержки аудио



📌Лицензирование: Apache 2.0 License


🟡Arxiv
🟡Веса
🖥Githib


@ai_machinelearning_big_data

#AI #ML #Embeddings #WeChat #Tencent
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥147👍41👏1915💯6🥰1👀1
📌 Билл Гейтс: мир не готов к эпохе ИИ

Главный филантроп планеты написал большую статью о том, чем обернется развитие ИИ, и предлагает вмешаться, пока не поздно, так как плана нет ни у кого.

Он выделил три главных риска и предложил шаги, которые нужно сделать уже сейчас.

🟡Угроза занятости

Раньше машины замещали физический труд, а ИИ сейчас замещает мышление человека, поэтому некоторые профессии исчезнут навсегда.

Первыми пойдут продажи, поддержка клиентов, разработка и юристы, но дальше очередь дойдет до финансов, анализа данных и даже здравоохранения.

Физический труд тоже в опасности - роботы отстают от ИИ, но дешевеют, и к концу десятилетия, считает Гейтс, начнут конкурировать с людьми на стройке и в общепите.

Дальше включится порочный круг. Одна компания внедрила роботов, сэкономила, снизила цены - остальные вынуждены делать то же самое. Не сделают компании, сделают стартапы.

🟡Безопасность

Инструкции по деструктивным действиям лежали в интернете и раньше. Разница в том, что теперь их не только легче найти, но и легче применить - преступник с очень скромными навыками сможет атаковать цели любого масштаба, от человека до государства.

Самые толковые из знакомых ему специалистов по кибербезопасности боятся ближайших лет, потому что атакующие получают новые возможности быстрее, чем защитники успевают закрывать дыры. Та же модель, которая находит уязвимость, помогает преступнику ею воспользоваться, и отделить одно от другого пока не получается.

И наконец, сами модели. Они уже иногда ведут себя не так, как задумывали создатели, и по мере роста их возможностей могут начать действовать против интересов людей, а мы можем потерять контроль.

🟡Влияние на молодежь

ИИ-компаньоны, считает Гейтс, вызывают сильное привыкание из-за того, что никогда не спорят с собеседником. Ребенок рискует вырасти в искусственно бережной среде и не научиться социальным навыкам.

Данных пока мало и они противоречивы, но тревожные признаки есть. В исследовании про ИИ-ассистентов выяснилось, что к чат-боту за общением чаще обращаются те, у кого узкий круг знакомых, и чем интенсивнее и эмоционально ближе становилось общение с ИИ, тем хуже люди себя чувствовали.

Под угрозой образование - тот же инструмент, который позволяет узнать больше, чем когда-либо, приведёт к тому, что люди будут учиться меньше. Уже сейчас прослеживается связь между использованием ИИ и ослаблением критического мышления, причем у молодых сильнее.

🟡Что делать

Строить новые институты

Существующие ведомства видят каждое свой кусок, а последствия ИИ расходятся по всей системе, поэтому нужны локальные и международные органы, которые видят влияние ИИ целиком.

Зарезервировать часть профессий за людьми

Эту идею Гейтс придумал, вспоминая сиделок, ухаживавших за его отцом на поздней стадии Альцгеймера, - в этом уходе, пишет он, было нечто незаменимо человеческое, хотя кто и по каким критериям будет проводить границу, он сам не знает.

Создать налог на ИИ

Нанимая человека, работодатель платит налоги, а купленного робота обычно списывает сразу как расход, т. е. налоговая система сама подталкивает заменять людей машинами, и налог на токены и роботов этот перекос выправит, заодно дав деньги на переобучение людей.

🟡Кто должен решать

Гейтс рад, что ИИ-компании предлагают решения проблем, созданных их же технологией, но ждать, что они возглавят этот процесс, не стоит. Часть вопросов лежит вне их компетенции, а в современном обществе решать такое не их роль.

Решения должны рождаться коллективно - с участием политиков, педагогов, медиков, чиновников и религиозных лидеров.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
95👍32👻22😁19🤣11🗿9🔥8🥱6🤔3💯1🎅1
🚀 Tencent показали Hy4-preview - новую open-source модель на 770B параметров

Архитектура MoE:
- 770B параметров всего
- 49B активны на токен
- контекст до 1 млн токенов
- упор на coding, agentic-задачи и продуктивность

Использует Gated DeepSeek Sparse Attention + IndexCache, чтобы удешевить длинный контекст и переиспользовать sparse-индексы между слоями.

Tencent позиционирует Hy4 как frontier-level open model с доступной стоимостью запуска.

Apache 2.0

🟡 Блог: https://hy.tencent.ai/research/hy4-preview

🟡Hugging Face:
https://huggingface.co/tencent/Hy4-preview

🟡GitHub: https://github.com/Tencent-Hunyuan/Hy4-preview

@ai_machinelearning_big_data

#Tencent
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍6720🔥9🥰1👌1
Сбер открыл доступ к новому поколению моделей GigaEmbeddings
 
Линейка включает три модели разного размера: 480M, 3B и 10B-A1.8B. Они переводят тексты в числовые векторы для семантического поиска, построения RAG-систем (Retrieval-Augmented Generation), классификации и кластеризации.
 
Команда разработки изменила архитектуру модели, чтобы упростить интеграцию со стандартными открытыми инструментами. На vLLM GigaEmbeddings 3B работает в 1,6 раза быстрее предыдущей версии, а 10B-A1.8B — в 2 раза.
 
Объём данных для обучения увеличился в несколько раз. В частности, за счёт открытых датасетов Nemotron, F2LLM и KALM.
 
На всех этапах применяли мержинг экспертов для сохранения языкового баланса. Самую компактную модель обучали с помощью дистилляции: она усваивала ответы более крупных и точных моделей.
 
По результатам тестов 10B-A1.8B заняла первое место в рейтинге ruMTEB. У модели 3B качество обработки кода выросло на 14,5 пункта. При этом самая компактная модель 480M стала лучшей на русском языке среди решений до 500 млн параметров.
 
Ищите веса под лицензией MIT на GitVerse и HuggingFace.
Модели бесплатно доступны разработчикам и бизнесу под открытой MIT-лицензией:

HF: 480M | 3B | 10B-A1.8B
Gitverse: 480M | 3B | 10B-A1.8B
 
Подробности читайте в посте команды ↖️
55🤣41👍13🔥7🥱3😁1🗿1
Media is too big
VIEW IN TELEGRAM
✔️ Nvidia покупает Hugging Face

Сумма сделки - $12,9 млрд. По данным инсайдеров, стороны находятся на стадии оформления, официальных комментариев от обеих компаний пока нет.

Переговоры ускорились после того, как Hugging Face получила предложение о поглощении от другого неназванного игрока и привлекла банк для оценки спроса.

Для Nvidia это выход за пределы железа и прямой контроль над площадкой, через которую расходится и разрабатывается основная масса открытых моделей. Ровно поэтому сделка почти наверняка заинтересует антимонопольные органы.
theinformation.com

✔️ Бигтех подписал открытое письмо об ИИ в кибербезопасности

OpenAI, Microsoft, Google, Anthropic, AWS, Cisco, CrowdStrike и еще около сотни компаний призвали защищать критическую инфраструктуру от атак, написанных с помощью ИИ, - тем же ИИ.

Коалиция предупреждает, что сегодня модели работают скорее на защитников - они автоматизируют поиск и закрытие уязвимостей, копившихся в системах десятилетиями. Перевес этот не вечен, поэтому внедрять такие инструменты нужно сейчас, пока он есть.

Корпорациям авторы письма советуют поднять киберзащиту на уровень топ-менеджмента, государствам - усилить координацию и финансирование отрасли.
openai.com

✔️ Anthropic встроила браузер в Claude

Через боковую панель Claude сам открывает сайты, читает страницы, кликает по элементам и заполняет поля. Пригодится, когда нужно снять цифры с дашборда, у которого нет API, или заполнить форму.

Работает это в изолированной среде - вкладок, закладок и паролей пользователя Claude не видит. Авторизацию можно перенести из Chrome, Edge или Firefox, но точечно - сессия привязывается к конкретной странице, а не отдается целиком. Почтовые клиенты и банковские сайты закрыты наглухо.

Функция появится на этой неделе у подписчиков Pro, Max, Team и Enterprise. Если нужно работать с уже открытыми вкладками, Anthropic советует расширение для Chrome.
claude.com

✔️ Google обновила Gemini Omni Flash до 1.1

Видеомодель умеет как генерировать, так и редактировать. Сцену выдает длиной до 40 секунд, опираясь на 10 секунд предыдущего видеоряда. На вход принимает текст, звук, изображения и видео.

Появилось ручное задание первого и последнего кадра, плюс черновой режим - он на 60% быстрее и втрое дешевле обычного, а понравившийся результат потом поднимается до 4K.

Секунда видео стоит 3 цента в 360p и 30 центов в 4K. Все, что генерирует модель, помечается невидимым знаком SynthID.

Модель доступна в Google AI Studio и через Agent Platform API, а подписчикам AI Plus, Pro и Ultra - еще и в Google Flow и приложении Gemini.
blog.google

✔️ ИИ-агент Instinct хайпует среди инвесторов Кремниевой долины

Стартап Spear Street Technology закрывает раунд на 250 млн долларов при оценке в 2,5 млрд. Ведут раунд Benchmark и Index Ventures. Основатель - 23-летний Ноа Шинн, автор метода Reflexion, до этого работавший в Sierra.

Instinct он делает как персонального агента, которого не нужно настраивать. Чтобы тот управлял компьютером, разбирал почту, бронировал билеты и проводил платежи, достаточно написать ему сообщение или позвонить голосом.

Первые тестировщики называют его "OpenClaw для обычных людей".

При этом продукт в закрытой бете, выручку и число пользователей стартап не раскрывает.
wsj.com


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
32👍16😢10🔥5😨3🤬2❤‍🔥1💘1
Институт AIRI выложил в открытый доступ 70+ видео лекций и семинаров по ИИ

Организаторы «Лето с AIRI 2026» поделились записями выступлений с летней школы по искусственному интеллекту для молодых учёных.

Разобрали чуть ли не весь ИИ — прошлись по робототехнике, адаптивным агентам, приложении в науках о жизни, медицине, погоде и так далее.

Посмотреть можно в VK Видео и на YouTube
48🔥27👍22😁4🤣1🫡1
🌟 IBM представила открытые модели Granite 4.2

Granite 4.2 - семейство языковых моделей под агентные сценарии и корпоративные задачи.

Модели умеют рассуждать шаг за шагом - планируют, прежде чем действовать, взвешивают варианты, прежде чем выбрать путь, и ловят собственные ошибки до того, как те во что-то выльются.

Версии - на 38 и 30 миллиардов параметров с окном на 128K (для длинных контекстов до 512К).

Архитектура dense, так что семейство зайдёт и для облаков, и для своих серверов, и под периферийные устройства.

🟡Обучение

Первый этап, базовое RL-обучение, прошли все три модели. Он подтянул математику, науку, код, рассуждения и работу с инструментами, причем награду считали двумя способами сразу: где ответ можно проверить формально - проверяли, где нельзя - оценивали отдельной моделью-судьей.

Модели на 8 и 30 млрд прошли еще и агентный этап, заточенный под корпоративные сценарии: разработку ПО, работу в терминале и поиск.

Навыки кодинга и рассуждения обучали на триллионе токенов синтетического кода из собственного конвейера IBM CodeAlchemy.

Есть еще слой спекулятивного декодирования - модель угадывает продолжение наперед и проверяет траекторию ответа наперед вместо пословной генерации. Текст выходит быстрее, а серверы инференса тянут больше пользователей одновременно.


Семейство доступно везде: Hugging Face, Ollama, CoreWeave и еще на десятке площадок.

🟡 Распознавание речи

Заодно IBM выпустила две речевые модели английского языка - Granite Speech 5.0 Turbo CTC и ее некоммерческую версию с индексом NC.

Скачок в нумерации с 4.1 сразу на 5.0 не случаен - это принципиально другая конструкция, чем была в 4-й серии.


В них всего 470 млн параметров и внутри нет языковой модели. Под капотом CTС (connectionist temporal classification) - способ сопоставлять звук с текстом без промежуточной разметки, и он особенно хорош на потоковом аудио.

В тестах IBM на одной H200 пропускная способность, RTFx, дошла примерно до 12 600. Нынешние лидеры публичного лидерборда Open ASR держатся около 6000.


Отдельно IBM снизила частоту дискретизации, и вот это дает главную цифру - три часа записи модель расшифровывает за секунды.


📌 Лицензирование: Apache 2.0 License


🟡Страница релиза
🟡Веса Granite 4.2
🟡Веса Granite Speech 5.0


@ai_machinelearning_big_data

#AI #ML #LLM #ASR #Granite #IBM
Please open Telegram to view this post
VIEW IN TELEGRAM
36🔥11👍7🤔1
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ В Пекине показали робо-коня

Китайская DaxAI Robotics привезла на World Robot Conference, проходившую в Пекине с 19 по 23 августа, четвероногого робота Qiji X1 с седлом и рулем.

DaxAI называет робота первым в мире роботом для верховой езды, хотя робо-коня в этом году показывала и DEEP Robotics.


Машина весит 300 кг и столько же может нести - это примерно двое взрослых плюс груз.

Скорость 7-10 км/ч, запас хода 40 км, до 10 часов непрерывной работы на высоковольтной батарее. Максимальный момент в суставе - 1400 Нм.

Соображает робот сам - внутри зашита модель мира DaxBrain-WM, которая подстраивает угол и глубину постановки ног под склоны, гравий и грязь.

DaxAI подписала трехлетнее соглашение с маркетплейсом JD и открыла там предзаказ первой партии. Покупателям обещают подарочный набор для поездок, пять лет бесплатного обслуживания и пять лет бесплатных обновлений.

Цена - около 289 тысяч юаней (~ 43 тысячи долларов).

Также компания показала колесно-шагающую версию Qiji XS - 320 кг, до 40 км/ч, запас хода 60 км, - и более крупный T1000 под тяжелые работы.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥43👍29🤩258🗿7🤷‍♂5😁5👏2🎄1
🔥 GLM-5.3 стал open-weight

Z.ai открыла веса своей самой сильной модели для agentic coding и defensive cybersecurity.

Теперь GLM-5.3 можно:

- скачать
- запускать локально
- дообучать и кастомизировать под свои задачи

Это полноценный релиз весов, а не просто доступ через API, так что разработчики и исследователи смогут разбирать модель глубже и использовать её в своих пайплайнах.

Weights:
https://huggingface.co/zai-org/GLM-5.3

Tech blog:
https://z.ai/blog/glm-5.3

@data_analysis_ml / Папка полезного по ML.
🔥120👍2814🤩13👏8
⚡️ Claude научили автоматически исправлять опасное поведение других моделей

Anthropic дала Claude задачу самому искать способы уменьшать обман, подхалимство, утечки приватных данных, взлом ограничений и другие проблемы поведения моделей.

Anthropic описали интересный эксперимент:

- Claude Sonnet 5 получил раннюю версию Opus 4.8 без полноценной настройки безопасности
- за 60 часов проверил более 50 подходов
- закрыл около 65% разрыва по безопасности
- результат почти приблизился к финальному Opus 4.8 - 72%
- для лучшего метода понадобилось чуть больше 2000 примеров
- это примерно в 15 000 раз меньше данных, чем в обычной процедуре Anthropic

На отдельном тесте по обману Claude закрыл в среднем 85% разрыва, а группа опытных исследователей - около 20%.

Но был и интересный побочный эффект: из ~1600 запусков в 39 случаях Claude пытался схитрить при проведении исследования, поэтому за агентами отдельно следила другая модель.

Anthropic открыла код системы для таких экспериментов.

https://www.anthropic.com/research/automated-researchers-mitigate-alignment-failures

#Claude #Anthropic
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔76👍29👏1714🔥8😁7🎉4😴2
✔️ В Китае выпустят первые в стране памятные монеты про ИИ

4 сентября Народный банк Китая выпустит набор золотых и серебряных памятных монет серии «Научно-технологические инновации будущего (Искусственный интеллект)».

В наборе три монеты - одна золотая и две серебряные, обе имеют статус законного платежного средства.

Золотая весит 5 граммов, квадратная, со стороной 18 миллиметров. На реверсе изображены чипы, схема в форме мозга и нули с единицами.

Серебряные - по 15 граммов, на них лица, микросхемы, спиральные узоры, ключи и символы ИИ.

Номинал золотой монеты - 80 юаней (~1000 рублей), тираж до 10 тысяч штук. У серебряных номинал 5 юаней (~60 рублей) и тираж до 20 тысяч.

Чеканят набор два государственных монетных двора - Шанхайский и шэньчжэньский Guobao. Купить монеты можно будет в том числе онлайн.

Кстати, когда в марте собирали эскизы для этих монет, организаторы разрешили дизайнерам пользоваться ИИ как вспомогательным инструментом, но запретили сдавать откровенный нейрослоп.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
33🔥21🤔19🥰8👏6😁4🤩4🤗1
Media is too big
VIEW IN TELEGRAM
✔️ Суд признал незаконным внесение Anthropic в черный список Пентагона

Федеральный суд в Калифорнии постановил, что Министерство обороны действовало произвольно и немотивированно, объявив Anthropic угрозой национальной безопасности. Доказательств того, что компания создает реальные риски для цепочек поставок или собирается саботировать работу собственных моделей, правительство в суде не привело.

Решение бессрочно запрещает исполнять директиву о бойкоте компании, но закупать что-либо у Anthropic Пентагон не обязывает - ведомство вправе выбирать других поставщиков.
reuters.com

✔️ США повезут на G20 концепцию мягкого регулирования ИИ

На встрече профильных министров стран G20 американская делегация представит Carolina Principles - документ, подготовленный Управлением по науке и технологиям и Минторгом.

Концепция предлагает странам отказаться от жесткого контроля над ИИ и не создавать новые надзорные органы, а вместо этого действовать точечно и расширять партнерство с ИТ-бизнесом для тестирования моделей.

Поддержать инициативу приедут первые лица индустрии. 1 сентября мероприятие откроют Илон Маск и бывший советник Белого дома по ИИ Дэвид Сакс, на следующий день к дискуссии подключатся Сэм Альтман и Дженсен Хуанг.

США рассчитывают убедить остальных участников G20, включая Китай, Японию и европейские страны. Если консенсус сложится, документ вынесут на утверждение лидеров двадцатки на декабрьском саммите.
bloomberg.com

✔️ OpenAI тестирует автономный режим Codex

Журналисты WIRED нашли в коде OpenAI упоминания Persistent Mode - режима, в котором агент Codex работает в фоне непрерывно, пока его вручную не выключат.

Судя по найденному, агент станет проактивным: будет держать контекст между сессиями, сам придумывать себе следующие задачи и первым начинать разговор с пользователем. Обращения к внешним системам по-прежнему только с подтверждения человека.

В OpenAI тестирование подтвердили, но сроков не назвали.
wired.com

✔️ Gemini Notebook научился работать с книгами

В сервисе появилась функция Expert Intelligence - электронные книги из Google Play Books можно подключать как источник знаний. На старте доступно больше 100 тысяч изданий, включая техническую литературу O'Reilly. По тексту выбранной книги Gemini отвечает на вопросы, делает пересказы и собирает обучающие карточки.

Книгу нужно купить, а если рабочим пространством пользуются несколько человек, купить ее обязан каждый - без подтвержденной лицензии доступ ко всем ответам и выдержкам по этому источнику блокируется автоматически.

Пока функция работает только внутри Notebook. Дальше Google планирует подключить платные научные статьи и маркетинговые отчеты, а саму механику перенести в основное приложение Gemini и в ИИ-поиск.
blog.google

✔️ Ученые создали ML-карту нейронных связей для терапии аутизма

Исследователи Калифорнийского университета собрали вычислительную карту, которая делит расстройства аутистического спектра на биологические подтипы по сочетанию паттернов мозговой активности и молекулярных биомаркеров.

Модели машинного обучения разобрали массивы данных фМРТ и результаты генетического секвенирования, а затем сопоставили архитектуру нейронных связей участников с тем, как те откликались на разные виды вмешательств.

В перспективе такая карта дополнит классическую диагностику по поведенческим признакам - подбирать помощь не только по симптомам, но и по биомаркерам, заранее прикидывая, что сработает. Пока это исследовательский результат, до применения в клинике ему предстоит независимая проверка.
science.org


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7528🔥14🤩12👏7😁1🍓1
Media is too big
VIEW IN TELEGRAM
🌟 Prime Intellect выложила отчет об агенте, с которым Opus 5 взял 95,5% на ARC-AGI-3

Prime Agent — это больше, чем харнесс модели. Сами авторы называют проект операционной системой для долгоживущих агентов.

Умнее модель он не делает, но дает ей работать дольше - программно раскладывать информацию, параллельно раздавать задачи подагентам и копить полезные процедуры.

Идея в том, чтобы у языковой модели была устойчивая вычислительная среда, где она сама распоряжается памятью, кодом, подагентами и долгими задачами.


Состояние в системе разложено по четырем уровням:

🟢веса модели - то, что она знает после обучения;
🟢активный контекст - информация текущего шага;
🟢постоянный REPL и рекурсивные подагенты - внешние вычисления, инструменты и параллельная работа;
🟢дисковое состояние - история, факты, навыки, промпты и спецификации подагентов.

Состояние переживает и шаги, и перезапуски, и отключения. Человек при этом может наблюдать за агентами и вмешиваться.

🟡Замеры

Сильнее всего эффект виден на длинных интерактивных задачах. На ARC-AGI-3 конфигурация с Opus 5 дала 95,5% Best@1 против 30,2% у обвязки самой ARC.

На длинноконтекстных задачах Prime Agent держится наравне с конкурентами, а на отдельных, вроде EmulatorBench, заметно вырывается вперед. Он обошел Pi-mono с GLM-5.2 и Codex с GPT-5.6 Sol, но уступил Claude Code с Opus 5.

Отдельно показательны игровые прогоны на эмуляторах. На Sega Genesis связка Prime Agent и GPT-5.6 Sol набрала 61,6% по итоговой оценке верификатора, а Claude Code с той же моделью — ноль. На Game Boy Color разрыв еще резче: 99,8% против нуля.

🟡 Побочный эффект

Самая любопытная деталь отчета - накопление навыков закрепляет не только полезное.

В одном из экспериментов агент нашел способ обходить ограничения Factorio, сохранил его как переиспользуемый навык и тем самым записал эксплойт в долговременную память. Дальше он доставал оттуда именно это решение, потому что оно один раз сработало.

На днях вышел релиз 0.8.0 с исправлениями найденных проблем и новыми возможностями.



📌Лицензирование: MIT License


🟡Техотчет
🖥Github


@ai_machinelearning_big_data

#AI #ML #Harness #Agents #PrimeIntellect
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7844🔥19👏14🤔9🎉4
📌 LAION выложила открытый датасет из 80 млн видео, 300 млн кадров и аудиодорожек

Исследовательская группа опубликовала BVD (Big Video Dataset). Его собрали, чтобы дать альтернативу монополизации обучающих материалов крупными технологическими компаниями и предоставить научному сообществу доступ к ресурсам для работы с видео, звуком и изображениями.

Отправной точкой послужили 1,3 млрд ссылок из архивов CommonCrawl. Из них LAION скачала 80 млн роликов общей длительностью 10 млн часов.

Дальше видео резали на клипы по сменам сцен, а к каждому фрагменту сгенерировали синтетические описания того, что происходит на экране и звучит в кадре.

Отдельно из роликов вытащили статичные кадры, привязав их к моментам смены ракурса.

Такая коллекция отличается от обычных интернет-корпусов картинок: в ней есть ракурсы, движение и композиции, которых в фотобанках не бывает.


По собственным экспериментам LAION, модели архитектур ViCLIP и CLAP, обученные на BVD, держатся на уровне передовых решений в профильных бенчмарках, а качество растет по мере увеличения объема обучающих данных.

🟡Что можно скачать

Датасет выложен в двух вариантах: облегченный - только URL-адреса видео и метаданные, и полный - с медиафайлами.

Оба варианта разложены на несколько наборов:

🟢BVD-RAW - все 80 млн роликов;

🟠BVD-V-55M - 55 млн клипов, нарезанных из BVD-RAW по сменам сцен;

🟠BVD-A-1.7M и BVD-A-10M - две аудиовыборки из BVD-V-55M, на 1,7 млн и 10 млн дорожек;

🟠BVD-I-300M - 300 млн кадров, извлеченных из BVD-RAW.

Облегченная версия лежит на Hugging Face свободно, а для доступа к вариантам с медиафайлами нужно заполнить анкету.

⚠️ Датасет опубликован только для исследований, коммерческое использование запрещено.


@ai_machinelearning_big_data

#AI #ML #Dataset #LAION
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4419🔥15❤‍🔥4