281K subscribers
5.45K photos
1.26K videos
17 files
5.78K links
Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri
Download Telegram
📌 Что показали на IFA 2026

Выставка прошла в Берлине с 4 по 8 сентября. Это главная европейская площадка потребительской электроники и бытовой техники, и в этом году её темой стал, ожидаемо, искусственный интеллект в его воплощённом проявлении - гуманоидах, экзоскелетах, робопсах и электромобиле.

Столько двуногих и четвероногих роботов одновременно на IFA ещё не было. Топовые производители привезли машины, которые ходят, танцуют, дерутся, играют в футбол и общаются с посетителями.

Самый заметный - T800 от EngineAI ростом 1,73 метра. У него 29 степеней свободы, каждая рука поднимает до 5 кг, а за зрение и вычисления отвечают камеры, лидар и модуль Nvidia Jetson Orin.

Agibot запомнился гуманоидом A3, который кисточкой пишет китайскую каллиграфию благодаря датчикам давления в пальцах.

DEEP Robotics привёз робопса Lynx M20S для инспекций, охраны и спасательных операций, а на турнире RoboCup автономные роботы играли друг против друга в футбол.

🟡Экзоскелет Hypershell Halo

Hypershell показала Halo - первый экзоскелет компании, который поддерживает бёдра и колени одновременно. Четыре мотора выдают до 1490 Вт пиковой мощности, больше 30 датчиков считывают движения и передают данные чипу HyperCore Pro.

Модель HyperIntuition 2.0 угадывает следующее движение примерно за 200 миллисекунд и до 2500 раз в секунду подстраивает усилие на каждом суставе. Весит всё это 2,6 кг, компактно складывается, а заряда хватает примерно на 20 км ходьбы.

В комплекте ИИ-помощник Shelly для настройки и планирования маршрутов. Цена 2299 евро, поставки обещают с ноября 2026 года.

🟡Электромобиль Xiaomi SU7 Ultra

Xiaomi привезла электроседан SU7 Ultra и объявила, что с 2027 года будет официально продавать свои автомобили в Германии и других странах Европы.

Машина выдаёт 1548 л. с. и, по данным производителя, разгоняется до 100 км/ч за 1,98 секунды. На Нюрбургринге она держит рекорд среди серийных электромобилей - 7 минут 4,957 секунды. Дорогу считывают лидар, радар, 11 камер и 12 ультразвуковых датчиков.

🟡 Робот, который меняет форму

PrimeBOT T1 переключается между двуногим режимом и ходьбой на четырёх конечностях, поэтому одинаково уверенно двигается и по квартире, и по улице.

Он сам следует за хозяином и снимает его на камеру - в памяти больше 15 готовых операторских приёмов.мКомпания видит в T1 компаньона для учёбы, творчества и развлечений.

Жюри выставки отдало ему официальную награду Innovation Award в категории Content Creation Technology.


🟡 Дата-центр под столом

AMD впервые показала рабочую станцию Threadripper Halo Station. Внутри процессор Threadripper Pro с 96 ядрами Zen 5 и два ускорителя Instinct MI350P по 144 ГБ памяти HBM3E каждый.

Система поддерживает до 2 ТБ оперативной памяти DDR5, а с четырьмя ускорителями, которые заявлены как опция, объём HBM3E вырастет до 576 ГБ.

По словам AMD, этого хватает, чтобы локально запускать модели с более чем триллионом параметров и гонять масштабные агентские сценарии без облака.

🟡Спарринг-партнёр для корта

Роботизированная теннисная пушка ACEMATE S10 Pro сама ездит по корту, следит за игроком и мячом через две 4K-камеры с HDR и в режиме Battle решает, каким ударом ответить, подражая разным стилям игры.

Мяч подаёт с скоростью до 120 км/ч, задаёт разные виды вращения, в памяти больше 100 тренировочных программ. После занятия ИИ разбирает данные и предлагает упражнения на следующее. Цена 2999 евро.

🟡Кибер-питомец

OlloBot пробует новую категорию где-то между роботом, домашним животным и ИИ-компаньоном. OlloNi SS1 реагирует на голос и прикосновения, запоминает привычки и настроение хозяина, а система EmpathCore подбирает под них эмоциональную реакцию. На IFA у него европейский дебют.

🟡Два пылесоса в одном

iRobot Roomba Duo - тандем из большого робота iRobot и маленького Roomba Plus 575, которого механическая рука опускает на пол. Большой пылесосит открытые зоны и моет паром, маленький забирается под мебель и в узкие места. Оба пользуются общей картой квартиры и делят задачи между собой с помощью ИИ. Пока это прототип без цены и даты выхода.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍68🔥239👀9👏4🥰1
📊 Anthropic смоделировала, что ИИ может сделать с экономикой США к 2030 году

Компания выпустила Economic Scenario Explorer - модель влияния ИИ на рабочие места, зарплаты и ВВП.

Три сценария:

- умеренный — ВВП к 2030 году выше примерно на 1,6%
- существенный — +8,3%, экономика растёт примерно вдвое быстрее обычного, а зарплаты специалистов умственного труда почти не растут
- экстремальный — +32,4% ВВП, темпы роста достигают 15% в год, но зарплаты knowledge workers падают более чем на 10%

В экстремальном сценарии ИИ выполняет почти всю интеллектуальную работу автономно, без появления сопоставимого количества новых задач для людей.

Меняется и распределение доходов: доля труда в экономике снижается с примерно 60% до 45,2%, а доля капитала растёт до 54,8%.

Результат зависит от возможностей ИИ, скорости внедрения и того, насколько быстро люди смогут переходить в новые профессии.

Интерактивная модель позволяет самому выставить уровень возможностей, автономности и распространения ИИ и посмотреть, какой экономике это соответствует в 2030 году.

https://www.anthropic.com/institute/econ-scenarios
🤔143👍32🤣3018👏14🤩8🎉5🔥4🙈2🐳1
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ Hugging Face запустила агента для ML-экспериментов

Платформа встроила в свой чат-бот открытого ассистента ML Intern, который берет на себя полный цикл машинного обучения по текстовому описанию задачи.

Инструмент ориентирован на пользователей без профильного опыта. Для старта достаточно сформулировать идею в окне ввода текста, включить агента и он сам найдет релевантные модели и датасеты на Hugging Face Hub, в GitHub или в сети.

Перед стартом проводится оценка необходимых вычислительных ресурсов и фиксируется бюджет, за пределы которого агент гарантированно не выйдет.

После подтверждения ML Intern подготавливает данные, запускает обучение, мониторит процесс через отдельный дашборд, выгружает веса обратно на Hub, генерирует отчет и разворачивает интерактивное демо.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍76🔥307🥰5😢3👀2💅1
⚡️ DeepSeek выпустила V4.1 Flash

Ноую модель уже раскатывают в веб-чате и мобильных приложениях. Прежние режимы - быстрый, экспертный и распознавание изображений свели в один: выбирать вручную больше ничего не нужно.

Теперь одна модель ведёт и обычный диалог, и разбор картинок, и сложные вопросы. Сложность запроса она определяет сама, а зрение включает, когда на вход приходит изображение.

По словам DeepSeek, V4.1 Flash обходит V4 Pro по качеству, стоимости и скорости. До выхода V4.1 Pro она возьмёт на себя все запросы, которые раньше уходили на V4 Pro.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍9233🔥14🥰3❤‍🔥1😁1🤬1🎉1
Media is too big
VIEW IN TELEGRAM
✔️ В США и Великобритании предложили запретить ASI

Законодатели по обе стороны Атлантики хотят запретить создание систем, превосходящих человека по всем направлениям.

В США представлен Ban Artificial Superintelligence Act, который вводит мораторий на обучение таких моделей до тех пор, пока не утвердят протоколы безопасности.

В британскую Палату общин внесён схожий документ, дающий регуляторам право отслеживать и ограничивать разработки, способные подорвать устойчивость государственных институтов.

Поводом авторы называют недавние инциденты с автономными агентами. Шансы на принятие у обоих документов невысокие, но сам факт показателен - разговор об экзистенциальных рисках ИИ перешёл из статей и конференций в тексты законопроектов.
time.com

✔️ АНБ, ФБР и CISA обвинили китайские компании в дистилляции западных моделей

Три американских ведомства выпустили совместный доклад, где обвиняют DeepSeek, Moonshot AI, Alibaba, MiniMax и StepFun в систематическом обучении своих моделей на выходах американских.

По версии спецслужб, с конца 2024 года китайские компании прогнали через API Claude, GPT, Gemini и Grok миллиарды токенов. Выходные данные американских моделей ведомства связывают с обучением DeepSeek-R1 и V3, а генерации GPT-4o и Claude - с линейкой Kimi от Moonshot AI.

Чтобы обойти лимиты платформ, компании, по данным доклада, использовали сети подставных аккаунтов и сторонние агрегаторы API. Специально подобранными промптами из западных систем вытягивали скрытые цепочки рассуждений.

Вредоносной такую дистилляцию называют потому, что она нарушает пользовательские соглашения сервисов. Обвиняемые компании доклад не комментировали.
US NSA Cyber в X

✔️ Runway забрала себе парижскую лабораторию Kinetix

Команда французского стартапа Kinetix в полном составе перешла в европейский исследовательский центр Runway - работать на стыке видеогенерации и робототехники.

Kinetix занималась моделированием движений человека в пространстве и физически корректными симуляциями. Runway этот опыт нужен, чтобы уйти от чисто визуальной генерации к моделям мира, которые смогут управлять роботами в реальной среде.

Направлением воплощённого ИИ в Европе компания займётся силами инженеров Kinetix.
runway.com

✔️ Inception обновила диффузионную языковую модель Mercury

Mercury 2.5 выдаёт больше 1100 токенов в секунду. Скорость берётся из архитектуры - обычная LLM создаёт текст по одному токену за раз, а диффузионная генерирует его блоками, уточняя целые фрагменты сразу.

Контекст - 260 тысяч токенов. Есть параллельный вызов инструментов, вывод в JSON и регулируемая глубина рассуждений. В голосовых сценариях время до первого токена не превышает 170 мс. По данным Inception, качество ответов выросло на 40% относительно прошлой версии.

Рассчитана модель на задачи, где критична задержка - многоэтапный поиск и RAG, голосовые боты и сжатие контекста.

Доступна через API InceptionBaseten и OpenRouter. Тариф - 0,20 доллара за миллион входных токенов и 0,75 за миллион выходных, на время релиза действует скидка 80%. Попробовать можно в веб-чате.
inceptionlabs.ai

✔️ Suno выпустила шестое поколение моделей

Линейка генераторов музыки с индексом v6 создавалась в партнёрстве с недавними оппонентами по судам Warner Music Group, BMG и Believe.

Моделей три. Флагманская v6 Pro рассчитана на предсказуемый результат в продакшене, экспериментальная v6-wild - на нестандартные идеи, а облегчённая v6-mini заменит базовую версию для бесплатных аккаунтов. По мере раскатки Suno обещает полностью отключить прежние поколения.

Главное новое - контроль над структурой композиции. Модели умеют править фрагмент, не перегенерируя трек целиком: переписать одну строчку текста, вытащить гитарный рифф для сэмплирования, заменить бэк-вокал.

Плюс появились мэшапы из разных треков, а на вход теперь идёт не только текст, но и референсное аудио, изображения и видео.
suno.com


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
63👍13😁9🔥6
Код, агенты и чуть-чуть психологии ⚡️

Именно такой стек тем Сбер подготовил для легендарной конференции Технохаб Конф, которая состоится 19 сентября в Екатеринбурге.

В программе — два стрима от экспертов Сбера и других технологических компаний:

✔️ Инженерия и AI‑Disrupt PDLC: код, архитектура, пайплайны, метрики, интеграции. Разборы реальных ошибок и того, как их фиксили.

✔️ Новая реальность: про то, как не растеряться, когда агент берёт на себя половину задач, и сохранить экспертизу.

Ещё будут классные активности, афтепати и много нетворкинга — участие бесплатное.

Регистрируйся, пока есть места! 💚
67🎉20🤣13👏87🤩6🔥5🌭3🍾1
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ Tencent релизнула одну модель на все задачи с речью

Tencent Hunyuan вместе с Шанхайским университетом выложили AuK, открытую базовую модель для генерации и редактирования речи на 1,5 млрд параметров.

Русского языка модель не знает, заявлены только китайский и английский. Авторы, правда, отмечают возможный перенос между языками - какая-то способность возникает сама, но поддержкой это не считается.


AuK принимает на вход текстовый запрос и, если нужно, исходное аудио и на выходе отдаёт готовый звук.

Всего заявлено пять типов задач: синтез речи (клонирование голоса по образцу и генерация по описанию), правка содержания (заменить слово в реплике или строчку в песне), акустика (темп, громкость, высота тона), паралингвистика (эмоция, тембр, акцент, вздохи и смешки, шёпот) и очистка с разделением (шумоподавление, выделение спикера, отделение вокала от музыки).

🟡Механика

Мультимодальная Qwen2.5-Omni читает инструкцию вместе с аудио и превращает её в смысловое условие. Аудио-VAE сжимает звук в компактное представление и потом восстанавливает обратно в волну.

Между ними работает трансформер по подобию FLUX - сначала десять блоков MMDiT, где смысловой и акустический потоки обмениваются информацией, оставаясь раздельными, затем двадцать обычных блоков DiT поверх склеенной последовательности.

🟡Тесты

По замерам Tencent, модель лидирует на Seed-TTS-Eval (разборчивость речи и похожесть на голос образца), InstructTTSEval (насколько точно модель отрабатывает словесное описание тембра), а также на MMAE-Speech и SpeechEditBench, где проверяют правки.

А вот на восстановлении сигнала (DNS Challenge, CHiME-4, Libri2Mix) она только конкурентоспособна, то есть узкоспециализированные модели там по-прежнему сильнее.

Отдельно выложена AuK-Flash - дистиллированная версия, которая укладывается в четыре шага вместо тридцати двух и работает в 4,5 раза быстрее.

К ней, кстати, нужно будет отдельно качать Qwen2.5-Omni-3B в роли энкодера.


В репозитории есть код установки, инференса на Gradio, ComfyUI, дообучения и шаблоны инструкций с примерами в кукбуке.

Пощупать можно в демо на Hugging Face и ModelScope.


📌Лицензирование: MIT License


🟡Страница проекта
🟡Веса
🟡Arxiv
🟡Демо
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #TTS #AuK #Tencent
Please open Telegram to view this post
VIEW IN TELEGRAM
👍58🤗1713👏13🔥1
КосмоХакатон в Нижнем Новгороде - 11–13 сентября 🚀

Участвовать можно очно на площадке или онлайн из любой точки России — задачи, критерии и рейтинг общие.

Что предстоит решать:
1. Как удержать связь и работоспособность спутниковой группировки, когда меняются условия эксплуатации и часть аппаратов выходит из строя.

2. Что в космических сервисах сделать общественным, что отдать рынку и как всё это закупать и финансировать при жёстких бюджетах.

🏆 Призовой фонд площадки — 1 200 000 ₽
💻 Очный и онлайн-форматы
🛰 Команды от 3 до 5 человек. Собери свою или присоединяйся к другим на нашей платформе
🚀 Лучшие команды выходят в финал в Москве 25–27 сентября

Детали и расписание: https://космохакатон.рф/nizhny/
👍50🎉19👏6🤩65😁3🏆3
⚡️ OpenAI может приостановить оформление новых подписок ChatGPT Pro

Неформальный голос в X OpenAI, Тибо, сообщил, что интерес к Astra побил все внутренние исторические рекорды сервиса.

Компания неоднократно сталкивалась с резкими скачками трафика, но текущая динамика оказалась беспрецедентной - команда задействует все доступные вычислительные мощности, чтобы удерживать доступность инфраструктуры.

Главным приоритетом в OpenAI называют сохранение качества обслуживания текущих клиентов и если нагрузка продолжит расти теми же темпами, компания пойдет на превентивную меру и временно заморозит продажи тарифа ChatGPT Pro во избежание очередей на инференс и деградации производительности.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔154🔥59🤣5017😁109😢6
⚡️ DeepSeek открыла веса V4.1-Flash

DeepSeek выложила свежайшую DeepSeek-V4.1-Flash, мультимодальную MoE-модель на 552 млрд параметров, с контекстом до миллиона токенов и методом Causal Encoder-Decoder под капотом, который вдвое удешевляет разбор входа.

Задача, под которую её делали, скучная, но дорогая. Долго работающий агент постоянно перечитывает свой контекст, и всё прочитанное приходится держать в KV-кэше.

На длинных дистанциях он раздувается, забивает видеопамять и упирается в пропускную способность шин.


В V4.1-Flash кэш сжат до 890 байт на токен, это вчетверо меньше, чем у V4-Flash, и в 437 раз, чем у первой версии DeepSeek.

Каждому слою внимания заранее назначен один из трёх режимов:

🟢в полном слой считает свои ключи и значения сам;
🟢в режиме переиндексации берёт их у предыдущего слоя, но заново выбирает, на что смотреть;
🟢в режиме повторного использования не считает ничего - берёт и чужой кэш, и чужой выбор.

Так хранить приходится в разы меньше. Сверху главный кэш держится в четырёхбитном формате FP4, и устойчивость к такой точности натренирована, а не добавлена после обучения.

🟡Causal Encoder-Decoder

Метод вдохновлен майкрософтовской работой You Only Cache Once про переиспользование KV-кэша слоями. DeepSeek внесла в него структурные улучшения, чтобы поднять ёмкость кэша и глубину вычислений при его порождении.

40 слоёв разделены пополам: 20 на энкодер, 20 - декодер. К и V для декодера не считаются в каждом его слое, а проецируются из последнего скрытого состояния энкодера.

Поэтому при разборе входа работает только первая половина сети - 8 млрд активных параметров на токен против 16 при генерации ответа.

Для агентов, у которых вход в разы длиннее вывода, это именно то, что нужно.


🟡Бенчмарки

На DeepSWE v1.1 модель берёт 74,2% против 74,0 у Claude Opus 5 и 73,0 у GPT-5.6 Sol.

На Terminal-Bench 2.1 - 90,6% (выше всех).

На AutomationBench - 54,8% против 50,3 у Opus 5.

А вот в Terminal-Bench 4.0, где нужны экспертные знания в науке, модель даёт 31,2% против 51,8 у Opus 5, то есть разрыв с топами на самых сложных задачах никуда не делся.


Модель поддерживает настраиваемый уровень рассуждений от 1 до 100, в API это три пресета: low, high, max - они соответствуют значениям 50, 75 и 100.

Шаблона чата в Jinja нет - вместо него советуют реализацию промптов на Python и отдельный набор Rust-библиотек.

Сообщество на Hugging Face уже сделало квантованные версии практически под всё.


📌Лицензирование: MIT License


🟡Блогпост
🟡Веса
🟡Техотчет


@ai_machinelearning_big_data

#AI #ML #MMLM #MoE #Deepseek
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥56🤩46👍2119👏11🤔7🥰2🏆2😁1🙏1🤝1
ТехВилл ищет в команду сотрудников!

ТехВилл (айтишка ВкусВилл) расширяет команду! Открыты новые вакансии для ИТ-специалистов разного профиля. 

Выбирайте свою роль:

🔹 Главный инженер в Роботизацию дарксторов — роботизация складов

🔹 Руководитель проекта — управление разработкой робототехнических комплексов

🔹 Разработчик (Навигация) — автономное движение на C++/ROS 2

🔹 Старший разработчик — аппаратная платформа дронов и embedded

🔹 Инженер-программист (вендинги) — настройка и интеграция торговых автоматов

Ключевые условия:
Аккредитованная ИТ-компания
Официальное оформление с первого дня, куратор на адаптации;
Прозрачные грейды, обучение, индивидуальные планы развития;
Компенсация медицины, спорта и AI-помощников;
Бонус 15% во ВкусВилл;
Соцподдержка;
📍 Гибрид Москва и МО.

Присоединяйтесь к созданию технологий будущего для розничной торговли!
👍6615👏14🎉6😁5🤩1
Media is too big
VIEW IN TELEGRAM
✔️ Госсектор США переходит на коммерческие тарифы OpenAI

OpenAI закрывает пилотную программу для федеральных ведомств, по которой доступ к её технологиям стоил 1 доллар в год. С 1 октября вступит в силу двухлетний контракт - чиновники перейдут на оплату по факту потребления со скидкой 50% от стандартного прайса.

По данным Управления общих служб правительства США, за год пилота доступ к ChatGPT получили 3,5 млн госслужащих, а заявленная экономия бюджета за это время составила 1,4 млрд долларов.

Ожидается, что переход на новые тарифы упростит ведомствам внедрение и использование будущих моделей OpenAI.
bloomberglaw.com

✔️ Palantir и Nebius объединят инфраструктуру

Компании договорились развернуть платформу Palantir AIP на мощностях Nebius AI Cloud. Расчёт на госсектор и корпоративных клиентов с жёсткими требованиями к локализации данных.

Клиенты Palantir получат доступ к европейским GPU-кластерам Nebius для распределённого обучения и инференса, с возможностью разворачивать изолированные ИИ-контуры по стандартам GDPR.

Аналитические и агентные инструменты Palantir теперь работают на дата-центрах Nebius. Основные заказчики - оборонные, финансовые и промышленные предприятия.
nebius.com

✔️ Экс-глава Sora и сооснователь DreamWorks запускают стартап по генерации видео

Билл Пиблз, бывший руководитель проекта Sora в OpenAI, сооснователь DreamWorks Джеффри Катценберг и экс-финансовый директор Dropbox Суджай Джасва запускают компанию для обучения собственных моделей видеогенерации под профессиональную киноиндустрию.

Проект пока привлекает финансирование, идут переговоры с венчурными фондами. Название и целевая оценка не раскрываются.

Техническое направление возглавил Пиблз - один из авторов Diffusion Transformer, архитектуры, лежащей в основе Sora и большинства современных видеогенераторов.

Из OpenAI он ушёл в апреле этого года, чтобы заниматься исследованиями в видеосинтезе вне жёстких продуктовых графиков корпорации.
theinformation.com

✔️ Anthropic следит за анти-ИИ активистами

По данным The American Prospect, служба безопасности Anthropic отслеживает протестные движения и анти-ИИ активистов с помощью инструментов сбора сведений из открытых источников и коммерческой платформы анализа рисков Samdesk.

Согласно расследованию издания, аналитики компании следят за перемещениями участников акций в реальном времени, ведут списки лиц, представляющих интерес, и прогнозируют инциденты рядом с офисами или топ-менеджерами. Собранные сведения передаются в полицию США.

Отдельно The American Prospect указывает на случаи, когда Anthropic сообщала правоохранителям об угрозах от пользователей в переписке с Claude, но отказывалась выдавать логи чатов, ссылаясь на политику приватности.
prospect.org

✔️ Вышло приложение Gemini для Windows

Google выпустила десктопный клиент Gemini для Windows 10 и 11. Интерфейс работает компактным оверлеем поверх активных окон, вызывается сочетанием Alt + Space.

В полноэкранном режиме приложение интегрируется с Gmail и Google Drive, а многоэтапные задачи можно делегировать агенту Gemini Spark.

Кроме работы с текстом, клиент генерирует изображения через Nano Banana и видео через Gemini Omni. Работает в фоне и уже доступно для скачивания.
blog.google

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9022👏15💯10🌚8🤝5
One Day Offer: научи роботов понимать мир! 🤖

Команда Центра робототехники Сбера делает то, что ещё недавно казалось невозможным — создаёт ИИ, который живёт в физическом мире: двигается, видит и принимает решения.

И ты можешь стать частью этого будущего — если пройдёшь отбор на One Day Offer для Robotics Software Engineer и Machine Learning Engineer.

Важно: твой код будет не просто строкой в репозитории, а командой для робота — сделать шаг или распознать предмет. Работать ты будешь с современным стеком: C++/Python, ROS2, PyTorch/Jax, VLA‑моделями.

Готов присоединиться? Регистрируйся по ссылке — встречаемся 26 сентября! 😉
🤩77👍19👏1412😁10🤬2🍓2
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ Голосовая модель GPT-Live-1 стала доступна по API

OpenAI открыла API полнодуплексной голосовой модели GPT-Live-1 стоимостью 5 центов за минуту. Модель слушает и синтезирует речь одновременно, заменяя традиционный каскад STT–LLM–TTS.

Единая архитектура снизила задержку реакции с 1,4 до 0,8 секунды и позволила обрабатывать перебивания. Обновленная фильтрация пауз и фонового шума сократила число ложных прерываний на 80%.

Модель поддерживает делегирование вычислений - голосовой фронтенд удерживает непрерывный контакт с пользователем, пока бэкенд (GPT-6 Astra и Luna) параллельно выполняют рассуждения и вызовы инструментов.

GPT-Live-1 готова к интеграции в телефонию. API может возвращать ASR-транскрипты, включает 12 голосов и поддерживает управление темпом и стилем речи через системный промпт.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍115🔥229👏5🤩4❤‍🔥1
⚡️ Яндекс открыл модель, на которой работают быстрые ответы в Поиске

Яндекс выложил на Hugging Face Alice AI-T5-35B-A0.6B Base — модель, которую обучили с нуля специально для высоконагруженного Поиска. Её дообученная версия Alice AI Search используется для генерации быстрых ИИ-ответов в Поиске. 

При сотнях тысяч запросов в минуту такая модель должна не только хорошо отвечать, но и делать это за считанные секунды, не сжигая лишнее. Поэтому из 35 млрд параметров на каждый токен включаются только 600 млн, а отдельная модель отбирает из найденных документов лишь нужные фрагменты — такой подход увеличил пропускную способность примерно на 40%.

В итоге модель показывает сильные результаты на русскоязычных задачах и сопоставима с гораздо более тяжёлыми моделями, оставаясь дешевле в работе.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍94🤣3533🔥1610🗿3🥰2😨1💘1
🌟 Tencent TeamAI CLI: общий конфиг для всех агентов команды

Инструмент складывает навыки, правила, хуки и настройки MCP в один git-репозиторий и раздаёт их всем участникам ИИ-команды.

Поддерживаются Claude Code, Codex, Cursor, CodeBuddy, WorkBuddy, Qoder, OpenCode, а также OpenClaw, Hermes и DeepSeek Harness (у последних трёх с ограничениями).

Хранилищем может быть GitHub, GitLab, GitCode, CNB, TGit или свой git-сервер.

Правки идут обычным рабочим процессом - участник делает пуш, открывается запрос на слияние, ревьюер проверяет и одобряет, остальные получают изменения при следующем запуске сессии. Повторный пуш по той же правке обновляет уже открытый MR, без создания нового.

Когда сессия заканчивается, хук оценивает её по критерию проблемности - перебивали ли модель, отклоняли ли вызовы инструментов, сколько раз агент повторял падающие команды.

Чистая сессия, пусть и длинная, не считается, но если с чем-то реально бились, TeamAI предложит записать вывод и отправить его в командный репозиторий. Подсказка при этом перечисляет, какие именно сигналы сработали.

Накопленное можно искать автоматически - агент перед задачей вызывает встроенный субагент, тот подбирает ключевые слова, читает найденные документы и возвращает выжимку.

Отдельная команда разбирает репозитории в граф компонентов, интерфейсов и зависимостей - для TypeScript, JavaScript, Python и Go связи достаёт парсер tree-sitter, для остальных языков работает запасной механизм на регулярных выражениях.

Еще TeamAI может делать недельный дайджест по расходу токенов, объёму диалогов и частоте вмешательств, а также дашборд со статусом текущих сессий каждого участника.


📌Лицензирование: MIT License


🖥Github


@ai_machinelearning_big_data

#AI #ML #Agents #Tools #TeamAiCli #Tencent
Please open Telegram to view this post
VIEW IN TELEGRAM
👍58🤩16🔥76👏5💯2
Сбер представил GigaChat 3.5 Reasoning — флагманскую модель с режимом рассуждений

Новая версия умеет последовательно решать сложные задачи. Сначала разбирает их на этапы и выстраивает план. Затем проверяет промежуточные результаты и исправляет ошибки.

Ещё одна особенность релиза — экономный расход токенов. В среднем на математические расчёты здесь используется на 37% меньше токенов, чем у открытой ИИ-модели DeepSeek V4 Flash Preview.

По сравнению с моделью без режима рассуждений GigaChat 3.5 Reasoning заметно улучшила результаты бенчмарков. В IFBench показатель вырос с 44 до 77 баллов, в Natural Plan — с 64 до 80, а в Live Code Bench v6 — с 56 до 85.

Модель доступна бесплатно по лицензии MIT на HuggingFace и GitVerse. Её можно интегрировать в собственные продукты.

Попробуйте обновлённый режим «Рассуждение» на giga.chat. Подробнее – в посте команды.
👍134😁6724👏21🥱20🔥11🤩5🙉5🤣4🤝1
✔️ В ComfyUI появился встроенный copilot для сборки и отладки нод

Comfy Org открыла бета-тестирование встроенного ассистента Comfy Agent. Инструмент может создавать и изменять воркфлоу, запускать задачи, отлаживать ошибки и предлагать улучшения в интерфейсе ComfyUI по текстовым запросам.

Агент работает в фоне и умеет создавать цепочки нод, оптимизировать имеющиеся воркфлоу и искать ошибки совместимости.

В отличие от Comfy MCP, который позволяет управлять ComfyUI через Claude или Cursor, Comfy Agent работает как готовое коробочное решение внутри редактора.

Бэкенд ассистента развернут в инфраструктуре Comfy Cloud, а для простых задач можно подключать локальные модели.

Comfy Agent, вероятно, войдёт в подписку Comfy Cloud.

Подать заявку на открытую бету можно по ссылке. Запись стрима с демонстрацией возможностей - на Youtube.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤩96👍34🎉168👏6🔥1🥱1🌭1
🚀 Последний шанс зайти на КосмоХакатон — старт сегодня

Сразу два этапа, 11–13 сентября: Нижний Новгород и Благовещенск. Задачи от компаний отрасли — от сервисной модели космических услуг до мониторинга паводков по спутниковым снимкам. Призовые на каждой площадке, общий фонд серии 7,2 млн рублей.

Участвовать можно очно или онлайн из любой точки России, командами 3–5 человек. Своей команды нет — собери на платформе.

Не успеваешь на эти — Питер и Красноярск идут 18–20 сентября. А лучшие команды всех этапов выходят в финал в Москве.

Регистрация и детали здесь: космохакатон.рф/
🔥47👍11👏7🏆5🎉4😁3🥰21🥱1
🐟 Sakana AI представила Fugu Max и Fugu Ultra v2 - обновление системы оркестрации AI-агентов

Fugu распределяет задачи между несколькими моделями, подбирая подходящую по возможностям и стоимости.

Fugu Max использует расширенный набор моделей с открытыми весами и специализированных моделей, включая NVIDIA Nemotron. По заявлению Sakana, система приближается к ведущим моделям по качеству при стоимости в 2–6 раз ниже.

Fugu Ultra v2 ориентирована на максимальное качество. По данным компании:

* опережает Opus 5 и Fable 5 на Chartography
* на DeepSWE превосходит модели, у которых цена за токен в 3–5 раз выше
* при этом Fable 5, Fable 5.1 и GPT-6-Astra не входят в её набор агентов

Модели внутри системы можно заменять. Такая архитектура рассчитана на снижение зависимости от отдельных поставщиков и сохранение работы при изменениях доступности API.

[Попробовать Fugu - https://sakana.ai/fugu

Анонс Sakana AI - https://sakana.ai/fugu-max-release/
🎉121👍39🤓2292🔥2