282K subscribers
5.42K photos
1.26K videos
17 files
5.76K links
Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri
Download Telegram
🖥 Дженсен Хуанг заявил, что с выходом GPT-6 Astra «AGI уже наступил»

Глава Nvidia сообщил, что модель обучалась на инфраструктуре с более чем 100 тысячами Grace Blackwell, объединёнными через NVLink. Путь от появления ChatGPT до Astra занял около четырёх лет.

Вскоре к инфраструктуре добавят ещё 400 тысяч ускорителей, и связывает дальнейшее масштабирование с возможным движением к ASI и рекурсивному самосовершенствованию AI-систем.

https://x.com/JensenHuang/status/2096700264569090384

@ai_machinelearning_big_data

#openai #agi #chatgpt
Please open Telegram to view this post
VIEW IN TELEGRAM
😁173🔥60🤔5518🤣18🥱11👍9👏8👻6🗿5🎅2
✔️ Китайская Ханьсюй показала архитектуру инференса на магнитной памяти

Компания, которую в Китае называют первой отечественной MRAM-компанией магнитных вычислений, представила два архитектурных уровня для инференса - uHBM и uLPU.

Ханьсюй предлагает держать веса целевой модели постоянно в массиве в массиве энергонезависимой MRAM - матрично-векторные операции выполняются на том же кристалле, а наружу идут только векторы активаций, которые заметно меньше.

Магниторезистивная память хранит бит не зарядом, как обычная память, а направлением намагниченности.

В ней ячейка - это магнитный туннельный переход: два ферромагнитных слоя, разделённые тончайшим изолятором.

Когда намагниченность слоёв сонаправлена, сопротивление низкое, когда противоположна - высокое, и по нему считывается ноль или единица.

У MRAM почти нулевой ток утечки, скорость переключения наносекундная, а ресурс перезаписи практически неограниченный в отличие от флеш-памяти.


uHBM - это кристалл вычислительной памяти на MRAM, работающий в паре с GPU или NPU через UCIe, LPDDR5X или GDDR7.

uLPU - инференс-чип, построенный поверх uHBM.

Заявленные расчётные показатели первого поколения uHBM - 24 ТБ/с внутрикристальной полосы на чтение и цель выше 2000 токенов в секунду при декодировании мультимодальной модели на 4 млрд параметров.

Из реальных прототипов есть верификационный чип SpinPU-ED01 со 120 банками MRAM, который прошёл независимую проверку и отработал 24 часа в стабильном режиме.

Сроков, техпроцесса и цен компания не называет, но декларирует планы от кристалла до модуля, 2U-лотка и стойки.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍72🔥43🤔3911👏32😁1
⚡️ Tencent обновила Hy4 Preview

Пользователи жаловались, что модель слишком долго рассуждает и повторно проверяет ответы в сложных задачах. Команда оптимизировала этот процесс.

По данным Tencent, обновлённая версия:

* делает меньше промежуточных шагов
* расходует меньше входных и выходных токенов
* сохраняет прежнее качество выполнения задач
* быстрее справляется со сложными агентными сценариями

Результаты проверили внутренними бенчмарками и оценкой людей. Обновление уже доступно всем пользователям WorkBuddy.

Hy4 Preview - открытая MoE-модель на 770 млрд параметров, из которых 49 млрд активируются при обработке токена. Контекст - до 1 млн токенов.

https://workbuddy.ai

https://github.com/Tencent-Hunyuan/Hy4-preview
52👍248🔥5👏4🗿1
Media is too big
VIEW IN TELEGRAM
🥊 Роботы Unitree провели бой без управления человеком

За их действия отвечает UnifoLM-X2-1.0 - модель мира, которая прогнозирует развитие ситуации и планирует движения прямо во время боя.

По заявлению Unitree, роботы самостоятельно реагируют на противника и корректируют свои действия в реальном времени. Компания называет это первым полностью автономным боем гуманоидов под управлением модели мира.

@ai_machinelearning_big_data

#Unitree #robots
🤩102👍84👏32🤔197🔥5😁4💅1
Что общего у йогурта на полке, нейросетей и квантовых вычислений?

Все это встречается в задачах MAGNIT TECH - IT-команды крупнейшего ритейлера страны «Магнита». Здесь прогнозируют спрос, автоматизируют поставки, разрабатывают компьютерное зрение, а сейчас и вовсе исследуют потенциал квантовых вычислений вместе с Росатомом. В работе - более 400 IT-проектов и продуктов. И это не предел! В духе главного слогана компании Без_предела.

С 6 по 8 сентября команда проводит в Суздале tech-тур для IT-блогеров и своих топ-специалистов. Среди участников - Алексей Голобурдин, Сергей Калюжный, Никита Соболев, Алексей Гладков и Антон Кулинский.

В программе - встречи с экспертами, обсуждение GenAI, роботизации складов и инженерных задач ритейла: как рассчитать поставки, управлять ассортиментом и обеспечить работу тысяч магазинов.

Между техническими обсуждениями - прогулки по Суздалю, знакомство с городом и полет на воздушном шаре. Однозначно лайк.
👍47🔥29🤩105👏4😁4🥱3🤬2😍2🗿1
Главный учёный OpenAI призвал притормозить гонку ИИ

Якуб Пахоцкий заявил, что развитие моделей требует предельной осторожности. По его мнению, гонка любой ценой выглядит абсурдной, если осознать масштаб рисков.

Он предлагает согласованно замедлять разработку, когда безопасность не успевает за возможностями моделей, и сделать международную координацию приоритетом для правительств. Об этом он написал в эссе An Alien Mind.

Автор исходного поста возражает: односторонняя пауза американских лабораторий может дать Китаю преимущество. Он считает, что остановить технологическую гонку уже не получится.
🤣107🤔58👍3975😁3🥱3😐3👨‍💻2👌1
✔️ MiniCPM5-2B - новая open-source LLM на 2B параметров

OpenBMB открыла MiniCPM5-2B — компактную модель для локального запуска и edge-устройств.

Что внутри:

- 2B параметров
- #1 среди open-source моделей до 4B в Artificial Analysis Intelligence Index
- 23 балла в Intelligence Index
- 20 баллов в Agentic Index
- 53.9 среднего балла по 34 бенчмаркам
- тесты охватывают код, математику, long context, tool use и agentic tasks

Вместе с моделью OpenBMB также публикует:

- данные для обучения
- training recipes
- RL stack

Hugging Face:
https://huggingface.co/openbmb/MiniCPM5-2B

GitHub: https://github.com/OpenBMB/MiniCPM

ModelScope: https://modelscope.cn/models/OpenBMB
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
96🔥80😍23👍22🎉1210👏9🥰3😁2👌1🙈1
⚡️ OpenAI изменила расход квоты на Astra

Тибо, главный рупор сброса лимитов в сети X, сообщил об изменениях в том, как Astra расходует квоту подписки ChatGPT.

По его словам, качество модели остаётся прежним, а вот использование подписки значительно снижено, до трех-четырёх раз меньше, чем раньше.

Судя по формулировке, речь о пересчёте того, как потребление учитывается на стороне учётки ChatGPT.

🟡Предыстория

Astra сначала вышла ограниченным превью, платные подписчики её не увидели, и OpenAI начала начислять по одному отложенному сбросу квоты за каждый день ожидания.

5 сентября сентября OpenAI объявили о завершении раскатки и полном сбросе квот для всех Plus, Pro и Business.

Через двое суток на GitHub пошли жалобы на слишком быстрый расход лимитов - пользователи Plus сообщали, что упираются в лимит примерно за двадцать минут, а обладатели тарифов Pro - что за сутки сжигают заметную часть недельной квоты.

Ну и да, лимиты использования для всех тарифов опять сбросили.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍56🔥1811😁83👌1
📲 OpenAI решила задачу тысячелетия? Пока доказательств нет

Математик Тристан Бакмастер утверждает, что 6 сентября представители OpenAI сообщили ему о готовом доказательстве образования сингулярности в уравнениях Навье–Стокса с внешней силой.

Если доказательство верно и соответствует условиям задачи Института Клэя, оно может закрыть одну из главных нерешённых проблем математики.

До этого Бакмастер и Левент Алпёге с помощью Claude и моделей OpenAI получили новые результаты для уравнений Эйлера и родственных систем. Однако эти работы сами по себе задачу Навье–Стокса не решают.

Параллельно возник спор об авторстве. Бакмастер заявляет, что ему предлагали оформить результат OpenAI без Алпёге, работающего в Anthropic. Себастьен Бюбек назвал обвинения ложными.

Доказательство OpenAI не опубликовано, Бакмастер его не видел, независимой проверки нет. Институт Клэя по-прежнему указывает задачу как нерешённую.

https://www.claymath.org/millennium/navier-stokes-equation/

@ai_machinelearning_big_data
🔥6520👍8🤔7🤣7🥰1
В выходные снова собрали AI VK & Pro — ивент для ML- и RecSys-лидов бигтеха.

Говорили о том, как сегодня устроены рекомендации и персонализация, делились, как развивается Discovery-платформа и новые технологии VK: от нейропрофиля и нейросетевого ранжирования до нейропоиска Discovery AI.

Без длинных докладов: несколько выступлений по делу и много общения между участниками уже на гольф-поле.
14🤣8👍6🔥3