Data Secrets
92.4K subscribers
7.26K photos
827 videos
20 files
3.31K links
Главный по машинному обучению

Сотрудничество: @veron_28

РКН: clck.ru/3FY3GN
Download Telegram
Китай открывает пятилетку ИИ-образования

Государственный совет опубликовал пятилетний план, где прописано, что ИИ‑грамотность должна стать ключевой способностью каждого учащегося на любом уровне образования.

Теперь обучение ИИ в Китае будет начинаться примерно с 6 лет, и распространяться в виде систематических курсов на все классы школы, и далее в университеты, колледжи и тд.

Причем это не просто идея, а часть стратегии Си Цзиньпина по технологическому превосходству и конкуренции с США. Массовая ИИ‑грамотность объявляется вопросом национальной конкурентоспособности и даже элементом нацбезопасности.

Молодцы, что сказать. Так они скоро станут первой страной, для которой навыки работы с ИИ будут такой же базой, как Интернет или простейшее ПО.
1238👍120❤‍🔥18😁7🤯5🎉5💯4🕊3👏2😎21
Мы проверили, это не первоапрельская шутка: GitHub теперь продает копии репозиториев на CD-ROM

На случай, если вам очень хочется передать своим детям сгенерированный в молодости слоп-код, вот ссылка для заказа: gh.io/cd
1😁235👍2316🔥7🤯51🎉1🆒1
Наглядно о том, насколько далек новый Fable от того, что мы получили изначально

Аналитики из BridgeMind провели повторные эвалы модели после возвращения, и вот результат:

Debugging: 86.2 → 25.9
Refactoring: 73.6 → 38.4
Hallucination: 75.9 → 61.7

Сама по себе глупее модель не стала, все дело в новых ограничениях: слишком много задач, даже самых обычных, маршрутизируются к Opus 4.8. Отсюда и просадка в метриках.
2160😁60🫡33😭324👍4🔥21🏆1💘1
Легендарная кожанка Дженсена Хуанга выставлена на аукцион

Купить ту самую историческую куртку Tom Ford с автографом Хуанга на подкладке можно, если у вас есть ОТ 40к долларов (скорее всего, по факту она уйдет гораздо дороже).

Конкретно в этом экземпляре Хуанг был на Hon Hai (Foxconn) Tech Day в Тайбэе 18 октября 2023, когда Nvidia презентовала AI factories.

Аукцион благотворительный, все средства пойдут в некоммерческую организацию The Edge Institute.

Скидываемся?
😁94🔥43229👍4💯3🍾3🕊11
Ничего романтичнее вы сегодня не увидите

«Я рассказал о тебе своему memory.md»
1😁28091😎21💘6😍3🍓3🗿2👍1💯1🫡11
Хакеры теперь используют галлюцинации LLM для мошенничества

Unit 42, одна из самых известных в мире команд, которая занимается расследованием кибератак и анализом вредоносного ПО, выпустила очень занятное исследование про так называемый Phantom Squatting.

Как мы все знаем, LLMки – большие любители выдумывать несуществующие URL. При этом, ожидаемо, некоторые домены они выдумывают чаще. Например, могут выдавать name_download. com вместо правильного name. com.

Таких паттернов довольно много, и вот злоумышленники поняли, что эти выдуманные адреса можно просто регистрировать на себя и размещать там фишинг. По аналогии с typosquatting, когда хакеры пользовались человеческими опечатками и регистрировали сайты типа goggle. com.

При этом пользователя даже не надо заманивать, за хакеров это делают сами LLM. Технолоджия, как говорится.

И если вы сейчас подумали, что это какой-то единичный случай, то нет: исследователи обнаружили уже более 13 тысяч существующих вредоносных URL, использующих этот принцип.

Поверх этого есть еще около 250 тысяч незарегистрированных доменов, которые регулярно придумывают модели. Настоящая находка для мошенников всех мастей.
1👍1167535🤯118😎83😁2💯1
Nvidia будет дарить стартапам компьют в обмен на долю с выручки

То есть вместо обычной покупки они теперь предлагают модель revenue-sharing: партнеры получают кредиты или доступ к инфраструктуре на базе Nvidia, а потом делятся процентом с будущей выручки.

Направлена программа в основном на строительство датацентров. Многим небольшим AI-облакам не хватает денег, но при этом спрос на вычисления есть. И вот тут-то приходит Nvidia и предлагает свою помощь.

Зачем это Nvidia? С одной стороны, кажется, что это риски. Но с другой – это новая модель долгосрочного повторяющегося заработка, в которой Nvidia будет меньше зависеть от гиперскейлеров типа Google, Amazon и Microsoft, которые активно разрабатывают собственные чипы.
1😁1052923👍13🤯6🔥1😍1🫡1🦄1😎1👾1
Верните нам наш 2024 💔
Please open Telegram to view this post
VIEW IN TELEGRAM
2😁50961🫡42😭3815💯1111🔥5👍1
GPT-5.6 Sol появится в Codex уже со дня на день

Да, модель будет в Codex, это подтвердили сотрудники. Вместе с братьями своими меньшими Terra и Luna, она, по слухам, должна выйти уже завтра-послезавтра. Готовимся вайб-кодить на полную.

Но это еще не самое интересное.

Самое интересное, что в ограниченный тест в июле выложат GPT-5.6 Sol на Cerebras. Обещают скорость (внимание!) до 750 токенов в секунду.

При этом это будет не какая-то отдельная специализированная под эти чипы или урезанная модель. Эта та же самая мощнейшая громадная Sol, которая будет летать в два раза быстрее Gemini 3.5 Flash.

По некоторым оценкам, размер модели – от 2 до 4 триллионов параметров (~150B активных). При таком размере вместить модель на Cerebras невозможно без инженерных ухищрений. Поэтому предполагается, что в новой линейке реализована какая-то кастомная схема KV-кэша.

Такое действительно ждем
1🔥20236👍19😁4🕊4🤔3🎉3🍓3🤯2
This media is not supported in your browser
VIEW IN TELEGRAM
Эрлинг Холанд стал настолько популярен, что под него косят даже роботы

Atlas от Boston Dynamics внезапно появился на Чемпионате мира во время халф-тайма Бразилия-Норвегия. Он передал арбитру мяч и повторил фирменное празднование гола Холанда.

Кстати, на данный момент Hyundai Motor Group полностью выкупили Boston Dynamics и запустили массовое производство Atlas. К 2028 планируют произвести 30 тысяч.
2😁11429🔥18🤯5👍3😎3🗿2👌1😍1
Нас раскусили…
1😁458💯46652🔥1👌1
Anthropic нашли внутри Claude внутреннее пространство, где хранятся его мысли

Стартап выпустил одну из самых интересных работ по интерпретируемости за последнее время. Они обнаружили, что в LLM есть отдельный небольшой внутренний набор нейронных активаций, который используется как рабочая память для сложного мышления: так называемый J-space.

Мы часто представляем LLM как огромную мешанину чисел, где знания и рассуждения размазаны по миллиардам параметров. Но похоже, что это не совсем так.

Любопытно, что человеческий мозг работает похожим образом. Есть когнитивная теория, утверждающая, что он состоит из множества специализированных подсистем, которые работают независимо; но иногда какая-то информация попадает в небольшой общий workspace, становится доступной сразу многим областям мозга и может использоваться для рассуждений и принятия решений. И вот именно такой механизм исследователи обнаружили в Claude.

Вот как работает J-space:

— Название происходит от разработанной учеными техники Jacobian Lens. Она позволяет по текущим активациям понимать, какие токены с большей вероятностью появятся в будущем. При этом то, что они появятся – далеко не факт, но это значит, что модель о них думает и держит их в J-space, чтобы использовать в рассуждениях. По сути, это чтение мыслей Claude.

— Если спросить Claude, о чем он думает, то содержимое J-space хорошо совпадает с ответом модели. Другие внутренние представления таким свойством не обладают. А еще модель умеет сознательно менять J-space. Например, если сказать ей «думай о слонах, пока решаешь задачу», то эта концепция появится в J-space. При решении сложной задачи промежуточные шаги тоже появляются именно внутри J-space, даже если их при этом нет в цепочках мыслей.

Если полностью отключить J-space, то у модели почти исчезают способности, требующие сложного мышления и многошагового рассуждения. Например, она больше не может сочинять стихи.

Самое важное во всем этом то, что J-space можно читать и менять. Anthropic приводят пример: исследователи специально внедряли модели скрытую цель во время обучения и затем наблюдали, как эта цель проявляется в J-space, хотя в ответах напрямую она ни разу не озвучивалась. При этом изменяя активации в J-space, они могли менять дальнейшие решения модели.

Потенциально это путь к тому, чтобы создавать (полностью?) безопасные и контролируемые модели. По крайней мере, сегодня Anthropic уже сделали черный ящик немного более прозрачным.

www.anthropic.com/research/global-workspace
3262🔥88👍48🤯16🤔11😁8🗿4👌2🏆211
Data Secrets
Anthropic нашли внутри Claude внутреннее пространство, где хранятся его мысли Стартап выпустил одну из самых интересных работ по интерпретируемости за последнее время. Они обнаружили, что в LLM есть отдельный небольшой внутренний набор нейронных активаций…
Смешной пример из исследования: Claude говорят не думать о мосте в Сан-Франциско во время ответа на вопрос, и в ответ на это во внутреннем пространстве мыслей модели сначала появляется слово «мост», а затем «damn» («черт»).

Ближе к человеку, чем кажется
6😁5434623🔥7👍4🍓4🤯32😍1🍾1
Пока ждем GPT-5.6 Sol (должен выйти уже в ближайшие часы), ловите веселые новости из Китая

Их министерство коммерции собирается ограничить доступ иностранцев к фронтирным моделям страны.

В частности, чиновники уже провели встречи с представителями Alibaba, ByteDance и Z.ai и обсудили соответствующие меры. Сообщается, что относится новые правила будут даже к моделям с открытыми весами 😭

Кроме того, государство собирается ограничить возможности иностранных инвестиций, а разглашение запатентованных технологий ИИ будут рассматривать как преступление против национальной безопасности.

Больше никаких квенов…
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤯23970🤨21👍12😁118🫡7😭65🤗2❤‍🔥1
Оп, Anthropic продлили доступ к Fable по подписке до 12 июля!

Чего только не сделаешь, когда конкуренты выпускают новую модель
Please open Telegram to view this post
VIEW IN TELEGRAM
1😁288🔥412215🤯3😎2👍1💯1🫡1