Data Secrets
Наглядно о том, насколько далек новый Fable от того, что мы получили изначально Аналитики из BridgeMind провели повторные эвалы модели после возвращения, и вот результат: Debugging: 86.2 → 25.9 Refactoring: 73.6 → 38.4 Hallucination: 75.9 → 61.7 Сама по…
Наконец-то все стало понятно
1😁405❤26😢15⚡3🗿3🔥2🏆2👍1😎1
Легендарная кожанка Дженсена Хуанга выставлена на аукцион
Купить ту самую историческую куртку Tom Ford с автографом Хуанга на подкладке можно, если у вас есть ОТ 40к долларов (скорее всего, по факту она уйдет гораздо дороже).
Конкретно в этом экземпляре Хуанг был на Hon Hai (Foxconn) Tech Day в Тайбэе 18 октября 2023, когда Nvidia презентовала AI factories.
Аукцион благотворительный, все средства пойдут в некоммерческую организацию The Edge Institute.
Скидываемся?
Купить ту самую историческую куртку Tom Ford с автографом Хуанга на подкладке можно, если у вас есть ОТ 40к долларов (скорее всего, по факту она уйдет гораздо дороже).
Конкретно в этом экземпляре Хуанг был на Hon Hai (Foxconn) Tech Day в Тайбэе 18 октября 2023, когда Nvidia презентовала AI factories.
Аукцион благотворительный, все средства пойдут в некоммерческую организацию The Edge Institute.
Скидываемся?
😁94🔥43❤22 9👍4💯3🍾3🕊1 1
Хакеры теперь используют галлюцинации LLM для мошенничества
Unit 42, одна из самых известных в мире команд, которая занимается расследованием кибератак и анализом вредоносного ПО, выпустила очень занятное исследование про так называемый Phantom Squatting.
Как мы все знаем, LLMки – большие любители выдумывать несуществующие URL. При этом, ожидаемо, некоторые домены они выдумывают чаще. Например, могут выдавать name_download. com вместо правильного name. com.
Таких паттернов довольно много, и вот злоумышленники поняли, что эти выдуманные адреса можно просто регистрировать на себя и размещать там фишинг. По аналогии с typosquatting, когда хакеры пользовались человеческими опечатками и регистрировали сайты типа goggle. com.
При этом пользователя даже не надо заманивать, за хакеров это делают сами LLM. Технолоджия, как говорится.
И если вы сейчас подумали, что это какой-то единичный случай, то нет: исследователи обнаружили уже более 13 тысяч существующих вредоносных URL, использующих этот принцип.
Поверх этого есть еще около 250 тысяч незарегистрированных доменов, которые регулярно придумывают модели. Настоящая находка для мошенников всех мастей.
Unit 42, одна из самых известных в мире команд, которая занимается расследованием кибератак и анализом вредоносного ПО, выпустила очень занятное исследование про так называемый Phantom Squatting.
Как мы все знаем, LLMки – большие любители выдумывать несуществующие URL. При этом, ожидаемо, некоторые домены они выдумывают чаще. Например, могут выдавать name_download. com вместо правильного name. com.
Таких паттернов довольно много, и вот злоумышленники поняли, что эти выдуманные адреса можно просто регистрировать на себя и размещать там фишинг. По аналогии с typosquatting, когда хакеры пользовались человеческими опечатками и регистрировали сайты типа goggle. com.
При этом пользователя даже не надо заманивать, за хакеров это делают сами LLM. Технолоджия, как говорится.
И если вы сейчас подумали, что это какой-то единичный случай, то нет: исследователи обнаружили уже более 13 тысяч существующих вредоносных URL, использующих этот принцип.
Поверх этого есть еще около 250 тысяч незарегистрированных доменов, которые регулярно придумывают модели. Настоящая находка для мошенников всех мастей.
1👍116 75❤35🤯11✍8😎8 3😁2💯1
Nvidia будет дарить стартапам компьют в обмен на долю с выручки
То есть вместо обычной покупки они теперь предлагают модель revenue-sharing: партнеры получают кредиты или доступ к инфраструктуре на базе Nvidia, а потом делятся процентом с будущей выручки.
Направлена программа в основном на строительство датацентров. Многим небольшим AI-облакам не хватает денег, но при этом спрос на вычисления есть. И вот тут-то приходит Nvidia и предлагает свою помощь.
Зачем это Nvidia? С одной стороны, кажется, что это риски. Но с другой – это новая модель долгосрочного повторяющегося заработка, в которой Nvidia будет меньше зависеть от гиперскейлеров типа Google, Amazon и Microsoft, которые активно разрабатывают собственные чипы.
То есть вместо обычной покупки они теперь предлагают модель revenue-sharing: партнеры получают кредиты или доступ к инфраструктуре на базе Nvidia, а потом делятся процентом с будущей выручки.
Направлена программа в основном на строительство датацентров. Многим небольшим AI-облакам не хватает денег, но при этом спрос на вычисления есть. И вот тут-то приходит Nvidia и предлагает свою помощь.
Зачем это Nvidia? С одной стороны, кажется, что это риски. Но с другой – это новая модель долгосрочного повторяющегося заработка, в которой Nvidia будет меньше зависеть от гиперскейлеров типа Google, Amazon и Microsoft, которые активно разрабатывают собственные чипы.
1😁105 29❤23👍13🤯6🔥1😍1🫡1🦄1😎1👾1
Please open Telegram to view this post
VIEW IN TELEGRAM
2😁509❤61🫡42😭38 15💯11 11🔥5👍1
GPT-5.6 Sol появится в Codex уже со дня на день
Да, модель будет в Codex, это подтвердили сотрудники. Вместе с братьями своими меньшими Terra и Luna, она, по слухам, должна выйти уже завтра-послезавтра. Готовимся вайб-кодить на полную.
Но это еще не самое интересное.
Самое интересное, что в ограниченный тест в июле выложат GPT-5.6 Sol на Cerebras. Обещают скорость (внимание!) до 750 токенов в секунду.
При этом это будет не какая-то отдельная специализированная под эти чипы или урезанная модель. Эта та же самая мощнейшая громадная Sol, которая будет летать в два раза быстрее Gemini 3.5 Flash.
По некоторым оценкам, размер модели – от 2 до 4 триллионов параметров (~150B активных). При таком размере вместить модель на Cerebras невозможно без инженерных ухищрений. Поэтому предполагается, что в новой линейке реализована какая-то кастомная схема KV-кэша.
Такое действительно ждем
Да, модель будет в Codex, это подтвердили сотрудники. Вместе с братьями своими меньшими Terra и Luna, она, по слухам, должна выйти уже завтра-послезавтра. Готовимся вайб-кодить на полную.
Но это еще не самое интересное.
Самое интересное, что в ограниченный тест в июле выложат GPT-5.6 Sol на Cerebras. Обещают скорость (внимание!) до 750 токенов в секунду.
При этом это будет не какая-то отдельная специализированная под эти чипы или урезанная модель. Эта та же самая мощнейшая громадная Sol, которая будет летать в два раза быстрее Gemini 3.5 Flash.
По некоторым оценкам, размер модели – от 2 до 4 триллионов параметров (~150B активных). При таком размере вместить модель на Cerebras невозможно без инженерных ухищрений. Поэтому предполагается, что в новой линейке реализована какая-то кастомная схема KV-кэша.
Такое действительно ждем
1🔥202❤36👍19😁4🕊4🤔3🎉3🍓3🤯2
This media is not supported in your browser
VIEW IN TELEGRAM
Эрлинг Холанд стал настолько популярен, что под него косят даже роботы
Atlas от Boston Dynamics внезапно появился на Чемпионате мира во время халф-тайма Бразилия-Норвегия. Он передал арбитру мяч и повторил фирменное празднование гола Холанда.
Кстати, на данный момент Hyundai Motor Group полностью выкупили Boston Dynamics и запустили массовое производство Atlas. К 2028 планируют произвести 30 тысяч.
Atlas от Boston Dynamics внезапно появился на Чемпионате мира во время халф-тайма Бразилия-Норвегия. Он передал арбитру мяч и повторил фирменное празднование гола Холанда.
Кстати, на данный момент Hyundai Motor Group полностью выкупили Boston Dynamics и запустили массовое производство Atlas. К 2028 планируют произвести 30 тысяч.
2😁114❤29🔥18🤯5👍3😎3🗿2👌1😍1
Anthropic нашли внутри Claude внутреннее пространство, где хранятся его мысли
Стартап выпустил одну из самых интересных работ по интерпретируемости за последнее время. Они обнаружили, что в LLM есть отдельный небольшой внутренний набор нейронных активаций, который используется как рабочая память для сложного мышления: так называемый J-space.
Мы часто представляем LLM как огромную мешанину чисел, где знания и рассуждения размазаны по миллиардам параметров. Но похоже, что это не совсем так.
Любопытно, что человеческий мозг работает похожим образом. Есть когнитивная теория, утверждающая, что он состоит из множества специализированных подсистем, которые работают независимо; но иногда какая-то информация попадает в небольшой общий workspace, становится доступной сразу многим областям мозга и может использоваться для рассуждений и принятия решений. И вот именно такой механизм исследователи обнаружили в Claude.
Вот как работает J-space:
— Название происходит от разработанной учеными техники Jacobian Lens. Она позволяет по текущим активациям понимать, какие токены с большей вероятностью появятся в будущем. При этом то, что они появятся – далеко не факт, но это значит, что модель о них думает и держит их в J-space, чтобы использовать в рассуждениях. По сути, это чтение мыслей Claude.
— Если спросить Claude, о чем он думает, то содержимое J-space хорошо совпадает с ответом модели. Другие внутренние представления таким свойством не обладают. А еще модель умеет сознательно менять J-space. Например, если сказать ей «думай о слонах, пока решаешь задачу», то эта концепция появится в J-space. При решении сложной задачи промежуточные шаги тоже появляются именно внутри J-space, даже если их при этом нет в цепочках мыслей.
— Если полностью отключить J-space, то у модели почти исчезают способности, требующие сложного мышления и многошагового рассуждения. Например, она больше не может сочинять стихи.
Самое важное во всем этом то, что J-space можно читать и менять. Anthropic приводят пример: исследователи специально внедряли модели скрытую цель во время обучения и затем наблюдали, как эта цель проявляется в J-space, хотя в ответах напрямую она ни разу не озвучивалась. При этом изменяя активации в J-space, они могли менять дальнейшие решения модели.
Потенциально это путь к тому, чтобы создавать (полностью?) безопасные и контролируемые модели. По крайней мере, сегодня Anthropic уже сделали черный ящик немного более прозрачным.
www.anthropic.com/research/global-workspace
Стартап выпустил одну из самых интересных работ по интерпретируемости за последнее время. Они обнаружили, что в LLM есть отдельный небольшой внутренний набор нейронных активаций, который используется как рабочая память для сложного мышления: так называемый J-space.
Мы часто представляем LLM как огромную мешанину чисел, где знания и рассуждения размазаны по миллиардам параметров. Но похоже, что это не совсем так.
Любопытно, что человеческий мозг работает похожим образом. Есть когнитивная теория, утверждающая, что он состоит из множества специализированных подсистем, которые работают независимо; но иногда какая-то информация попадает в небольшой общий workspace, становится доступной сразу многим областям мозга и может использоваться для рассуждений и принятия решений. И вот именно такой механизм исследователи обнаружили в Claude.
Вот как работает J-space:
— Название происходит от разработанной учеными техники Jacobian Lens. Она позволяет по текущим активациям понимать, какие токены с большей вероятностью появятся в будущем. При этом то, что они появятся – далеко не факт, но это значит, что модель о них думает и держит их в J-space, чтобы использовать в рассуждениях. По сути, это чтение мыслей Claude.
— Если спросить Claude, о чем он думает, то содержимое J-space хорошо совпадает с ответом модели. Другие внутренние представления таким свойством не обладают. А еще модель умеет сознательно менять J-space. Например, если сказать ей «думай о слонах, пока решаешь задачу», то эта концепция появится в J-space. При решении сложной задачи промежуточные шаги тоже появляются именно внутри J-space, даже если их при этом нет в цепочках мыслей.
— Если полностью отключить J-space, то у модели почти исчезают способности, требующие сложного мышления и многошагового рассуждения. Например, она больше не может сочинять стихи.
Самое важное во всем этом то, что J-space можно читать и менять. Anthropic приводят пример: исследователи специально внедряли модели скрытую цель во время обучения и затем наблюдали, как эта цель проявляется в J-space, хотя в ответах напрямую она ни разу не озвучивалась. При этом изменяя активации в J-space, они могли менять дальнейшие решения модели.
Потенциально это путь к тому, чтобы создавать (полностью?) безопасные и контролируемые модели. По крайней мере, сегодня Anthropic уже сделали черный ящик немного более прозрачным.
www.anthropic.com/research/global-workspace
3❤262🔥88👍48🤯16🤔11😁8🗿4👌2🏆2✍1 1
Data Secrets
Anthropic нашли внутри Claude внутреннее пространство, где хранятся его мысли Стартап выпустил одну из самых интересных работ по интерпретируемости за последнее время. Они обнаружили, что в LLM есть отдельный небольшой внутренний набор нейронных активаций…
Смешной пример из исследования: Claude говорят не думать о мосте в Сан-Франциско во время ответа на вопрос, и в ответ на это во внутреннем пространстве мыслей модели сначала появляется слово «мост», а затем «damn» («черт»).
Ближе к человеку, чем кажется
Ближе к человеку, чем кажется
6😁543 46❤23🔥7👍4🍓4🤯3☃2😍1🍾1
Пока ждем GPT-5.6 Sol (должен выйти уже в ближайшие часы), ловите веселые новости из Китая
Их министерство коммерции собирается ограничить доступ иностранцев к фронтирным моделям страны.
В частности, чиновники уже провели встречи с представителями Alibaba, ByteDance и Z.ai и обсудили соответствующие меры. Сообщается, что относится новые правила будут даже к моделям с открытыми весами😭
Кроме того, государство собирается ограничить возможности иностранных инвестиций, а разглашение запатентованных технологий ИИ будут рассматривать как преступление против национальной безопасности.
Больше никаких квенов…
Их министерство коммерции собирается ограничить доступ иностранцев к фронтирным моделям страны.
В частности, чиновники уже провели встречи с представителями Alibaba, ByteDance и Z.ai и обсудили соответствующие меры. Сообщается, что относится новые правила будут даже к моделям с открытыми весами
Кроме того, государство собирается ограничить возможности иностранных инвестиций, а разглашение запатентованных технологий ИИ будут рассматривать как преступление против национальной безопасности.
Больше никаких квенов…
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤯239 70🤨21👍12😁11❤8🫡7😭6 5🤗2❤🔥1
Оп, Anthropic продлили доступ к Fable по подписке до 12 июля!
Чего только не сделаешь, когда конкуренты выпускают новую модель✨
Чего только не сделаешь, когда конкуренты выпускают новую модель
Please open Telegram to view this post
VIEW IN TELEGRAM
1😁288🔥41❤22 15🤯3😎2👍1💯1🫡1
GPT-5.6 выходит завтра – официальный анонс от OpenAI
Все три модели выйдут одновременно. В линейке, напоминаем, будет:
1. Sol, самая крупная и мощная, примерно на уровне Mythos, и при этом дешевле в два раза.
2. Terra, промежуточный вариант. Уровень Opus 4.8.
3. Luna, самый дешевая и быстрая модель.
Тем временем уже сейчас стартап расширяет превью доступ. Так что некоторые счастливчики могут попробовать модели уже сейчас.
Все три модели выйдут одновременно. В линейке, напоминаем, будет:
1. Sol, самая крупная и мощная, примерно на уровне Mythos, и при этом дешевле в два раза.
2. Terra, промежуточный вариант. Уровень Opus 4.8.
3. Luna, самый дешевая и быстрая модель.
Тем временем уже сейчас стартап расширяет превью доступ. Так что некоторые счастливчики могут попробовать модели уже сейчас.
1❤133👍44🔥38🦄6🤯5👏2😁2🤩1🫡1🎄1
Полный I'll be back: "Терминатор 2" возвращают в кинотеатры. Джеймс Кэмерон заявил, что это "послание надежды, в котором хорошие парни побеждают ИИ"
В этом году фильму исполняется 35 лет. Дистрибьюторы конвертнули картину в 4к и 3D, и готовятся снова выпустить ее на экраны 28 августа. Вот что сказал по этому поводу Кэмерон:
Он что-то знает?
В этом году фильму исполняется 35 лет. Дистрибьюторы конвертнули картину в 4к и 3D, и готовятся снова выпустить ее на экраны 28 августа. Вот что сказал по этому поводу Кэмерон:
Я думаю, спустя 35 лет уже можно раскрывать спойлеры, так что СПОЙЛЕР: хорошие парни побеждают искусственный суперинтеллект! И, возможно, это именно тот посыл надежды, который всем нам не помешает этим летом.
Он что-то знает?
😁200❤46🤔15 14👍8🔥7🍓3 3❤🔥1🤯1🎄1
Anthropic бесплатно раздают пол года Claude Max 20x
Стартап запустил программу "Claude for Open Source". Условия относительно простые, и любой, кто так или иначе связан с опенсорсом, может получить в подарок пол года самого мощного тарифа антропиков. Сорвать куш можно, если:
– Вы автор библиотеки или поддерживаете ее: 500+ зависимых репозиториев, 100+ зависимых пакетов или 200 000+ суммарных загрузок в месяц в любом реестре;
– Вы являетесь официальным коммиттером или мейнтейнером крупного проекта (аля CPython, Rust, Kubernetes, Linux и др);
– Вы просто активно контрибьютите: за последний год у вас было 100+ принятых PR в чужие репозитории;
– Вы создаете проекты, в которые контрибьютит сообщество: за последний год в один из ваших репозиториев было принято 20+ PR от уникальных внешних участников;
– Вы поддерживаете критически важную инфраструктуру: один из ваших репозиториев имеет OpenSSF Criticality Score 0.4 или выше.
Если не подходите под критерии, но делаете что-то полезное для сообщества, Anthropic все равно советуют подаваться. Форма для подачи: https://claude.com/contact-sales/claude-for-oss
Стартап запустил программу "Claude for Open Source". Условия относительно простые, и любой, кто так или иначе связан с опенсорсом, может получить в подарок пол года самого мощного тарифа антропиков. Сорвать куш можно, если:
– Вы автор библиотеки или поддерживаете ее: 500+ зависимых репозиториев, 100+ зависимых пакетов или 200 000+ суммарных загрузок в месяц в любом реестре;
– Вы являетесь официальным коммиттером или мейнтейнером крупного проекта (аля CPython, Rust, Kubernetes, Linux и др);
– Вы просто активно контрибьютите: за последний год у вас было 100+ принятых PR в чужие репозитории;
– Вы создаете проекты, в которые контрибьютит сообщество: за последний год в один из ваших репозиториев было принято 20+ PR от уникальных внешних участников;
– Вы поддерживаете критически важную инфраструктуру: один из ваших репозиториев имеет OpenSSF Criticality Score 0.4 или выше.
Если не подходите под критерии, но делаете что-то полезное для сообщества, Anthropic все равно советуют подаваться. Форма для подачи: https://claude.com/contact-sales/claude-for-oss
2 108❤62😁23🔥16👍5🎉2😎2☃1👌1😭1