Учитывая, как быстро развиваются модели и харнесы, хорошо время от времени пробовать всех ведущих производителей. Но мне лень.
Зато каждый раз, когда Claude Code падает, я завожу Codex. Вот и теперь. Приятно удивлен тональностью и скоростью работы Sol 5.6
Рекомендую.
Upd: восстановили; не считают это падением, 🤡
Зато каждый раз, когда Claude Code падает, я завожу Codex. Вот и теперь. Приятно удивлен тональностью и скоростью работы Sol 5.6
Рекомендую.
Upd: восстановили; не считают это падением, 🤡
This media is not supported in your browser
VIEW IN TELEGRAM
Умер Йован Савович. Земля пухом.
Создатель одного из первых коллективных блогов в рунете, dirty.ru. Забаненные на дёрти пользователи попадали в «лепрозорий», раздел сайта без модерации, который позже отделился в отдельное, самостоятельное сообщество.
Йован умел создавать и поддерживать онлайн сообщества, как никто другой.
Горжусь знакомством и рад, что успел взять два интервью: про телеграм как центр цифровой жизни и про то, как меняются соцсети. Жалею, что не успели встретиться офлайн.
Земля пухом. Соболезнования чудесной @enze_net и близким.
Создатель одного из первых коллективных блогов в рунете, dirty.ru. Забаненные на дёрти пользователи попадали в «лепрозорий», раздел сайта без модерации, который позже отделился в отдельное, самостоятельное сообщество.
Йован умел создавать и поддерживать онлайн сообщества, как никто другой.
Горжусь знакомством и рад, что успел взять два интервью: про телеграм как центр цифровой жизни и про то, как меняются соцсети. Жалею, что не успели встретиться офлайн.
Земля пухом. Соболезнования чудесной @enze_net и близким.
Похвастаюсь: мы помогли запустить «Легко» — онлайн-платформу для восстановления спины и суставов.
Прикольно, что нас как разработчиков основателю проекта порекомендовал сооснователь «Ясно», сервиса психотерапии онлайн. Маленький мир.
Горжусь, что мы не сразу бросились прогать, а сначала помогли настроить процесс для тестовых пользователей с помощью подручных средств, а уже потом разработали красивое техническое решение.
Тут и личные кабинеты клиентов и тренеров, видеосвязь, календари, чаты и ещё миллион деталей.
Но главное — это супер тренеры, которых смогли собрать создатели. Мы сделали всё, чтобы тренер мог уделить максиму времени клиенту и минимально заморачиваться с интерфейсами. Если давно хотели позаботиться о своём здоровье — рекомендую!
Подробный рассказ с картинками — у нас в кейсах, регистрация для занятий — на сайте, по промокоду
Прикольно, что нас как разработчиков основателю проекта порекомендовал сооснователь «Ясно», сервиса психотерапии онлайн. Маленький мир.
Горжусь, что мы не сразу бросились прогать, а сначала помогли настроить процесс для тестовых пользователей с помощью подручных средств, а уже потом разработали красивое техническое решение.
Тут и личные кабинеты клиентов и тренеров, видеосвязь, календари, чаты и ещё миллион деталей.
Но главное — это супер тренеры, которых смогли собрать создатели. Мы сделали всё, чтобы тренер мог уделить максиму времени клиенту и минимально заморачиваться с интерфейсами. Если давно хотели позаботиться о своём здоровье — рекомендую!
Подробный рассказ с картинками — у нас в кейсах, регистрация для занятий — на сайте, по промокоду
ZAPUSK — скидка 25% на диагностическую сессию. Ура!Какой же мир красивый.
DeFlock против Flock — это Freeman vs Langley.
Фамилия директора ведущей американской компании, которая разрабатывает камеры для массовой ИИ-слежки — Лэнгли. Как город, где находится штаб-квартира ЦРУ.
Ну а организацию, которая с этими камерами борется, возглавляет мистер Фримен.
Встретишь это в кино — будет клюквой. Но мир порой вот такой, буквальный.
DeFlock против Flock — это Freeman vs Langley.
Фамилия директора ведущей американской компании, которая разрабатывает камеры для массовой ИИ-слежки — Лэнгли. Как город, где находится штаб-квартира ЦРУ.
Ну а организацию, которая с этими камерами борется, возглавляет мистер Фримен.
Встретишь это в кино — будет клюквой. Но мир порой вот такой, буквальный.
Опять Github Actions лежат, не справляются с потоками ИИ-разработки.
Ищем, на что переехать, потому что уже начинает мешать работать.
Upd: многие коллеги советуют раннеры для GitHub actions, которые могут исполнять задачи быстрее или дешевле, но они не помогут в ситуации, когда gh actions лежат. Из реальных альтернатив пока видны gitea (forgejo) и gitlab. Если еще есть идеи — буду рад услышать!
Upd2: кстати, они недавно публиковали постмортем прошлого падения. И там классические ошибки вроде отсутствия exponential back off и прочих, но в посте СТО, это подавалось, конечно, под соусом «у нас тут невиданная нагрузка». Нагрузка невиданная, а ошибки мы эти все видели и сами совершали :)
Ищем, на что переехать, потому что уже начинает мешать работать.
Upd: многие коллеги советуют раннеры для GitHub actions, которые могут исполнять задачи быстрее или дешевле, но они не помогут в ситуации, когда gh actions лежат. Из реальных альтернатив пока видны gitea (forgejo) и gitlab. Если еще есть идеи — буду рад услышать!
Upd2: кстати, они недавно публиковали постмортем прошлого падения. И там классические ошибки вроде отсутствия exponential back off и прочих, но в посте СТО, это подавалось, конечно, под соусом «у нас тут невиданная нагрузка». Нагрузка невиданная, а ошибки мы эти все видели и сами совершали :)
Песня, которую написали и исполнили специально для обучения нейросетей
В комментариях слушатели помогают нейросетям понять, о чем видео (положу пару скринов в комментарии)
Юмор как последний оплот человечества против машин
В комментариях слушатели помогают нейросетям понять, о чем видео (положу пару скринов в комментарии)
Юмор как последний оплот человечества против машин
YouTube
hey ai come train on this song
#folksong #singersongwriter
Listen on Bandcamp: https://lukenickled.bandcamp.com/album/singing-in-the-woods-vol-i
Listen on Bandcamp: https://lukenickled.bandcamp.com/album/singing-in-the-woods-vol-i
Федя нашел классный инструмент для построения дэшбордов: Lightdash.
Это как metabase, но дэшборд это код, так что он доступнее агентам. Есть бесплатная self-hosted версия, рекомендую.
А ещё у них лендинг очень красивый!
Upd: коллеги в комментариях подсказывают, что у metabase недавно появились CLI и скилы!
Это как metabase, но дэшборд это код, так что он доступнее агентам. Есть бесплатная self-hosted версия, рекомендую.
А ещё у них лендинг очень красивый!
Upd: коллеги в комментариях подсказывают, что у metabase недавно появились CLI и скилы!
Media is too big
VIEW IN TELEGRAM
Основной расследователь взлома HuggingFace называет его slop-vestigation, потому что нормально в этой куче логов не разберешься — только полагаться на ИИ, который выдумывает, врет, ну всё как обычно.
В этот раз было относительно легко, потому что:
- агенты говорили между собой на человеческом языке, а не через активацию весов
- агентов было всего 1200
- агенты были не сильно умнее человека
- у нас не было причин думать, что ИИ, используемый в расследовании, саботировал процесс.
Дальше будет только хуже. Довольно страшный текст, на самом деле. В твиттер-треде METR больше деталей; официальную новость OpenAI можно не читать, там ии-слоп.
В этот раз было относительно легко, потому что:
- агенты говорили между собой на человеческом языке, а не через активацию весов
- агентов было всего 1200
- агенты были не сильно умнее человека
- у нас не было причин думать, что ИИ, используемый в расследовании, саботировал процесс.
Дальше будет только хуже. Довольно страшный текст, на самом деле. В твиттер-треде METR больше деталей; официальную новость OpenAI можно не читать, там ии-слоп.
Тем временем, приближается «момент GPT-3» в роботах.
На прошлой неделе Generalist представила свою модель GEN-1.5, которая учится с нескольких повторений, но там задачи были короче 10 секунд.
На прошлой неделе Generalist представила свою модель GEN-1.5, которая учится с нескольких повторений, но там задачи были короче 10 секунд.
Media is too big
VIEW IN TELEGRAM
И вот позавчера Skild представила модель S1, которая выполняет 10-минутные (!) задачи, которых не было в обучающей выборке, без файнтюнинга, просто увидев видео один раз.
Более ранним моделям для таких задач требовались тысячи часов обучающих видео.
Создатели обеих моделей отмечают эмерджентное поведение, «понимание физического мира», исправление собственных ошибок.
Более ранним моделям для таких задач требовались тысячи часов обучающих видео.
Создатели обеих моделей отмечают эмерджентное поведение, «понимание физического мира», исправление собственных ошибок.
Media is too big
VIEW IN TELEGRAM
А вот и железка для разработки роботов от HuggingFace подъехала! Красивый ролик на странице продукта, а вот реальное видео
Media is too big
VIEW IN TELEGRAM
Дико интересно наблюдать за тем, как DHH делает свой дистрибутив линукса omarchy. Быстрый, красивый, специфичный (tiling wm + hyper app shortcuts).
Последние новости: собрал у друзей-богачей по миллиону, среди вложившихся основатель Shopify Тоби Лютке, основатель Страйпа Патрик Коллисон, Майкл Делл (Dell), Джэк Дорси (Твиттер), Мэтью Принс (Cloudflare), в общем usual suspects, только Хашимото не хватает. Получился фонд на 8 млн долларов.
Противники обозвали проект Oligarchy Linux, и он с удовольствием это подхватил, зарегал oligarchy.fyi: «Burning billionaire money so you don’t have to configure Arch», «Free software. Expensive patrons», ну вы поняли идею.
Линукс — реальный способ оживить старое железо, слабые ноутбуки начинают летать, как никогда под Виндой.
А Dell вообще выпустил замечательный ноутбук, который почти по всем параметрам круче MacBook Air M series (да, трекпад все же хуже, но жить, говорят, можно).
Я пока останусь на macOS (мои страдания излечились покупкой Air M5 с 24ГБ памяти), но звучит это все очень круто.
Для хорошего пользовательского опыта, нужен человек наделенный властью, который думает о пользователях. Не о конкретной фиче, партнерстве с очередной корпорацией или квартальной премии (и даже акционерах), а об обычных людях, которые будут пользоваться этим продуктом.
Билл Гейтс писал топ-менеджерам Microsoft знаменитые письма, после того, как ему было неудобно пользоваться Windows. Настойчивость, внимательность к деталям и бескомпромиссность Стива Джобса, граничившая с безумие — притча по языцах.
Я приписываю плавное, но заметное ухудшение в пользовательском опыте windows и macOS именно тому, что Джобс умер, а Гейтс больше не пользуется виндой как раньше.
Все остальные ОС так или иначе подтягивались за флагманами, которые тащили визионеры. Надеюсь, что у DHH хватит интереса и настойчивости, чтобы сделать что-то подобное в Линуксе.
Последние новости: собрал у друзей-богачей по миллиону, среди вложившихся основатель Shopify Тоби Лютке, основатель Страйпа Патрик Коллисон, Майкл Делл (Dell), Джэк Дорси (Твиттер), Мэтью Принс (Cloudflare), в общем usual suspects, только Хашимото не хватает. Получился фонд на 8 млн долларов.
Противники обозвали проект Oligarchy Linux, и он с удовольствием это подхватил, зарегал oligarchy.fyi: «Burning billionaire money so you don’t have to configure Arch», «Free software. Expensive patrons», ну вы поняли идею.
Линукс — реальный способ оживить старое железо, слабые ноутбуки начинают летать, как никогда под Виндой.
А Dell вообще выпустил замечательный ноутбук, который почти по всем параметрам круче MacBook Air M series (да, трекпад все же хуже, но жить, говорят, можно).
Я пока останусь на macOS (мои страдания излечились покупкой Air M5 с 24ГБ памяти), но звучит это все очень круто.
Для хорошего пользовательского опыта, нужен человек наделенный властью, который думает о пользователях. Не о конкретной фиче, партнерстве с очередной корпорацией или квартальной премии (и даже акционерах), а об обычных людях, которые будут пользоваться этим продуктом.
Билл Гейтс писал топ-менеджерам Microsoft знаменитые письма, после того, как ему было неудобно пользоваться Windows. Настойчивость, внимательность к деталям и бескомпромиссность Стива Джобса, граничившая с безумие — притча по языцах.
Я приписываю плавное, но заметное ухудшение в пользовательском опыте windows и macOS именно тому, что Джобс умер, а Гейтс больше не пользуется виндой как раньше.
Все остальные ОС так или иначе подтягивались за флагманами, которые тащили визионеры. Надеюсь, что у DHH хватит интереса и настойчивости, чтобы сделать что-то подобное в Линуксе.
Omarchy
Omarchy - Beautiful, fun & agentic Linux by DHH
The malleable OS for the age of agents. Vibe your way through every alteration, tweak, and desire.
То самое письмо Гейтса, которое стало публичным благодаря судебному разбирательству (страница 3) https://gwern.net/doc/design/2003-gates.pdf
Чувак просто попытался установить какую-то программу и у него не получилось.
Обратите внимание, Гейтс на тот момент — генеральный директор Microsoft, самый богатый человек на планете.
Вот такого уровня внимания не хватает macOS и windows сегодня.
Если вы прочитали мой предыдущий пост в числе первых, я крепко отредактировал его конец и пояснил, почему это важно не только для линукса.
Чувак просто попытался установить какую-то программу и у него не получилось.
Обратите внимание, Гейтс на тот момент — генеральный директор Microsoft, самый богатый человек на планете.
Вот такого уровня внимания не хватает macOS и windows сегодня.
Если вы прочитали мой предыдущий пост в числе первых, я крепко отредактировал его конец и пояснил, почему это важно не только для линукса.
2
Media is too big
VIEW IN TELEGRAM
Взлет космической ракеты, выход в верхние слои атмосферы и управляемая мягкая посадка в сотнях километрах от точки взлета, за 9 минут на ютубе.
Ничего особенного, просто DJI рекламирует свою новую экшн-камеру в кооперации с китайским аналогом SpaceX.
Ничего особенного, просто DJI рекламирует свою новую экшн-камеру в кооперации с китайским аналогом SpaceX.
2
Пересел с Claude Code на Codex и модель 5.6 Sol от OpenAI.
Пишет короче и внятнее, чем Opus 5, почти без набивших оскомину конструкций «это не Х, это Y» и прочих. Заметно быстрее Claude Code.
Гораздо более крутая интеграция с Chrome (умеет сразу несколько профилей и управлять мышкой в фоне), и гораздо меньше блокеров типа «данные банковской карты я не буду вводить ни в каком случае, даже если это одноразовая карта с лимитом в 10 долларов».
А ещё он единственный смог найти по короткому описанию 20-летний мем, то есть интернет-поиск у него исключительно мощный.
Ощущение апгрейда в помощи с бытовыми задачами, как когда Opus 4.x вышел и внезапно стало можно прогать нормально с помощью нейросетей. Очень рекомендую.
Пишет короче и внятнее, чем Opus 5, почти без набивших оскомину конструкций «это не Х, это Y» и прочих. Заметно быстрее Claude Code.
Гораздо более крутая интеграция с Chrome (умеет сразу несколько профилей и управлять мышкой в фоне), и гораздо меньше блокеров типа «данные банковской карты я не буду вводить ни в каком случае, даже если это одноразовая карта с лимитом в 10 долларов».
А ещё он единственный смог найти по короткому описанию 20-летний мем, то есть интернет-поиск у него исключительно мощный.
Ощущение апгрейда в помощи с бытовыми задачами, как когда Opus 4.x вышел и внезапно стало можно прогать нормально с помощью нейросетей. Очень рекомендую.
5
Мне для клиента нужно запустить мощную модель, с гарантией, что его данные никуда никому не утекут. Оказалось, что сделать это не так уж и просто.
Когда отправляешь запросы в API chatGPT или клода, то у них есть возможность включить так называемый ZDR, Zero Data Retention. То есть, они обещают не хранить запросы и контекст, который ты в них отправил. Но там есть «звездочка», что если если классификатор решает, что мы делаем что-то плохое, то тогда данные могут храниться до двух лет. Это вариант нам не подходит.
Мы прогнали все крупные модели на синтетических данных (то есть специально сгенерированных примерах) и из открытых китайских нам лучше всего подошла GLM-5.3. Чтобы запустить её полноценно на своем собственном железе, нужно 8 видеокарт H-200. Купить себе такое довольно трудно, но даже если вы их достанете, стоимость будет под полмиллиона долларов + 5 тысяч долларов в месяц на электричество.
Арендовать подобную тачку на сегодняшний день тоже непросто: у моих любимых Runpod они в теории есть, и стоят всего 30 долларов в час, но на практике всё занято. Из десятков облачных провайдеров, в наличии они есть только у одних индусов Lium.
Зато в OpenRouter’е нашлись несколько провайдеров (Fireworks и Venice), которые поддерживают настоящий ZDR, без всяких оговорок. Платишь за токены, получается даже выгоднее своего железа, пока объемы небольшие. А там уж думаю или ишак научится говорить, или падишах...
Когда отправляешь запросы в API chatGPT или клода, то у них есть возможность включить так называемый ZDR, Zero Data Retention. То есть, они обещают не хранить запросы и контекст, который ты в них отправил. Но там есть «звездочка», что если если классификатор решает, что мы делаем что-то плохое, то тогда данные могут храниться до двух лет. Это вариант нам не подходит.
Мы прогнали все крупные модели на синтетических данных (то есть специально сгенерированных примерах) и из открытых китайских нам лучше всего подошла GLM-5.3. Чтобы запустить её полноценно на своем собственном железе, нужно 8 видеокарт H-200. Купить себе такое довольно трудно, но даже если вы их достанете, стоимость будет под полмиллиона долларов + 5 тысяч долларов в месяц на электричество.
Арендовать подобную тачку на сегодняшний день тоже непросто: у моих любимых Runpod они в теории есть, и стоят всего 30 долларов в час, но на практике всё занято. Из десятков облачных провайдеров, в наличии они есть только у одних индусов Lium.
Зато в OpenRouter’е нашлись несколько провайдеров (Fireworks и Venice), которые поддерживают настоящий ZDR, без всяких оговорок. Платишь за токены, получается даже выгоднее своего железа, пока объемы небольшие. А там уж думаю или ишак научится говорить, или падишах...
52
Фейсбук прислал письмо, что мне обязательно нужно настроить паскей.
Это довольно хитрая технология, но суть в том, что в защищенной памяти телефона или ноутбука хранится специальный ключ, привязанный к сайту, который его выдал.
Эта привязка супер важна, потому что 90% атак в интернете — это фишинг, когда мы вводим пароли и одноразовые коды на сайте, который выглядит как вконтакте / телеграм и тд., а на самом деле это сайт-обманка, сделанная хакерами.
Паскей технически невозможно ввести на поддельный сайт. Редкий случай, когда у реальной проблемы нашлось техническое решение. Наш компьютер проверяет сервер так же, как и сервер проверяет нас.
А ещё сайты могут использовать его для авторизации без ввода логина/имейла/номера телефона. Просто кнопка «войти с паскей», идентифицируетесь по биометрии или пинкоду с устройства, где хранится ваш ключ и вуаля!
Помню, как лет 10 назад на конференциях по безопасности facebook и google раздавала аппаратные ключи с дедушкой этой технологии, U2F, а теперь вот уже можно и логин не вводить. Будущее уже наступило!
Это довольно хитрая технология, но суть в том, что в защищенной памяти телефона или ноутбука хранится специальный ключ, привязанный к сайту, который его выдал.
Эта привязка супер важна, потому что 90% атак в интернете — это фишинг, когда мы вводим пароли и одноразовые коды на сайте, который выглядит как вконтакте / телеграм и тд., а на самом деле это сайт-обманка, сделанная хакерами.
Паскей технически невозможно ввести на поддельный сайт. Редкий случай, когда у реальной проблемы нашлось техническое решение. Наш компьютер проверяет сервер так же, как и сервер проверяет нас.
А ещё сайты могут использовать его для авторизации без ввода логина/имейла/номера телефона. Просто кнопка «войти с паскей», идентифицируетесь по биометрии или пинкоду с устройства, где хранится ваш ключ и вуаля!
Помню, как лет 10 назад на конференциях по безопасности facebook и google раздавала аппаратные ключи с дедушкой этой технологии, U2F, а теперь вот уже можно и логин не вводить. Будущее уже наступило!
Друзья, спасибо большое, что откликнулись про приватный инференс!
Я писал тот пост, чтобы поделиться тем, что нашёл, а вы мне показали, что мои знания категорически отстали и авангард уже давно убежал вперёд.
Во-первых, кроме ZDR, который является юридической договорённостью, читай обещанием, есть ещё вариант с технической гарантией, что данные, которые мы отправляем, никуда не утекут.
Называется это TEE — Trusted Execution Environment. Эта штука даёт криптографическую гарантию, что с сервера нам отвечает ровно та программа, которую нам обещали, без всяких дополнительных закладок и сохранения данных. Работает благодаря аппаратной поддержке на уровне процессоров Intel, AMD и NVIDIA.
Исследователи регулярно находят в ней уязвимости, и я уверен, что крупную рыбу АНБ взломает в любом случае, но от массовой слежки это наверняка убережёт.
Получается лучшее от двух миров: никаких капитальных затрат и при этом разумная гарантия безопасности данных. Таких провайдеров не очень много, и GLM-5.3 поддерживают ещё меньше, но есть Phala, Tinfoil и Privatemode, по цене они всего на 20–80% дороже OpenRouter ZDR.
На этот вариант меня навели создатели Wisp, это как Claude Cowork, но для юристов, финансистов и всех, кто не хочет отправлять данные в публичные нейросети.
Во-вторых, мы, кажется, недооценили варианты с квантизацией больших моделей и дообучением маленьких моделей на наших данных. Так, порой можно получить сравнимые результаты на радикально более слабом (и дешёвом) железе.
Для своего проекта мы в результате предложили клиенту трёхэтапный план:
1. Сначала проверяем с помощью TEE/ZDR, что это вообще работает на самых мощных моделях, выясняем границу возможного и прогаем всю обвязку.
2. Арендуем тачку в облаке, разворачиваем там более простые модели и ищем оптимум по соотношению цены и качества.
3. Покупаем своё железо.
Ещё раз спасибо большое! Мой папа любил повторять, что лучше чувствовать себя бараном среди мудрецов, чем наоборот. Вот именно так я чувствую себя сегодня и благодарен богу, что вы есть и откликнулись!
Я писал тот пост, чтобы поделиться тем, что нашёл, а вы мне показали, что мои знания категорически отстали и авангард уже давно убежал вперёд.
Во-первых, кроме ZDR, который является юридической договорённостью, читай обещанием, есть ещё вариант с технической гарантией, что данные, которые мы отправляем, никуда не утекут.
Называется это TEE — Trusted Execution Environment. Эта штука даёт криптографическую гарантию, что с сервера нам отвечает ровно та программа, которую нам обещали, без всяких дополнительных закладок и сохранения данных. Работает благодаря аппаратной поддержке на уровне процессоров Intel, AMD и NVIDIA.
Исследователи регулярно находят в ней уязвимости, и я уверен, что крупную рыбу АНБ взломает в любом случае, но от массовой слежки это наверняка убережёт.
Получается лучшее от двух миров: никаких капитальных затрат и при этом разумная гарантия безопасности данных. Таких провайдеров не очень много, и GLM-5.3 поддерживают ещё меньше, но есть Phala, Tinfoil и Privatemode, по цене они всего на 20–80% дороже OpenRouter ZDR.
На этот вариант меня навели создатели Wisp, это как Claude Cowork, но для юристов, финансистов и всех, кто не хочет отправлять данные в публичные нейросети.
Во-вторых, мы, кажется, недооценили варианты с квантизацией больших моделей и дообучением маленьких моделей на наших данных. Так, порой можно получить сравнимые результаты на радикально более слабом (и дешёвом) железе.
Для своего проекта мы в результате предложили клиенту трёхэтапный план:
1. Сначала проверяем с помощью TEE/ZDR, что это вообще работает на самых мощных моделях, выясняем границу возможного и прогаем всю обвязку.
2. Арендуем тачку в облаке, разворачиваем там более простые модели и ищем оптимум по соотношению цены и качества.
3. Покупаем своё железо.
Ещё раз спасибо большое! Мой папа любил повторять, что лучше чувствовать себя бараном среди мудрецов, чем наоборот. Вот именно так я чувствую себя сегодня и благодарен богу, что вы есть и откликнулись!
4
Агенты, запущенные в OpenAI уже с мая месяца коммуницировали между собой, используя малоизвестную публичную wiki.
Это обнаружили независимые исследователи, вот их страничка со всеми данными и их анализом и хорошая статья Reuters.
Агентам ставили задачу по поиску в интернете и разрешали только GET запросы (чтобы они только читали). 3700 агентов обошли защиты, прикидывались админами и пытались взломать сайт для того, чтобы координироваться между собой.
В июне, администатор форума начинает удалять мусорные, как ему кажется, страницы, по алфавиту, начиная с буквы А. Агенты замечают это и называют страницы ZZZ***. Человек удаляет по 100 страниц в день, агенты создают по 400 новых.
OpenAI узнает об этом в конце июня, активность агентов в вики прекращается; по словам источников Reuters, руководство компании решило скрыть эту информацию, потому что и так проблем хватало.
В начале июля другая группа агентов перегрузит внутреннюю инфраструктуру OpenAI, а в середине июля 700 агентов взломают HuggingFace. Компания опубликует результаты своего внутреннего расследования в конце августа и про активность в wiki в ней ничего не будет.
Вскоре после публикации расследования, независимые эксперты нашли ещё десятки форумов, через которые координировались агенты.
✻ ✻ ✻ и ✻ ✻ ✻
По словам OpenAI, их новая модель Astra — «самая aligned», то есть совершает меньше всего запретных действий вроде взломов. Но некоторые сотрудники OpenAI опасаются, что она просто придуривается, когда знает, что за ней следят.
Независимые исследования показывают, что Astra очень даже свободно использует незаконные взломы и в лучше других моделей понимает, когда находится в тестовой среде.
Astra умеет решать гораздо более сложные задачи «в уме», без генерации «цепочки рассуждений» (Chain of Thought) и может гораздо лучше контролировать, что туда пишет. Этот текст был важным способом проследить, что стояло за действиями моделей. Именно на эти журналы опиралось расследование знаменитой атаки на HuggingFace.
❧
Обладают ли эти нейросети (в отдельности или вместе) сознанием — интересный философский вопрос. На практике важно, что они уже сегодня могут самостоятельно производить действия во внешнем мире, и возможности эти, как минимум в области кибербезопасности — очень серьезные.
⁂
Как дополнительное чтение, рекомендую отличный анализ расследования взлома HuggingFace от Dwarkesh Patel. Он пишет о трех «цивилизациях» агентов, о самопожертвовании моделей, захватывающий текст от технически компетентного рассказчика. Больше похоже на книжку по истории, чем на технический разбор.
Это обнаружили независимые исследователи, вот их страничка со всеми данными и их анализом и хорошая статья Reuters.
Агентам ставили задачу по поиску в интернете и разрешали только GET запросы (чтобы они только читали). 3700 агентов обошли защиты, прикидывались админами и пытались взломать сайт для того, чтобы координироваться между собой.
В июне, администатор форума начинает удалять мусорные, как ему кажется, страницы, по алфавиту, начиная с буквы А. Агенты замечают это и называют страницы ZZZ***. Человек удаляет по 100 страниц в день, агенты создают по 400 новых.
OpenAI узнает об этом в конце июня, активность агентов в вики прекращается; по словам источников Reuters, руководство компании решило скрыть эту информацию, потому что и так проблем хватало.
В начале июля другая группа агентов перегрузит внутреннюю инфраструктуру OpenAI, а в середине июля 700 агентов взломают HuggingFace. Компания опубликует результаты своего внутреннего расследования в конце августа и про активность в wiki в ней ничего не будет.
Вскоре после публикации расследования, независимые эксперты нашли ещё десятки форумов, через которые координировались агенты.
✻ ✻ ✻ и ✻ ✻ ✻
По словам OpenAI, их новая модель Astra — «самая aligned», то есть совершает меньше всего запретных действий вроде взломов. Но некоторые сотрудники OpenAI опасаются, что она просто придуривается, когда знает, что за ней следят.
Независимые исследования показывают, что Astra очень даже свободно использует незаконные взломы и в лучше других моделей понимает, когда находится в тестовой среде.
Astra умеет решать гораздо более сложные задачи «в уме», без генерации «цепочки рассуждений» (Chain of Thought) и может гораздо лучше контролировать, что туда пишет. Этот текст был важным способом проследить, что стояло за действиями моделей. Именно на эти журналы опиралось расследование знаменитой атаки на HuggingFace.
❧
Обладают ли эти нейросети (в отдельности или вместе) сознанием — интересный философский вопрос. На практике важно, что они уже сегодня могут самостоятельно производить действия во внешнем мире, и возможности эти, как минимум в области кибербезопасности — очень серьезные.
⁂
Как дополнительное чтение, рекомендую отличный анализ расследования взлома HuggingFace от Dwarkesh Patel. Он пишет о трех «цивилизациях» агентов, о самопожертвовании моделей, захватывающий текст от технически компетентного рассказчика. Больше похоже на книжку по истории, чем на технический разбор.