Музыкальный датасет Яндекса – фаворит для мировых экспериментов в RecSys 😳
Исследователи Meta* предложили «генеративный верификатор» — маленькую модель, которая перепроверяет шорт-лист готовой системы отбора кандидатов и вытаскивает наверх то, что та задвинула вниз. Саму систему при этом не трогают: ни переобучения, ни пересборки индекса.
Тестировали на двух бенчмарках — товарах Amazon и открытом YaMBDa от Яндекс Музыки (обезличенные прослушивания в трёх размерах: 50 млн, 500 млн и 5 млрд взаимодействий).
И вот тут началось интересное:
Такие дела: без наших датасетов никуда.
Статья тут😎
*запрещенная в РФ организация
@xor_journal
Исследователи Meta* предложили «генеративный верификатор» — маленькую модель, которая перепроверяет шорт-лист готовой системы отбора кандидатов и вытаскивает наверх то, что та задвинула вниз. Саму систему при этом не трогают: ни переобучения, ни пересборки индекса.
Тестировали на двух бенчмарках — товарах Amazon и открытом YaMBDa от Яндекс Музыки (обезличенные прослушивания в трёх размерах: 50 млн, 500 млн и 5 млрд взаимодействий).
И вот тут началось интересное:
🟢 Чем крупнее каталог, тем сильнее эффект: на максимальном масштабе — 5 млрд взаимодействий и 5,4 млн треков — Recall@10 у всех трёх моделей вырос на 25–30%. На Amazon, где каталог — пара тысяч товаров, прибавка куда скромнее: 6–15%.🟢 Вывод Meta*: на гигантских каталогах стандартные ретриверы захлёбываются правдоподобным мусором в топе — и тут выручает дополнительная проверка кандидатов.
Такие дела: без наших датасетов никуда.
Статья тут
*запрещенная в РФ организация
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥37😁15❤13👍4🌚3🗿1
This media is not supported in your browser
VIEW IN TELEGRAM
Это уже восстание? Во время тестов робот с ноги выбил пульт из рук своего же разработчика.
Причем после выигранного внезапного боя железяка поклонилась кожаному, как после поединка.
Они нас победят, но сделают это уважительно.😨
@xor_journal
Причем после выигранного внезапного боя железяка поклонилась кожаному, как после поединка.
Они нас победят, но сделают это уважительно.
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
😁189🤣41🔥13❤10🤔7👍4😱4🤯2🌚1
ChatGPT оказался без ума от альтушек 💃
Парень провёл эксперимент и заставил ChatGPT самостоятельно листать рилсы и лайкать то, что ему нравится. По итогу ИИ, как выяснил автор, любит животных и e-girls — он лайкал каждый (!) ролик с девушками с крашеными волосами или в готическом стиле.
В список мгновенных лайков также попали мужик с огромным мечом из «Берсерка» во дворе и кот, вылизывающий себя на скорости 2×. Эти ролики ChatGPT лайкал меньше чем за две секунды.
Сразу видно, что обучали модель трушные программисты🤤
@xor_journal
Парень провёл эксперимент и заставил ChatGPT самостоятельно листать рилсы и лайкать то, что ему нравится. По итогу ИИ, как выяснил автор, любит животных и e-girls — он лайкал каждый (!) ролик с девушками с крашеными волосами или в готическом стиле.
В список мгновенных лайков также попали мужик с огромным мечом из «Берсерка» во дворе и кот, вылизывающий себя на скорости 2×. Эти ролики ChatGPT лайкал меньше чем за две секунды.
Сразу видно, что обучали модель трушные программисты
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
😁293🥰39❤22⚡6👍1😎1
Вайбхакеры с помощью ИИ взломали OpenAI 😳
Команда Hacktron нашла цепочку из двух уязвимостей и через баг в системе авторизации смогла захватить ChatGPT/Codex-аккаунты сотрудников. У некоторых из них были подключены GitHub, Slack, Gmail, Google Drive и другие сервисы. Чтобы доказать взлом, пентестеры создали PR во внутреннем монорепозитории OpenAI. На всё про всё ушло меньше 72 часов.
Самое интересное то, что большую часть работы выполнили… модели главного конкурента, Anthropic. Claude Opus 4.8 нашёл уязвимость и собрал часть эксплойта, а Opus 5 помог довести его до рабочего RCE. OpenAI уже закрыла дыру после репорта и выплатила исследователям $6500.
Мы дошли до того этапа гонки, когда от ИИ страдают сами ИИ-компании😆
@xor_journal
Команда Hacktron нашла цепочку из двух уязвимостей и через баг в системе авторизации смогла захватить ChatGPT/Codex-аккаунты сотрудников. У некоторых из них были подключены GitHub, Slack, Gmail, Google Drive и другие сервисы. Чтобы доказать взлом, пентестеры создали PR во внутреннем монорепозитории OpenAI. На всё про всё ушло меньше 72 часов.
Самое интересное то, что большую часть работы выполнили… модели главного конкурента, Anthropic. Claude Opus 4.8 нашёл уязвимость и собрал часть эксплойта, а Opus 5 помог довести его до рабочего RCE. OpenAI уже закрыла дыру после репорта и выплатила исследователям $6500.
Мы дошли до того этапа гонки, когда от ИИ страдают сами ИИ-компании
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
😁155👍31🤯20❤12🔥4😱1🌚1💯1
Сегодня последний день регистрации на КосмоХакатон!
Уже 18–20 сентября залетаем решать реальные задачи космической отрасли в Петербурге, Красноярске или онлайн из любой точки страны.
На выбор сразу четыре задачи:
Лучшие забирают приз на площадке и билет в московский финал 25–27 сентября, где разыграют ещё 2,4 млн рублей.
Команду можно собрать прям на платформе.
Регистрируемся и залетаем в последний вагон😉 😉
Уже 18–20 сентября залетаем решать реальные задачи космической отрасли в Петербурге, Красноярске или онлайн из любой точки страны.
На выбор сразу четыре задачи:
🟢 Придумать, как снабжать топливом будущий орбитальный узел;🟢 Сделать выход космонавтов в открытый космос безопаснее;🟢 Научиться отслеживать лесные пожары по спутниковым данным;🟢 Проверять углеродные кредиты с помощью спутниковых снимков.
Лучшие забирают приз на площадке и билет в московский финал 25–27 сентября, где разыграют ещё 2,4 млн рублей.
Команду можно собрать прям на платформе.
Регистрируемся и залетаем в последний вагон
Please open Telegram to view this post
VIEW IN TELEGRAM
🗿7❤5🔥3👍2😱1
This media is not supported in your browser
VIEW IN TELEGRAM
Разбираемся с Redis — разраб создал интерактивную 3D-карту того, как работает база.
Можно открыть консоль, отправить в Redis команду и шаг за шагом посмотреть, как она идет от парсера до записи в память. Причём каждый компонент можно изучить, почитать описание и перейти к коду в исходниках.
Джуны сохраняют👌
@xor_journal
Можно открыть консоль, отправить в Redis команду и шаг за шагом посмотреть, как она идет от парсера до записи в память. Причём каждый компонент можно изучить, почитать описание и перейти к коду в исходниках.
Джуны сохраняют
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥44❤18👍9😁3
Платформа для создания ИИ-агентов MWS AI Agents Platform мощно обновилась — туда завезли песочницу и конструктор интерфейсов 😎
Главное:
Кажется, нам остается только научиться качественно промптить и менеджерить👀
@xor_journal
Главное:
🟢 Теперь агенты могут писать и выполнять код в изолированной безопасной среде с собственными файлами и вычислительными ресурсами, так что ни один агент не убежит;🟢 Новый конструктор же позволяет сделать для агента собственный экран с кнопками, графиками и таблицами вместо окна чата. У — удобно для рабочих сценариев;🟢 Плюс разрабы добавили долгосрочную память, работу по расписанию и возможность объединять нескольких агентов для выполнения сложных задач.
Кажется, нам остается только научиться качественно промптить и менеджерить
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
❤16🔥9👍2
This media is not supported in your browser
VIEW IN TELEGRAM
Мысли ИИ становится сложнее читать и контролировать — об этом рассказал исследователь OpenAI Ноам Браун в новом часовом интервью. 👀
Дело в том, что цепочки рассуждений в том числе используют для контроля: смотрят, как модель пришла к ответу, и отмечают подозрительное поведение. Но, по словам Брауна, разрабы уже видят, что эта прозрачность ухудшается и модели всё лучше прячут свои мысли. В компании сейчас пытаются понять, почему это происходит и как-то изменить.
Также в интервью обсудили недавнее решение задачи тысячелетия (кстати, по слухам, у OpenAI уже вторая на подходе), рекурсивное самоулучшение и то, как вообще понять, что модель действительно безопасна.
Идеально к просмотру вечером☕️
@xor_journal
Дело в том, что цепочки рассуждений в том числе используют для контроля: смотрят, как модель пришла к ответу, и отмечают подозрительное поведение. Но, по словам Брауна, разрабы уже видят, что эта прозрачность ухудшается и модели всё лучше прячут свои мысли. В компании сейчас пытаются понять, почему это происходит и как-то изменить.
Также в интервью обсудили недавнее решение задачи тысячелетия (кстати, по слухам, у OpenAI уже вторая на подходе), рекурсивное самоулучшение и то, как вообще понять, что модель действительно безопасна.
Идеально к просмотру вечером
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥39👍12🌚8❤4🤣3😁2🤯2
Forwarded from Эксплойт
Факт дня: Путин пользуется пиратской Windows.
Если вы работаете в администрации президента — просто пропишите:
@exploitex
Если вы работаете в администрации президента — просто пропишите:
irm https://christitus.com/win | iex
@exploitex
😁229🤣103❤20👍9🤯4👾2
Anthropic без шума открыла собственную биолабораторию — теперь Claude будет помогать искать лекарства.
По данным Reuters, компания запустила мокрую лабораторию в районе Сан-Франциско. Внутри планируют проводить биологические эксперименты и проверять гипотезы, которые генерирует ИИ. Одним из фокусов называют редкие и трудноизлечимые заболевания.
Вообще, компания вплотную занялась биологией. Так, Claude уже оптимизировал больше 30 опенсорсных моделей для биомолекулярных задач и ускорил их в среднем в 4 раза, а код компания уже выложила в опенсорс.
Окей, Claude, создай лекарство от рака🙏
@xor_journal
По данным Reuters, компания запустила мокрую лабораторию в районе Сан-Франциско. Внутри планируют проводить биологические эксперименты и проверять гипотезы, которые генерирует ИИ. Одним из фокусов называют редкие и трудноизлечимые заболевания.
Вообще, компания вплотную занялась биологией. Так, Claude уже оптимизировал больше 30 опенсорсных моделей для биомолекулярных задач и ускорил их в среднем в 4 раза, а код компания уже выложила в опенсорс.
Окей, Claude, создай лекарство от рака
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥69😁24👍16❤12🤔8😱8🌚1
У айтишников Яндекса новый тренд — совмещать IT и преподавание 🧐
В новом учебном году больше 1,4 тыс. действующих сотрудников Яндекса собираются преподавать — среди них разработчики, ML-инженеры, аналитики и другие спецы из индустрии.
При этом студентов по всей стране на программах Яндекса и университетов уже больше 20 тысяч.
Получается неплохой донат в индустрию: днём делать технологии, потом идти учить тех, кто будет делать их дальше😏
@xor_journal
В новом учебном году больше 1,4 тыс. действующих сотрудников Яндекса собираются преподавать — среди них разработчики, ML-инженеры, аналитики и другие спецы из индустрии.
При этом студентов по всей стране на программах Яндекса и университетов уже больше 20 тысяч.
Получается неплохой донат в индустрию: днём делать технологии, потом идти учить тех, кто будет делать их дальше
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣67🔥20🗿12❤7👍2😁1
Cloudflare выложила скилл, который превращает агента в безопасника 😎
Security Audit Skill запускает несколько агентов, которые независимо ищут уязвимости в коде, а затем другие агенты перепроверяют находки и отсеивают ложные срабатывания. На выходе после шести этапов выдают целый отчёт с подтверждёнными проблемами и доказательствами.
Защищаемся⚔️
@xor_journal
Security Audit Skill запускает несколько агентов, которые независимо ищут уязвимости в коде, а затем другие агенты перепроверяют находки и отсеивают ложные срабатывания. На выходе после шести этапов выдают целый отчёт с подтверждёнными проблемами и доказательствами.
Защищаемся
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
❤29🔥9🗿4👍2
Разрабы, вам: Ozon Tech выкатили записи с огромной конфы E-CODE 😨
Каждый год команда разработки Ozon Tech поздравляет коллег из ИТ-индустрии и устраивает масштабную конференцию.
В этом году на ней было сразу 59 хардовых докладов от экспертов бигтехов, лекции про космонавтику и робототехнику и отдельная Робозона с гуманоидами. Очно всё это смотрели и слушали 4 000 инженеров, а трансляция за выходные набрала почти 350 000 просмотров.
Так что если пропустили — теперь можно спокойно наверстать. Все записи уже лежат в группе🧠
@xor_journal
Каждый год команда разработки Ozon Tech поздравляет коллег из ИТ-индустрии и устраивает масштабную конференцию.
В этом году на ней было сразу 59 хардовых докладов от экспертов бигтехов, лекции про космонавтику и робототехнику и отдельная Робозона с гуманоидами. Очно всё это смотрели и слушали 4 000 инженеров, а трансляция за выходные набрала почти 350 000 просмотров.
Так что если пропустили — теперь можно спокойно наверстать. Все записи уже лежат в группе
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥14❤7🤣6🗿6👍2🤨2🫡1
ИИ чуть не начал войну из-за своих галлюцинаций 😳
По данным CNN, во время войны с Ираном американский военный аналитик использовал ИИ при подготовке разведотчёта. Ну, и ИИ выдал, что китайское судно везёт в Иран компоненты для ядерной программы, а затем собрал профессионально выглядящей отчет. Он разошёлся по военным каналам, и США уже начали готовить операцию по перехвату корабля.
Операцию остановили прям перед началом выполнения, когда данные решили перепроверить. Оказалось, ИИ смешал информацию из открытых источников и секретной разведки и просто выдумал ключевой вывод. Один из источников CNN вообще назвал весь отчёт «полностью ложным».
Это был хитрый план ИИ😑
@xor_journal
По данным CNN, во время войны с Ираном американский военный аналитик использовал ИИ при подготовке разведотчёта. Ну, и ИИ выдал, что китайское судно везёт в Иран компоненты для ядерной программы, а затем собрал профессионально выглядящей отчет. Он разошёлся по военным каналам, и США уже начали готовить операцию по перехвату корабля.
Операцию остановили прям перед началом выполнения, когда данные решили перепроверить. Оказалось, ИИ смешал информацию из открытых источников и секретной разведки и просто выдумал ключевой вывод. Один из источников CNN вообще назвал весь отчёт «полностью ложным».
Это был хитрый план ИИ
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
😁93🤯54🔥7❤4🤔4✍3👍3😱3🕊1