Data Science | Machinelearning [ru]
19.8K subscribers
819 photos
56 videos
28 files
3.74K links
Все о Data Science, машинном обучении и искусственном интеллекте: от базовой теории до cutting-edge исследований и LLM.

Личный блог автора - @just_genych
По вопросам рекламы или разработки - @g_abashkin


РКН: https://vk.cc/cJPGXD
Download Telegram
Как выглядят задачи машинного обучения в бигтехе?

Открыта регистрация на E-CUP 2026 Students — ежегодное соревнование от Ozon Tech. В этом сезоне — для студентов, которые интересуются ML, Data Science, Big Data и аналитикой данных.

Вас ждут три трека: поиск дубликатов товаров, ИИ-модерация карточек маркетплейса и прогнозирование поведения пользователей. Все задачи основаны на реальных обезличенных данных Ozon.

Участвовать можно по одиночке или в команде до пяти человек. Соревнование проходит онлайн с финалом на масштабной конференции E-CODE.

Что ждёт участников:
- призовой фонд 7 200 000 ₽;
- обратная связь от инженеров Ozon Tech;
- нетворк с экспертами индустрии;
- лимитированный мерч;
- билеты на конференцию E-CODE, где наградят победителей.

Подробнее — на сайте E-CUP 2026 Students.
➡️ Регистрация уже открыта!

Присоединяйтесь, чтобы выйти за рамки учебных проектов, попробовать свои силы в задачах настоящего бигтеха и сравнить своё решение с лучшими участниками.
2
Claude Fable уделала GPT-5.6 в переписывании кода с нуля. И нет, это не опечатка

Чуваки из Epoch AI долили свежих результатов в MirrorCode — закинули туда топ-модели от Anthropic и OpenAI. Claude Fable 5 расхерачила 64% задач. GPT-5.6 Sol наскребла жалкие 20%.

Разрыв в три раза смотрится дико. На остальных тестах эти двое дышат друг другу в затылок, а где-то Sol вообще рвала всех. Официальный коммент никто не дал — ни Epoch AI, ни Anthropic. Но если поковыряться в данных лидерборда, оправдание этой порке найти реально. Читать далее

👉 Data Science | Machinelearning
Please open Telegram to view this post
VIEW IN TELEGRAM
7👎1
За последний год навайбкодил пару десятков лендосов — под проги Физтеха, свои хотелки и левые заказы. В статье разбираю четыре самых жирных: Школа Техпреда, конфу «Точка сборки», курс «ИИ Продакт-менеджмент» и один пет-проект.

Поверх всего натянут слой визуального жирка, который орёт «дорого-богато». Интерактивная вода на WebGL-шейдерах, лого Физтеха, собранный из тысяч спрайтов, живая кубическая хреновина в 3D и облако частиц, меняющее форму прямо под скроллом.

До этого слоя автор дополз двумя маршрутами. Для «Точки сборки» запилил эффекты ручками на голом WebGL. Под всё остальное сварганил движок на Three.js: эффекты раскиданы по отдельным файлам, кочуют с сайта на сайт и трусливо откатываются до 2D-canvas, если CDN лёг и не отвечает. Внутри — оба пути с боевым кодом, тулчейн от и до и собранные грабли.

Читать далее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
👍41
Google Maps в 2018 прикрутил фишку «Your Match» — предсказание, насколько тебе зайдёт ресторан (0–100%), выстроенное на твоих же оценках. Автор не ленился долбить рейтинги, чтобы система не тупила, и хрень реально пахала, особенно когда совпадение переваливало за 90%. А в 2023 Гугл тихо прикончил эту тему.

У Claude оставалась прорва протухающих за неделю токенов, и автор решил вернуть ништяк своими руками — через LLM.

Читать далее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6👎1
Чувак за год сварганил целый зоопарк из 33 AI-агентов на одном движке, без единого форка ядра. От няньки-шахматиста для мелкого до зубастых ботов, пашущих на металлургический холдинг и внутреннюю CRM-кухню. Всё это добро крутится в одном Docker-образе и жрёт общую кодовую базу.

И забудь ты про эту вашу магию промптов, подбор идеальной LLM или RAG. Реальная разница между агентом-овощем и боевой машиной упирается в то, как ты разрулил границу: где считает голый код, а где начинается болтовня модели. В статье — без соплей: потроха нескольких агентов, живой код, бенчмарки и конкретные косяки, на которые автор налетел, пока рисовал эту границу.

Читать дальше

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Как автор собирал базу знаний для ИИ-агента и натравливал её на собственные анализы

Годовой чекап прилетел в пятницу к вечеру. Семь простынь, куча показателей за пределами референсов, а ближайший эндокринолог лениво ждёт тебя аж через две недели. Автор (бэкендер, который пилит базу знаний в Искре) поступил как любой уважающий себя технарь: забил на гугл, залил всё в свой же продукт и начал тыкать вопросами.

Сразу предупреждаю о конфликте интересов: база знаний — кусок продукта, который он сам и делает. Так что статья будет не про успешный успех, а про внутренности и откровенно больные места. Никаких сладких од, разбор полётов — что под капотом и где болит. Вся статья здесь: Читать далее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
2
This media is not supported in your browser
VIEW IN TELEGRAM
🖥 Cloudflare выложила в опенсорс свою платформу для ИИ-агентов

Cloudflare OS работает прямо в браузере и позволяет создавать корпоративных ИИ-агентов и приложения, которыми потом сможет пользоваться вся команда.

Внутри — единое рабочее пространство с системой безопасного доступа к внутренним данным компании и возможностью подключать свои скиллы и инструменты.

✖️ xCode Journal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥6😁2
This media is not supported in your browser
VIEW IN TELEGRAM
🗺 Разраб сделал интерактивный мануал, который по шагам показывает, что происходит после нажатия Enter в адресной строке браузера

Внутри прям весь путь запроса: от интерпретации ввода и DNS до TLS, HTTP и рендеринга страницы. Всего 16 этапов и 124 подшага с анимациями и объяснениями.

Всё на русском

✖️ xCode Journal
Please open Telegram to view this post
VIEW IN TELEGRAM
4🔥3
😁 Мы в безопасности?

💥 xCode Journal
😁159
🖐 Бесплатный интенсив по машинному обучению — за неделю от нуля до проекта в портфолио

Про ML слышали все, но те, кто хоть раз пытался разобраться в Машинном обучении самостоятельно знают, что без практики и живого человека рядом теория не превращается в навык.

Симулейтив открыл бесплатный доступ к интенсиву «Основы машинного обучения» — с живыми занятиями и поддержкой ментора. Обычно такое сопровождение стоит 20 000 ₽, сейчас — 0 ₽, без каких-либо скрытых нюансов.

За неделю пройдёте:
🔶введение в анализ данных и pandas
🔶линейные модели и предобработку признаков в sklearn
🔶градиентный бустинг на LightGBM и метрики качества
🔶мини-контесты на Kaggle — это и есть готовые проекты для резюме
🔶итоговый вебинар: как оформить проект и Readme на GitHub, чтобы его было не стыдно показать работодателю

Кто ведёт: Илья Карчмит — специалист по данным в Альфа-Банке, строит модели для антифрода и комплаенса, ведёт семинары по ML в AIMasters при МГУ. Ментор в чате — Валерия Елпатьевская, инженер данных в Альфа-Банке.

Что нужно: ноутбук, браузер и базовое понимание Python. Продвинутая математика не требуется — начинаем с азов.

Записи и задачи останутся у вас после интенсива, выпускники получают сертификат о прохождении!

⚡️ Старт 12 августа!

👉 РЕГИСТРАЦИЯ НА ИНТЕНСИВ
Please open Telegram to view this post
VIEW IN TELEGRAM
3
This media is not supported in your browser
VIEW IN TELEGRAM
⚒️ Реддитор сделал для удаленщиков Manyplace

Это уютное виртуальное пространство, где можно работать, учиться или читать в компании других людей со всего мира. Каждый занимается своим делом, но благодаря присутствию других работать в одиночку уже не так одиноко, а сосредоточиться может быть проще.

Плюс в перерывах можно взаимодействовать с другими пользователями и обмениваться реакциями.

💥 xCode Journal
5
😭 Stack Overflow перешёл в режим read-only

Пользователи пока не могут публиковать новые вопросы и ответы — сайт работает только на чтение. Пишут, что это временно, но, учитывая, что число новых вопросов уже упало ниже тысячи в месяц — не факт, что из режима выведут.

Эпоха уходит на глазах

💥 xCode Journal
🐳145🔥1
Media is too big
VIEW IN TELEGRAM
😎 Разраб сделал из Codex ассистента на iPhone

ИИ сможет читать экран, управлять приложениями и выполнять действия от вашего имени. Общаться с ним можно голосом.

Плагин полностью опенсорс

💥 xCode Journal
🔥82
АЙТИШНИКИ, ХВАТИТ сливать время на прилизанные новости и бесполезные курсы

Проект «ИИнтеллигенция» стал главным каналом для тех, кто использует нейросети на уровне разработки, автоматизации и опенсорса, а не просто балуется в чатах. Здесь собирают только то, что реально экономит человеко-часы и работает в проде.

🎓 Готовые ИИ-сервисы, промпты и ИИ-агенты для автоматизации рутины

🖋 Разборы полезных ИИ-инструментов, локальных LLM и опенсорс-репозиториев

🛠 Практические кейсы, гайды по деплою моделей и интеграции ИИ в пайплайны

⚡️ Технические ИТ-новости без маркетинговой воды и душных отчетов

Обучение и прокачка в реальном времени: работа с API (Claude, GPT), локалки (Ollama, vLLM), автоматизация кода, опенсорс-утилиты, AI-агенты и др.

Ценишь время и работаешь с ИИ, подпишись: @clucai
Please open Telegram to view this post
VIEW IN TELEGRAM
3😁1
🤣 Проблема засела где-то между стулом и компьютером

💥 xCode Journal
Please open Telegram to view this post
VIEW IN TELEGRAM
😁11🐳41🔥1
На Хабре запилили материал про угон цепочек рассуждений у закрытых моделей. Схема до идиотизма простая: зашифрованный кусок от мощной модели пихают слабой версии того же провайдера и требуют дословный пересказ. Так высасывают чужие мысли, включая случайно затесавшиеся пароли и ключи.

Статья заставила отряхнуть пыль с одного древнего ресёрча и продуть парсером свежие сессии. За полгода протокол распух на четыре версии схемы, а внутри нашлась херня, из-за которой у меня к выводам препринта есть поправочка.

Стартую с показа реальной, живой подписи — выдернул её из своей сессии Claude Code полчаса назад.

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
😁3
Ханс Моравек тыкнул пальцем в 2028-й как в дату, когда железяки поумнеют до нашего уровня. И ведь не промазал, похоже.

77-летний старик-робототехник впервые за 20 лет вылез под софиты и разродился большим интервью. Говорит, со скоростями не налажал, но саму суть машинного мозга представлял себе в корне иначе. Реальность нарисовалась совсем другая, веселее некуда.

Это пиздец.

Читать на Habr

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
4😁2
🤣 Железо читерит используя физику

💥 xCode Journal
😁17
Single Task Algorithmic Reasoning Models: маленькая модель против большой LLM — кто кого?

Коллеги уже показали, а мы и сами убедились: в 2026-м отличная reasoning-модель не вывезет на одних текстовых рассуждениях. Чтобы отвечать нормально на большинство вопросов, ей нужны инструменты, мультимодальные рассуждения, а порой и вовсе экзотика вроде рассуждений в латентных представлениях сети.

И ещё: завезли фреймворк STARM для обучения рекурсивных reasoning-моделей. Он заметно уделывает по качеству все предыдущие open source аналоги.

Читать далее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
1
Как ИИ метит текст и как содрать эти вотермарки

В ЕС теперь по закону каждый LLM-провайдер обязан шлёпать метки на всё, что сгенерил ИИ. Claude обновила документацию по своим вотермаркам, но конкретики ноль: ни как они добавляются, ни как их ловить — инструментов тоже не завезли. Автор паникует, что его текст могут принять за генератив, и в статье разбирает, как эти метки устроены и как от них избавиться.

Читать далее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1