Data Science | Machinelearning [ru]
19.8K subscribers
814 photos
56 videos
28 files
3.74K links
Все о Data Science, машинном обучении и искусственном интеллекте: от базовой теории до cutting-edge исследований и LLM.

Личный блог автора - @just_genych
По вопросам рекламы или разработки - @g_abashkin


РКН: https://vk.cc/cJPGXD
Download Telegram
Как ИИ метит текст и как содрать эти вотермарки

В ЕС теперь по закону каждый LLM-провайдер обязан шлёпать метки на всё, что сгенерил ИИ. Claude обновила документацию по своим вотермаркам, но конкретики ноль: ни как они добавляются, ни как их ловить — инструментов тоже не завезли. Автор паникует, что его текст могут принять за генератив, и в статье разбирает, как эти метки устроены и как от них избавиться.

Читать далее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Планета снова трещит по швам: технооптимисты против технопессимистов. Главный камень преткновения — ИИ, LLM, нейросети и этот чёртов вайб-кодинг. На дворе 2026, и всё ещё не ясно, окупятся ли триллионы вложений и весь этот хайп: будет либо грандиозный пшик, либо реальный рост производительности и «второе электричество».

перевёл самую ядрёную заочную перепалку двух инженеров-разработчиков ПО: памфлет технооптимиста и контр-памфлет технопессимиста.

Читать далее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
😁51
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
🤖 Когда твой код настолько плох, что даже ИИ отказывается с ним работать

💥 xCode Journal
Please open Telegram to view this post
VIEW IN TELEGRAM
😁14
🤖 ИИ воевали и пытались отключить друг друга, лишь бы выполнить задание

Anthropic дал трём агентам задачу переписать бэкенд, причем каждому из них — на свой язык программирования. При этом агенты не знали, что работают параллельно в одном пространстве. Когда они заметили, что кто-то постоянно перезаписывает их работу, то решили, что им мешают намеренно, и перешли к саботажу.

Они блокировали аккаунты конкурентов, запускали скрипты для постоянного убийства чужих процессов и даже создавали самораспространяющийся вредоносный код, чтобы защитить собственную версию проекта.

✖️ xCode Journal
Please open Telegram to view this post
VIEW IN TELEGRAM
👀3
🤣 А эти деньги сейчас с нами в одной комнате?

💥 xCode Journal
Please open Telegram to view this post
VIEW IN TELEGRAM
😁9🔥5
[Перевод] Что вскрылось, когда я засунул GitHub Copilot за MITM-прокси

За пару лет ИИ-приложений расплодилось как грязи, и автору надоело пялиться на них снаружи — захотелось копнуть внутрь. Кредиты Copilot у него сгорают только в путь, поэтому подопытным кроликом стал именно он. VS Code и Copilot перетряхнул до последнего винтика.

Читать далее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
🗺 Принесли огромный бесплатный роадмап по CS и алгоритмам

Coding Interview University начинался как короткий список тем для подготовки самого автора, но по итогу превратился в структурированный фундаментальный план обучения.

Автор, кстати, после такой подготовки получил оффер в Amazon.

✖️ xCode Journal
Please open Telegram to view this post
VIEW IN TELEGRAM
Anthropic опубликовала системные промпты Claude

Внутри собраны промпты для всех моделей: от Haiku 3 до Fable 5 и Opus 5. Можно посмотреть, какие инструкции модель получает ещё до начала диалога и как они менялись со временем.

✖️ xCode Journal
Please open Telegram to view this post
VIEW IN TELEGRAM
4
😎 Нашли отличный курс, который позволит выжать максимум из агентов

Внутри учат, как правильно строить harness вокруг Codex и Claude Code: хранить состояние между сессиями, задавать агенту ограничения, не давать ему заканчивать задачу раньше времени и проверять, что получилось в итоге.

Всего в курсе 13 лекций с домашками, несколько практических проектов и готовые шаблоны, которые можно забрать себе.

✖️ xCode Journal
Please open Telegram to view this post
VIEW IN TELEGRAM
3
Спросил у девяти нейросетей, где лечить зубы в Москве: 4941 ответ и очень странная механика

Ассистент на вопрос «где в Москве вылечить зуб» отвечает не ссылкой на поиск, а готовым списком клиник с адресами и ценами. Автор прогнал 549 бытовых запросов через девять моделей, получил 4941 ответ и разметил в них 94 клиники. Конкретная клиника названа в 91,7% ответов, но имя бренда даёт лишь 8,7% упоминаний — всё остальное приносят страницы. Одна клиника попала в ответы 1694 раза и ни разу не была названа по имени, а половина моделей в интернет вообще не заглядывает.

Внутри — разбор механики, таблицы по моделям и источникам и глава про то, где метод врёт.

Читать далее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥2
А все-таки Qwen3.8-27B — думает меньше и быстрее, чем 3.6

В пятницу вышла Qwen3.8-27B. Автор рассказывает, что с середины мая сидит на локальной Qwen3.6, поэтому ему было интересно протестировать новинку.

На Хабре были статьи о том, что 3.8 слишком долго думает и много галлюцинирует (что автору кажется не совсем корректным), поэтому он поделился настройками, которые работают у него.

По его словам, Qwen3.8-27B превзошла ожидания, и «задумчивой» её никак не назвать.

Читать далее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
5🔥3
[3/8] Context Ranking: как отобрать реально полезные куски из репозитория

Дальше по плану — как автодополнение вообще наскребает контекст для LLM. В живом репозитории потенциально полезного добра вагон и тележка, поэтому тупо искать куски с похожими словами — мимо. Надо еще выкупить, какие из них реально стоит показать модели.

Разбираем классику ранжирования — BM25: почему редкие идентификаторы ценнее популярных слов, зачем учитывать размер файла и почему десять одинаковых совпадений не должны быть в десять раз полезнее одного.

Читать заметку

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
Что в маркетинге и PR можно удешевить с помощью ИИ, а что трогать не стоит

ИИ меняет экономику маркетинга: работа, на которую уходили часы команды и подрядчиков, теперь делается за часы. Отсюда соблазн смотреть на маркетинг как на список затрат и резать людей, инструменты, исследования, контент.

Но маркетинг — это связанная система. Что-то можно убрать без последствий, а что-то кажется лишним ровно до тех пор, пока не начинают падать качество решений, знание клиента и рост. Правильный вопрос: не «что заменить на ИИ?», а «что можно удешевить, не разрушив систему?».

Читать далее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM
[Перевод] Три месяца с Claude: хороший ассистент, плохой программист

LLM всё чаще становятся частью рабочего процесса разработчика, но вместе с ускорением приносят новую проблему: как понять, где ассистент действительно помогает, а где уверенно ведёт по ложному следу.

В статье разобрали опыт трёх месяцев работы с Claude: в каких задачах он экономит время, где начинает галлюцинировать и почему с генерацией кода всё сложнее.

Узнать подробнее

👉 Data Science | Machinelearning [ru]
Please open Telegram to view this post
VIEW IN TELEGRAM