Анализ данных (Data analysis)
50.4K subscribers
3.39K photos
414 videos
1 file
2.78K links
Data science, наука о данных.

@haarrp - админ

РКН: clck.ru/3FmyAp
Download Telegram
⚡️ Полезный список лучших инструментов, чтобы запускать мощные LLM полностью бесплатно и локально на своём ноутбуке. Сейчас это №1 в трендах GitHub.

1. AnythingLLM
All-in-one workspace для чата с документами и создания агентов
http://github.com/Mintplex-Labs/anything-llm

2. KoboldCpp
Лёгкий инструмент, особенно хорош для creative writing и сценариев с персонажами
http://github.com/LostRuins/koboldcpp

3. llama.cpp
Базовый движок. Очень эффективный и запускается почти на любом железе
http://github.com/ggml-org/llama.cpp

4. Open WebUI
Удобный веб-интерфейс в стиле ChatGPT, отлично работает с Ollama
http://github.com/open-webui/open-webui

5. GPT4All
Простое desktop-приложение со встроенным чатом по документам
http://github.com/nomic-ai/gpt4all

6. LocalAI
OpenAI-compatible API, который работает на разном железе и поддерживает много backend’ов
http://github.com/mudler/LocalAI

7. vLLM
Быстрый inference engine, когда нужны более быстрые ответы и работа в масштабе
http://github.com/vllm-project/vllm

@data_analysis_ml
17🔥7👍6
Сегодня заканчивается доступ к Fable 5 в подписочном плане, вероятно, на довольно долгий срок.

Anthropic дала понять, что в будущем планирует вернуть Fable в подписку, но конкретную дату не назвала.

Пока хорошей альтернативой выглядит GPT-5.6 Sol, хотя между ними, конечно, есть заметные различия. Но, как я уже несколько раз говорил, лимиты у 5.6 огромные, поэтому сейчас использовать его всё равно получается не так свободно.

В любом случае 5.6 стал крупным релизом и явно дал OpenAI серьёзный рывок относительно Anthropic.

Теперь вопрос в том, как ответит Anthropic. Моя догадка такая:

они очень скоро выпустят Opus 5 как более дешёвую альтернативу Fable 5, надеясь этим успокоить пользователей.
🍌14👍74🔥3😐1
Qwythos-9B-v2 вышел, и это скорее не апгрейд ради бенчмарков, а фикс главной боли

У модели оставили глубокое reasoning-поведение, но почистили самый неприятный баг: зацикливание при greedy decoding упало с 6.7% до 0%.

Также вернули MTP head, поправили identity-behavior и сохранили 1M context через YaRN.

По сути, v2 - это более стабильный Qwythos: не «новая магия», а hygiene release, где модель меньше ломается в реальном использовании.

Из заметного:

- MMLU CoT - 83.8%
- GSM8K - 93.6%
- ARC-Challenge - 96.4%
- GPQA-diamond - 49.0%
- HumanEval pass@1 - 77.4%

Лицензия - Apache-2.0.

Модель построена вокруг Qwen3.5-9B и рассчитана на long-context reasoning, код, анализ и локальные эксперименты.

https://huggingface.co/empero-ai/Qwythos-9B-v2
6👍6😁4🔥3
This media is not supported in your browser
VIEW IN TELEGRAM
🐠 Sakana AI показали интересный переход от красивых симуляций к физическому прототипу распределённого интеллекта.

В работе Smart Cellular Bricks используются простые кубические модули. В каждом модуле работает одна и та же небольшая нейросетевая клеточная модель. У блока нет координат, нет общей карты конструкции и нет центрального управляющего узла. Он обменивается сигналами только с соседними блоками, к которым подключён физически.

За счёт этих локальных обменов вся конструкция постепенно определяет, какую форму она образует, где находится повреждение и каких блоков не хватает для восстановления.

Авторы задаются вопросом - можно ли обученные локальные правила перенести из симуляции в реальное железо. В симуляторе связь идеальная, модули не отваливаются, задержки контролируемые. В физическом прототипе всё в разы сложнее: шум, сбои контактов, ограничения электроники, неполная информация и ошибки передачи.

Одна и та же модель внутри каждого блока позволяет системе получать глобальное поведение без глобального наблюдателя. Отдельный модуль ничего не “понимает” про всю фигуру, но сеть модулей в целом сходится к правильной интерпретации формы.

Такие системы могут быть полезны в модульной робототехнике, самодиагностирующихся конструкциях, адаптивных материалах и инфраструктуре, где централизованный контроль слишком дорогой или ненадёжный.

Работа пока исследовательская, но направление выглядит сильным. ИИ здесь живёт не в одном большом агенте, а распределяется по множеству простых физических элементов, которые вместе начинают вести себя как единая адаптивная система.

Blog: https://sakana.ai/smart-cellular-bricks
Paper: https://nature.com/articles/s41467-026-75166-7
9👍6🔥3
⚡️ Демис Хассабис обычно не из тех, кто разгоняет хайп вокруг AGI.

Он годами был скорее умеренным голосом в индустрии: осторожные прогнозы, меньше громких обещаний, больше науки и проверки результатов. Поэтому его новый текст звучит особенно сильно.

Хассабис пишет, что AGI нельзя сравнивать с интернетом или смартфонами. По масштабу это ближе к электричеству или огню. Технология, которая меняет не отдельную индустрию, а саму логику развития цивилизации.

По его оценке, эффект может быть в десять раз больше промышленной революции и пройти в десять раз быстрее.

Да, AGI может резко ускорить медицину, физику, биологию, материалы, энергетику. Но Хассабис прямо говорит и о другой стороне: киберриски уже реальны, дальше могут появиться угрозы в био- и других чувствительных областях, а отдельная проблема - агентные системы, которые становятся всё автономнее.

Гонка за возможностями идёт быстрее, чем наше понимание того, как это безопасно контролировать.

Когда человек уровня Хассабиса говорит, что нужна серьёзная регуляторная инфраструктура уже в ближайшие годы, это звучит совсем иначе, чем очередной пост про сингулярность.

https://x.com/Machinelearrn/status/2076985021752082689
👍95🔥3
DeepSeek собрали гайд по подключению своих моделей к coding tools

Полезная находка для тех, кто хочет использовать DeepSeek не в отдельном чате, а прямо внутри привычных инструментов.

В репозитории есть инструкции для:

* Claude Code
* Cline
* Codex
* GitHub Copilot
* Cherry Studio
* Crush
* OpenCode
* Qwen Code
* DeepSeek-TUI
* других agent/coding-assistant инструментов

Каждый гайд проходит базовый путь: установка, конфиг, первый запуск.

Идея простая: можно быстро подключить DeepSeek-V4-Pro или V4-Flash к своему рабочему процессу и проверить, насколько хорошо они тянут агентное кодинг-окружение.

github.com/deepseek-ai/awesome-deepseek-agent
👍20🥰32
🤖У нас есть ИИ дома
Узнайте, как запустить корпоративный ИИ в собственном контуре за 2 недели

Не готовы мириться с ограничениями и дырами в безопасности при использовании публичных ИИ-сервисов, но разворачивать собственную инфраструктуру для инференса долго и тяжело? Присоединяйтесь к вебинару от Selectel и узнайте, как быстро запускать и масштабировать ИИ в собственном контуре без крупных капитальных затрат.

В программе вебинара:

🔹Модели развертывания ИИ-инфраструктуры и причины выбора решений на собственной площадке.
🔹Обзор возможностей и сценариев применения нового сервиса AIBox от Selectel, Yandex Cloud и Metamentor — развертывания локального ИИ в контуре клиента на базе серверов Selectel.
🔹Разбор реальных бизнес-кейсов.

📍 Онлайн
23 июля в 12:00


Регистрируйтесь и ускорьте внедрение ИИ в компании ➡️ https://slc.tl/fzw6h

Больше мероприятий для ИТ-специалистов в канале @selectel_events. Подписывайтесь!

Реклама. АО "Селектел". erid:2W5zFGUVJrM
3
Кто-то разобрал Claude Code почти до винтика

learn-coding-agent - репозиторий для тех, кто хочет понять, как устроены современные coding agents не на уровне промо-страниц, а на уровне архитектуры.

Автор собрал разбор Claude Code по публичным источникам: цикл агента, систему инструментов, разрешения, работу с контекстом, сессии, подпроцессы, MCP, удалённые настройки, телеметрию и скрытые флаги.

Получился не “гайд по использованию”, а карта внутренней логики CLI-агента: как он принимает решение, когда просит разрешение, как вызывает инструменты, как хранит историю и как расширяется через внешние интеграции.

https://github.com/justxor/Claudecourse/
20🔥10👍8❤‍🔥2
OpenAI показала, как модели начинают прокачивать безопасность друг друга.

Новый проект называется GPT-Red. Это внутренний red-teaming агент, который специально обучают ломать другие модели: искать prompt injection, обходы, утечки через tools, браузер, файлы и подключённые приложения.

Главная идея: человеческий red team важен, но он плохо масштабируется. Люди не могут бесконечно генерировать тысячи разных атак под каждый новый агентный сценарий. Поэтому OpenAI обучает отдельную модель-атакующего, которая сама пробует атаки, смотрит на ответ модели и улучшает стратегию.

Получается self-play для безопасности: один агент атакует, другой учится не ломаться.

По данным OpenAI, GPT-Red находил успешные атаки в 84% новых сценариев против GPT-5.1, тогда как human red-teamers - в 13%. После использования этих атак в обучении GPT-5.6 Sol стал заметно устойчивее к prompt injection: OpenAI пишет про 6× fewer failures на самом сложном бенчмарке.

GPT-Red пока не выпускают для всех. Это не продукт, а внутренний инструмент, потому что модель специально натренирована на вредные сценарии.

https://openai.com/index/unlocking-self-improvement-gpt-red/
13🔥10👍6
Теперь можно запускать Thinking Machines Inkling локально.

Это огромная open-модель на 975B параметров с поддержкой текста, изображений, аудио и контекста до 1M токенов. На Hugging Face её описывают как мультимодальную модель с 41B активных параметров и поддержкой agentic-сценариев.

Unsloth уже выложила GGUF-кванты и гайд по запуску. Самый жёсткий вариант — Dynamic 1-bit, который режет размер примерно на 86% и требует около 270–290 ГБ RAM/VRAM для запуска.

Главный момент не в том, что модель «маленькая».

Она всё ещё гигантская.

Но 1-bit-квантизация делает локальный запуск таких монстров хотя бы технически реалистичным для очень мощных машин.

Для тех, кто тестирует локальные агенты, мультимодальные пайплайны и long-context задачи, Inkling выглядит как модель, которую точно стоит потрогать.

Guide: https://unsloth.ai/docs/models/inkling
GGUF: https://huggingface.co/unsloth/inkling-GGUF
🤨7👍54🔥3🤔1
Forwarded from Machinelearning
Kimi K3 только что появилась в Kimi Code CLI

В документации Kimi Code уже есть новая модель Kimi K3 - её называют самым сильным flagship-моделем Kimi на сегодня. Упор: кодинг, игры/3D и knowledge-задачи.

Что интересно по спекам:

* model ID: k3
* контекст: до 1M токенов
* reasoning сейчас только на max
* low и high обещают добавить позже
* на Moderato доступно до 256K
* до 1M открывается на Allegretto и выше

Переключиться можно прямо в Kimi Code CLI через команду /model. Для VS Code — через dropdown в поле ввода.

Нюанс для сторонних coding agents: если хотите полный контекст K3, вручную ставьте context window 1048576, потому что часть инструментов по умолчанию режет окно меньше максимума.

kimi.com/code/docs/en/kimi-code/models
🔥105👍5
CLI-Anything: как дать AI-агентам руки для обычных приложений

Идея простая: CLI-Anything генерирует командные интерфейсы для реального софта, чтобы агент мог не «тыкать мышкой», а вызывать понятные команды.

Так можно управлять CAD-инструментами, 3D-редакторами, редакторами субтитров, браузером, Blender, FreeCAD, GIMP, Inkscape, Obsidian, Kdenlive, OBS и другими приложениями. В репозитории уже есть десятки agent-harness’ов под разные программы.

Как это выглядит:

* агент получает задачу
* вызывает CLI
* приложение делает работу
* результат можно проверить и повторить

Есть и CLI-Hub: установка через pip install cli-anything-hub, дальше можно ставить готовые CLI через cli-hub install <name>.

GitHub: https://github.com/HKUDS/CLI-Anything
19🔥10👍6
NVIDIA выкатили Nemotron 3 Embed — семейство open-моделей для RAG, agentic retrieval, code retrieval и памяти агентов.

Флагман Nemotron-3-Embed-8B-BF16 заявлен как SOTA на multilingual RTEB на 16 июля 2026 года. Это retrieval-бенчмарк: он показывает, насколько хорошо embedding-модель находит нужный контекст для RAG.

Почему это важно для агентов?

Когда retrieval промахивается, агент получает мусорный контекст. Дальше начинаются лишние поиски, длиннее reasoning, больше токенов и выше счёт за inference.

В линейке три модели:

* 8B-BF16 — максимум качества
* 1B-BF16 — дешевле и быстрее для продакшена
* 1B-NVFP4 — версия под Blackwell/vLLM, квантованная через NVIDIA Model Optimizer

Все модели работают с входом до 32K токенов, то есть могут индексировать длинные документы, код и agent history без слишком агрессивной нарезки.

У 1B-NVFP4 на RTEB почти тот же результат, что у BF16: 72.00 против 72.38, при этом модель остаётся совместимой по embedding-space с 1B-BF16.

https://huggingface.co/blog/nvidia/nemotron-3-embed-wins-rteb
4👍3
🎓 Хотите в ШАД, но не знаете, с чего начать?

На курсе ShadHelper мы помогаем выстравивать подготовку по понятному плану: закрывать необходимые темы по математике и алгоритмам, разбирать задачи вступительных и получать обратную связь преподавателей.

Новый поток курса «Подготовка к ШАД» уже начался, но сейчас идёт вводная часть. Поэтому до 19 июля включительно ещё можно присоединиться к группе без сильного отставания.

На время добора мы открыли бесплатный тестовый доступ к материалам и занятиям текущего потока.

Вы сможете посмотреть:
- как выстроена программа подготовки;
- какие темы и задачи разбирают на курсе;
- как преподаватели дают обратную связь;
- подходит ли вам темп и формат обучения.

Если формат вам подойдёт, сможете присоединиться к текущей группе и продолжить обучение.

👉 Посмотреть курс изнутри

Реклама ООО "ШВМ",
ИНН: 5638076560 Erid: 2VtzqxUcqML
👍21
Математика без попсы: три бесплатных книги для тех, кто хочет настоящий фундамент

Три бесплатные книги Аллена Хатчера по математике

Если хочется нормального фундамента по топологии, K-theory и теории чисел, у Аллена Хатчера есть отличный бесплатный набор.

1. Algebraic Topology
Классический учебник по алгебраической топологии. Книга вышла в Cambridge University Press, но онлайн-версия доступна бесплатно по соглашению с издателем. На сайте есть полный PDF, главы отдельно, исправления и дополнительные упражнения.
https://pi.math.cornell.edu/~hatcher/AT/AT.pdf

Дополнительно: Spectral Sequences - отдельная расширенная глава к этой книге.
https://pi.math.cornell.edu/~hatcher/AT/ATch5.pdf

2. Vector Bundles & K-Theory
Короткая книга про векторные расслоения, топологическую K-теорию и характеристические классы. Сейчас онлайн выложено около 120 страниц: основы vector bundles, часть K-theory, Bott periodicity, characteristic classes и stable J-homomorphism.
https://pi.math.cornell.edu/~hatcher/VBKT/VB.pdf

3. Topology of Numbers
Необычное введение в теорию чисел через геометрию и картинки. Много внимания уделено квадратичным формам, диаграмме Фарея, цепным дробям, уравнению Пелля, quadratic reciprocity и topograph Конвея. PDF примерно на 350 страниц доступен бесплатно.
https://pi.math.cornell.edu/~hatcher/TN/TNbook.pdf
13🔥6👍3