DevOps от первого лица
698 subscribers
209 photos
23 videos
154 links
Пишу реальные истории из АйТи о том как:
👨‍💻 пишу код
🏗 строю инфраструктуру
🧨 шатаю продакшен

Полезные заметки: https://byurrer.ru/
Download Telegram
🏭 Купил еще 2 видеокарты:
- Gigebyte RTX 3090 Gaming OC 24gb (первый скрин)
- Tesla V100 16gb в кастомном корпусе (четвертый скрин)

💶 Карта от Gigabyte оказалась примерно аналогичной по производительности для инференса что и Asus Rog Strix, но более компактная и менее прожорливая, апгрейд CPU покажет более точные результаты. Пока картой доволен, если предположения подтвердятся то карта от Gigabyte будет самым рациональным вариантом для домашнего инференса: тихая и экономная, хотя в этом рейтинге она занимает аж 6 место, в отличии от первенства Asus Rog Strix.

🕹 Tesla V100 16gb по габаритам меньше, но тяжелее на 100г, сверху есть цифровой датчик температуры, а при нагрузке турбина начинает сильно гудеть. В инференсе конечно же эта карта проигрывает RTX 3090 примерно на 10%. Взял потому что мне было интересно что эта за штука такая, теперь буду на ней запускать маленькие модели на другом сервере.

🦄 Кстати, удалось запустить gpt-oss-120b на 2 RTX 3090 + Tesla V100 16gb, только с маленьким контекстом в 4096 (может и больше получится, не проверял), а в полном контексте 128к загрузка модели на видеокарты фэйлится - видеопамяти не хватает, можно попробовать что-то оставлять на CPU.

🚚 Минимально укомплектовал свой стенд для работы с ИИ (второй скрин): 3 RTX 3090 на которых крутится инференс для gpt-oss-120b со скоростью ~100т/с.
Для полного питания всех карт не хватает PCIE проводов, поэтому каждая карта может работать максимум на 250ватт, иначе полный отвал карты с дальнейшей ручной перезагрузкой. Энергопотребление ограничил так (с автоматизацией через systemd):
nvidia-smi -pl 250


🎢 На одном из фото видно где я вставил в стенд все видеокарты что у меня есть (кроме CMP 40HX) и запитал блоком питания True Miner на 1800ватт, все завелось и работало нормально, но шум от БП мешает.

Дальше для апгрейда:
✔️ CPU, потому что двухядерный Celeron здесь явно узкое место, нужно подобрать что-то из Intel Core 11 поколения
✔️ блок питания, пока присмотрел Azerty 1200w, есть позитивный опыт эксплуатации
✔️ возможно потребуются угловые PCIE коннекторы типа таких

🚀 Первоначальная загрузка модели на видеокарты занимала ~4 минуты, точнее запуск сервера llamacpp. Подключил NVMe диск через PCIE-переходник (m2-слот отказался работать на плате) удалось ускорить запуск сервера до ~2 минут 30 секунд. Очень надеюсь что замена CPU сократит это время еще больше и увеличит скорость инференса.

🙈 Tesla P40 высвободилась, теперь ей и Tesla V100 16gb (итого 40гб видеопамяти) (последний скрин) нужно будет найти применение 👀
🔥12👍1
🚀 Установка драйвера NVIDIA  580 на Debian 12 – простой гайд для любых поколений видеокарт для запуска ИИ: Ampere (RTX 3090), Turing (Tesla V100) и Pascal (Tesla P40) 🥳

🔧 Почему стоит прочитать:
- Тема обкатана мной на нескольких серверах, в том числе и не на моих
- Вы избежите типичных проблем (Secure Boot, nouveau, nvidia-smi not found).
- Всё объяснено на примерах, без лишних терминов.

💬 Почему это важно: без правильного драйвера ваш сервер не сможет запускать модели ИИ, а мой гайд избавит от часов проб и ошибок. В следующем посте я покажу, как развернуть локальную модель ИИ, используя уже готовый драйвер.

📦 Docker‑плюс: дополнительно подготовим Docker чтобы через готовые контейнеры ИИ без лишних заморочек в виде ручной сборки и компиляции - все будет просто

👉 https://byurrer.ru/debian-nvidia-driver
1🔥82👍1
🚀 Хотите запустить свою локальную модель ИИ на домашнем сервере? Я собрал проверенный рецепт и написал инструкцию!

🔧 Что получаете:
- Параллельные чаты (-np) без очередей
- Чистый вывод размышлений (--jinja --reasoning-format auto)
- Авторизацию через --api-key – ваш API теперь защищён
- docker‑compose.yml для запуска одной командой, а как скачивать модель тоже покажу
- метрики с примерами возможных графиков в Grafana

🔥 И даже затронем тему распределения модели на несколько видеокарт!

👉 Подробнее, со скриншотами: https://byurrer.ru/llamacpp-guide
16👍41🔥1
🔀 Проброс SSH к GitLab через внешнюю VM без публичного IP

🙈 Немного подевопсим с сетями :)

Недавно развернул себе Gitlab на локальном сервере и захотелось мне его прокинуть наружу, не имея внешнего IP. Тут то я и познакомился с NAT поближе, оказалось не так сложно как я думал.

В статье кратко разберем:
🔀🌐 что такое NAT и зачем он нам нужен
➡️🖥 как поочередно пробросить трафик от ssh через несколько машин
🧪🔍 как все это дело тестировать и отлаживать

👉 https://byurrer.ru/iptables-nat-gitlab
👍52
Попробовал на выходных ComfyUI 🛋, несколько моделей для генерации картинок и видео из промпта. Особенно впечатлила модель wan2.2, при помощи которой я оживил 3 фото:

1️⃣ экскурсия на заводе БалАЗ (2025 год) 🏭, где машина превращается в Оптимуса Прайма 🤖
2️⃣ выход из гипсовых штолен в Камском Устье (2024 год) ⛏️, здесь нас ждет инопланетное вторжение 👽
3️⃣ прогулка по тем же штольням, но за нами уже следует чужой 🕵️‍♂️

🚀 Все это генерировалось быстро НА ЛОКАЛЬНОМ СЕРВЕРЕ, без облаков! Причем, это первый мой опыт генерации видео 🎥

⚠️Сначала генерировал на Tesla V100 + 16 ГБ ОЗУ, через несколько часов и несколько OOM поставил RTX 3090 + 64 ГБ ОЗУ, и этого вполне хватило. Собираю второй сервер для генерации картинок/видео.

Первое видео генерировалось примерно 250‑300 секунд. Последнее за ~550с

🐏 Скорость получения пользовательского опыта зависит от скорости генерации видео, поэтому, чтобы быстрее понять, как нужно работать с моделью, нужно ставить минимальное разрешение – мне хватило 240×240. Так генерация будет быстрее и вы сможете получить обратную связь на ваш промпт, а после того как в маленьком разрешении получите ожидаемый результат, можно переключиться на большее разрешение и подождать завершения генерации.

🦧 Провозился целый день и понял, что модели не поддерживают промпты с последовательным сценарием, как минимум те, что разворачиваются локально. Нужны простые действия на сцену/воркфлоу 🛠, а затем из последнего кадра сцены генерировать другое видео 🎞 и сшивать.

Надо дальше изучать построение воркфлоу в ComfyUI, тема заинтересовала 🤩
1🔥153👍1
DevOps от первого лица
Мои исследования локального развертывании ИИ продолжаются, на этот раз я собрал стенд в своей домашней лаборатории. 🥳 Купил NVIDIA Tesla P40 для расширения опыта с ИИ. В простое потребление ~120ватт, а при инференсе ~290ватт. Это совсем другой уровень…
❄️ Кастомизация охлаждения Tesla P40

Собрал воедино накопившиеся материалы по кастомизации охлаждения на видеокарте Tesla P40, о том как я одомашил эту серверную карту. В статье разбираю:
❄️ проблема охлаждения Tesla P40
🏠 почему серверным турбинам нет места для домашней сборки
🔎 поиск и подбор альтернатив для кастомизации охлаждения, а именно подбор систем охлаждения с видеокарт 1080 и p104-100
🛠 как закастомить обдув, ведь на Tesla P40 нет коннектора для питания вентиляторов
📊 драйверы, использование в ИИ, сравнение производительности с RTX 3090 и перспективы Tesla P40

Безусловно, карта устарела, но если она найдется по очень выгодной цене, то ее нужно как-то адаптировать под домашние условия, эта статья как раз поможет это сделать.

👉 https://byurrer.ru/tesla-p40-custom
👍9
🚀 Написал статью и смонтировал видео как я собирал тестовый стенд из трех видеокарт и запускал модель gpt-oss-120b.

Внутри поговорим про:
🎮 3 разные видеокарты: RTX 3090 TI KFA2, ASUS Rog Strix RTX 3090, Tesla P40
🧩 как это все разместить на материнской плате
🔌 как это все запитать
📊 результаты запуска, сколько в итоге выдает токенов в секунду

👉 Видео: https://youtu.be/yTNmruYj9BU
👉 Текст: https://byurrer.ru/vga3-first-test
1👍7🔥3
🧾 Расшифровка звука через Whisper локально

🧐 Еще в прошлом году я наткнулся на транскрибацию звука, но так и не разобрался в ней толком. А сейчас понадобилось встроить к себе в OpenWebUI функцию расшифровки голосовых сообщений + диаризировать несколько длинных звукозаписей.

👨‍💻 Перебрал несколько опенсорных проектов, разобрался в пользовательской теории. Оказывается там другая сфера ИИ, не такая как у LLM.

📊 В конце статьи подготовил сводную таблицу с характеристиками и скоростью обработки тестового семпла. Для облегчения принятия решения привел примеры использования и наиболее подходящий вариант.

👉 Собрал все свои поиски и исследования в краткий обзор с примерами: https://byurrer.ru/whisper-ai
1🔥53👍2
DevOps от первого лица
Попробовал на выходных ComfyUI 🛋, несколько моделей для генерации картинок и видео из промпта. Особенно впечатлила модель wan2.2, при помощи которой я оживил 3 фото: 1️⃣ экскурсия на заводе БалАЗ (2025 год) 🏭, где машина превращается в Оптимуса Прайма 🤖 2️⃣
🚀 ComfyUI Быстрый старт

Добрался до написания инструкции по ComfyUI при помощи которого можно генерировать изображения и видео, причем все это можно делать локально без облаков.

Внутри много контента, а если по сути то:
начнем с примеров, чтобы было интересно, там будут промпты и результаты
🖥 кратко затронем железо
⚙️ установим ComfyUI
🧠 разберем теорию генерации контента
🧩 посмотрим на шаблоны workflow и загрузим модели для локального запуска

👉 https://byurrer.ru/comfyui-quick-start
🔥5
Несколько раз я уже упоминал что работаю над сборкой домашней лаборатории для ИИ на базе материнской платы для майнинга. Именно такой вектор я выбрал из-за цены комплектующих (без учета видеокарт), они дешевые.

🎉 И вот теперь я все докупил/дособирал/прокачал по максимуму и логически завершил эту веху - стенд полностью готов и не нуждается в доработках.

Расписал весь пройденный путь и показал результаты здесь:
🚀 посмотреть видео на youtube
👉 почитать на хабре

💶 В конце видео/статьи есть расчеты финансовых затрат на итоговую сборку, без учета расходов, которые не вошли в эту самую сборку. Так как все делается на энтузиазме из личного финансирования, то я старался рационально распоряжаться бюджетом.

Если вы задумывались о персональном приватном ИИ, то теперь вы можете увидеть сколько денег это потребует. А все инструкции по настройке и развертыванию вы можете найти у меня на сайте:
- Установка NVIDIA‑драйвера на Debian
- Запуск локальных модели ИИ через llama.cpp
- Запуск gpt-oss-120b на трех видеокартах

⁉️ Если у вас есть вопросы по сборке пишите в комментариях.
🔥172👍1