🏭 Купил еще 2 видеокарты:
-
-
💶 Карта от
🕹
🦄 Кстати, удалось запустить
🚚 Минимально укомплектовал свой стенд для работы с ИИ (второй скрин):
Для полного питания всех карт не хватает
🎢 На одном из фото видно где я вставил в стенд все видеокарты что у меня есть (кроме
Дальше для апгрейда:
✔️
✔️ блок питания, пока присмотрел
✔️ возможно потребуются угловые
🚀 Первоначальная загрузка модели на видеокарты занимала
🙈
-
Gigebyte RTX 3090 Gaming OC 24gb (первый скрин)-
Tesla V100 16gb в кастомном корпусе (четвертый скрин)💶 Карта от
Gigabyte оказалась примерно аналогичной по производительности для инференса что и Asus Rog Strix, но более компактная и менее прожорливая, апгрейд CPU покажет более точные результаты. Пока картой доволен, если предположения подтвердятся то карта от Gigabyte будет самым рациональным вариантом для домашнего инференса: тихая и экономная, хотя в этом рейтинге она занимает аж 6 место, в отличии от первенства Asus Rog Strix.🕹
Tesla V100 16gb по габаритам меньше, но тяжелее на 100г, сверху есть цифровой датчик температуры, а при нагрузке турбина начинает сильно гудеть. В инференсе конечно же эта карта проигрывает RTX 3090 примерно на 10%. Взял потому что мне было интересно что эта за штука такая, теперь буду на ней запускать маленькие модели на другом сервере.🦄 Кстати, удалось запустить
gpt-oss-120b на 2 RTX 3090 + Tesla V100 16gb, только с маленьким контекстом в 4096 (может и больше получится, не проверял), а в полном контексте 128к загрузка модели на видеокарты фэйлится - видеопамяти не хватает, можно попробовать что-то оставлять на CPU.🚚 Минимально укомплектовал свой стенд для работы с ИИ (второй скрин):
3 RTX 3090 на которых крутится инференс для gpt-oss-120b со скоростью ~100т/с.Для полного питания всех карт не хватает
PCIE проводов, поэтому каждая карта может работать максимум на 250ватт, иначе полный отвал карты с дальнейшей ручной перезагрузкой. Энергопотребление ограничил так (с автоматизацией через systemd):nvidia-smi -pl 250
🎢 На одном из фото видно где я вставил в стенд все видеокарты что у меня есть (кроме
CMP 40HX) и запитал блоком питания True Miner на 1800ватт, все завелось и работало нормально, но шум от БП мешает.Дальше для апгрейда:
✔️
CPU, потому что двухядерный Celeron здесь явно узкое место, нужно подобрать что-то из Intel Core 11 поколения✔️ блок питания, пока присмотрел
Azerty 1200w, есть позитивный опыт эксплуатации✔️ возможно потребуются угловые
PCIE коннекторы типа таких🚀 Первоначальная загрузка модели на видеокарты занимала
~4 минуты, точнее запуск сервера llamacpp. Подключил NVMe диск через PCIE-переходник (m2-слот отказался работать на плате) удалось ускорить запуск сервера до ~2 минут 30 секунд. Очень надеюсь что замена CPU сократит это время еще больше и увеличит скорость инференса.🙈
Tesla P40 высвободилась, теперь ей и Tesla V100 16gb (итого 40гб видеопамяти) (последний скрин) нужно будет найти применение 👀🔥12👍1
🚀 Установка драйвера NVIDIA 580 на Debian 12 – простой гайд для любых поколений видеокарт для запуска ИИ:
🔧 Почему стоит прочитать:
- Тема обкатана мной на нескольких серверах, в том числе и не на моих
- Вы избежите типичных проблем (Secure Boot, nouveau, nvidia-smi not found).
- Всё объяснено на примерах, без лишних терминов.
💬 Почему это важно: без правильного драйвера ваш сервер не сможет запускать модели ИИ, а мой гайд избавит от часов проб и ошибок. В следующем посте я покажу, как развернуть локальную модель ИИ, используя уже готовый драйвер.
📦 Docker‑плюс: дополнительно подготовим Docker чтобы через готовые контейнеры ИИ без лишних заморочек в виде ручной сборки и компиляции - все будет просто ✨
👉 https://byurrer.ru/debian-nvidia-driver
Ampere (RTX 3090), Turing (Tesla V100) и Pascal (Tesla P40) 🥳🔧 Почему стоит прочитать:
- Тема обкатана мной на нескольких серверах, в том числе и не на моих
- Вы избежите типичных проблем (Secure Boot, nouveau, nvidia-smi not found).
- Всё объяснено на примерах, без лишних терминов.
💬 Почему это важно: без правильного драйвера ваш сервер не сможет запускать модели ИИ, а мой гайд избавит от часов проб и ошибок. В следующем посте я покажу, как развернуть локальную модель ИИ, используя уже готовый драйвер.
📦 Docker‑плюс: дополнительно подготовим Docker чтобы через готовые контейнеры ИИ без лишних заморочек в виде ручной сборки и компиляции - все будет просто ✨
👉 https://byurrer.ru/debian-nvidia-driver
1🔥8❤2👍1
🚀 Хотите запустить свою локальную модель ИИ на домашнем сервере? Я собрал проверенный рецепт и написал инструкцию!
🔧 Что получаете:
- Параллельные чаты (
- Чистый вывод размышлений (
- Авторизацию через
-
- метрики с примерами возможных графиков в Grafana
🔥 И даже затронем тему распределения модели на несколько видеокарт!
👉 Подробнее, со скриншотами: https://byurrer.ru/llamacpp-guide
🔧 Что получаете:
- Параллельные чаты (
-np) без очередей- Чистый вывод размышлений (
--jinja --reasoning-format auto)- Авторизацию через
--api-key – ваш API теперь защищён-
docker‑compose.yml для запуска одной командой, а как скачивать модель тоже покажу- метрики с примерами возможных графиков в Grafana
🔥 И даже затронем тему распределения модели на несколько видеокарт!
👉 Подробнее, со скриншотами: https://byurrer.ru/llamacpp-guide
1❤6👍4✍1🔥1
🔀 Проброс SSH к GitLab через внешнюю VM без публичного IP
🙈 Немного подевопсим с сетями :)
Недавно развернул себе Gitlab на локальном сервере и захотелось мне его прокинуть наружу, не имея внешнего
В статье кратко разберем:
🔀🌐 что такое
➡️🖥 как поочередно пробросить трафик от ssh через несколько машин
🧪🔍 как все это дело тестировать и отлаживать
👉 https://byurrer.ru/iptables-nat-gitlab
🙈 Немного подевопсим с сетями :)
Недавно развернул себе Gitlab на локальном сервере и захотелось мне его прокинуть наружу, не имея внешнего
IP. Тут то я и познакомился с NAT поближе, оказалось не так сложно как я думал.В статье кратко разберем:
🔀🌐 что такое
NAT и зачем он нам нужен➡️🖥 как поочередно пробросить трафик от ssh через несколько машин
🧪🔍 как все это дело тестировать и отлаживать
👉 https://byurrer.ru/iptables-nat-gitlab
👍5✍2
Попробовал на выходных ComfyUI 🛋, несколько моделей для генерации картинок и видео из промпта. Особенно впечатлила модель wan2.2, при помощи которой я оживил 3 фото:
1️⃣ экскурсия на заводе БалАЗ (2025 год) 🏭, где машина превращается в Оптимуса Прайма 🤖
2️⃣ выход из гипсовых штолен в Камском Устье (2024 год) ⛏️, здесь нас ждет инопланетное вторжение 👽
3️⃣ прогулка по тем же штольням, но за нами уже следует чужой 🕵️♂️
🚀 Все это генерировалось быстро НА ЛОКАЛЬНОМ СЕРВЕРЕ, без облаков! Причем, это первый мой опыт генерации видео 🎥
⚠️Сначала генерировал на
⏳ Первое видео генерировалось примерно
🐏 Скорость получения пользовательского опыта зависит от скорости генерации видео, поэтому, чтобы быстрее понять, как нужно работать с моделью, нужно ставить минимальное разрешение – мне хватило
🦧 Провозился целый день и понял, что модели не поддерживают промпты с последовательным сценарием, как минимум те, что разворачиваются локально. Нужны простые действия на сцену/воркфлоу 🛠, а затем из последнего кадра сцены генерировать другое видео 🎞 и сшивать.
Надо дальше изучать построение воркфлоу в ComfyUI, тема заинтересовала 🤩
1️⃣ экскурсия на заводе БалАЗ (2025 год) 🏭, где машина превращается в Оптимуса Прайма 🤖
2️⃣ выход из гипсовых штолен в Камском Устье (2024 год) ⛏️, здесь нас ждет инопланетное вторжение 👽
3️⃣ прогулка по тем же штольням, но за нами уже следует чужой 🕵️♂️
🚀 Все это генерировалось быстро НА ЛОКАЛЬНОМ СЕРВЕРЕ, без облаков! Причем, это первый мой опыт генерации видео 🎥
⚠️Сначала генерировал на
Tesla V100 + 16 ГБ ОЗУ, через несколько часов и несколько OOM поставил RTX 3090 + 64 ГБ ОЗУ, и этого вполне хватило. Собираю второй сервер для генерации картинок/видео.⏳ Первое видео генерировалось примерно
250‑300 секунд. Последнее за ~550с 🐏 Скорость получения пользовательского опыта зависит от скорости генерации видео, поэтому, чтобы быстрее понять, как нужно работать с моделью, нужно ставить минимальное разрешение – мне хватило
240×240. Так генерация будет быстрее и вы сможете получить обратную связь на ваш промпт, а после того как в маленьком разрешении получите ожидаемый результат, можно переключиться на большее разрешение и подождать завершения генерации.🦧 Провозился целый день и понял, что модели не поддерживают промпты с последовательным сценарием, как минимум те, что разворачиваются локально. Нужны простые действия на сцену/воркфлоу 🛠, а затем из последнего кадра сцены генерировать другое видео 🎞 и сшивать.
Надо дальше изучать построение воркфлоу в ComfyUI, тема заинтересовала 🤩
1🔥15❤3👍1
DevOps от первого лица
⏳ Мои исследования локального развертывании ИИ продолжаются, на этот раз я собрал стенд в своей домашней лаборатории. 🥳 Купил NVIDIA Tesla P40 для расширения опыта с ИИ. В простое потребление ~120ватт, а при инференсе ~290ватт. Это совсем другой уровень…
❄️ Кастомизация охлаждения Tesla P40
Собрал воедино накопившиеся материалы по кастомизации охлаждения на видеокарте Tesla P40, о том как я одомашил эту серверную карту. В статье разбираю:
❄️ проблема охлаждения
🏠 почему серверным турбинам нет места для домашней сборки
🔎 поиск и подбор альтернатив для кастомизации охлаждения, а именно подбор систем охлаждения с видеокарт
🛠 как закастомить обдув, ведь на
📊 драйверы, использование в ИИ, сравнение производительности с
Безусловно, карта устарела, но если она найдется по очень выгодной цене, то ее нужно как-то адаптировать под домашние условия, эта статья как раз поможет это сделать.
👉 https://byurrer.ru/tesla-p40-custom
Собрал воедино накопившиеся материалы по кастомизации охлаждения на видеокарте Tesla P40, о том как я одомашил эту серверную карту. В статье разбираю:
❄️ проблема охлаждения
Tesla P40🏠 почему серверным турбинам нет места для домашней сборки
🔎 поиск и подбор альтернатив для кастомизации охлаждения, а именно подбор систем охлаждения с видеокарт
1080 и p104-100🛠 как закастомить обдув, ведь на
Tesla P40 нет коннектора для питания вентиляторов📊 драйверы, использование в ИИ, сравнение производительности с
RTX 3090 и перспективы Tesla P40Безусловно, карта устарела, но если она найдется по очень выгодной цене, то ее нужно как-то адаптировать под домашние условия, эта статья как раз поможет это сделать.
👉 https://byurrer.ru/tesla-p40-custom
👍9
🚀 Написал статью и смонтировал видео как я собирал тестовый стенд из трех видеокарт и запускал модель
Внутри поговорим про:
🎮 3 разные видеокарты:
🧩 как это все разместить на материнской плате
🔌 как это все запитать
📊 результаты запуска, сколько в итоге выдает токенов в секунду
👉 Видео: https://youtu.be/yTNmruYj9BU
👉 Текст: https://byurrer.ru/vga3-first-test
gpt-oss-120b.Внутри поговорим про:
🎮 3 разные видеокарты:
RTX 3090 TI KFA2, ASUS Rog Strix RTX 3090, Tesla P40🧩 как это все разместить на материнской плате
🔌 как это все запитать
📊 результаты запуска, сколько в итоге выдает токенов в секунду
👉 Видео: https://youtu.be/yTNmruYj9BU
👉 Текст: https://byurrer.ru/vga3-first-test
YouTube
Запуск gpt-oss-120b на трех видеокартах RTX 3090 TI, RTX 3090 и Tesla P40
Собираем тестовый стенд из подручных средств и запускаем gpt-oss-120b на трех разных видеократах через llamacpp на Debian 12 в docker-контейнере.
Рассмотрим компоненты сборки, как запитать, и какие результаты получаются в итоге.
#ai #chatgpt #ии #gpt #rtx3090…
Рассмотрим компоненты сборки, как запитать, и какие результаты получаются в итоге.
#ai #chatgpt #ии #gpt #rtx3090…
1👍7🔥3
🧾 Расшифровка звука через Whisper локально
🧐 Еще в прошлом году я наткнулся на транскрибацию звука, но так и не разобрался в ней толком. А сейчас понадобилось встроить к себе в OpenWebUI функцию расшифровки голосовых сообщений + диаризировать несколько длинных звукозаписей.
👨💻 Перебрал несколько опенсорных проектов, разобрался в пользовательской теории. Оказывается там другая сфера ИИ, не такая как у
📊 В конце статьи подготовил сводную таблицу с характеристиками и скоростью обработки тестового семпла. Для облегчения принятия решения привел примеры использования и наиболее подходящий вариант.
👉 Собрал все свои поиски и исследования в краткий обзор с примерами: https://byurrer.ru/whisper-ai
🧐 Еще в прошлом году я наткнулся на транскрибацию звука, но так и не разобрался в ней толком. А сейчас понадобилось встроить к себе в OpenWebUI функцию расшифровки голосовых сообщений + диаризировать несколько длинных звукозаписей.
👨💻 Перебрал несколько опенсорных проектов, разобрался в пользовательской теории. Оказывается там другая сфера ИИ, не такая как у
LLM.📊 В конце статьи подготовил сводную таблицу с характеристиками и скоростью обработки тестового семпла. Для облегчения принятия решения привел примеры использования и наиболее подходящий вариант.
👉 Собрал все свои поиски и исследования в краткий обзор с примерами: https://byurrer.ru/whisper-ai
1🔥5✍3👍2
DevOps от первого лица
Попробовал на выходных ComfyUI 🛋, несколько моделей для генерации картинок и видео из промпта. Особенно впечатлила модель wan2.2, при помощи которой я оживил 3 фото: 1️⃣ экскурсия на заводе БалАЗ (2025 год) 🏭, где машина превращается в Оптимуса Прайма 🤖 2️⃣…
🚀 ComfyUI Быстрый старт
Добрался до написания инструкции по ComfyUI при помощи которого можно генерировать изображения и видео, причем все это можно делать локально без облаков.
Внутри много контента, а если по сути то:
✨ начнем с примеров, чтобы было интересно, там будут промпты и результаты
🖥 кратко затронем железо
⚙️ установим ComfyUI
🧠 разберем теорию генерации контента
🧩 посмотрим на шаблоны workflow и загрузим модели для локального запуска
👉 https://byurrer.ru/comfyui-quick-start
Добрался до написания инструкции по ComfyUI при помощи которого можно генерировать изображения и видео, причем все это можно делать локально без облаков.
Внутри много контента, а если по сути то:
✨ начнем с примеров, чтобы было интересно, там будут промпты и результаты
🖥 кратко затронем железо
⚙️ установим ComfyUI
🧠 разберем теорию генерации контента
🧩 посмотрим на шаблоны workflow и загрузим модели для локального запуска
👉 https://byurrer.ru/comfyui-quick-start
🔥5
DevOps от первого лица
🚀 ComfyUI Быстрый старт Добрался до написания инструкции по ComfyUI при помощи которого можно генерировать изображения и видео, причем все это можно делать локально без облаков. Внутри много контента, а если по сути то: ✨ начнем с примеров, чтобы было интересно…
Нагенерировал контента для статьи, по ссылке есть промпты, чтобы повторить результат самостоятельно.
1🔥8
Несколько раз я уже упоминал что работаю над сборкой домашней лаборатории для ИИ на базе материнской платы для майнинга. Именно такой вектор я выбрал из-за цены комплектующих (без учета видеокарт), они дешевые.
🎉 И вот теперь я все докупил/дособирал/прокачал по максимуму и логически завершил эту веху - стенд полностью готов и не нуждается в доработках.
Расписал весь пройденный путь и показал результаты здесь:
🚀 посмотреть видео на youtube
👉 почитать на хабре
💶 В конце видео/статьи есть расчеты финансовых затрат на итоговую сборку, без учета расходов, которые не вошли в эту самую сборку. Так как все делается на энтузиазме из личного финансирования, то я старался рационально распоряжаться бюджетом.
Если вы задумывались о персональном приватном ИИ, то теперь вы можете увидеть сколько денег это потребует. А все инструкции по настройке и развертыванию вы можете найти у меня на сайте:
- Установка NVIDIA‑драйвера на Debian
- Запуск локальных модели ИИ через llama.cpp
- Запуск gpt-oss-120b на трех видеокартах
⁉️ Если у вас есть вопросы по сборке пишите в комментариях.
🎉 И вот теперь я все докупил/дособирал/прокачал по максимуму и логически завершил эту веху - стенд полностью готов и не нуждается в доработках.
Расписал весь пройденный путь и показал результаты здесь:
🚀 посмотреть видео на youtube
👉 почитать на хабре
💶 В конце видео/статьи есть расчеты финансовых затрат на итоговую сборку, без учета расходов, которые не вошли в эту самую сборку. Так как все делается на энтузиазме из личного финансирования, то я старался рационально распоряжаться бюджетом.
Если вы задумывались о персональном приватном ИИ, то теперь вы можете увидеть сколько денег это потребует. А все инструкции по настройке и развертыванию вы можете найти у меня на сайте:
- Установка NVIDIA‑драйвера на Debian
- Запуск локальных модели ИИ через llama.cpp
- Запуск gpt-oss-120b на трех видеокартах
⁉️ Если у вас есть вопросы по сборке пишите в комментариях.
🔥17❤2👍1