dcgm-exporter - эспортер prometheus метрик для NVIDIA GPU DCGMhttps://github.com/NVIDIA/dcgm-exporter
Grafana дашбоард: https://grafana.com/grafana/dashboards/12239
опубликовано в @gitgate
#moni #nvidia #dcgm #exporter #prometheus
👍8🔥5
nvidia-fan-control - утилита Linux для мониторинга температуры графического процессора и динамического управления скоростью вращения вентиляторов графического процессора NVIDIA с использованием NVML.Требования:
- графические процессоры
NVIDIA с поддержкой NVML
- драйверы NVIDIA 520 или вышеhttps://github.com/ZanMax/nvidia-fan-control
опубликовано в @gitgate
#nvidia #cli #utils #moni
GitHub
GitHub - ZanMax/nvidia-fan-control: Nvidia Fan Control for linux
Nvidia Fan Control for linux. Contribute to ZanMax/nvidia-fan-control development by creating an account on GitHub.
👍10🔥6
GPU-hot - панель мониторинга
Возможности:
- показатели в реальном времени (менее секунды)
- автоматическое определение наличия нескольких графических процессоров
- мониторинг процессов (PID-регуляторы, использование памяти)
- исторические графики (использование, температура, мощность, время)
- системные показатели (процессор, оперативная память)
- масштабирование от 1 до 100+ графических процессоров
Метрики:
- использование
- температура
- память
- потребляемая мощность
- скорость вращения вентилятора
- тактовые частоты
- информация о PCIe, P-State
- состояние ограничения нагрузки
- сессии кодировщика/декодера.
https://github.com/psalias2006/gpu-hot
Опубликовано в @gitgate
#mini #nvidia #webui
SSH не требуется.Возможности:
- показатели в реальном времени (менее секунды)
- автоматическое определение наличия нескольких графических процессоров
- мониторинг процессов (PID-регуляторы, использование памяти)
- исторические графики (использование, температура, мощность, время)
- системные показатели (процессор, оперативная память)
- масштабирование от 1 до 100+ графических процессоров
Метрики:
- использование
- температура
- память
- потребляемая мощность
- скорость вращения вентилятора
- тактовые частоты
- информация о PCIe, P-State
- состояние ограничения нагрузки
- сессии кодировщика/декодера.
https://github.com/psalias2006/gpu-hot
Опубликовано в @gitgate
#mini #nvidia #webui
👍18🔥5
This media is not supported in your browser
VIEW IN TELEGRAM
nbd-vram - используйте видеопамять вашей видеокарты NVIDIA в качестве пространства подкачки в Linux.Проект создан для ноутбуков с гибридной графикой, с припаянной памятью и без возможности апгрейда. Дисплей работает от встроенного графического процессора
AMD/ATI. Видеокарта NVIDIA большую часть времени простаивает, её видеопамять полностью не используется. Это позволяет использовать видеопамять в качестве высокоприоритетного файла подкачки.Порядок переполнения: сначала заполняется ОЗУ, затем видеопамять поглощает излишки (
PCIe), затем zram сжимает оставшуюся память (CPU), затем SSD только если все остальное исчерпано.https://github.com/c0deJedi/nbd-vram
Опубликоввано в @gitgate
#swap #gpu #laptop #linux #memory #nbd #nvidia #vram
👍10🔥5
vLLM - простой, быстрый и недорогой сервис LLM для всех.vLLM обеспечивает бесперебойную поддержку более 200 архитектур моделей на платформе HuggingFace, включая:-
LLM-ы, работающие только с декодером (например, Llama, Qwen, Gemma)-
Mixture-of-Expert LLMs (например, Mixtral, DeepSeek-V3, Qwen-MoE, GPT-OSS).- гибридные модели (например,
Mamba, Qwen3.5)- мультимодальные модели (например,
LLaVA, Qwen-VL, Pixtral)- модели встраивания и поиска (например,
E5-Mistral, GTE, ColBERT)- reward модели и модели классификации (например,
Qwen-Math)Возможности:
- бесшовная интеграция с популярными моделями
Hugging Face.- высокопроизводительное обслуживание с использованием различных алгоритмов декодирования, включая параллельную выборку, поиск по лучу и другие.
- параллельная обработка тензоров, конвейеров, данных, экспертов и контекста для распределенного вывода
- потоковые выходы
- генерация структурированных выходных данных с использованием
xgrammar или guidance- парсеры вызова инструментов и логических рассуждений
- сервер
API, совместимый с OpenAI, а также поддержка Anthropic Messages API и gRPC.- эффективная поддержка нескольких
LoRA для плотных и MoE-слоев.- поддержка графических процессоров
NVIDIA, AMD и процессоров x86/ARM/PowerPC. Кроме того, поддерживаются различные аппаратные плагины, такие как Google TPU, Intel Gaudi, IBM Spyre, Huawei Ascend, Rebellions NPU, Apple Silicon, MetaX GPU и другие.https://github.com/vllm-project/vllm
Опубликоввано в @gitgate
#ai #llm #api #openai #grpc #nvidia #amd #cpu
🔥5👍3