Вокруг Kubernetes в VK
4.33K subscribers
231 photos
6 videos
401 links
Делимся новостями из мира Kubernetes и DevOps. А еще рассказываем про кластеры K8s в облаке VK Cloud https://cloud.vk.com/containers

Мы в MAX: https://max.ru/k8s_vk
Download Telegram
Почему оператора недостаточно для on-prem DBaaS

Инструменты Kubernetes умеют создавать базы данных, настраивать репликацию, масштабирование и переключение на резервную реплику. Но для DBaaS этого мало: разным командам нужны единые правила обновлений, восстановления из бэкапов и соблюдения политик.

Когда каждая команда самостоятельно выстраивает эти процессы, решения начинают дублироваться: у команд появляются свои API, правила обновлений, восстановления и эксплуатации.

🤝 Что должно быть между командой и инфраструктурой

Чтобы не собирать отдельное DBaaS-решение для каждой команды, нужен слой абстракции между запросом разработчика и конкретным способом создания базы. Он отделит запрос на базу от способа ее создания.

Разработчик описывает нужный сервис через привычные ресурсы Kubernetes. Платформенная команда выбирает, какой бэкенд выполнит этот запрос: оператор, собственная автоматизация или управляемый облачный сервис.

При этом бэкенд можно менять, не заставляя разработчиков осваивать новый способ работы.

Что добавляет Klutch.iо

Open source-проект Klutch.iо адаптирует модель service broker для Kubernetes. Разработчики создают запросы в локальных кластерах, а платформенная команда централизованно выбирает способ их выполнения и нужный бэкенд.

В статье разбираем, почему модель Open Service Broker не закрепилась в Kubernetes и как Klutch.iо пытается приблизить экосистему к общему стандарту DBaaS.

Читайте 👉 на Хабре

📬 Мы в MAX
Please open Telegram to view this post
VIEW IN TELEGRAM
5🔥3👏3
🧩 Три мастер-ноды и несколько реплик еще не делают Kubernetes-кластер отказоустойчивым. Сервис может пережить отказ одной ноды или потерять данные из томов.

В статье разбираем, как распределять реплики между зонами с topologySpreadConstraints, зачем нужен PodDisruptionBudget и почему снапшот etcd не заменяет бэкап данных приложений.

Отдельно показываем, что берет на себя Managed Kubernetes, а что остается зоной ответственности команды.

👉 Читайте в блоге

📬 Мы в MAX
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥53👏2🤔1
Forwarded from VK Cloud
📣 27 августа в Москве проведем Cloud Sessions — технический митап про облака, платформы и инфраструктуру.

В программе — доклады с реальными инженерными кейсами, с которыми сталкиваются разработчики и архитекторы при развитии облачной инфраструктуры. Например, вы узнаете, как команда VK Cloud написала свой планировщик ядра на eBPF и победила steal time в облаке.

После докладов вас ждет афтепати с пиццей и нетворкингом: в кулуарах можно обсудить то, что не уместилось на слайдах, и задать вопросы спикерам напрямую.

Кому будет полезно:

 🔹 Инженерам разработки облачных и сетевых сервисов, платформенным разработчикам

🔹 DevOps- и SRE-инженерам, SysOps, системным администраторам и архитекторам

🔹 Руководителям отделов разработки облачных, сетевых и инфраструктурных сервисов.

Когда и где

🗓️ 27 августа с 18:00 до 00:00
📍 Ленинградский проспект, 39, бизнес-центр Skylight, Б1

Митап бесплатный, но необходима регистрация.

☝️ Количество мест ограничено

📬 Мы в МАХ
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3👏3
Kuber Conf от АОТ — первая в России некоммерческая комьюнити‑конференция по Kubernetes.

💙Обсудим все самое актуальное: AI и облачную инфраструктуру, экономику платформ и безопасность в эпоху LLM, эксплуатацию Kubernetes и наблюдаемость, сети и Service Mesh, а также железо, ЦОДы и bare metal‑инфраструктуру. Особый акцент в этом году будет на экономике платформ.

Зоны для нетворкинга и неформального общения, а также стенды и активности от партнеров тоже будут.

🤩 Кому будет полезно?

Инфраструктурным инженерам и администраторам / DevOps, архитекторам платформ и сервисов, разработчикам платформ на базе k8s, а также специалистам по ИБ (DevSecOps).

😎 А выступить можно?

Да. Рассмотрим доклады по теме конференции: AI и облачная инфраструктура, экономика платформ, безопасность в эпоху LLM, Platform Engineering, эксплуатация Kubernetes, наблюдаемость и другим. Подробный список — на сайте.


🗓 22 октября
📍Москва, конгресс‑пространство Connect

👉Регистрируйтесь и подавайте заявки на выступление.
4👍3🔥3
Media is too big
VIEW IN TELEGRAM
Просто напоминаем, что в следующий четверг проведем технический митап про облака, платформы и инфраструктуру — Cloud Sessions.

Поделимся реальными инженерными кейсами. Об одном из них расскажет Юлия Санжаровская, инфраструктурный архитектор VK Cloud.

🗓️ 27 августа
📍 Ленинградский проспект, 39, бизнес-центр Skylight, Б1
🕰 Начало в 18:00

👉Регистрируйтесь по ссылке.
3🔥3🥰3
This media is not supported in your browser
VIEW IN TELEGRAM
На демо LLM-инференс может работать быстро, а под реальной нагрузкой — получить растущий p99, очередь запросов и внезапный OOM.

Причем проблемы проявляются не сразу: когда p99 уже начинает расти, средняя задержка еще может быть нормальной.

В статье разбираем четыре механизма такой деградации:

🌟фрагментация KV-cache
🌟нехватка памяти на длинном контексте
🌟блокировка очереди при батчинге
🌟разрыв между p50 и p99.

👀 Главное — этот процесс можно заметить заранее. Средней задержки для этого мало. Нужны gpu_cache_usage, p99 задержки между токенами, глубина очереди, счетчик вытеснений и preemption.

Отдельно показываем, как подобрать параметры батчинга под свой трафик и почему оптимизации вроде PagedAttention не отменяют наблюдения за памятью и хвостовыми задержками.

В статье есть примеры расчетов для разных контекстов и скрипты для проверки KV-кэш, OOM, батчинга и хвостовой латентности на собственной инфраструктуре.

👉 Читайте на Хабре

📬 Мы в MAX
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥43👏2🤔1
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥5👏43
Уже сегодня в 19:00 встречаемся на Cloud Sessions!

С нетерпением ждем начала и готовимся обсуждать кейсы вместе с инженерами из VK Cloud и Dodo Engineering.

Спикеры:
🔹 Владимир Вдовин, Principal Engineer VK Cloud — о steal time и планировщике ядра на eBPF
🔹 Юлия Санжаровская, инфраструктурный архитектор VK Cloud — о том, как масштабировать облако в условиях дефицита серверного железа
🔹 Павел Притчин, CTO Dodo Engineering — о том, как удалось ускорить разработку в 1,5 раза с помощью агентов


💻 Подключайтесь к онлайн-трансляции по ссылке.

💬 Вопросы спикерам оставляйте в комментариях под этим постом. Будем собирать их по ходу встречи и передавать экспертам.

Если не успеем озвучить ваш вопрос во время митапа, спикеры ответят на него в чате после мероприятия 💙

📲 Мы в MAX
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍2🔥2
🤔 Как защитить Kubernetes-кластер от сбоев и ошибок конфигурации?

Для production-кластеров, состояние которых важно быстро восстановить, в Managed Kubernetes доступен аддон Velero. Он настраивает резервное копирование workloads, namespace и Kubernetes-объектов, а копии хранит в VK Object Storage.

С какими задачами поможет Velero?

🔹Резервное копирование: сохраняйте состояние workloads, namespace и других Kubernetes-объектов.

🔹Быстрое восстановление: возвращайте кластер в рабочее состояние после сбоев, ошибок конфигурации, неудачных релизов или инцидентов с данными.

🔹Надежное хранение: бэкапы лежат в отдельном объектном хранилище VK Object Storage независимо от жизненного цикла кластера.

🪄 Как активировать?

Установите аддон velero во вкладке «Аддоны» кластера в панели управления VK Cloud, указав бакет и ключи доступа к VK Object Storage.

👉 Подробности — по ссылке.

📬 Мы в MAX
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥2💯2
В Managed Kubernetes доступна новая версия Kubernetes 1.35.

Обновление приносит актуальные исправления безопасности и стабильности, улучшает работу платформы и снижает риски эксплуатации, а также упрощает дальнейшие обновления и использование новых возможностей экосистемы Kubernetes.

Почему стоит обновиться

🔹Работая на актуальной версии, вы снижаете риски, связанные с уязвимостями и нестабильностью устаревших версий оркестратора.

🔹Упрощается переход на будущие обновления и новую функциональность экосистемы Kubernetes.

❗️Важно: на старте новая версия доступна кластерам, которые уже работают на новой версии оркестратора. Для кластеров на старой версии обновление выйдет позже.

Подробности — по ссылке.

📬 Мы в MAX
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3🎉3👏1
💙 Ingress в Kubernetes: выбор контроллера, маршрутизация и TLS

Ingress кажется простой точкой входа в Kubernetes, пока не появляются дополнительные маршруты, TLS и настройки конкретного контроллера.

Разобрали три важных аспекта:
🔵как этот ресурс обрабатывает трафик
🔵что учитывать при маршрутизации и TLS
🔵откуда берется зависимость от контроллера.

👉 Подробнее в нашем блоге

📬 Мы в MAX
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍4🔥4
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥53💯3
Forwarded from VK Cloud
⚡️У АОТ появился первый экспертный совет

В него вошли девять ведущих практиков в области облачно-ориентированных технологий и Kubernetes. От VK Cloud в совете Алексей Волков, руководитель продуктовой команды Developer Productivity.

🤓 Эксперты будут определять технологическую стратегию ассоциации и подключаться к ее отраслевым инициативам.

Одна из первых задач — работа в программном комитете Kuber Conf 2026. Совет примет участие в отборе докладов для конференции и представит свой взгляд на развитие облачно-ориентиованных технологий.

Что именно будет делать совет и какие направления эксперты он объединяет — в карточках. Подробности — по ссылке.

📬 Мы в МАХ
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3👍2😐1
🤖 Для ИИ-задач часто нужны значительные ресурсы, но постоянно держать их занятыми не получается. Во время обучения модели мощностей требуется больше, между запусками — меньше. Поэтому важно уметь быстро перераспределять ресурсы между задачами и командами.

Kubernetes решает сразу две задачи: помогает эффективнее использовать GPU и упрощает управление инфраструктурой.

➡️ Подробнее о том, как Kubernetes используют для ИИ-задач и какую роль здесь играет Managed Kubernetes, читайте на Хабре.

📬 Мы в MAX
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3👏3