Media is too big
VIEW IN TELEGRAM
❓Что выбрать при проектировании: синхронное или асинхронное взаимодействие?
Синхронное:
1️⃣ Клиент не может продолжать работу без ответа от сервера;
2️⃣ Простота разработки и отладки приоритетнее масштабируемости и высокой пропускной способности;
3️⃣ Транзакционность - жесткая последовательность исполняемых операций.
Асинхронное:
1️⃣ Исполнение длительных операций;
2️⃣ Требуется высокая пропускная способность и масштабируемость интеграции;
3️⃣ Необходимость снижения связности компонентов системы;
4️⃣ Исполнение фоновых задач.
Системный анализ | Дмитрий Помаскин
Синхронное:
1️⃣ Клиент не может продолжать работу без ответа от сервера;
2️⃣ Простота разработки и отладки приоритетнее масштабируемости и высокой пропускной способности;
3️⃣ Транзакционность - жесткая последовательность исполняемых операций.
Асинхронное:
1️⃣ Исполнение длительных операций;
2️⃣ Требуется высокая пропускная способность и масштабируемость интеграции;
3️⃣ Необходимость снижения связности компонентов системы;
4️⃣ Исполнение фоновых задач.
Системный анализ | Дмитрий Помаскин
🔥9👍5
Как вы смотрите на онлайн-встречу в небольшой группе (от 4 до 6 человек)?
1. Один интенсив — одна тема и необходимый уровень. Например, "Проектирование БД (junior)".
2. Дату и время я объявлю заранее, а также открою запись.
3. Длительность — 3-4 часа.
Как будет проходить онлайн-занятие:
1. Теоретическая часть (20-30 минут).
2. Практическая: разбираем подробно несколько кейсов (20-30 минут).
3. Самостоятельная работа: участники решают практические задания (60-90 минут).
4. Итоги: вместе проверяем решения всех участников с разбором каждого варианта (60-90 минут).
Все материалы (запись конференции, задания с моими исправлениями и презентация) остаются вам.
Системный анализ | Дмитрий Помаскин
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥17👍8👏1
Интересен ли вам такой формат прокачки навыков? ☝️
Anonymous Poll
75%
Да, можно быстро прокачаться в нужных темах
7%
Нет, предпочитаю комплексные курсы
17%
Какое обучение? Я тут за контентом :)
Media is too big
VIEW IN TELEGRAM
🚩Кейс: Балансировка нагрузки на консьюмерах (Back Pressure на примере Apache Kafka)
⚠️ Чтобы консьюмер не пытался обработать больше сообщений, чем позволяют его ресурсы, необходимо ограничить количество одновременно получаемых сообщений.
1️⃣ Отключить автоматический коммит оффсета на консьюмере. Коммитить оффсет вручную, только после успешной обработки полученных сообщений.
2️⃣ Установить параметр max.poll.records для ограничения числа сообщений, получаемых консьюмером за один раз — батч.
3️⃣ Убедиться, что консьюмер успевает обработать весь батч за отведённое время, установленное в параметре max.poll.interval.ms (по умолчанию 5 минут).
Системный анализ | Дмитрий Помаскин
⚠️ Чтобы консьюмер не пытался обработать больше сообщений, чем позволяют его ресурсы, необходимо ограничить количество одновременно получаемых сообщений.
1️⃣ Отключить автоматический коммит оффсета на консьюмере. Коммитить оффсет вручную, только после успешной обработки полученных сообщений.
2️⃣ Установить параметр max.poll.records для ограничения числа сообщений, получаемых консьюмером за один раз — батч.
3️⃣ Убедиться, что консьюмер успевает обработать весь батч за отведённое время, установленное в параметре max.poll.interval.ms (по умолчанию 5 минут).
Системный анализ | Дмитрий Помаскин
🔥9👍6
Media is too big
VIEW IN TELEGRAM
❓Есть ли гарантия доставки при использовании брокеров?
⚠️ На самом деле, брокеры не гарантируют нам доставку.
Они гарантируют, что сообщение не потеряется на уровне транспорта.
Для того, чтобы обеспечить гарантию доставки, нужны:
✅ Гарантия отправки сообщения продюсером - паттерн Transactional Outbox;
✅ Гарантия обработки сообщения консьюмером - механизм Back Pressure.
Чтобы не искать, ссылки тут👇
🔸Transactional Outbox;
🔸Back Pressure в RabbitMQ;
🔸Back Pressure в Apache Kafka.
Системный анализ | Дмитрий Помаскин
⚠️ На самом деле, брокеры не гарантируют нам доставку.
Они гарантируют, что сообщение не потеряется на уровне транспорта.
Для того, чтобы обеспечить гарантию доставки, нужны:
✅ Гарантия отправки сообщения продюсером - паттерн Transactional Outbox;
✅ Гарантия обработки сообщения консьюмером - механизм Back Pressure.
Чтобы не искать, ссылки тут
🔸Transactional Outbox;
🔸Back Pressure в RabbitMQ;
🔸Back Pressure в Apache Kafka.
Системный анализ | Дмитрий Помаскин
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥8👍4
(Напоминаю, что продолжительность в районе 3-х часов)
Anonymous Poll
47%
Будние дни, после 19:00 МСК
60%
Выходные дни
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
❓Что такое партиционирование в БД?
ℹ️ Партиционирование — это метод разделения больших таблиц в базе данных на меньшие, более управляемые части для повышения производительности и упрощения работы с данными.
Основные типы партиционирования:
✅ По диапазону - данные разделяются по диапазону значений (например, по датам);
✅ По значениям - разделение по конкретным значениям атрибутов (например, по регионам);
✅ По хэшу - равномерное распределение по партициям с помощью хэш-функции.
P.S. Завтра расскажу реальный кейс, основанный на партиционировании.
Системный анализ | Дмитрий Помаскин
ℹ️ Партиционирование — это метод разделения больших таблиц в базе данных на меньшие, более управляемые части для повышения производительности и упрощения работы с данными.
Основные типы партиционирования:
✅ По диапазону - данные разделяются по диапазону значений (например, по датам);
✅ По значениям - разделение по конкретным значениям атрибутов (например, по регионам);
✅ По хэшу - равномерное распределение по партициям с помощью хэш-функции.
P.S. Завтра расскажу реальный кейс, основанный на партиционировании.
Системный анализ | Дмитрий Помаскин
🔥12👍6
Media is too big
VIEW IN TELEGRAM
🚩Кейс: Очистка устаревших данных в БД.
❌ Простой запрос на поиск устаревших данных может быть медленным и тяжеловесным на больший объемах.
✅ Удаление целой партиции - почти мгновенная операция, гораздо быстрее, чем DELETE по условию. Вместо удаления каждой записи, СУБД просто "отцепляет" партицию как отдельную таблицу (аналог DROP).
Алгоритм реализации:
1️⃣ Создаем партиции по необходимым периодам, например ежедневно или ежемесячно;
2️⃣ Процедура очистки находит партиции, подходящие по критерий "устаревших";
3️⃣ Партиция удаляется целиком, без поиска записей внутри неё.
P.S. Лучше делать ночью, так как в момент операции таблица блокируется целиком. Это нужно для согласованности метаданных.
P.P.S. Если вы пропустили пост про партиционирование, жмите сюда :)
Системный анализ | Дмитрий Помаскин
❌ Простой запрос на поиск устаревших данных может быть медленным и тяжеловесным на больший объемах.
✅ Удаление целой партиции - почти мгновенная операция, гораздо быстрее, чем DELETE по условию. Вместо удаления каждой записи, СУБД просто "отцепляет" партицию как отдельную таблицу (аналог DROP).
Алгоритм реализации:
1️⃣ Создаем партиции по необходимым периодам, например ежедневно или ежемесячно;
2️⃣ Процедура очистки находит партиции, подходящие по критерий "устаревших";
3️⃣ Партиция удаляется целиком, без поиска записей внутри неё.
P.S. Лучше делать ночью, так как в момент операции таблица блокируется целиком. Это нужно для согласованности метаданных.
P.P.S. Если вы пропустили пост про партиционирование, жмите сюда :)
Системный анализ | Дмитрий Помаскин
🔥10👍5
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥17👍5
Media is too big
VIEW IN TELEGRAM
🚩Кейс: Построение отчетов по регионам.
ℹ️ Для решения такой задачи необходимо создавать партиции по ключу региона, это даст вам ряд преимуществ:
✅ Запрос от пользователя из конкретного региона будет сканировать только его партицию, что значительно ускорит построение отчета;
✅ Изоляция ресурсов при получении запросов по разным регионам в одно и тоже время;
✅ Партиция может полностью поместиться в локальный кэш, что существенно ускорит повторные запросы.
P.S. Не забывайте, что база для построения отчетов должна быть изолирована. Пост на эту тему тут.
Системный анализ | Дмитрий Помаскин
ℹ️ Для решения такой задачи необходимо создавать партиции по ключу региона, это даст вам ряд преимуществ:
✅ Запрос от пользователя из конкретного региона будет сканировать только его партицию, что значительно ускорит построение отчета;
✅ Изоляция ресурсов при получении запросов по разным регионам в одно и тоже время;
✅ Партиция может полностью поместиться в локальный кэш, что существенно ускорит повторные запросы.
P.S. Не забывайте, что база для построения отчетов должна быть изолирована. Пост на эту тему тут.
Системный анализ | Дмитрий Помаскин
🔥6👍2
Media is too big
VIEW IN TELEGRAM
🚩Кейс: Партиционирование при проведении A/B-тестирования.
ℹ️ Для удобной оценки эффективности новых алгоритмов лучше всего создавать партиции по сегментам пользователей. Тех пользователей, которые работают со старыми алгоритмами, относим в сегмент А. Тех, кто работает с новыми, относим в сегмент Б.
Таким образом получим:
✅ Быстрые выборки при агрегации метрик внутри сегмента (исследуемого алгоритма);
✅ Моментальное удаление тестовых данных после завершения тестирования.
Системный анализ | Дмитрий Помаскин
ℹ️ Для удобной оценки эффективности новых алгоритмов лучше всего создавать партиции по сегментам пользователей. Тех пользователей, которые работают со старыми алгоритмами, относим в сегмент А. Тех, кто работает с новыми, относим в сегмент Б.
Таким образом получим:
✅ Быстрые выборки при агрегации метрик внутри сегмента (исследуемого алгоритма);
✅ Моментальное удаление тестовых данных после завершения тестирования.
Системный анализ | Дмитрий Помаскин
👍6🔥5
🔸Что такое партиционирование в БД?
🔸Очистка устаревших данных в БД.
🔸Построение отчетов по регионам.
🔸Партиционирование при проведении A/B-тестирования.
P.S. Если вам было бы интересно в таком же формате послушать про шардирование, то ставьте 👍.
Системный анализ | Дмитрий Помаскин
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13🔥9
Так как голоса о днях проведения разделились, запускаю 2 группы:
🔸Воскресенье 20.07 12:00 МСК;
🔸Понедельник 21.07 19:00 МСК.
Тема: Базы данных.
Уровень: С нуля.
Кол-во участников: до 4.
Программа:
✅ Типы баз данных;
✅ Проектирование БД;
✅ Описание БД с помощью ER-диаграммы;
✅ Нормализация;
✅ Базовый SQL для аналитиков.
Практика:
✅ Самостоятельное проектирование БД для сервиса;
✅ Описание этой БД с помощью ER-диаграммы;
✅ Написание SQL-запросов.
Так как обе группы пилотные, цену участия поставил максимально низкую. В будущем цена будет выше.
Для тех, кто не понимает, о каких интенсивах речь, подробности тут.
Системный анализ | Дмитрий Помаскин
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥7👍4
Дату и время проведения следующих интенсивов объявлю позже.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🤯4
Media is too big
VIEW IN TELEGRAM
❓Что такое шардирование в БД?
ℹ️ Шардирование — это метод распределения данных в базе данных между несколькими серверами (шардами) для повышения производительности и масштабируемости системы.
Основные типы шардирования:
✅ Горизонтальное шардирование — данные разделяются по диапазону значений (аналогично партиционированию);
✅ Вертикальное шардирование — разные таблицы или столбцы в них размещаются на разных серверах;
✅ Хэш-шардирование — используется хэш-функция от ключа шардирования для определения места хранения.
⚠️Отличие шардирования от партиционирования — при шардировании данные разделены по серверам, при партиционировании остаются на одном сервере.
⚠️Отличие шардирования от классического кластера — при шардировании данные не реплицируются, а просто распределяются по шардам. В кластере данные реплицируются между нодами.
P.S. В следующих видео на примерах расскажу, какие преимущества можно получить от внедрения шардирования.
Системный анализ | Дмитрий Помаскин
ℹ️ Шардирование — это метод распределения данных в базе данных между несколькими серверами (шардами) для повышения производительности и масштабируемости системы.
Основные типы шардирования:
✅ Горизонтальное шардирование — данные разделяются по диапазону значений (аналогично партиционированию);
✅ Вертикальное шардирование — разные таблицы или столбцы в них размещаются на разных серверах;
✅ Хэш-шардирование — используется хэш-функция от ключа шардирования для определения места хранения.
⚠️Отличие шардирования от партиционирования — при шардировании данные разделены по серверам, при партиционировании остаются на одном сервере.
⚠️Отличие шардирования от классического кластера — при шардировании данные не реплицируются, а просто распределяются по шардам. В кластере данные реплицируются между нодами.
P.S. В следующих видео на примерах расскажу, какие преимущества можно получить от внедрения шардирования.
Системный анализ | Дмитрий Помаскин
👍8🔥6👏1
Media is too big
VIEW IN TELEGRAM
🚩Кейс: Применение шардирования по регионам.
ℹ️ Если делить данные между шардами в разрезе регионов, это даст вам прирост производительности при выборке данных из нескольких регионов:
1️⃣ Запрос разделится на несколько шардов, в зависимости от того, по скольким регионам выполняется запрос.
2️⃣ Каждый шард выполнит запрос на своих ресурсах, так как является отдельным сервером.
3️⃣ БД объединит данные, полученные с каждого шарда, и вернёт вам общий результат запроса.
P.S. Кто пропустил пост про шардирование, он тут.
Системный анализ | Дмитрий Помаскин
ℹ️ Если делить данные между шардами в разрезе регионов, это даст вам прирост производительности при выборке данных из нескольких регионов:
1️⃣ Запрос разделится на несколько шардов, в зависимости от того, по скольким регионам выполняется запрос.
2️⃣ Каждый шард выполнит запрос на своих ресурсах, так как является отдельным сервером.
3️⃣ БД объединит данные, полученные с каждого шарда, и вернёт вам общий результат запроса.
P.S. Кто пропустил пост про шардирование, он тут.
Системный анализ | Дмитрий Помаскин
4👍6🔥5
Media is too big
VIEW IN TELEGRAM
🚩Кейс: поиск проблемного участка в распределенной системе.
Вспомните, как иногда тяжело найти тот самый микросервис, который вернул вам неверный результат.
Долгие выяснения "кто виноват" между командами разработки и часы поиска нужного сообщения в логах.🤬
На выходных заканчивал подготовку модулей для тарифа "Senior" по системным интеграциям и решил поделиться с вами фрагментом из модуля по observability.
❗️ В нем рассказываю, как повысить observability системы и упростить поиск багов в больших распределенных системах с помощью трассировки между сервисами.
Системный анализ | Дмитрий Помаскин
Вспомните, как иногда тяжело найти тот самый микросервис, который вернул вам неверный результат.
Долгие выяснения "кто виноват" между командами разработки и часы поиска нужного сообщения в логах.
На выходных заканчивал подготовку модулей для тарифа "Senior" по системным интеграциям и решил поделиться с вами фрагментом из модуля по observability.
Системный анализ | Дмитрий Помаскин
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥6👍2👏1🙏1
Немного позже, чем я планировал, но курс по интеграциям, наконец-то, готов полностью.
Напомню, что на нём вместо классических тарифов я предлагаю три гибких варианта, которые открывают доступ к модулям поэтапно.
Junior (12 890 ₽)
✅ Введение в системные интеграции;
✅ Форматы данных в интеграциях;
✅ REST / SOAP / GraphQL;
✅ Интеграционные шины.
Middle (22 480 ₽)
✅ Все модули из тарифа Junior;
✅ Брокеры сообщений;
✅ RPC (Remote Procedure Call);
✅ Real-time взаимодействие (WS, Long Polling, SSE).
Senior (38 790 ₽)
✅ Все модули из тарифов Junior и Middle;
✅ Интеграция на уровне БД;
✅ Безопасность в интеграциях;
✅ Паттерн Circuit Breaker;
✅ Observability (Наблюдаемость) интеграций;
✅ API-first подход, Swagger и AsyncApi.
Записаться можно тут :)
Системный анализ | Дмитрий Помаскин
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🔥4😁1
Системный анализ | Дмитрий Помаскин
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6🔥2