Forwarded from Українська девопсарня (Seva Poliakov)
Мне очень зашла эта статья о том что ж такое Waypoint https://copyconstruct.medium.com/waypoint-3f00b11da4a
Medium
Waypoint
A couple of weeks ago, I saw a demo of Waypoint, the new tool Hashicorp announced today, that aims to provide an easy, intuitive and…
Forwarded from Sysadmin Tools 🇺🇦
A List of Post-mortems!
Table of Contents
- Config Errors
- Hardware/Power Failures
- Conflicts
- Time
- Uncategorized
- Other lists of postmortems
- Analysis
- Contributors
#postmortem #github #google #microsoft #heroku #cloudflare
Table of Contents
- Config Errors
- Hardware/Power Failures
- Conflicts
- Time
- Uncategorized
- Other lists of postmortems
- Analysis
- Contributors
#postmortem #github #google #microsoft #heroku #cloudflare
GitHub
GitHub - danluu/post-mortems: A collection of postmortems. Sorry for the delay in merging PRs!
A collection of postmortems. Sorry for the delay in merging PRs! - danluu/post-mortems
Forwarded from Мониторим ИТ
We’re making Prometheus use less memory and restart faster
A few months ago, I blogged about memory-mapping of full chunks of the head block from disk. The feature, which was introduced in Prometheus v2.19.0, brings down memory usage and restart time.
Additionally, there’s another Prometheus feature in progress that snapshots in-memory data during shutdown for faster restarts; it’s expected to cut down the restart times by a big factor. Интересно, как это.
A few months ago, I blogged about memory-mapping of full chunks of the head block from disk. The feature, which was introduced in Prometheus v2.19.0, brings down memory usage and restart time.
Additionally, there’s another Prometheus feature in progress that snapshots in-memory data during shutdown for faster restarts; it’s expected to cut down the restart times by a big factor. Интересно, как это.
Grafana Labs
We’re making Prometheus use less memory and restart faster | Grafana Labs
Here's a recap of the new Prometheus features that are bringing down memory usage and restart time.
Начинаешь свой путь в IT? Попробуй силы в Java-разработке на реальных задачах и создай приложение, которое украсит твоё портфолио.
Ждём тебя на бесплатном интенсиве 22–24 октября в 16:00!
Нужна только регистрация: 👉 https://clc.am/pNHxRQ
Ты узнаешь, как:
✔️ писать код на Java и вносить в него изменения;
✔️ отлавливать исключения и обрабатывать их;
✔️ читать и записывать файлы в Java;
✔️ подключать внешние библиотеки.
🔊 За три дня под руководством опытного разработчика ты создашь приложение, которое записывает звук с микрофона, сохраняет запись в файл и отправляет его в Dropbox!
🎁 Авторы трёх лучших проектов получат сертификаты на 30 000 рублей для поступления на любой онлайн-курс университета Skillbox, а все участники, дошедшие до конца, — электронную книгу Кей Петерсон и Дэвида Колба «Век живи — век учись» от издательства «МИФ».
Ждём тебя на бесплатном интенсиве 22–24 октября в 16:00!
Нужна только регистрация: 👉 https://clc.am/pNHxRQ
Ты узнаешь, как:
✔️ писать код на Java и вносить в него изменения;
✔️ отлавливать исключения и обрабатывать их;
✔️ читать и записывать файлы в Java;
✔️ подключать внешние библиотеки.
🔊 За три дня под руководством опытного разработчика ты создашь приложение, которое записывает звук с микрофона, сохраняет запись в файл и отправляет его в Dropbox!
🎁 Авторы трёх лучших проектов получат сертификаты на 30 000 рублей для поступления на любой онлайн-курс университета Skillbox, а все участники, дошедшие до конца, — электронную книгу Кей Петерсон и Дэвида Колба «Век живи — век учись» от издательства «МИФ».
Forwarded from Библиотека Go-разработчика | Golang
Интересная статья, которая познакомит вас с паттерном Расширение интерфейса в Go: https://proglib.io/w/c9b49350
Medium
What Is the Extension Interface Pattern in Go?
New name for old things!
Forwarded from Канал «Цинковый прод»
Выпуск про кубернетес с Димой и Васей получился очень ржачным и познавательным. Если кто еще не смотрел/не слушал - MUST SEE!
Видео: https://www.youtube.com/watch?v=slE11sPm8fQ
Аудио: https://soundcloud.com/znprod/082-pro-k8s-v-kurilke-s-dmitriem-stolyarovym-i-vasiliem-marmerom-iz-flant
Не рефлексируйте, распространяйте )
Алсо, собираем темы, вопросы, пожелания для следующего выпуска в этом "исусе":
https://github.com/znprod/stream-topics/issues/2
Видео: https://www.youtube.com/watch?v=slE11sPm8fQ
Аудио: https://soundcloud.com/znprod/082-pro-k8s-v-kurilke-s-dmitriem-stolyarovym-i-vasiliem-marmerom-iz-flant
Не рефлексируйте, распространяйте )
Алсо, собираем темы, вопросы, пожелания для следующего выпуска в этом "исусе":
https://github.com/znprod/stream-topics/issues/2
YouTube
#082 Про k8s в курилке с Дмитрием Столяровым и Василием Мармером из Флант
К нам в гости заглянули Дмитрий Столяров (CTO Flant) и Василий Мармер (Team Lead Flant)
В формате курилки мы обсуждали k8s
Ссылки на наших друзей:
https://flant.ru/mk8s
https://werf.io
0:00 Приветствие
1:10 Говорим про Kubernetes и знакомимся с гостями…
В формате курилки мы обсуждали k8s
Ссылки на наших друзей:
https://flant.ru/mk8s
https://werf.io
0:00 Приветствие
1:10 Говорим про Kubernetes и знакомимся с гостями…
Forwarded from IT Meeting - митапы и конференции по разработке
Go MeetUp
1. RPC over NATS — умная доставка сообщений - Александр Ковалев, Go Teamlead, IVA Technologies
Для обеспечения быстрой, надежной и масштабируемой доставки сообщений между компонентами, было решено использовать NATS .io в качестве транспорта и модифицированный JSON RPC, как начальную реализацию протокола. Что из этого уже получилось, какие возможности дает такой подход и что еще планируется сделать.
2. Go Modules в production - Данилкин Илья, Senior Engineer, Scrum Master, Авито
Со времени анонса модулей прошло уже 2 года. За это время их успели выпустить в виде официального эксперимента, сломать и починить несколько раз.
Готовы ли они к использованию в проде? Зачем переезжать с dep/Glide (и как)? Как работать с ними в IDE?
__________________________________
🗓 29 октября 18:00–20:00, Четверг
🌐 ОНЛАЙН
✅ Регистрация на мероприятие
1. RPC over NATS — умная доставка сообщений - Александр Ковалев, Go Teamlead, IVA Technologies
Для обеспечения быстрой, надежной и масштабируемой доставки сообщений между компонентами, было решено использовать NATS .io в качестве транспорта и модифицированный JSON RPC, как начальную реализацию протокола. Что из этого уже получилось, какие возможности дает такой подход и что еще планируется сделать.
2. Go Modules в production - Данилкин Илья, Senior Engineer, Scrum Master, Авито
Со времени анонса модулей прошло уже 2 года. За это время их успели выпустить в виде официального эксперимента, сломать и починить несколько раз.
Готовы ли они к использованию в проде? Зачем переезжать с dep/Glide (и как)? Как работать с ними в IDE?
__________________________________
🗓 29 октября 18:00–20:00, Четверг
🌐 ОНЛАЙН
✅ Регистрация на мероприятие
Forwarded from Админим с Буквой (bykva)
Настройка Heartbeat для проверки работы системы мониторинга
Расскажу на примере prometheus, alertmanager, opsgenie.
opsgenie:
0) создаем команду
1) по адресу https://app.opsgenie.com/settings/heartbeat создаем хартбит по нужным вам параметрам (severity, на кого повесить, описание). Запоминаем имя (далее ${name})
2) идем в интеграции, создаем для prometheus - именуем, назначаем команду, получаем api ключ.
https://app.opsgenie.com/settings/integration/integration-list (далее ${opsgenie_api_key})
alertmanager.yml:
1) в течение 5 минут прометей проверяет выражение
2) через 5 минут (а затем еще каждую минуту) он будет пиннать алертменеджер и говорить что есть проблема.
3) Алертменеджер будет долбиться раз в минуту на специальный урл opsgenie.
4) В настройках хартбита вы выставляете время которое считаете нормальным для того чтобы система оповещения лежала. и далее ход конём:
5) если у вас погиб прометей (или сеть до алертменеджера), он не будет долбить алертменеджер и рефрешить гарантированный алерт. в таком случае автоматически происходит разрезолв алерта (по-умолчанию 5 минут) и перестают посылаться сообщения на урл из п.3. Тогда по истечению таймаута из п4. на вашу команду упадет алерт о том что хартбит просрочен.
6) если у вас умер алертменеджер (или связность до апи opsgenie), то по истечению таймаута из п4. на вашу команду упадет алерт о том что хартбит просрочен.
т.о. такая связка гарантирует что вся цепочка от мониторинга до алертменеджера и апишки opsgenie находится в работоспособном состоянии
Источник знаний:
- https://xn--r1a.website/metrics_ru
- https://docs.opsgenie.com/docs/heartbeat-api
- https://github.com/prometheus/alertmanager/pull/444#issuecomment-428493861
#prometheus #opsgenie #alertmanager
Расскажу на примере prometheus, alertmanager, opsgenie.
opsgenie:
0) создаем команду
1) по адресу https://app.opsgenie.com/settings/heartbeat создаем хартбит по нужным вам параметрам (severity, на кого повесить, описание). Запоминаем имя (далее ${name})
2) идем в интеграции, создаем для prometheus - именуем, назначаем команду, получаем api ключ.
https://app.opsgenie.com/settings/integration/integration-list (далее ${opsgenie_api_key})
alertmanager.yml:
receivers:prometheus.yml -> далее если у вас правила вынесены в отдельный файл, если нет, ну, сами поправите)
- name: deadmansswitch
webhook_configs:
- url: https://api.opsgenie.com/v2/heartbeats/${name}/ping
send_resolved: true
http_config:
basic_auth:
password: ${opsgenie_api_key}
route:
group_by:
- job
group_interval: 5m
group_wait: 10s
receiver: default
repeat_interval: 1m
routes:
- receiver: deadmansswitch
match:
severity: DeadMansSwitch
repeat_interval: 1m
...prometheus.rules:
rule_files:
- /etc/prometheus/prometheus.rules
...
groups:Как это работает:
- name: prometheus.alerts.rules
rules:
- alert: PrometheusAlertmanagerE2eDeadManSwitch
expr: vector(1)
for: 5m
labels:
severity: DeadMansSwitch
annotations:
summary: "Prometheus AlertManager E2E dead man switch (instance {{ $labels.instance }})"
description: "Prometheus DeadManSwitch is an always-firing alert. It's used as an end-to-end test of Prometheus through the Alertmanager.\n VALUE = {{ $value }}\n LABELS: {{ $labels }}"
1) в течение 5 минут прометей проверяет выражение
vector(1), которое всегда будет отдавать 1, а значит фейлиться.2) через 5 минут (а затем еще каждую минуту) он будет пиннать алертменеджер и говорить что есть проблема.
3) Алертменеджер будет долбиться раз в минуту на специальный урл opsgenie.
4) В настройках хартбита вы выставляете время которое считаете нормальным для того чтобы система оповещения лежала. и далее ход конём:
5) если у вас погиб прометей (или сеть до алертменеджера), он не будет долбить алертменеджер и рефрешить гарантированный алерт. в таком случае автоматически происходит разрезолв алерта (по-умолчанию 5 минут) и перестают посылаться сообщения на урл из п.3. Тогда по истечению таймаута из п4. на вашу команду упадет алерт о том что хартбит просрочен.
6) если у вас умер алертменеджер (или связность до апи opsgenie), то по истечению таймаута из п4. на вашу команду упадет алерт о том что хартбит просрочен.
т.о. такая связка гарантирует что вся цепочка от мониторинга до алертменеджера и апишки opsgenie находится в работоспособном состоянии
Источник знаний:
- https://xn--r1a.website/metrics_ru
- https://docs.opsgenie.com/docs/heartbeat-api
- https://github.com/prometheus/alertmanager/pull/444#issuecomment-428493861
#prometheus #opsgenie #alertmanager
Telegram
Церковь метрик
Метрики. Метрики. Метрики.
Prometheus, Graphite, Influx, Moira, Grafana, Netdata...
Zabbix - сравнительные степепи к zabbix -- ro на канале.
FAQ: http://bit.ly/2BJTgma
Еще базы: https://goo.gl/BRqzdG
Логи: @ru_logs @elasticsearch_ru
Prometheus, Graphite, Influx, Moira, Grafana, Netdata...
Zabbix - сравнительные степепи к zabbix -- ro на канале.
FAQ: http://bit.ly/2BJTgma
Еще базы: https://goo.gl/BRqzdG
Логи: @ru_logs @elasticsearch_ru
Forwarded from DevOps&SRE Library
Self hosted Github Actions runners in Kubernetes
https://vitobotta.com/2020/09/29/self-hosted-github-actions-runners-in-kubernetes
https://vitobotta.com/2020/09/29/self-hosted-github-actions-runners-in-kubernetes
Forwarded from Полезняшки от "Разбора Полетов"
It’s Time to Say Goodbye to Docker
https://towardsdatascience.com/its-time-to-say-goodbye-to-docker-5cfec8eff833
https://towardsdatascience.com/its-time-to-say-goodbye-to-docker-5cfec8eff833
Medium
You Don’t Have to Use Docker Anymore
Docker is not the only containerization tool out there and there might just be better alternatives…
Forwarded from CatOps
Wake up Neo, Kubernetes Services not exist.
And it uses random LB strategy, not round-robin.
Good news - it can be ignored in some cases, but in the worst case (long-lived TCP connections + frontend services less than backend) pods may not be able to handle traffic and horizontal scaling won't help.
To choose the right pill, take a cup of something and read about load balancing and scaling long-lived connections in K8s.
#kubernetes
And it uses random LB strategy, not round-robin.
Good news - it can be ignored in some cases, but in the worst case (long-lived TCP connections + frontend services less than backend) pods may not be able to handle traffic and horizontal scaling won't help.
To choose the right pill, take a cup of something and read about load balancing and scaling long-lived connections in K8s.
#kubernetes
Forwarded from linkmeup
Тут Google внезапно разоткровенничался и рассказал про свои проблемы с DDoS. Проблемы у них интересные: 2,5Tbs (не вчера, а два года назад) и 690 миллионов пакетов в секунду от IoT ботнета.
Ты там как? Прикрутил уже на свой микротик радиатор побольше?
https://cloud.google.com/blog/products/identity-security/identifying-and-protecting-against-the-largest-ddos-attacks
Ты там как? Прикрутил уже на свой микротик радиатор побольше?
https://cloud.google.com/blog/products/identity-security/identifying-and-protecting-against-the-largest-ddos-attacks
Google Cloud Blog
Identifying and protecting against the largest DDoS attacks | Google Cloud Blog
How Google prepares for and protects against the largest volumetric DDoS attacks.
Forwarded from Sysadmin Tools 🇺🇦
Роман в 6 частях - A Deep Dive into Kubernetes Metricshttps://blog.freshtracks.io/a-deep-dive-into-kubernetes-metrics-b190cc97f0f6
#monitoring #k8s #kubernetes #prometheus #metrics #victoriametrics #docker
Forwarded from Человек и машина
Вчера AWS выпустил Origin Shield для CloudFront - своей услуги CDN. Из названия мне показалось, что речь про некий экран, который позволит пользователю получать контент только от узлов CDN, блокируя трафик до origin, но на деле нововведение оказалось гораздо полезнее.
Origin Shield имплементирует дополнительный уровень кеширования, который позволит Edge локациям (географически распределенные точки присутствия CloudFront) обновлять свой локальный кеш не из origin, а непосредственно из этого слоя.
Иными словами, если вы расположились в eu-west-1 и настроили CloudFront на раздачу по всему миру, то все Edge локации будут запрашивать контент у ваших серверов в eu-west-1, тем самым создавая серьезную нагрузку на ваш origin. В случае с Origin Shield обновление кеша будет запрашиваться непосредственно с узлов CloudFront в eu-west-1, и только локальный CloudFront будет “мучать” ваш origin.
Такое решение лучше всего подходит для динамического контента, такого как видеостриминг. Имплементация единого слоя кеширования позволит уменьшить затраты на вычислительные мощности origin’ов или перенаправив их в другое русло, хоть на то же транскодирование видеоконтента.
Важно! Имейте в виде, что Origin Shield имеет добавочную стоимость, так что прежде чем радостно ставить галочку в консоли CloudFront сравните расходы на трафик с Origin Shield с трафиком и ценой на compute origin’а.
А то будете потом писать мне, что клавды клятые вас грабят.
Origin Shield имплементирует дополнительный уровень кеширования, который позволит Edge локациям (географически распределенные точки присутствия CloudFront) обновлять свой локальный кеш не из origin, а непосредственно из этого слоя.
Иными словами, если вы расположились в eu-west-1 и настроили CloudFront на раздачу по всему миру, то все Edge локации будут запрашивать контент у ваших серверов в eu-west-1, тем самым создавая серьезную нагрузку на ваш origin. В случае с Origin Shield обновление кеша будет запрашиваться непосредственно с узлов CloudFront в eu-west-1, и только локальный CloudFront будет “мучать” ваш origin.
Такое решение лучше всего подходит для динамического контента, такого как видеостриминг. Имплементация единого слоя кеширования позволит уменьшить затраты на вычислительные мощности origin’ов или перенаправив их в другое русло, хоть на то же транскодирование видеоконтента.
Важно! Имейте в виде, что Origin Shield имеет добавочную стоимость, так что прежде чем радостно ставить галочку в консоли CloudFront сравните расходы на трафик с Origin Shield с трафиком и ценой на compute origin’а.
А то будете потом писать мне, что клавды клятые вас грабят.
Amazon
Announcing Amazon CloudFront Origin Shield - AWS
Discover more about what's new at AWS with Announcing Amazon CloudFront Origin Shield
Forwarded from Tech Cheat Sheet (Oleg Kovalov)
Forwarded from Полезняшки от "Разбора Полетов"
Building Netflix’s Distributed Tracing Infrastructure
https://netflixtechblog.com/building-netflixs-distributed-tracing-infrastructure-bb856c319304?source=rss----2615bd06b42e---4
https://netflixtechblog.com/building-netflixs-distributed-tracing-infrastructure-bb856c319304?source=rss----2615bd06b42e---4
Medium
Building Netflix’s Distributed Tracing Infrastructure
by Maulik Pandey
Forwarded from oleg_log (Oleg Kovalov)
Заметил еще, что мало кто знает об аббревиатуре NFR, советую запомнить, +10 к уважению https://en.wikipedia.org/wiki/Non-functional_requirement
Wikipedia
Non-functional requirement
criteria that can be used to judge the operation characteristics of a system, rather than specific behaviors
Forwarded from Security Wine (бывший - DevSecOps Wine) (Denis Yakimov)
CloudSecDocs
Один из крутых инженеров Marco Lancini, за активностью которого слежу, релизнул cloudsecdocs.com. Это большая Интернет-энциклопедия по безопасности облаков.
Вот что уже можно почитать:
- Secure SDLC: сканеры, работа с секретами, compliance as code, лабы, моделирование угроз, метрики, логирование
- Docker и Kubernetes, что это, какие компоненты, как деплоить и работать с этим
- Моделирование угроз для Docker и Kubernetes
- Опиcание RBAC
- Описание важных компонентов с точки зрения безопасности k8s
- Атаки и пентест на контейнеры
- Компоненты AWS и Azure, а также их защита
- Угрозы и методология тестирования облаков
#aws #gcp #azure #dev #ops #k8s #docker #attack
Один из крутых инженеров Marco Lancini, за активностью которого слежу, релизнул cloudsecdocs.com. Это большая Интернет-энциклопедия по безопасности облаков.
Вот что уже можно почитать:
- Secure SDLC: сканеры, работа с секретами, compliance as code, лабы, моделирование угроз, метрики, логирование
- Docker и Kubernetes, что это, какие компоненты, как деплоить и работать с этим
- Моделирование угроз для Docker и Kubernetes
- Опиcание RBAC
- Описание важных компонентов с точки зрения безопасности k8s
- Атаки и пентест на контейнеры
- Компоненты AWS и Azure, а также их защита
- Угрозы и методология тестирования облаков
#aws #gcp #azure #dev #ops #k8s #docker #attack
В Слёрме стартует предпродажа курса "CI/CD на примере Gitlab CI".
Курс поможет понять принципы работы CI/CD. После обучения вы сможете автоматизировать процесс интеграции и поставки и ускорить цикл разработки с минимальными рисками.
В период предзаказа можно не только купить курс по выгодной цене, но и поучаствовать в формировании итоговой программы, задать свои вопросы спикерам.
До релиза (3 декабря) цена курса - 15 000 рублей.
Посмотреть программу и оставить заявку: https://slurm.club/3mfoyU3
Курс поможет понять принципы работы CI/CD. После обучения вы сможете автоматизировать процесс интеграции и поставки и ускорить цикл разработки с минимальными рисками.
В период предзаказа можно не только купить курс по выгодной цене, но и поучаствовать в формировании итоговой программы, задать свои вопросы спикерам.
До релиза (3 декабря) цена курса - 15 000 рублей.
Посмотреть программу и оставить заявку: https://slurm.club/3mfoyU3