DevOps MemOps
6.26K subscribers
3.22K photos
528 videos
16 files
5.15K links
Всё о DevOps

Для связи - @raz_raz
Заказать рекламу через биржу: https://telega.in/c/devops_memops
Download Telegram
Как мы перестроили архитектуру нашего Vault с использованием Raft, снимков и аварийного восстановления

Управление секретами в масштабе — это не просто безопасность, это доступность, отказоустойчивость и экономическая эффективность. В BioCatch мы используем HashiCorp Vault для управления секретами в нашей среде Kubernetes, но наша начальная конфигурация оставляла место для улучшений.

Вот как мы перепроектировали архитектуру Vault, используя хранилище Raft, автоматизацию Kubernetes и аварийное восстановление на основе снимков, в результате чего получилась система, которая обладает высокой доступностью, экономически эффективна и готова к работе в производственной среде.


📌 Подробнее: https://medium.com/@BioCatchTechBlog/how-we-rebuilt-our-vault-architecture-with-raft-snapshots-and-dr-b6789ea5fa28

MemOps 🤨
Please open Telegram to view this post
VIEW IN TELEGRAM
1
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Как мониторить Java-приложения: метрики, алерты и правило 80/20

Хороший мониторинг помогает быстро понять, что происходит с приложением и куда смотреть в первую очередь. Для этого не нужно пытаться измерить всё: базовый набор технических метрик покрывает большинство типовых проблем, а бизнес-метрики, SLO и анализ аномалий помогают заранее замечать нетипичные отклонения. В Календаре мы называем этот подход правилом 80/20.
Всем привет! Меня зовут Настя, я бэкенд-разработчик в Яндекс 360 и отвечаю за надёжность Календаря. В этой статье я покажу, какие метрики стоит взять за основу, как выбирать полезные алерты и чем дополнять базовый набор для оставшихся 20%.

В статье хороший разбор подхода 80/20: какие метрики реально ловят большую часть проблем, зачем следить за RED, лагами очередей, connection pool и JVM, когда нужны бизнес-метрики и SLO, и почему аномалии иногда полезнее очередного статического порога.

Отдельно плюсую за onepager, drill-down и ранбуки. Потому что хороший мониторинг — это не «у нас есть график на всё», а «мы быстро поняли, что сломалось и что делать дальше».


📌 Подробнее: https://habr.com/ru/companies/yandex/articles/1068874/

MemOps 🤨
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Please open Telegram to view this post
VIEW IN TELEGRAM