Инженеры DoubleVerify рассказали, как собирать метрики производительности из приложений, развёрнутых в инфраструктуре партнёров, которая остаётся для них «чёрным ящиком». Решением стал Vector от Datadog — лёгкий open-source инструмент для сбора, преобразования и маршрутизации логов, метрик и трейсов в любые системы мониторинга.
Авторы показывают пошаговую настройку взаимной аутентификации mTLS между Vector и удалённым Prometheus с помощью самоподписанных сертификатов, что гарантирует подлинность обеих сторон соединения.
Vector разворачивается в Kubernetes как StatefulSet. При этом инструмент гибок и поддерживает разные схемы развёртывания, а также работу с Loki, Splunk и Datadog помимо Prometheus.
📌 Подробнее: https://medium.com/doubleverify-engineering/a-step-by-step-guide-to-securing-observability-pipelines-using-vector-by-datadog-75417454e532
MemOps🤨
Авторы показывают пошаговую настройку взаимной аутентификации mTLS между Vector и удалённым Prometheus с помощью самоподписанных сертификатов, что гарантирует подлинность обеих сторон соединения.
Vector разворачивается в Kubernetes как StatefulSet. При этом инструмент гибок и поддерживает разные схемы развёртывания, а также работу с Loki, Splunk и Datadog помимо Prometheus.
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
Medium
A Step-by-Step Guide to Securing Observability Pipelines Using Vector by Datadog
Written By: Surya Nittala
endpoint-monitoring-operator
📌 Подробнее: https://github.com/iam404/endpoint-monitoring-operator
MemOps🤨
Легковесный, расширяемый оператор Kubernetes, который проверяет любой эндпоинт — HTTP/JSON, TCP, DNS, ICMP, Trino, OpenSearch и другие — и направляет оповещения в Slack или по электронной почте.
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - iam404/endpoint-monitoring-operator: Monitor configurable endpoints through Kubernetes CRD config.
Monitor configurable endpoints through Kubernetes CRD config. - iam404/endpoint-monitoring-operator
👍2
OpsKnight
📌 Подробнее: https://github.com/Dushyant-rahangdale/OpsKnight
MemOps🤨
Центр управления инцидентами с открытым исходным кодом. Весь жизненный цикл инцидента, графики дежурств и страницы состояния — на одной мощной платформе.
OpsKnight — это альтернатива с открытым исходным кодом PagerDuty и OpsGenie, разработанная для команд, которые хотят получить полный контроль над своей системой управления инцидентами без затрат на SaaS-сервисы.
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Все проверки зелёные, а данных нет: как мониторить gRPC server‑side стримы
📌 Подробнее: https://habr.com/ru/articles/1066146/
https://github.com/youngpabl0/grpc-streams-checker
MemOps🤨
Стандартная (для многих) история. Отдаём какие‑то данные в реальном времени через server‑side web‑gRPC стримы. Цепочка: балансировщик, дальше Envoy с grpc‑web, дальше бэкенд.
Все проверки зелёные: TCP поднят, хендшейк проходит, /healthz отвечает 200, в графане/slack'e тишина. А фронтенд у клиентов замёрз. И узнали мы об этом от клиентов, а не от мониторинга.
В статье описание механизма работы демона, который по расписанию подгружает.proto на лету через proto‑loader, открывает server‑side RPC как обычный клиент, ждёт кадров (например 3) в бюджет времени и валидирует каждый кадр.
https://github.com/youngpabl0/grpc-streams-checker
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
Хабр
Все проверки зелёные, а данных нет: как мониторить gRPC server‑side стримы
Стандартная (для многих) история. Отдаём какие‑то данные в реальном времени через server‑side web‑gRPC стримы. Цепочка: балансировщик, дальше Envoy с grpc‑web, дальше бэкенд. Все проверки...