DevOps MemOps
6.25K subscribers
3.19K photos
523 videos
16 files
5.1K links
Всё о DevOps

Для связи - @raz_raz
Заказать рекламу через биржу: https://telega.in/c/devops_memops
Download Telegram
MemOps 😃
Please open Telegram to view this post
VIEW IN TELEGRAM
😁30
Pod завис в Pending? Вот по какой цепочке kube-scheduler решает, куда его посадить

kube-scheduler не выбирает ноду случайно. Сначала Pod попадает в ActiveQueue и сортируется по приоритету — PriorityClass здесь решает, кто пойдёт первым. Потом идёт фильтрация: какие ноды вообще подходят по ресурсам, taint’ам и affinity. Оставшиеся кандидаты проходят scoring, где учитываются запрошенные ресурсы, topology spread и affinity.

Если Pod не запланировался, смотрите kubectl describe pod: в Events увидите, на каком шаге отсеялись ноды и почему. Иногда причина в resource requests, иногда в taints или anti-affinity. Разбор на devops.dev проходит путь от очереди до binding и preemption.


📌 Подробнее: https://blog.devops.dev/where-did-my-pod-go-a-deep-dive-into-k8s-scheduling-d1d50c23e549

MemOps 🤨
Please open Telegram to view this post
VIEW IN TELEGRAM
2
MemOps 😃
Please open Telegram to view this post
VIEW IN TELEGRAM
😁30
MemOps 😃
Please open Telegram to view this post
VIEW IN TELEGRAM
😁26
SRE-агенты переходят от рекомендаций к автономным действиям

В классическом SRE инженер получает алерт, открывает консоль, гоняет диагностику и правит по ранбуку. Агент ИИ может съесть тот же алерт, коррелировать его с недавним деплоем и выполнить рутинное исправление самостоятельно.

Это меняет роль SRE: из «делающего вручную» в «менеджера команды агентов», которые накапливают операционную память и снижают зависимость от одного эксперта. Но работает только при одном условии — выбираете один целевой сценарий, а не натягиваете «ИИ-слой» на всё подряд.


📌 Подробнее: https://thenewstack.io/sre-ai-agents-capabilities/

MemOps 🤨
Please open Telegram to view this post
VIEW IN TELEGRAM
3
MemOps 😃
Please open Telegram to view this post
VIEW IN TELEGRAM
15💯7
k3s-cluster-maintenance

Модульная роль и плейбук Ansible, выполняющие автоматическое обновление операционной системы и техническое обслуживание узлов кластера K3s с семантикой нулевого времени простоя.


📌 Подробнее: https://github.com/sudo-kraken/k3s-cluster-maintenance

MemOps 🤨
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
😁24🔥1
Сетевое взаимодействие Kubernetes: от пакетов до подов

Сетевое взаимодействие Kubernetes не должно быть черным ящиком. В этом руководстве мы разбираем его, начиная с основ сетевого взаимодействия Linux и изоляции контейнеров. Затем мы углубляемся в полную модель Kubernetes, объясняя все: от IP-адресов подов и плагинов CNI до сервисов, NetworkPolicy и Ingress, предоставляя четкую карту от начала до конца того, как работает связность в вашем кластере.


📌 Подробнее: https://www.lucavallin.com/blog/kubernetes-networking-from-packets-to-pods

MemOps 🤨
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1
MemOps 😃
Please open Telegram to view this post
VIEW IN TELEGRAM
🦄11😁3
Инженеры DoubleVerify рассказали, как собирать метрики производительности из приложений, развёрнутых в инфраструктуре партнёров, которая остаётся для них «чёрным ящиком». Решением стал Vector от Datadog — лёгкий open-source инструмент для сбора, преобразования и маршрутизации логов, метрик и трейсов в любые системы мониторинга.

Авторы показывают пошаговую настройку взаимной аутентификации mTLS между Vector и удалённым Prometheus с помощью самоподписанных сертификатов, что гарантирует подлинность обеих сторон соединения.

Vector разворачивается в Kubernetes как StatefulSet. При этом инструмент гибок и поддерживает разные схемы развёртывания, а также работу с Loki, Splunk и Datadog помимо Prometheus.

📌 Подробнее: https://medium.com/doubleverify-engineering/a-step-by-step-guide-to-securing-observability-pipelines-using-vector-by-datadog-75417454e532

MemOps 🤨
Please open Telegram to view this post
VIEW IN TELEGRAM
MemOps 😃
Please open Telegram to view this post
VIEW IN TELEGRAM
😁8🫡3
endpoint-monitoring-operator

Легковесный, расширяемый оператор Kubernetes, который проверяет любой эндпоинт — HTTP/JSON, TCP, DNS, ICMP, Trino, OpenSearch и другие — и направляет оповещения в Slack или по электронной почте.


📌 Подробнее: https://github.com/iam404/endpoint-monitoring-operator

MemOps 🤨
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
MemOps 😃
Please open Telegram to view this post
VIEW IN TELEGRAM
🌚9🫡4
OpsKnight

Центр управления инцидентами с открытым исходным кодом. Весь жизненный цикл инцидента, графики дежурств и страницы состояния — на одной мощной платформе.

OpsKnight — это альтернатива с открытым исходным кодом PagerDuty и OpsGenie, разработанная для команд, которые хотят получить полный контроль над своей системой управления инцидентами без затрат на SaaS-сервисы.


📌 Подробнее: https://github.com/Dushyant-rahangdale/OpsKnight

MemOps 🤨
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
MemOps 😃
Please open Telegram to view this post
VIEW IN TELEGRAM
💯19👍3
Please open Telegram to view this post
VIEW IN TELEGRAM
Все проверки зелёные, а данных нет: как мониторить gRPC server‑side стримы

Стандартная (для многих) история. Отдаём какие‑то данные в реальном времени через server‑side web‑gRPC стримы. Цепочка: балансировщик, дальше Envoy с grpc‑web, дальше бэкенд.

Все проверки зелёные: TCP поднят, хендшейк проходит, /healthz отвечает 200, в графане/slack'e тишина. А фронтенд у клиентов замёрз. И узнали мы об этом от клиентов, а не от мониторинга.

В статье описание механизма работы демона, который по расписанию подгружает.proto на лету через proto‑loader, открывает server‑side RPC как обычный клиент, ждёт кадров (например 3) в бюджет времени и валидирует каждый кадр.


📌 Подробнее: https://habr.com/ru/articles/1066146/
https://github.com/youngpabl0/grpc-streams-checker

MemOps 🤨
Please open Telegram to view this post
VIEW IN TELEGRAM
MemOps 😃
Please open Telegram to view this post
VIEW IN TELEGRAM
😁25