meganuke — технический блог о DevOps и инструментах

MLOps в Yubo: Kubernetes, GitOps и KServe

Команда инфраструктуры Yubo из пяти человек управляет MLOps-платформой для 80 млн пользователей полностью декларативно. Обучение описывается шаблонами Argo Workflows, инференс обслуживает KServe с ModelMesh, а собственный оператор Kubernetes и CRD связывают MLflow, валидацию и развёртывание по принципам GitOps.

Настройка swap в Kubernetes: параметры ядра Linux

Статья разбирает ключевые параметры ядра Linux (vm.swappiness, vm.min_free_kbytes, vm.watermark_scale_factor) для корректной работы NodeSwap в Kubernetes и показывает, как их настройка предотвращает OOM kill и нежелательные вытеснения pod'ов.

Preq: проактивная диагностика Kubernetes-кластера

Preq — kubectl-плагин для проактивного обнаружения проблем в Kubernetes: сканирует логи, события и конфигурации по каталогу шаблонов сбоев CRE. Помогает выявлять неправильные конфигурации и коды завершения контейнеров до инцидента.

Инфраструктура Yubo на 80M: автоматизация через CRD

Yubo перешла от Terraform к управлению всей инфраструктурой через Kubernetes CRD и GitOps: провижининг, CI/CD и Lives-стек описываются декларативным YAML. Это позволяет команде из пяти инженеров держать платформу на 80 млн пользователей.

Дата-инжиниринг Yubo: 80 млн пользователей, 5 человек

Команда из пяти человек масштабирует дата-инжиниринг Yubo под 80+ млн пользователей: дата-инженеры рано подключаются к дизайну фич, а данные осознанно дублируются с единым источником истины и синхронизацией через Kafka и CDC. Разработчики при этом получают self-service-платформу баз данных на Kubernetes CRD.

Sveltos: управление дополнениями в флоте Kubernetes

Sveltos — контроллер для развёртывания Helm-чартов, YAML и Kustomize сразу в множестве кластеров Kubernetes через сопоставление по меткам. Поддерживает мультиарендность, событийный фреймворк, pull-режим и поэтапные выкатки без привязки конфигурации к конкретному кластеру.

© 2026 meganuke