#mlops

NVIDIA AICR: надёжные рецепты для GPU-кластеров

NVIDIA AI Cluster Runtime (AICR) — инструмент с открытым исходным кодом, генерирующий проверенные конфигурации для GPU-ускоренных кластеров Kubernetes под конкретное сочетание облака, оборудования и рабочей нагрузки.

piqc: находим утечки GPU-бюджета в Kubernetes

piqc — открытый коллектор фактов для AI-инференса на Kubernetes, который выявляет три типа GPU-расточительства: простаивающие аллокации, несоответствие уровней оборудования и тёмную ёмкость. Один запуск `piqc scan` даёт мгновенный отчёт о стоимости без внешних платформ.

MLOps в Yubo: Kubernetes, GitOps и KServe

Команда инфраструктуры Yubo из пяти человек управляет MLOps-платформой для 80 млн пользователей полностью декларативно. Обучение описывается шаблонами Argo Workflows, инференс обслуживает KServe с ModelMesh, а собственный оператор Kubernetes и CRD связывают MLflow, валидацию и развёртывание по принципам GitOps.

© 2026 meganuke