ML для больших компаний: статья про ML-платформу на Kubeflow
Вышла текстовая версия доклада с infra.conf 2026 про ML-платформу на Kubeflow. Со ссылками на наши PR в community и манифесты, чтобы воспроизвести платформу у себя.
ML-платформы
Антон Алексеев · ML-инфраструктура
ML- и inference-платформы на Kubernetes: шеринг GPU, скедулинг, автоскейлинг инференса.
Запустить модель через docker run можно за вечер. А дальше её надо держать под нагрузкой, делить GPU с другими командами, обновлять без простоя и не спалить бюджет. Вот этим я и занимаюсь.
DAY 0 · ПРОЕКТИРОВАНИЕ
DAY 1 · ЗАПУСК
DAY 2 · ЭКСПЛУАТАЦИЯ
5%Средняя утилизация GPU в продакшен-кластерах Kubernetes по отчёту Cast AI за 2026 год. За простаивающую карту платят как за загруженную.cast.ai ↗
Вышла текстовая версия доклада с infra.conf 2026 про ML-платформу на Kubeflow. Со ссылками на наши PR в community и манифесты, чтобы воспроизвести платформу у себя.
ML-платформы
Как ML-платформа в Авито выросла из DevBox-решений и юнит-платформ разных команд в единую платформу на Kubeflow и с какими проблемами мы столкнулись по пути. Отдельно рассказываю про инференс-платформу и то, как могут выглядеть агентские платформы. Пригодится и тем, кто строит платформы в больших компаниях, и тем, кто работает на DevBox или небольших юнит-платформах.
ML-платформы · Инференс
Speculative decoding от Modal, prefix caching в GKE Inference Gateway, AI-платформа Databricks и Ray на AKS.
Инференс · ML-платформы
infra.conf 2026 (Yandex Infrastructure), Москва
MLечный путь 2026 (Selectel), Москва
Подкаст ИТМО × Клуб IT-инфраструктуры
Карьерный митап self × Звук, Москва
Проще всего написать в Telegram.