Антон Алексеев
MLOps-инженер. Строю ML- и inference-платформы на Kubernetes и делаю так, чтобы GPU не простаивали.
Где работал
Сейчас · с 2025
Крупный сервис объявлений
Развиваю ML-платформу на Kubeflow: поднимаю утилизацию GPU, подключил Kueue для батч-задач и Vault для секретов. Параллельно строю inference-платформу на KServe: Knative- и Standard-режимы для ML- и LLM-моделей и сервис распределённого дезагрегированного инференса LLM.
2022-2025
Облачный провайдер
Делал MLOps-платформу на Kubernetes с ClearML, JupyterHub, Keycloak и Istio и маркетплейс готовых образов для Data Science с CUDA. Разрабатывал inference-платформу на Triton с автоскейлингом. Исследовал, как шеринг GPU (MIG, time-slicing, MPS, HAMi) снижает стоимость GPU-флаворов.
Проекты
Банк
Концепт ML-платформы на ClearML, Feast, JupyterHub и KServe.
Курс и канал
Автор курса «MLOps для разработки и мониторинга моделей» в Яндекс Практикуме. Ментор на getMentor. Веду Telegram-канал «Инфраструктура для AI и ML» и пишу на Хабр.