Антон Алексеев

MLOps-инженер. Строю ML- и inference-платформы на Kubernetes и делаю так, чтобы GPU не простаивали.

Где работал

Сейчас · с 2025

Крупный сервис объявлений

Развиваю ML-платформу на Kubeflow: поднимаю утилизацию GPU, подключил Kueue для батч-задач и Vault для секретов. Параллельно строю inference-платформу на KServe: Knative- и Standard-режимы для ML- и LLM-моделей и сервис распределённого дезагрегированного инференса LLM.

2022-2025

Облачный провайдер

Делал MLOps-платформу на Kubernetes с ClearML, JupyterHub, Keycloak и Istio и маркетплейс готовых образов для Data Science с CUDA. Разрабатывал inference-платформу на Triton с автоскейлингом. Исследовал, как шеринг GPU (MIG, time-slicing, MPS, HAMi) снижает стоимость GPU-флаворов.

Проекты

Банк

Концепт ML-платформы на ClearML, Feast, JupyterHub и KServe.

Курс и канал

Автор курса «MLOps для разработки и мониторинга моделей» в Яндекс Практикуме. Ментор на getMentor. Веду Telegram-канал «Инфраструктура для AI и ML» и пишу на Хабр.

Связаться

Telegram-каналLinkedIngetMentorGitHub

↑↓ выбор · Enter открыть · Esc закрыть