@drxim

· AI / LLM ops lead UTC+3

Основатель ZATVA, 12 лет в SRE и DevOps. Веду команду, держу руку на on-call ротации и отвечаю за архитектуру клиентских деплоев. Сам дежурю по GPU-инференсу и LLM-сервингу.

vLLM GPU ops Triton CUDA Ray Kubernetes

что делаю в ZATVA

GPU-инференс и LLM-сервинг: on-call по vLLM и Triton, автоскейл и ревью costs на prod. Дежурю в смене UTC+3 (00:00 → 08:00 UTC), а на discovery-созвонах работаю напрямую с CTO/фаундерами, без sales-прослойки.

Больше всего последние годы работаю с vLLM и Triton инференсом на A100/H100: мульти-GPU автоскейл, тюнинг KV-cache и батчинга, оптимизация GPU-costs.

бэкграунд

Начинал классическим сисадмином ещё в 90-х: FreeBSD, BSDi и RedHat у интернет-провайдера. Дальше была инфра и SRE в высоконагруженных бэкенд-сервисах, а потом уход в Web3- и AI-инфраструктуру. С 2024 года мы работаем как DevOps-команда ZATVA на контракте.

Быстрее всего обсудить техдетали или собрать стек под проект — через GitHub или Telegram на странице контактов.