@drxim
· AI / LLM ops lead UTC+3Основатель ZATVA, 12 лет в SRE и DevOps. Веду команду, держу руку на on-call ротации и отвечаю за архитектуру клиентских деплоев. Сам дежурю по GPU-инференсу и LLM-сервингу.
что делаю в ZATVA
GPU-инференс и LLM-сервинг: on-call по vLLM и Triton, автоскейл и ревью costs на prod. Дежурю в смене UTC+3 (00:00 → 08:00 UTC), а на discovery-созвонах работаю напрямую с CTO/фаундерами, без sales-прослойки.
Больше всего последние годы работаю с vLLM и Triton инференсом на A100/H100: мульти-GPU автоскейл, тюнинг KV-cache и батчинга, оптимизация GPU-costs.
бэкграунд
Начинал классическим сисадмином ещё в 90-х: FreeBSD, BSDi и RedHat у интернет-провайдера. Дальше была инфра и SRE в высоконагруженных бэкенд-сервисах, а потом уход в Web3- и AI-инфраструктуру. С 2024 года мы работаем как DevOps-команда ZATVA на контракте.
Быстрее всего обсудить техдетали или собрать стек под проект — через GitHub или Telegram на странице контактов.