> solutions / zk

Операции ZK prover-ферм и роллапов на контракте

Генерация пруфов упирается сразу в GPU, в дедлайны и в параллельность. Шедулер потерял джобу - вы потеряли блок и награду за него. Мы собираем ферму, очередь, ретраи и per-circuit бенчмарки на SP1, RISC Zero, Boundless, Brevis.

Стек у нас уже собран: SP1 и RISC Zero как baseline RISC-V zkVM, Boundless и Brevis как децентрализованные prover-маркетплейсы, Jolt и Halo2 под кастомные схемы. На вашу ферму ставим GPU-шедулер с deadline-aware приоритизацией, kv-cache сегментов схемы, retry-очередь с экспоненциальным backoff и алерты на пропуск proof window.

Наша ниша - оператор для операторов на prover-маркетплейсах. Succinct, Boundless и Brevis запустились как маркетплейсы в конце 2025, но держать вашу GPU-ферму на них под подписанный SLA пока не берётся никто. Мы берёмся.

[ План деплоя за 48ч ]

стек, которым оперируем

Это подсет под ZK, а платформенный слой у нас везде одинаковый.

ZK: SP1 RISC Zero Boundless Brevis Jolt Halo2
Platform: Kubernetes Terraform Ansible Prometheus Grafana Loki OpenTelemetry PagerDuty

что разворачиваем

Конкретные deliverables под ZK-команды, и каждый идёт под ключ: с репозиторием, IaC и раннбуками.

[ Prover-ферма с GPU-шедулером ]

H100 / A100 / 4090 пул, deadline-aware приоритизация джобов, NUMA-aware placement, утилизация по карте 75%+ в типовом сценарии.

[ Retry-очередь proof-job'ов ]

Идемпотентный submit и экспоненциальный backoff, dead-letter queue с per-circuit анализом, а на pre-deadline ETA-промах приходит алерт.

[ Per-circuit бенчмарк-каталог ]

Замеры на SP1 / RISC Zero / Jolt по каждой схеме: time-to-prove, peak memory, optimal GPU type. Артефакт-кеш для precompiles.

[ Operator на Boundless / Brevis / Succinct ]

Регистрация в marketplace, bidding-стратегия по типам схем, репутация-трекинг, реконсиляция выплат, switching между маркетплейсами по marginal cost.

[ ZK rollup ops: prover + sequencer + DA ]

Сборка proving stack для собственного роллапа: координация sequencer'а, batcher'а и prover'ов, наблюдение L1 finality, плейбук при stall'е.

что держим 24/7

После hand-off pager уходит к нам, а покрытие мы настраиваем под ZK-фермы:

  • Liveness-проверки prover'ов под дедлайны сети: alert если ETA пруфа превышает 70% от proof window.
  • GPU health watchdog: ECC errors, thermal throttling или xid триггерят preempt и переезд джоба.
  • Queue depth / lag метрики per-circuit: alert при отклонении >20% от baseline.
  • Auto-retry на failed proof generation с deterministic seed для воспроизводимости.
  • Версионированные runbook'и: prover crash, OOM на witness gen, marketplace bid stuck, fork-choice на L1 в proof window.
  • Ежемесячный perf-ревью, где смотрим новые precompiles, обновляем бенчмарки и перераспределяем нагрузку между маркетплейсами.

сценарии миграции

Вот что мы переносим без потери выплат и без skipped proof'ов.

один маркетплейс → mix

Переход с одного prover-marketplace на портфель из 2-3: дифференциация по типу схемы, hedge против простоя одной площадки.

cloud GPU → bare-metal

Перенос фермы с AWS / GCP на dedicated GPU у Latitude.sh / DataPacket: cost-per-proof -50% в типовом сценарии, без потери дедлайнов.

SP1 → RISC Zero (или наоборот)

Параллельный shadow-proving для контроля корректности, постепенный cutover по типам схем, фиксация baseline по latency.

scale-up под season инсентивов

Мощности prover'ов ×5 за 7-10 дней: экспресс-подбор H100, авто-онбординг в marketplace, плейбук свертки после сезона.

FP32 → FP16 / mixed precision

Quantization-aware proof generation там, где схема позволяет: -30% time-to-prove, контрольный re-verify на каждом батче.

в свою proving stack

Переход с external prover service на собственную ферму: расчёт breakeven, gradual cutover, аудит ключевого материала и precompiles.

кейсы

Все анонимизированы: имена по NDA не раскрываем, а вот цифры реальные.

ZK rollup · 6 мес · validator ops + prover farm · slashing: 0 · missed proof window: 0
SP1 marketplace operator · 4 мес · 32 H100 · top-3 по win-rate · cost-per-proof -45%
RISC Zero proving service · 8 мес · 16 H100 + 24 4090 · ETA accuracy ±8%
Brevis incentivized season · 8 недель · burst x5 capacity · 99.4% on-time delivery

SLA tiers

Три уровня покрытия. Для production proving с подписанным SLA по дедлайнам мы обычно рекомендуем Silver и выше.

Tier Response p95 (Sev-1) Coverage Incident report Engineer hours / мес
Bronze 30 мин Business hours, 5×8 В течение 48ч 40
Silver 15 мин 24/7 on-call ротация В течение 24ч 80
Gold 5 мин 24/7 с выделенным инженером В течение 12ч 160+

FAQ

Поверх всех: SP1 и RISC Zero для RISC-V zkVM подхода, Jolt и Halo2 для custom-схем, а Boundless / Brevis / Succinct как marketplace-слой. Если у вас collab с конкретным provider'ом, то подключаемся к их toolchain.

Это Sev-1: эскалация в течение 5-15 мин (по tier'у), root cause за 12-24ч, а затем разбор инцидента со списком исправлений и владельцами. При этом архитектурно мы стараемся ловить до промаха, ведь alert на ETA >70% от proof window триггерит pre-emptive миграцию на свободный GPU.

Зависит от схемы и throughput target'а. Под одну production-схему baseline - это 4-8 H100 или 16-24 RTX 4090, а под marketplace-бид мы начинаем с 8-16 H100 и масштабируем по win-rate. Пришлите тип схемы и target proof / hour, и мы дадим точный расчёт за 24ч.

Да, это одна из наших whitespace-ставок. Регистрируемся как ваш оператор в Boundless / Brevis / Succinct, держим bid-стратегию, мониторим репутацию и реконсилируем выплаты, при этом ключи staking-материала и payout-кошельки остаются у вас.

Да, и сюда входит sequencer + batcher + prover как координированный пайплайн, L1 finality observability и плейбук при stall'е. Можем собрать stack с нуля или взять на эксплуатацию existing setup.

готовы развернуть инфру?

Опишите задачу: ответим в течение 24 часов.

[ План деплоя за 48ч ]