Главная › Услуги

Услуги

Железо перепродаётся почти по себестоимости у всех. Разница между поставщиками — в том, что происходит до и после отгрузки. Ниже то, за что отвечаем мы.

Подбор и проверка совместимости

До закупки первого компонента: бюджет линий PCIe, схема заполнения памяти, резервирование питания, тепловой расчёт, требования к стойке. Результат — спецификация, которую не придётся переделывать.

Сборка и burn-in 72 часа

Входной контроль, сборка, прошивки BIOS/BMC/VBIOS, три слоя испытаний: функциональный, 48–72 часа под нагрузкой, приёмо-сдаточный. Протокол из девяти разделов с сырой телеметрией.

«Золотой образ» ПО

Ubuntu 24.04 LTS, драйвер NVIDIA R580 LTSB с поддержкой до 2028 года, Docker и NVIDIA Container Toolkit, DCGM + Prometheus + Grafana. По запросу — Kubernetes с GPU Operator, Slurm, vLLM, Astra Linux.

Аудит энергетики площадки

GPU-стойка требует 15–20 кВт против типовых 5–8. Проверяем подведённую мощность, ИБП, PDU, охлаждение. Письменное заключение: можно ли ставить узел и что доработать.

Пусконаладка на площадке

Монтаж в стойку, подключение питания и сети, проверка охлаждения под нагрузкой, приёмо-сдаточные испытания вместе с вами.

SLA «Следующий рабочий день»

Реакция 4 часа, выезд или замена на следующий рабочий день из подменного фонда: ускорители, блоки питания, память. Удалённый мониторинг DCGM. Стандартное восстановление в сервисном центре занимает до 21 рабочего дня — сутки простоя узла на 8 GPU стоят от 132 тыс. ₽.

Что получает клиент вместе с машиной

Паспорт изделия

Спецификация с серийными номерами, версии BIOS, BMC, VBIOS, драйвера и всех компонентов стека.

Протокол испытаний

Результаты DCGM diag r4, gpu-burn, nccl-tests, графики температур и мощности, список Xid за прогон (должен быть пуст).

Руководство по эксплуатации

Требования к питанию и охлаждению, схема подключения, границы ответственности по слоям ПО, порядок обращения в сервис.

Границы ответственности по слоям ПО

СлойКто обновляет
ОС (Ubuntu / Rocky / Astra)Заказчик; базовая установка — мы
Драйвер NVIDIA (LTSB)NodeFactory при поставке и в рамках SLA
CUDA, cuDNN, NCCLВнутри контейнеров, заказчик
Docker, Container ToolkitNodeFactory
Kubernetes / SlurmЗаказчик; развёртывание по запросу
Мониторинг DCGM / Prometheus / GrafanaNodeFactory, базовая настройка
Прикладное ПО (vLLM, NGC-контейнеры)Заказчик

Границу фиксируем в договоре, чтобы не поддерживать чужой Kubernetes бесплатно и чтобы вы точно знали, за что отвечаем мы.

Запросить предложение