ABADDONGPU
Каталог моделей · цены сервера в реальном времени

Модели, которые мы развернём

Открьите модели Hugging Face — от лёгких 8B до флагманов 235B — с живым расчётом: какая видеокарта нужна и сколько это стоит в час.

Как считается стоимость

VRAM определяет цену

Чем больше модель и выше точность квантования — тем больше нужна видеопамять и тем мощнее (дороже) карта.

VRAM ≈ параметры (B) × ГБ на 1B (квантование) × 1.25 (контекст + накладные)
Q4

Q4 — оптимум

~0.58 ГБ на 1B параметров. Потеря качества минимальна, а требования к VRAM вдвое ниже FP16. Большинство приватных установок — именно Q4.

Пример: 70B Q4 ≈ 51 GB → L40S / RTX A6000.

Q8

Q8 — качество

~1.1 ГБ на 1B. Почти нет потерь против оригинала. Нужна карта вдвое больше — для задач, где важна каждая капля качества.

Пример: 8B Q8 ≈ 11 GB → RTX 4070.

FP16

FP16 — генерация и тюнинг

~2 ГБ на 1B. Диффьюзеры (FLUX, Wan) и обучение LoRA работают в полной точности — отсюда большие требования.

Пример: 70B FP16 ≈ 175 GB → H200 / B200.

Цены в каталоге уже включают сервисный сбор Abaddon. Час работы × 24 × 30 — это ориентировочная цена «круглосуточного» сервера на месяц.

Калькулятор

Подберите сервер под модель

Введите параметры модели и квантование — покажем нужную VRAM и самую выгодную карту из каталога.

Каталог

Модели под ключ

Каждая модель — с рекомендуемым GPU и живой ценой из каталога. Развернём любую другую модель с Hugging Face по запросу.

Нужна другая модель?

В каталоге — проверенные варианты, но мы развернём любую модель с Hugging Face: подберём железо, установим и настроим под ключ.

Выбрать GPU в каталоге