ABADDONGPU
ML-инженеры · ручная работа · до результата

Наши услуги — технически и под ключ

Что мы делаем и как именно это делается: стек, инструменты, этапы. Никаких шаблонов — инженер ведёт ваш проект лично.

Как мы работаем

4 шага от идеи до работающего AI

01

Диагностика — бесплатно

Разбираем задачу, подбираем модель и GPU, считаем VRAM и стоимость. Предлагаем план и смету.

02

Разворачивание

Ставим окружение, модели и интерфейс. Тестируем на ваших данных, замеряем скорость.

03

Передача

Инструктаж, документация, доступы. Вы полностью управляете сервером и моделями.

04

Сопровождение

Мониторинг, обновления моделей, оптимизация скорости по мере роста нагрузки.

Услуги

Что мы можем делать

Каждая услуга — с техническим разбором: как это делается и что вы получаете на выходе.

01

Установка нейросетей «под ключ»

Разворачиваем LLM, генерацию изображений и видео, агентные схемы на вашем сервере.

Технически: Docker-окружение → Ollama или vLLM для LLM (GGUF/AWQ-кванты), ComfyUI с ControlNet для изображений, Open WebUI как чат-интерфейс. Для RAG — векторная БД Qdrant. Автозапуск через systemd, API-эндпоинты OpenAI-совместимые.

Готовый сервер: модель + чат + API + инструкция.

DockervLLMComfyUIOpen WebUI
02

Обучение и файн-тюнинг

Дообучаем модель под вашу задачу: стиль, предметную область, формат ответов.

Технически: Подготовка датасета → LoRA/QLoRA через Unsloth и PEFT (4-битное обучение — 70B влезает на одну 80GB-карту), полный файн-тюн для малых моделей. Валидация на hold-out, слияние адаптеров, квантование в GGUF.

Ваша модель в GGUF — готова к развёртыванию где угодно.

UnslothPEFTLoRAGGUF
03

Создание датасетов

Собираем и размечаем данные под вашу модель — источник уникальности вашего AI.

Технически: Парсинг источников → очистка и дедупликация → синтетическая генерация и аугментация → разметка (включая RLHF-пары «вопрос-идеал-худший») → формат обучения JSONL/Alpaca.

Датасет в формате обучения. Остается у вас.

ParcingSyntheticRLHFJSONL
04

RAG и базы знаний

Ассистент, который отвечает по вашим документам — с ссылками на источники.

Технически: Chunking документов → эмбеддинги BGE-M3 → векторная БД (Qdrant/FAISS) → retrieval с цитированием. Гибридный поиск: вектора + BM25, реранкинг результатов.

Ответы по вашей базе знаний с указанием источника.

BGE-M3QdrantBM25Rerank
05

Пайплайны автоматизации

Автоматические конвейеры: контент, модерация, отчёты, обработка заявок.

Технически: Python-скрипты + очереди задач (Celery/Redis), триггеры по webhook и крону, цепочки «запрос → модель → постобработка → результат» с уведомлениями в Telegram.

Конвейер работает без человека 24/7.

PythonCeleryWebhookCron
06

Подбор конфигурации и сопровождение

Оптимальный сервер под задачу и бюджет + поддержка после запуска.

Технически: Расчёт VRAM под модель и контекст, бенчмарки инференса (tokens/s), оптимизация: flash-attention, управление KV-кэшем, квантование под нагрузку. Мониторинг и автоперезапуск сервисов.

Стабильный сервер с максимальной скоростью за свои деньги.

BenchmarkFlashAttentionKV-cacheMonitor

Все услуги — индивидуальный расчёт: цена зависит от задачи, модели и объёма работ.

Обсудим вашу задачу?

Диагностика бесплатна: разберём задачу, подберём модель и GPU, предложим план.

Посмотреть модели