Корпоративный ИИ on-premise

Рутину — агентам.
Данные всегда
в периметре.

Физический сервер + единая защищённая основа для всех агентов. Новые агенты подключаются быстрее — не переписывают одно и то же с нуля. Данные не покидают ваш контур.

192 000 ₽ экономии в месяц на 6 агентах
459 ч освобождённого времени в мес
от 30 дн. до запуска первого агента
Внедрение 30 дней Окупаемость от 2 недель ROI ≈42% за 24 мес.
PRAXIS · 6 агентов · онлайн
🎯Квалификация лидовактивен
✉️Персонализация писемактивен
📝Резюмирование встречожидание
📊Подготовка отчётовактивен
📚RAG-ассистентактивен
💰Мониторинг дебиторкиактивен
0 ₽
лицензий ПО в месяц
100%
данные внутри контура
🔒Данные внутри контура
⚖️152-ФЗ
🏛️Готовность к КИИ
🧩Open-source · MIT / Apache 2.0
🇷🇺Оборудование в РФ
Почему сейчас

Идеальный шторм для on-premise ИИ

Три фактора совпали одновременно. Компании, внедрившие сейчас, получат преимущество на 18–24 месяца.

01
Модели стали доступны
DeepSeek R1 и Qwen 3 достигли уровня GPT-4o по качеству рассуждений. Лицензии MIT и Apache 2.0. Стоимость инференса — 0 ₽/мес.
02
GPU стало доступным
RTX 4090 в 2026 году — реалистичный вход в серьёзный инференс. Тариф «Точка входа» работает на одной карте: 3–5 пользователей одновременно.
03
Регуляторное давление
152-ФЗ, требования КИИ и NDA-ограничения делают облачные ИИ юридически рискованными для большинства B2B-компаний РФ.
Окно возможностей — 12–18 месяцев

ИИ-агенты на open-source моделях только что стали реально работоспособными. Первые 15–20% рынка, внедрившие сейчас, получат операционное преимущество, которое конкурентам будет дорого нагонять.

📅 Внедрение за 30 дней · Окупаемость от 2 недель
Как это устроено внутри

Одна защищённая основа. Не набор изолированных скриптов.

Каждый новый агент PRAXIS не переписывает одно и то же с нуля — он подключается к общей платформе, где уже решены лимиты, мониторинг, секреты и отказоустойчивость к сбоям LLM-провайдеров. Поэтому внедрение следующего агента быстрее и дешевле первого.

01
Единые лимиты и квоты
Все агенты работают по общим правилам расхода ресурсов — один продукт не может незаметно забрать мощность и бюджет у остальных.
02
Честный мониторинг состояния
Единый health-check показывает, что реально работает, а не разноцветную витрину. Проблема видна сразу, а не после жалобы клиента.
03
Единая защита секретов и ключей
Ключи доступа к LLM-провайдерам и данным хранятся и проверяются в одном месте, а не разбросаны по настройкам каждого агента отдельно.
04
Устойчивость к сбоям провайдера LLM
Если один провайдер моделей отвечает с ошибкой, платформа переключается на резервный автоматически — без остановки работы агента.
Не концепция, а факт на сентябрь 2026
RAG-ассистент, генератор рассылок и ассистент встреч реально переведены на эту общую основу и покрыты 96 автоматическими тестами. Живые health-check проверены на серверных копиях.

Это про устойчивость приложений к сбоям LLM-провайдера и про честный мониторинг — не про гарантию восстановления при аппаратном отказе сервера целиком.

6 агентов из коробки

Агенты — не чат-боты.
Они выполняют работу.

Событие в системе → агент запускается → готовый артефакт без участия сотрудника. Human-in-the-loop: агент готовит, человек одобряет.

🎯
Квалификация входящих лидов
SDR · Менеджер по продажам · РОП
«30 секунд вместо 30 минут на каждый лид»
56 000 ₽/мес
130 ч/мес
✉️
Персонализация outreach-писем
SDR · AE · РОП
«Письмо, которое читают, а не удаляют»
29 000 ₽/мес
66 ч/мес
Reply rate +30–50%
📝
Резюмирование встреч
Все сотрудники
«Выжимка часового совещания за 8 минут»
38 000 ₽/мес
120 ч/мес
📊
Подготовка клиентских отчётов
Консультанты · Аналитики
«Черновик аналитического отчёта за 5 минут»
28 000 ₽/мес
35 ч/мес
📚
Корпоративный RAG-ассистент
Все сотрудники
«Ответ на вопрос по базе знаний за 3–5 сек»
29 000 ₽/мес
90 ч/мес
💰
Мониторинг дебиторской задолженности
Бухгалтер · CFO · Менеджер
«Автонапоминания без участия бухгалтера»
12 000 ₽/мес
18 ч/мес
Просрочка −20–35%
192 000 ₽
совокупная экономия
в месяц
459 ч
освобождённого времени
= 2,7 FTE
≈42%
ROI за 24 месяца
пример: Полный пакет
Три уровня по числу агентов · Прозрачные цены

Выберите конфигурацию

Точка входа — 1 агент. Стартовый — 3 агента под ваши процессы. Полный — все 6 агентов каталога.

Точка входа
от 490 000 ₽
покупка под ключ
или 30 000 ₽/мес подписка (1 агент)

1 агент на выбор. Внедрение 30 дней.


Оборудование
1× NVIDIA RTX 4090 24 GB
AMD Ryzen 9 7950X · 96 GB DDR5
2 TB NVMe + 4 TB NVMe (RAG)
LLM: DeepSeek R1 32B / Qwen 3 30B
3–5 пользователей одновременно
Поддержка (при покупке)
25 000 ₽/мес · Пн–Пт 9–18
Запросить предложение
Популярный выбор
Стартовый
от 1 490 000 ₽
покупка под ключ
или 70 000 ₽/мес подписка (3 агента)

3 агента, подобранных под вашу отрасль и процессы. Qwen 3 235B.


Оборудование
2× NVIDIA RTX 4090 · 48 GB total
AMD EPYC 7443 · 256 GB ECC DDR4
4 TB NVMe RAID-1 + 8 TB NVMe
LLM: Qwen 3 235B / DeepSeek R1 70B
10–20 пользователей одновременно
Поддержка (при покупке)
55 000 ₽/мес · Пн–Пт 9–20
Запросить предложение
Полный
от 4 200 000 ₽
покупка под ключ
или 135 000 ₽/мес подписка (6 агентов)

Все 6 агентов каталога. Приоритетная поддержка 24/7.


Оборудование
4× NVIDIA RTX A40 48 GB · 192 GB
2× AMD EPYC 7713 · 512 GB ECC
8 TB NVMe RAID-10 + SAN 20 TB
Kubernetes (k3s) · LDAP/AD
50+ пользователей одновременно
Поддержка (при покупке)
120 000 ₽/мес · 24/7
Запросить предложение

Лизинг 36 мес.: от 18 000 ₽/мес (Точка входа) · от 52 000 ₽/мес (Стартовый) · от 145 000 ₽/мес (Полный). Партнёры: Сбербанк Лизинг, ВТБ Лизинг, Балтийский лизинг.

Для руководителей

ROI. TCO. Аргументы для совета директоров.

Пример расчёта: компания 55 сотрудников, B2B-консалтинг, Стартовый пакет (3 агента). Ставки по ролям — 400–1 200 ₽/час (hh.ru/SuperJob, 2026), не единая ставка для всех должностей.

104 000 ₽
экономии в месяц
в этом примере
≈149%
ROI за 24 месяца
в этом примере
70 000 ₽
стоимость Стартового
пакета в месяц
TCO трёх вариантов развёртывания (Точка входа, 36 мес.)
Нарастающим итогом · млн ₽
Критерий A: Собственный сервер B: Подписка / Лизинг C: Аренда GPU
TCO 3 года~1,4 млн ₽~2,3 млн ₽~5,4 млн ₽
Тип затратCAPEX разовыйOPEX фиксированныйOPEX переменный
Данные внутри контура✓ Да✓ Да✗ Нет
Соответствие 152-ФЗ / КИИ✓ Полное✓ Полное⚠ Условно
Vendor Lock-in✓ Нет⚠ Контракт✗ Высокий
Работа без интернета✓ Да (Air Gap)✓ Да✗ Нет
Срок запуска4–6 недель4–6 недель1–3 дня (пилот)
Налоговый эффектАмортизация CAPEXOPEX + НДС к вычетуOPEX снижает налог
Конкурентный анализ

Почему PRAXIS, а не конкуренты

GigaChat Enterprise (Сбер)
Контракты от 5–15 млн ₽/год
Плюсы
Российская модель, 152-ФЗ
Интеграция Сбер-экосистемы
Минусы
Недоступен для SMB по цене
Закрытые веса, слабее на агентных задачах
PRAXIS на порядок дешевле при сопоставимом или лучшем качестве. Open-source. Агентный фреймворк из коробки.
YADRO AI Platform
Серверы от ~8–15 млн ₽ (8× GPU)
Плюсы
Российское производство
Нет санкционных рисков на железо
Минусы
Только железо + базовое ПО
Нет готовых агентов, нет SMB
PRAXIS закрывает прикладной уровень: агенты, интеграции, UI — из коробки. Не нужна команда разработки.
YandexGPT API
400 ₽/1M токенов · ~200 000 ₽/мес при нагрузке SMB
Плюсы
Нет капзатрат, быстрый старт
Простая интеграция
Минусы
Данные уходят в облако Яндекса
OPEX растёт с нагрузкой, нет контроля
При нагрузке от 300 000 токенов/день PRAXIS дешевле уже на 3-й месяц. За 24 мес. — разница до 4,8 млн ₽ только на токенах.
amoCRM «Амма» / Bitrix24 «AI Проекты»
AI-надстройка поверх подписки на CRM
Плюсы
Уже встроена в привычный интерфейс CRM
Низкий порог входа — не отдельное внедрение
Минусы
Нет обогащения данных из ЕГРЮЛ
Нет RAG по внутренней базе знаний компании
PRAXIS — не надстройка над одной CRM, а отдельный слой агентов с доступом к вашим документам и обогащением по ЕГРЮЛ. Работает поверх любой CRM, данные не покидают ваш контур.
Для ИТ-директора и DevOps

Open-source стек. On-prem. Zero vendor lock-in.

СлойКомпонентЛицензияВерсия
LLM InferenceOllama / vLLMMIT Apache 2.0Ollama 0.4+
Базовая модельDeepSeek R1 / Qwen 3MIT Apache 2.0R1-0528 / Q3-2026
Оркестрацияn8n (self-hosted)Sustainable Usen8n 1.x
Агентный фреймворкLangGraph / CrewAIMITLG 0.2+
Векторная БДQdrantApache 2.01.9+
EmbeddingsBAAI/bge-m3MITbge-m3
ТранскрипцияWhisper large-v3MITlarge-v3
UI (чат)Open WebUIMIT0.5+
Реверс-проксиNGINX / CaddyBSD / ApacheStable
МониторингLangfuse + GrafanaMITLangfuse 2.x
VPNWireGuard / HeadscaleGPL / BSDStable

Суммарная стоимость лицензий ПО: 0 ₽/мес. Все компоненты — open-source, self-hosted.

ПараметрТочка входаСтартовыйПолный
GPU1× RTX 4090 24 GB2× RTX 4090 48 GB4× RTX A40 48 GB (192 GB)
CPUAMD Ryzen 9 7950X (16c)AMD EPYC 7443 (24c, 2P)2× AMD EPYC 7713 (128c)
RAM96 GB DDR5-5200256 GB ECC DDR4-3200512 GB ECC DDR4
Хранилище2 TB NVMe + 4 TB NVMe4 TB RAID-1 + 8 TB NVMe8 TB RAID-10 + SAN 20 TB
Сеть1 GbE2× 10 GbE4× 25 GbE + IPMI
Питание1 200 W 80+ Gold2× 1 600 W redundant4× 2 000 W redundant
Форм-факторTower / 4U rack2U rack4U rack
ОСUbuntu 22.04 LTSUbuntu 22.04 LTSUbuntu 22.04 + k3s
LLM модельDeepSeek R1 32B / Qwen 3 30BQwen 3 235B / DeepSeek R1 70BНесколько моделей одновременно
Concurrent users3–510–2050+
Резервный узел— (на дорожной карте)
ubuntu-setup.sh
# Ubuntu + обновление + драйверы NVIDIA
sudo apt update && sudo apt upgrade -y
sudo ubuntu-drivers autoinstall && sudo reboot
nvidia-smi   # Проверка: RTX 4090, CUDA 12.4+

# Docker
curl -fsSL https://get.docker.com | sh
sudo usermod -aG docker $USER && newgrp docker
ollama-install.sh
# Установка Ollama
curl -fsSL https://ollama.com/install.sh | sh
sudo systemctl enable ollama && sudo systemctl start ollama

# Загрузка моделей
ollama pull deepseek-r1:32b    # ~19 GB
ollama pull qwen3:30b           # ~17 GB (MoE)
ollama pull deepseek-r1:14b    # ~9 GB
ollama pull bge-m3              # ~570 MB
deploy.sh
# Развёртывание сервисов
git clone https://[supplier-repo]/apk-start.git /opt/apk
cd /opt/apk && cp .env.example .env && nano .env
docker compose up -d
docker compose ps   # Все сервисы: Up (healthy)

# Загрузка базы знаний
python3 /opt/apk/scripts/ingest.py \
  --source /path/to/documents \
  --collection company_kb \
  --embedding bge-m3
443
HTTPS / TCP
NGINX (reverse proxy)
TLS 1.3, JWT/Basic Auth
11434
HTTP / TCP
Ollama API (Тир 1)
Только localhost — внешний доступ закрыт
8000/8001
HTTP / TCP
vLLM API (Тир 2/3)
Docker internal, API key обязателен
5678
HTTP / TCP
n8n UI & API
Только через NGINX + auth
6333
HTTP / gRPC
Qdrant
API key обязателен
3000
HTTP / TCP
Open WebUI
Через NGINX + TLS
5432
TCP
PostgreSQL
Internal network, пароль
51820
UDP
WireGuard VPN
WireGuard, preshared key
Точка входа
8 ч
P1 отклик, рабочее время
ПоддержкаПн–Пт 09–18 MSK
КаналEmail, Helpdesk
P1 решение48 ч (рабочих)
Стартовый
4 ч
P1 отклик, 24/7
ПоддержкаПн–Пт 09–20 MSK
КаналEmail, TG, Phone
P1 решение24 часа
Полный
1 ч
P1 отклик, 24/7
Поддержка24/7/365
КаналВыделенный менеджер
P1 решение8 часов

Это время реакции и решения обращений в поддержку — не гарантия аптайма сервера. Разворачивается один физический сервер без резервного узла: при аппаратном отказе восстановление идёт через резервные копии и новое оборудование, а не автоматическое переключение на резерв. Резервный узел пока не входит ни в один тариф.

30 дней внедрения

От договора до боевого режима

Пошаговый процесс без сюрпризов. Ваш ИТ-администратор тратит 4 часа в неделю на координацию.

1–3
Дни 1–3
Диагностика процессов

2 интервью с SDR, HR, бухгалтером. Определяем, какие агенты внедряем первыми и в каком порядке.

✓ Чёткий план внедрения
4–10
Дни 4–10
Поставка и установка

Ubuntu + n8n + Ollama + Qdrant, подключение к сети клиента. Проверка: Open WebUI доступен.

✓ Сервер работает
11–18
Дни 11–18
Настройка первого агента

Интеграция с amoCRM / Битрикс24. Тест на 20 реальных лидах. SDR видит первые автозаполненные карточки.

✓ Первый агент в работе
19–25
Дни 19–25
Загрузка базы знаний

PDF, регламенты, договоры → индексация в Qdrant. Сотрудники задают первые вопросы через RAG-чат.

✓ База знаний в работе
26–30
Дни 26–30
Приёмка и SLA

Все агенты протестированы, команда обучена. Подписание акта приёмки. Переход на контракт поддержки.

✓ Система в боевом режиме
Возражения и ответы

Часто задаваемые вопросы

PRAXIS — не ещё один чат-бот. Агенты встроены в ваши процессы: новый лид в CRM запускает агент автоматически. Никаких ручных запросов — система работает, пока вы занимаетесь бизнесом.
При нагрузке от 300 000 токенов в день — PRAXIS дешевле уже на 3-й месяц. YandexGPT API при нагрузке SMB = ~200 000 ₽/мес. За 24 мес. = ~4 800 000 ₽ только за токены. А данные ваших клиентов не уходят на серверы третьих сторон.
PRAXIS поставляется под ключ. 30 дней — и система работает. Ваш ИТ-администратор потратит 4 часа в неделю на мониторинг. Поддержка входит в контракт.
«Точка входа» окупается уже на автоматизации одного агента — например, квалификации лидов (экономия ≈56 000 ₽/мес при подписке 30 000 ₽/мес). Для тех, кто предпочитает OPEX — лизинг от 18 000 ₽/мес.
Open-source — это стек, не продукт. PRAXIS — это собранный, настроенный, интегрированный и поддерживаемый комплекс. Вы покупаете работающую систему и поддержку, а не набор компонентов, которые нужно самостоятельно связать.
Все компоненты — open-source: Ollama, n8n, Qdrant, DeepSeek, Qwen. Лицензии MIT и Apache 2.0. Если мы уйдём с рынка, вы продолжаете работать. Оборудование и ПО принадлежат вам.
Честно: сегодня это один физический сервер без автоматического резервного узла. При аппаратном отказе восстановление идёт через резервные копии на новом оборудовании, а не мгновенное переключение — это стандартное ограничение on-premise для СМБ, и мы не выдумываем несуществующий SLA, чтобы его скрыть. Резервный узел — в проработке; если для вас это критично, обсуждаем конкретные условия резервирования на этапе пилота.
DeepSeek R1 и Qwen 3 обновляются каждые несколько месяцев — обновление модели означает замену весов на том же сервере, а не новую закупку железа. Текущее оборудование рассчитано на следующее поколение открытых моделей 2026–2027 годов. Апгрейд GPU понадобится, только если вы захотите кратно нарастить число одновременных пользователей.
Запросить демо

Покажем, как агенты работают на вашем сценарии

Демонстрация 45 минут. Показываем живой сервер, реального агента на реальных данных (анонимизированных).

Ответ в течение 2 часов в рабочее время. Подтверждаем дату демо в день обращения.
🔒NDA перед демо. Ваши данные не покидают наш разговор.
📋Персональный расчёт ROI для вашей компании по итогам демо.
🚫Никакого давления. Демо — это информация, не продажа.

Условия пилотного внедрения (1–2 агента) — уточняются, требуют данных от PRAXIS перед публикацией.

Нажимая «Отправить», вы соглашаетесь на обработку персональных данных в соответствии с 152-ФЗ.