Продукт · On-premise
Голосовой агент в вашем контуре — от двух дней до запуска
Агент и распознавание речи работают на ваших серверах, звук разговоров остаётся у вас. Хотите, чтобы вообще всё жило внутри, — разворачиваем полный контур. Хотите быстро и дёшево — гибрид на CPU.
- Гибрид на CPU — 2 дня
- Полный контур — 2 недели
- 900–1400 мс до ответа
Живое демо
Вера · инженер по внедрению
Это настоящий агент на нашем железе, а не запись. Выберите сценарий и просто говорите.
Нужен микрофон · звонок до 3 минут
Разговор записывается и расшифровывается, чтобы мы улучшали агента и могли с вами связаться. Нажимая «Позвонить», вы соглашаетесь с Политикой конфиденциальности.
Спросите про схемы развёртывания, сроки и задержку — Вера расскажет, как это работает у вас в контуре.
Попробуйте сказать
«Чем гибрид отличается от полного контура?»«Какая задержка ответа?»«За сколько запустите?»Коротко в цифрах
900–1400 мс
от окончания фразы клиента до начала ответа агента (voice-to-voice)
2 дня
запуск гибридной схемы: агент и распознавание речи на CPU у вас
2 недели
развёртывание полного контура у вас
API-доки
документация по on-premise API и интеграциям входит в поставку
Схема 1. Гибрид: агент и STT у вас, LLM и TTS у нас
Самый быстрый и недорогой путь: не нужны мощные GPU-серверы, а звук разговоров не покидает ваш контур.
Телефония и клиент
Звонок клиента
ваша АТС или SIP-провайдер
Ваш контур
У вас
Агент SalesBot
логика диалога, сценарий, интеграции
Распознавание речи (STT)
работает на CPU
Облако SalesBot
У нас
Языковая модель (LLM)
или ваша собственная
Синтез речи (TTS)
или ваш собственный
Речь распознаётся у вас, наружу уходит только текст реплик. Языковую модель или синтез речи можно заменить своими.
Схема 2. Полный контур: всё внутри вашей инфраструктуры
Для компаний, у которых наружу нельзя отправлять ничего. Наше ПО на вашем оборудовании или комплект с железом под ключ.
Телефония и клиент
Звонок клиента
ваша АТС или SIP-провайдер
Ваш контур
У вас
Агент SalesBot
логика диалога, сценарий, интеграции
Распознавание речи (STT)
Языковая модель (LLM)
Синтез речи (TTS)
Ваши системы
CRM и другие системы
Битрикс24, amoCRM, ваш API
Какую схему выбрать
| Облако SalesBot | Гибрид на CPU | Полный контур | |
|---|---|---|---|
| Где распознавание речи | У нас | У вас, на CPU | У вас |
| Где LLM и синтез речи | У нас | У нас; можно подключить свои | У вас |
| Что остаётся у вас | — | Звук разговоров, агент, STT | Всё |
| Запуск | Сразу после настройки | около 2 дней | около 2 недель |
| Для кого | Быстрый старт без инфраструктуры | Контроль над звуком и низкая цена | Полностью закрытый контур |
Цены не публикуем: стоимость зависит от нагрузки и схемы, называем после встречи.
Почему так
Контроль над данными без дорогого железа и долгого проекта
Дешевле полного контура
В гибриде распознавание речи работает на обычных CPU, без собственных GPU-серверов. Тяжёлые модели — LLM и синтез речи — остаются у нас, и под них не нужно покупать оборудование.
Звук разговоров — у вас
Речь распознаётся в вашем контуре, наружу уходит только текст реплик. Вместо наших LLM или TTS можно подключить свои.
Запуск за дни, а не за месяцы
Гибрид — около 2 дней, полный контур — около 2 недель. Документация по on-premise API входит в поставку.
Проверенный стек
Платформа и модели те же, что работают в нашем облаке, задержка ответа 900–1400 мс. Послушайте агента вверху страницы.
Что входит в поставку
Развёртывание
Устанавливаем и настраиваем агента и выбранные компоненты, подключаем телефонию и ваши системы.
API и документация
Документация по on-premise API и интеграциям поставляется вместе с платформой.
Свои модели
В гибридной схеме можно использовать собственную языковую модель или синтез речи вместо наших.
Оборудование
Для полного контура возможен комплект с железом под ключ — подбираем под вашу нагрузку.
Запуск сценариев
Помогаем настроить первых агентов и проверить их на реальных звонках.
Сопровождение
Поддержка и обновления после запуска.
Вопросы про on-premise
Сколько стоит on-premise?
Стоимость зависит от схемы, нагрузки и требований к безопасности, поэтому мы не публикуем её на сайте — называем после встречи.
Чем гибрид на CPU отличается от полного контура?
В гибриде у вас работают агент и распознавание речи на обычных CPU-серверах, а языковая модель и синтез речи — в нашем облаке. Это быстрее запускается (около 2 дней) и дешевле. В полном контуре всё работает у вас, на развёртывание уходит около 2 недель.
Какая задержка ответа?
Обычно 900–1400 мс от конца фразы клиента до начала ответа агента — по нашим замерам. Точная цифра зависит от схемы, канала и выбранных моделей.
Что уходит за пределы нашего контура в гибридной схеме?
Речь распознаётся у вас, поэтому звук разговоров остаётся внутри. Наружу, в наше облако, передаётся текст реплик для языковой модели и синтеза речи.
Можно использовать свою языковую модель или синтез речи?
Да, в гибридной схеме можно подключить собственные LLM или TTS вместо наших.
Какое оборудование нужно?
В гибриде — серверы на CPU под распознавание речи и агента, в полном контуре — оборудование под все компоненты. Конкретные требования называем после разговора о вашей нагрузке; для полного контура можем поставить комплект с железом.
Дадите ли вы документацию?
Да, документация по on-premise API и интеграциям поставляется вместе с платформой.
Можно ли начать с облака, а потом перейти?
Можно: запустить сценарии в облаке, проверить эффект, затем обсудить перенос в ваш контур.
Выжмите всё из вашего трафика
Обсудим развёртывание в вашем контуре
Расскажите о нагрузке и требованиях к безопасности — вернёмся с подходящей схемой и расчётом.
Или свяжитесь с нами напрямую