Своя платформа голосовых агентов
Оркестратор, модели и логика диалога — свои, чужих SDK внутри нет. Поэтому за задержку и качество разговора отвечаем мы, а любую модель можно заменить под требования вашей службы безопасности.
№34390
Как голос проходит через платформу
Речь распознаётся, оркестратор решает, что и когда ответить, ответ синтезируется голосом. Модели распознавания, генерации и синтеза подключаются по выбору заказчика.
Компоненты, которые мы сделали сами
Оркестратор диалога
Собственный сервер управления моделями. Здесь живут персона, её характер и логика возражений.
Smart Turn Detection
Небольшая модель на базе Qwen решает, договорил человек или держит паузу. Работает локально: аудио для этой задачи наружу не уходит.
Управление персоной
Отдельная модель слушает диалог и держит характер собеседника, чтобы скептичный врач не начал помогать через три реплики.
Распознавание под фарму
Своя модель распознавания речи, дообученная на фармацевтических терминах: названия препаратов, дозировки, числительные. Работает локально.
Свои STT и TTS для on-prem
Распознавание и синтез речи разворачиваются в контуре заказчика, без внешних вызовов.
Четыре продукта на одном движке
Техническая встреча с вашими ИТ и СБ
Разберём архитектуру, ответим на анкету безопасности, покажем on-prem сборку.