Технология Как устроена платформа

Своя платформа голосовых агентов

Оркестратор, модели и логика диалога — свои, чужих SDK внутри нет. Поэтому за задержку и качество разговора отвечаем мы, а любую модель можно заменить под требования вашей службы безопасности.

Реестр российского ПО

№34390

01 Каскад Путь реплики

Как голос проходит через платформу

Речь распознаётся, оркестратор решает, что и когда ответить, ответ синтезируется голосом. Модели распознавания, генерации и синтеза подключаются по выбору заказчика.

Голос сотрудника → распознавание речи → оркестратор Pichi (языковая модель, Smart Turn Detection, управление персоной) → синтез речи → голос собеседника Голос Распознавание STT · по выбору Оркестратор Pichi Языковая модель LLM · по выбору Конец реплики своя, локально Управление персоной своя Синтез речи TTS · по выбору Ответ
02 Что наше Строим с 2023 года

Компоненты, которые мы сделали сами

Pichi

Оркестратор диалога

Собственный сервер управления моделями. Здесь живут персона, её характер и логика возражений.

Pichi

Smart Turn Detection

Небольшая модель на базе Qwen решает, договорил человек или держит паузу. Работает локально: аудио для этой задачи наружу не уходит.

Pichi

Управление персоной

Отдельная модель слушает диалог и держит характер собеседника, чтобы скептичный врач не начал помогать через три реплики.

Преимущество

Распознавание под фарму

Своя модель распознавания речи, дообученная на фармацевтических терминах: названия препаратов, дозировки, числительные. Работает локально.

Pichi

Свои STT и TTS для on-prem

Распознавание и синтез речи разворачиваются в контуре заказчика, без внешних вызовов.

04 Демо По запросу

Техническая встреча с вашими ИТ и СБ

Разберём архитектуру, ответим на анкету безопасности, покажем on-prem сборку.