NeuroCall Speech API · Синтез

Синтез речи, который не звучит роботом.

Голосовой движок с управлением интонацией и паузами, потоковой отдачей звука и клонированием голоса под ваш бренд. Работает на ваших серверах по API — без обращений к чужим облакам.

Документация
Страница «TTS API»
kk + RU
Два языка одним движком и одним каталогом голосов
streaming
Звук отдаётся чанками до конца генерации фразы
clone
Голос из вашего референса или каталога организации
01Возможности

Что именно продаёт TTS-эндпоинт.

Живая интонация вместо диктора

Паузы, темп и ударения управляются на уровне текста: вопрос звучит вопросом, перечисление — перечислением. Агент не зачитывает ответ роботом.

Клонирование голоса под бренд

Голос клонируется из короткого референса или выбирается из каталога Voice вашей организации. Один голос живёт во всех каналах — звонки, IVR, уведомления.

Потоковый синтез для диалога

Первый аудио-чанк уходит раньше, чем фраза досинтезирована целиком — пауза перед ответом остаётся в человеческих рамках даже на длинных репликах.

Движок в вашем контуре

Веса стоят на ваших GPU-серверах: ни один фрагмент текста или звука не уходит наружу, а лимиты и тарифы стороннего облака к вам не применяются.

02Интеграция

Один запрос — готовый результат.

  1. Шаг 1

    Текст ответа

    Реплика агента или любой текст по HTTP — до пары абзацев за запрос.

  2. Шаг 2

    Нормализация

    Числа, даты, суммы в тенге и аббревиатуры разворачиваются в произносимую форму.

  3. Шаг 3

    Синтез чанками

    Фраза делится на естественные куски и озвучивается по мере готовности.

  4. Шаг 4

    Аудио-стрим

    Байты звука текут в звонок или в ваш плеер с первого готового чанка.

Схема вызова · python
import requests

resp = requests.post(
    "https://neurocall.io/api/v1/synthesis",
    headers={"Authorization": f"Bearer {SPEECH_API_KEY}"},
    json={
        "voice": "<голос из каталога организации>",
        "text": "Сәлеметсіз бе! Картаңыз белсендірілді.",
    },
    stream=True,
)

# Звук начинается до конца синтеза всей фразы:
for chunk in resp.iter_content(chunk_size=4096):
    play(chunk)

Схема показывает форму интеграции: движок поставляется внутрь вашего периметра, базовый хост — ваш. Точный контракт фиксируем при подключении вместе с ключами.

Разворачивается там же, где весь агент.

Docker-образ в ваш контур: собственные веса модели, GPU-сервер, лимиты и тарифы чужого облака не применимы. Аудио и текст не покидают вашу сеть.

on-premisedockergpu
TTS API · пилот

Проверим на ваших записях за первую неделю.

Пришлите выборку реального звука — вернём измеримый результат на ваших данных, а не демо на наших. Нужен и голос для ответов? STT API — та же поставка, тот же контур.