tokenola

Text-to-Speech

Синтез естественной русской речи из текста с помощью Tokenola TTS V1.

POST/v1/audio/speech

Параметры запроса

ПараметрТипОписание
model*stringtokenola-tts-v1
input*stringТекст для озвучки, до 5000 символов на один запрос.
voicestringИдентификатор голоса, например alena, dmitry, sky.
formatstringФормат аудио на выходе: mp3, wav или ogg. По умолчанию mp3.

Пример запроса

curl https://api.tokenola.ru/v1/audio/speech \
  -H "Authorization: Bearer $TOKENOLA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tokenola-tts-v1",
    "input": "Заказ подтверждён, курьер выехал",
    "voice": "alena",
    "format": "mp3"
  }' \
  --output speech.mp3

Тарификация

Стоимость рассчитывается по количеству символов во входном тексте (поле input) — см. раздел Модели и цены.