Аудио

Синтез речи (текст в речь) и транскрипция (речь в текст).

Синтез речи

http
POST /v1/audio/speech
json
{
  "text": "Bonjour, ceci est un test de synthese vocale.",
  "voice": "alloy",
  "model": null,
  "routing_strategy": "auto"
}

voice зависит от выбранного поставщика: названия голосов OpenAI (alloy, echo и т. д.) и идентификаторы голосов ElevenLabs не взаимозаменяемы — явно укажите model, если вам нужен конкретный голос.

json
{
  "audio": "https://cdn.uploadscenter.com/file_...",
  "model": "eleven_multilingual_v2",
  "provider": "elevenlabs"
}

Транскрипция

http
POST /v1/audio/transcriptions
json
{
  "audio_url": "https://exemple.com/enregistrement.mp3",
  "language": "fr",
  "model": null,
  "routing_strategy": "auto"
}
json
{
  "text": "Transcription du contenu audio.",
  "model": "whisper-1",
  "provider": "openai"
}

Поставщики

OpenAI (TTS + Whisper), ElevenLabs (высококачественный многоязычный синтез речи + транскрипция).