Audio

Síntesis de voz (texto a voz) y transcripción (voz a texto).

Síntesis de voz

http
POST /v1/audio/speech
json
{
  "text": "Bonjour, ceci est un test de synthese vocale.",
  "voice": "alloy",
  "model": null,
  "routing_strategy": "auto"
}

voice depende del proveedor elegido: los nombres de OpenAI (alloy, echo, ...) y los identificadores de voz de ElevenLabs no son intercambiables — fija model explícitamente si necesitas una voz precisa.

json
{
  "audio": "https://cdn.uploadscenter.com/file_...",
  "model": "eleven_multilingual_v2",
  "provider": "elevenlabs"
}

Transcripción

http
POST /v1/audio/transcriptions
json
{
  "audio_url": "https://exemple.com/enregistrement.mp3",
  "language": "fr",
  "model": null,
  "routing_strategy": "auto"
}
json
{
  "text": "Transcription du contenu audio.",
  "model": "whisper-1",
  "provider": "openai"
}

Proveedores

OpenAI (TTS + Whisper), ElevenLabs (síntesis de voz multilingüe de alta calidad + transcripción).