Audio
Síntesis de voz (texto a voz) y transcripción (voz a texto).
Síntesis de voz
http
POST /v1/audio/speechjson
{
"text": "Bonjour, ceci est un test de synthese vocale.",
"voice": "alloy",
"model": null,
"routing_strategy": "auto"
}voice depende del proveedor elegido: los nombres de OpenAI (alloy, echo, ...) y los identificadores de voz de ElevenLabs no son intercambiables — fija model explícitamente si necesitas una voz precisa.
json
{
"audio": "https://cdn.uploadscenter.com/file_...",
"model": "eleven_multilingual_v2",
"provider": "elevenlabs"
}Transcripción
http
POST /v1/audio/transcriptionsjson
{
"audio_url": "https://exemple.com/enregistrement.mp3",
"language": "fr",
"model": null,
"routing_strategy": "auto"
}json
{
"text": "Transcription du contenu audio.",
"model": "whisper-1",
"provider": "openai"
}Proveedores
OpenAI (TTS + Whisper), ElevenLabs (síntesis de voz multilingüe de alta calidad + transcripción).