API de Síntesis de Voz (POST /v1/audio/speech)
Genera audio a partir de texto siguiendo la especificación /v1/audio/speech de OpenAI.
📥 Cuerpo de la Solicitud (Request Body)
| Campo | Tipo | Requerido | Por defecto | Descripción |
|---|---|---|---|---|
model | string | Opcional | edgetts | ID del modelo o proveedor (tts-1, edgetts, kokoro) |
input | string | Sí | - | Texto a sintetizar (hasta 8.192 caracteres) |
voice | string | Opcional | alloy | ID de voz o alias (alloy, zh-CN-XiaoxiaoNeural) |
response_format | string | Opcional | mp3 | Formato: mp3, opus, aac, flac, wav, pcm |
speed | float | Opcional | 1.0 | Multiplicador de velocidad (de 0.25 a 4.0) |
stream | boolean | Opcional | false | Habilitar transmisión de audio HTTP Chunked |
💡 Ejemplo
bash
curl http://localhost:8030/v1/audio/speech \
-H "Authorization: Bearer sk-onetts-v1-k9L3mX8QZ2sT4vA7wE1rY6u" \
-H "Content-Type: application/json" \
-d '{
"model": "tts-1",
"input": "OneTTS ofrece síntesis de voz ultra rápida.",
"voice": "alloy",
"response_format": "mp3"
}' \
--output speech.mp3