Skip to content

API de Síntesis de Voz (POST /v1/audio/speech) ​

Genera audio a partir de texto siguiendo la especificación /v1/audio/speech de OpenAI.


📥 Cuerpo de la Solicitud (Request Body) ​

CampoTipoRequeridoPor defectoDescripción
modelstringOpcionaledgettsID del modelo o proveedor (tts-1, edgetts, kokoro)
inputstringSí-Texto a sintetizar (hasta 8.192 caracteres)
voicestringOpcionalalloyID de voz o alias (alloy, zh-CN-XiaoxiaoNeural)
response_formatstringOpcionalmp3Formato: mp3, opus, aac, flac, wav, pcm
speedfloatOpcional1.0Multiplicador de velocidad (de 0.25 a 4.0)
streambooleanOpcionalfalseHabilitar transmisión de audio HTTP Chunked

💡 Ejemplo ​

bash
curl http://localhost:8030/v1/audio/speech \
  -H "Authorization: Bearer sk-onetts-v1-k9L3mX8QZ2sT4vA7wE1rY6u" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts-1",
    "input": "OneTTS ofrece síntesis de voz ultra rápida.",
    "voice": "alloy",
    "response_format": "mp3"
  }' \
  --output speech.mp3

Released under the Apache-2.0 License.