음성 합성 API (POST /v1/audio/speech)
OpenAI /v1/audio/speech 규격에 따라 입력된 텍스트로부터 오디오 음성을 생성합니다.
📥 요청 본문 (Request Body)
| 필드명 | 타입 | 필수 여부 | 기본값 | 설명 |
|---|---|---|---|---|
model | string | 선택 | edgetts | 모델 또는 Provider ID (tts-1, edgetts, kokoro) |
input | string | 필수 | - | 합성할 텍스트 내용 (최대 8,192자) |
voice | string | 선택 | alloy | 음색 ID 또는 별칭 (alloy, zh-CN-XiaoxiaoNeural) |
response_format | string | 선택 | mp3 | 반환 포맷: mp3, opus, aac, flac, wav, pcm |
speed | float | 선택 | 1.0 | 재생 배속 배율 (0.25 ~ 4.0) |
stream | boolean | 선택 | false | HTTP Chunked 오디오 스트리밍 활성화 여부 |
💡 호출 예시
bash
curl http://localhost:8030/v1/audio/speech -H "Authorization: Bearer sk-onetts-v1-k9L3mX8QZ2sT4vA7wE1rY6u" -H "Content-Type: application/json" -d '{
"model": "tts-1",
"input": "OneTTS는 초고속 음성 합성을 지원합니다.",
"voice": "alloy",
"response_format": "mp3"
}' --output speech.mp3