Vue d'ensemble & Architecture
OneTTS est une passerelle d'agrégation de synthèse vocale (TTS) professionnelle et performante, conçue pour unifier divers moteurs de synthèse vocale au sein d'un point d'accès API unique compatible OpenAI.
🌟 Pourquoi OneTTS ?
- Remplacement direct du standard OpenAI : Toute application compatible avec OpenAI TTS (comme Dify, FastGPT, Open WebUI, DuRT) peut adopter OneTTS simplement en mettant à jour l'
baseURLet l'apiKey. - Démarrage sans GPU : Grâce au support intégré d'Edge-TTS, déployez immédiatement sur un VPS abordable ou une machine CPU locale sans aucun GPU requis.
- Streaming à faible latence : La segmentation des phrases en pipeline fournit le premier segment audio en moins de 200 ms.
- Mise en cache audio intelligente : Les requêtes de synthèse identiques accèdent instantanément au cache MD5 local, économisant bande passante et ressources de calcul.
🏗️ Architecture
text
Client (DuRT / Dify / Web / API)
│
▼ (HTTP /v1/audio/speech)
┌───────────────────────────────┐
│ Passerelle OneTTS │
│ ┌─────────────────────────┐ │
│ │ Cache de Synthèse MD5 │ │
│ └─────────────────────────┘ │
│ ┌─────────────────────────┐ │
│ │ Découpeur de Phrases │ │
│ └─────────────────────────┘ │
└──────────────┬────────────────┘
│
┌────────────┼────────────┐
▼ ▼ ▼
┌─────────┐ ┌─────────┐ ┌───────────┐
│ EdgeTTS │ │ Kokoro │ │ CosyVoice │
└─────────┘ └─────────┘ └───────────┘