Skip to content

Vue d'ensemble & Architecture ​

OneTTS est une passerelle d'agrégation de synthèse vocale (TTS) professionnelle et performante, conçue pour unifier divers moteurs de synthèse vocale au sein d'un point d'accès API unique compatible OpenAI.


🌟 Pourquoi OneTTS ? ​

  • Remplacement direct du standard OpenAI : Toute application compatible avec OpenAI TTS (comme Dify, FastGPT, Open WebUI, DuRT) peut adopter OneTTS simplement en mettant à jour l'baseURL et l'apiKey.
  • Démarrage sans GPU : Grâce au support intégré d'Edge-TTS, déployez immédiatement sur un VPS abordable ou une machine CPU locale sans aucun GPU requis.
  • Streaming à faible latence : La segmentation des phrases en pipeline fournit le premier segment audio en moins de 200 ms.
  • Mise en cache audio intelligente : Les requêtes de synthèse identiques accèdent instantanément au cache MD5 local, économisant bande passante et ressources de calcul.

🏗️ Architecture ​

text
 Client (DuRT / Dify / Web / API)
                │
                ▼ (HTTP /v1/audio/speech)
    ┌───────────────────────────────┐
    │       Passerelle OneTTS       │
    │  ┌─────────────────────────┐  │
    │  │  Cache de Synthèse MD5  │  │
    │  └─────────────────────────┘  │
    │  ┌─────────────────────────┐  │
    │  │  Découpeur de Phrases   │  │
    │  └─────────────────────────┘  │
    └──────────────┬────────────────┘
                   │
      ┌────────────┼────────────┐
      ▼            ▼            ▼
  ┌─────────┐ ┌─────────┐ ┌───────────┐
  │ EdgeTTS │ │ Kokoro  │ │ CosyVoice │
  └─────────┘ └─────────┘ └───────────┘

Released under the Apache-2.0 License.