Skip to content
Passerelle OneTTS · Synthèse Vocale Haute Performance

Nouvelle Génération UnifiéePasserelle TTS Auto-hébergée

Agrège Edge-TTS, Kokoro, CosyVoice et OpenAI en une passerelle de synthèse vocale ultra-rapide et 100% compatible OpenAI.

# 1. Pull and run OneTTS Gateway Service
$ docker run -d -p 8030:8030 --name onetts codeandxv/onetts:latest
INFO: Registering TTS Engines: [edgetts, kokoro, openai]
INFO: Application startup complete. Uvicorn running on http://0.0.0.0:8030
OpenAI Speech API ready at /v1/audio/speech

Conçu pour les Agents Vocaux Temps Réel

Haut débit, latence de streaming inférieure à 200 ms et compatibilité client universelle.

🎙️API Standard

Compatible OpenAI Speech

Remplacement direct pour /v1/audio/speech, /v1/models et /v1/audio/voices sans modification de code.

⚡< 200ms

Streaming par Chunks < 200 ms

Découpage par phrases et streaming HTTP Chunked pour une lecture audio instantanée.

🧩Multi-Moteurs

Agrégation Multi-Moteurs

Intègre Microsoft Edge-TTS, Kokoro-82M ONNX, CosyVoice et OpenAI avec plus de 400 voix.

💾Cache

Cache Disque Intelligent MD5

Mise en cache automatique des requêtes pour des réponses en moins de 10 ms sur les phrases récurrentes.

🛡️Privé

100% Auto-hébergé & Privé

Déploiement local avec Docker ou uv. Aucune fuite de données vocales vers des tiers.

🎛️Contrôle Fin

Contrôle Précis & Multi-Formats

Ajustement fin du débit, de la hauteur et prise en charge des formats MP3, WAV, AAC, OPUS, FLAC.

Moteurs de Synthèse Pris en Charge

Sélectionnez le moteur idéal selon vos besoins de latence, de matériel et de fidélité vocale.

MoteurTypeVoix / LanguesLatenceMatérielIdéal pour
Edge-TTSRecommandéCloud / Gratuit400+ Voix / 40+ Langues150 - 300msCPU / RAM faibleLecture générale, textes multilingues, production de livres audio
Kokoro-82MUltra RapideONNX LocalAnglais / Japonais / Chinois< 150msCPU ou GPU CUDAAgents vocaux conversationnels temps réel, PNJ de jeux vidéo
CosyVoiceModèle Neuronal LocalClonage de Voix Zero-Shot250 - 450msGPU NVIDIA (CUDA)Clonage vocal personnalisé haute fidélité et voix expressives
OpenAI RelayCloud Upstreamalloy, echo, fable, onyx, nova, shimmer300 - 600msClé API uniquementSecours officiel OpenAI et proxy multi-modèles

Pipeline de Synthèse Vocale

De la requête textuelle au flux audio en quatre étapes optimisées.

Step 01

Authentification & Analyse API

Validation des jetons et analyse du modèle, de la voix, du texte et du format.

Step 02

Normalisation & Cache MD5

Recherche dans le cache disque ou découpage du texte en segments phonétiques.

Step 03

Acheminement vers le Moteur

Distribution parallèle des segments au moteur cible (EdgeTTS, Kokoro, CosyVoice).

Step 04

Encodage & Diffusion Chunked

Diffusion en flux continu vers le client tout en enregistrant le résultat dans le cache.

Aucune Modification du SDK

Modifiez simplement base_url dans votre SDK OpenAI pour utiliser OneTTS.

from openai import OpenAI

# Initialize client pointing to your local OneTTS gateway
client = OpenAI(
    base_url="http://localhost:8030/v1",
    api_key="sk-onetts-v1-k_8LxQm9Z2sTwE7rY1u"
)

# Synthesize speech stream using Edge-TTS or Kokoro
response = client.audio.speech.create(
    model="edgetts",
    voice="zh-CN-YunxiNeural",
    input="你好,这是通过 OneTTS 高性能语音合成网关生成的高保真音频流!",
    response_format="mp3",
    speed=1.0
)

# Stream or save audio directly
response.stream_to_file("output.mp3")

Released under the Apache-2.0 License.