Guide complet des voix de synthèse vocale, de la compatibilité des navigateurs et de la capture audio
SSN peut lire le texte capturé depuis toute source prise en charge ; la plateforme de chat n’a pas besoin de sa propre fonction de synthèse vocale. Votre dock ou incrustation avec synthèse vocale lit les messages reçus selon ses filtres et paramètres vocaux. Commencez par le guide de configuration rapide; cette page couvre les options de voix et les réglages avancés. Comparez les fournisseurs, écoutez des exemples et consultez les paramètres.
dock.html?session=YOUR_SESSION&speech=en-US. La synthèse vocale système est utilisée par défaut. Pour un fournisseur gratuit dans OBS, ajoutez aussi &ttsprovider=kokoro. Gardez cette page ouverte et connectée ; une seule instance doit parler.
| Fournisseur | Coût | Capture OBS | Fonctionnalités |
|---|---|---|---|
| Kokoro TTS | Gratuit | Direct | IA dans le navigateur, excellente qualité, des dizaines de voix |
| Piper TTS | Gratuit | Direct | Dans le navigateur, synthèse neuronale rapide et légère pour le CPU |
| Kitten TTS | Gratuit | Direct | Dans le navigateur, modèle ONNX léger |
| eSpeak-NG | Gratuit | Direct | Open source classique, compatible avec tout matériel |
| Fournisseur | Coût | Capture OBS | Fonctionnalités |
|---|---|---|---|
| OpenAI TTS | Frais API applicables, ou gratuit en local | Direct | Haute qualité ; prend aussi en charge des serveurs locaux via un point d’accès personnalisé |
| Google Cloud | Frais API applicables | Direct | Qualité professionnelle, plusieurs langues |
| ElevenLabs | Offre gratuite disponible | Direct | Entraînement de voix personnalisées, son naturel |
| Speechify | Frais API applicables | Direct | Voix de haute qualité, plusieurs langues |
| Synthèse vocale Gemini | Frais API applicables | Direct | API de langage génératif Google |
Il s’agit de capacités habituelles, sans garantie pour chaque installation. OBS utilise son propre navigateur intégré et n’hérite pas de la liste des voix Chrome/Edge installée. Un test réussi dans l’application SSN ne teste pas une source Navigateur OBS distincte.
✓ Voix système disponibles sur les installations compatibles
Voix Google et voix système
✓ Voix système disponibles sur les installations compatibles
Voix Microsoft et packs TTS Windows
⚠ Prise en charge limitée
Langues du système local uniquement
⚠ Prise en charge limitée
Basé sur Chromium ; les voix disponibles varient selon l’installation
Les fournisseurs locaux dans le navigateur et les fournisseurs audio cloud de SSN diffusent le son généré dans la page :
Pour la synthèse vocale système en particulier :
Téléchargements pour le routage : VB-Audio Virtual Cable | Voicemeeter | Audio Router (ancien)
Essayez d’abord de capturer le navigateur qui parle avec la capture audio d’application ou de bureau d’OBS, lorsque c’est pris en charge. Les méthodes par câble virtuel ci-dessous sont des alternatives facultatives ; elles n’ajoutent pas de prise en charge vocale à OBS.
Suivez les instructions du guide officiel Microsoft pour installer les packs de langues.
| Paramètre | Description | Exemple |
|---|---|---|
| &speech | Activer la synthèse vocale avec un code de langue | &speech=en-US |
| &pitch | Hauteur de voix (0.1 à 2.0) | &pitch=1.2 |
| &volume | Niveau de volume (0.0 à 1.0) | &volume=0.8 |
| &rate | Vitesse de parole (0.1 à 10.0) | &rate=1.5 |
| &voice | Correspondance partielle du nom de voix | &voice=google |
| &ttsprovider | Sélectionnez un fournisseur : kokoro, piper, kitten, espeak, openai, customtts, localtts, elevenlabs, google, speechify, gemini | &ttsprovider=customtts |
| Paramètre | Description |
|---|---|
| &simpletts | Ne pas dire « dit » ou « quelqu’un dit » |
| &simpletts2 | Ne jamais lire les noms des participants |
| &ttscommand | Activer une commande vocale personnalisée, !say par défaut |
| &readevents | Inclure les événements de diffusion dans la lecture vocale |
| &skipmessages=3 | Lire seulement un message sur trois |
?ttsprovider=kokoro&voicekokoro=af_bella&kokorospeed=1.2&voicekokoro=ef_dora pour l’espagnol ou &voicekokoro=pf_dora pour le portugais brésilien. Modifier &speech= seul ne change pas la voix sélectionnée. Les identifiants de voix anglaises existants fonctionnent toujours.?ttsprovider=piper&pipervoice=en_US-hfc_female-medium&pipervoice=pt_BR-faber-medium ou &pipervoice=pt_BR-edresson-low&pipervoice=es_ES-davefx-medium ou &pipervoice=es_MX-ald-medium&piperspeed=1.0?ttsprovider=kitten&kittenvoice=expr-voice-4-f?ttsprovider=espeak&espeakvoice=en&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br&speech=es-ES&ttsprovider=espeak&espeakvoice=es&espeakspeed=175?speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium?speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br?speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium?speech=es-ES&ttsprovider=espeak&espeakvoice=es?ttsprovider=openai?ttsprovider=customtts ou ?ttsprovider=localtts pour un point d’accès auto-hébergé&openaiendpoint=http://localhost:8880/v1/audio/speechlocalhost et 127.0.0.1 désignent l’ordinateur qui lit la page de synthèse vocale. Si OBS se trouve sur un autre ordinateur que le serveur vocal, utilisez l’adresse IP locale du serveur.npm run local-tts-bridge sur l’ordinateur OBS et configurez SSN pour utiliser http://127.0.0.1:8124/v1/audio/speech{ model, input, voice, response_format, speed } et prend en charge le son binaire, les URL audio en JSON et le son en base64 JSON&voiceopenai=af_bella, vitesse : &openaispeed=1.0. Utilisez un nom de voix pris en charge par votre serveur ; les voix Kokoro ressemblent à af_bella, tandis que les voix de type openedai-speech/OpenAI peuvent ressembler à nova ou echo.?ttsprovider=google&ttskey=YOUR_API_KEY&voicegoogle=en-GB-Standard-A&googlelang=en-US?ttsprovider=gemini&geminikey=YOUR_API_KEY&geminimodel=gemini-2.5-flash-preview-tts&voicegemini=Kore, langue : &geminilang=th-TH&geministyle=Read aloud in a warm tone.?ttsprovider=elevenlabs&elevenlabskey=YOUR_API_KEY&voice11=YOUR_VOICE_ID&elevenlabsmodel=eleven_multilingual_v2Choisissez Fish Audio et saisissez votre clé API, avec un identifiant de voix facultatif. Le modèle par défaut est s2.1-pro-free. Configuration, options de modèles et limites d’accès du navigateur.
?ttsprovider=speechify&speechifykey=YOUR_API_KEY&voicespeechify=henry&speechifymodel=simba-3.0 (par défaut), ou &speechifymodel=simba-3.2 pour l’anglais.&speechifyspeed=1.2 (plage de 0.5 à 3.0 ; valeur normale : 1.0).127.0.0.1.ttsquick de l’URL OBS s’il est présent.Cela répertorie les Voix système du seul navigateur affichant ce guide. Cela ne teste pas OBS, une fenêtre SSN distincte ni les fournisseurs comme Kokoro. Une liste vide ne signifie pas que les autres fournisseurs SSN sont indisponibles.