Vollständige Anleitung zu TTS-Stimmenoptionen, Browser-Kompatibilität und Audioerfassung
SSN kann erfassten Chattext aus jeder unterstützten Quelle vorlesen; die Chatplattform braucht keine eigene TTS-Funktion. Dein Dock oder Overlay mit aktiviertem TTS liest empfangene Nachrichten entsprechend seinen Filtern und TTS-Einstellungen vor. Beginne mit der kurzen Einrichtungsanleitung; diese Seite behandelt Stimmenoptionen und erweiterte Einstellungen. Vergleiche Anbieter, höre Beispiele und sieh dir die Einstellungen an.
dock.html?session=YOUR_SESSION&speech=en-US. Standardmäßig wird System TTS verwendet. Füge für einen kostenlosen OBS-Anbieter außerdem &ttsprovider=kokoro hinzu. Lasse diese Seite geöffnet und verbunden; nur eine Instanz sollte sprechen.
| Anbieter | Kosten | OBS-Erfassung | Funktionen |
|---|---|---|---|
| Kokoro TTS | Kostenlos | Direkt | Browserbasierte KI, hervorragende Qualität, Dutzende Stimmen |
| Piper TTS | Kostenlos | Direkt | Browserbasierte, schnelle, CPU-schonende neuronale TTS |
| Kitten TTS | Kostenlos | Direkt | Browserbasiertes, schlankes ONNX-Modell |
| eSpeak-NG | Kostenlos | Direkt | Klassisch und quelloffen, funktioniert auf jeder Hardware |
| Anbieter | Kosten | OBS-Erfassung | Funktionen |
|---|---|---|---|
| OpenAI TTS | API-Kosten fallen an (oder kostenlos lokal) | Direkt | Hohe Qualität; unterstützt über einen eigenen Endpunkt auch lokale Server |
| Google Cloud | API-Kosten fallen an | Direkt | Professionelle Qualität, mehrere Sprachen |
| ElevenLabs | Kostenloses Angebot verfügbar | Direkt | Training eigener Stimmen, natürlicher Klang |
| Speechify | API-Kosten fallen an | Direkt | Hochwertige Stimmen, mehrere Sprachen |
| Gemini TTS | API-Kosten fallen an | Direkt | Generative Sprach-API von Google |
Dies sind typische Möglichkeiten, keine Garantien für jede Installation. OBS verwendet einen eigenen eingebetteten Browser und übernimmt nicht die Stimmenliste eines installierten Chrome/Edge. Ein erfolgreicher SSN-App-Test prüft keine separate OBS-Browser-Quelle.
✓ Systemstimmen auf unterstützten Installationen verfügbar
Google-Stimmen + Systemstimmen
✓ Systemstimmen auf unterstützten Installationen verfügbar
Microsoft-Stimmen + Windows-TTS-Pakete
⚠ Eingeschränkte Unterstützung
Nur lokale Systemsprachen
⚠ Eingeschränkte Unterstützung
Chromium-basiert; verfügbare Stimmen variieren je nach Installation
Die browserbasierten lokalen Anbieter und Cloud-Audioanbieter von SSN spielen erzeugtes Audio über die Seite ab:
Speziell für System TTS:
Downloads für Audio-Routing: VB-Audio Virtual Cable | Voicemeeter | Audio Router (veraltet)
Versuche zuerst, den sprechenden Browser mit OBS-Anwendungs- oder Desktop-Audio zu erfassen, sofern unterstützt. Die folgenden Methoden mit virtuellem Kabel sind optionale Alternativen; sie ergänzen keine Sprachunterstützung in OBS.
Folge den Anweisungen in der offiziellen Microsoft-Anleitung zum Installieren von Sprachpaketen.
| Parameter | Beschreibung | Beispiel |
|---|---|---|
| &speech | TTS mit Sprachcode aktivieren | &speech=en-US |
| &pitch | Stimmtonhöhe (0,1 bis 2,0) | &pitch=1.2 |
| &volume | Lautstärkepegel (0,0 bis 1,0) | &volume=0.8 |
| &rate | Sprechgeschwindigkeit (0,1 bis 10,0) | &rate=1.5 |
| &voice | Teilübereinstimmung des Stimmennamens | &voice=google |
| &ttsprovider | Anbieter auswählen: kokoro, piper, kitten, espeak, openai, customtts, localtts, elevenlabs, google, speechify, gemini | &ttsprovider=customtts |
| Parameter | Beschreibung |
|---|---|
| &simpletts | „sagt“ oder „jemand sagt“ nicht sprechen |
| &simpletts2 | Chatnamen gar nicht vorlesen |
| &ttscommand | Eigenen TTS-Befehl aktivieren (Standard: !say) |
| &readevents | Stream-Ereignisse in TTS einbeziehen |
| &skipmessages=3 | Nur jede 3. Nachricht vorlesen |
?ttsprovider=kokoro&voicekokoro=af_bella&kokorospeed=1.2&voicekokoro=ef_dora für Spanisch oder &voicekokoro=pf_dora für brasilianisches Portugiesisch. Das Ändern von &speech= allein ändert die ausgewählte Stimme nicht. Bestehende englische Stimmen-IDs funktionieren weiterhin.?ttsprovider=piper&pipervoice=en_US-hfc_female-medium&pipervoice=pt_BR-faber-medium oder &pipervoice=pt_BR-edresson-low&pipervoice=es_ES-davefx-medium oder &pipervoice=es_MX-ald-medium&piperspeed=1.0?ttsprovider=kitten&kittenvoice=expr-voice-4-f?ttsprovider=espeak&espeakvoice=en&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br&speech=es-ES&ttsprovider=espeak&espeakvoice=es&espeakspeed=175?speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium?speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br?speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium?speech=es-ES&ttsprovider=espeak&espeakvoice=es?ttsprovider=openai?ttsprovider=customtts oder ?ttsprovider=localtts für einen selbst gehosteten Endpunkt&openaiendpoint=http://localhost:8880/v1/audio/speechlocalhost und 127.0.0.1 bezeichnen denselben Computer, der die TTS-Seite abspielt. Wenn OBS auf einem anderen Computer als dein TTS-Server läuft, verwende stattdessen die LAN-IP des Servercomputers.npm run local-tts-bridge auf dem OBS-Computer und verwende in SSN http://127.0.0.1:8124/v1/audio/speech{ model, input, voice, response_format, speed } und unterstützt binäres Audio, JSON-Audio-URLs und Base64-Audio in JSON&voiceopenai=af_bella, Geschwindigkeit: &openaispeed=1.0. Verwende einen Stimmennamen, den dein Server unterstützt; Kokoro-Stimmen sehen so aus: af_bella, während openedai-speech-/OpenAI-artige Stimmen so aussehen können: nova oder echo.?ttsprovider=google&ttskey=YOUR_API_KEY&voicegoogle=en-GB-Standard-A&googlelang=en-US?ttsprovider=gemini&geminikey=YOUR_API_KEY&geminimodel=gemini-2.5-flash-preview-tts&voicegemini=Kore, Sprache: &geminilang=th-TH&geministyle=Read aloud in a warm tone.?ttsprovider=elevenlabs&elevenlabskey=YOUR_API_KEY&voice11=YOUR_VOICE_ID&elevenlabsmodel=eleven_multilingual_v2Wähle Fish Audio und gib deinen API-Schlüssel sowie optional eine Stimmen-ID ein. Das Standardmodell ist s2.1-pro-free. Einrichtung, Modelloptionen und Einschränkungen beim Browserzugriff.
?ttsprovider=speechify&speechifykey=YOUR_API_KEY&voicespeechify=henry&speechifymodel=simba-3.0 (Standard) oder &speechifymodel=simba-3.2 für Englisch.&speechifyspeed=1.2 (Bereich 0,5 bis 3,0; normal ist 1,0).127.0.0.1.ttsquick aus der OBS-URL, falls vorhanden.Dies listet nur die System-TTS-Stimmen des Browsers, der diese Anleitung anzeigt, auf. Es testet weder OBS noch ein separates SSN-App-Fenster oder Anbieter wie Kokoro. Eine leere Liste bedeutet nicht, dass die anderen TTS-Anbieter von SSN nicht verfügbar sind.