Pełny poradnik opcji głosów syntezy mowy, zgodności przeglądarek i przechwytywania dźwięku
SSN może odczytywać przechwycony tekst czatu z każdego obsługiwanego źródła; platforma czatu nie potrzebuje własnej funkcji TTS. Dok lub nakładka z włączonym TTS odczytuje otrzymane wiadomości zgodnie z filtrami i ustawieniami TTS. Zacznij od krótkiego poradnika konfiguracji; ta strona opisuje opcje głosów i ustawienia zaawansowane. Porównaj dostawców, posłuchaj próbek i zobacz ustawienia.
dock.html?session=YOUR_SESSION&speech=en-US. Domyślnie używa System TTS. Dla bezpłatnego dostawcy w OBS dodaj również &ttsprovider=kokoro. Pozostaw tę stronę otwartą i połączoną; mówić powinna tylko jedna kopia.
| Dostawca | Koszt | Przechwytywanie w OBS | Funkcje |
|---|---|---|---|
| Kokoro TTS | Bezpłatne | Bezpośrednio | AI w przeglądarce, doskonała jakość, dziesiątki głosów |
| Piper TTS | Bezpłatne | Bezpośrednio | Szybki neuronowy TTS w przeglądarce, przyjazny dla CPU |
| Kitten TTS | Bezpłatne | Bezpośrednio | W przeglądarce, lekki model ONNX |
| eSpeak-NG | Bezpłatne | Bezpośrednio | Klasyczny, z otwartym kodem, działa na dowolnym sprzęcie |
| Dostawca | Koszt | Przechwytywanie w OBS | Funkcje |
|---|---|---|---|
| OpenAI TTS | Obowiązują opłaty API (lub bezpłatnie lokalnie) | Bezpośrednio | Wysoka jakość; obsługuje również lokalne serwery przez własny punkt końcowy |
| Google Cloud | Obowiązują opłaty API | Bezpośrednio | Profesjonalna jakość, wiele języków |
| ElevenLabs | Dostępny bezpłatny plan | Bezpośrednio | Własne trenowanie głosu, naturalne brzmienie |
| Speechify | Obowiązują opłaty API | Bezpośrednio | Wysokiej jakości głosy, wiele języków |
| Gemini TTS | Obowiązują opłaty API | Bezpośrednio | API generatywnego języka Google |
To typowe możliwości, a nie gwarancje dla każdej instalacji. OBS używa własnej wbudowanej przeglądarki i nie dziedziczy listy głosów zainstalowanego Chrome/Edge. Udany test w aplikacji SSN nie testuje oddzielnego źródła przeglądarkowego OBS.
✓ Głosy systemowe dostępne w obsługiwanych instalacjach
Głosy Google + głosy systemowe
✓ Głosy systemowe dostępne w obsługiwanych instalacjach
Głosy Microsoft + pakiety TTS Windows
⚠ Ograniczona obsługa
Tylko lokalne języki systemowe
⚠ Ograniczona obsługa
Oparte na Chromium; dostępne głosy zależą od instalacji
Lokalni dostawcy SSN działający w przeglądarce i chmurowi dostawcy dźwięku odtwarzają wygenerowany dźwięk przez stronę:
W szczególności dla System TTS:
Programy do routingu do pobrania: VB-Audio Virtual Cable | Voicemeeter | Audio Router (starsze)
Najpierw spróbuj przechwycić mówiącą przeglądarkę przez dźwięk aplikacji lub pulpitu OBS, tam gdzie jest to obsługiwane. Poniższe metody wirtualnego kabla są opcjonalnymi alternatywami; nie dodają obsługi mowy do OBS.
Postępuj zgodnie z instrukcjami w oficjalnym poradniku Microsoft , aby zainstalować pakiety językowe.
| Parametr | Opis | Przykład |
|---|---|---|
| &speech | Włącz TTS z kodem języka | &speech=en-US |
| &pitch | Wysokość głosu (od 0.1 do 2.0) | &pitch=1.2 |
| &volume | Poziom głośności (od 0.0 do 1.0) | &volume=0.8 |
| &rate | Tempo mowy (od 0.1 do 10.0) | &rate=1.5 |
| &voice | Częściowe dopasowanie nazwy głosu | &voice=google |
| &ttsprovider | Wybierz dostawcę: kokoro, piper, kitten, espeak, openai, customtts, localtts, elevenlabs, google, speechify, gemini | &ttsprovider=customtts |
| Parametr | Opis |
|---|---|
| &simpletts | Nie mów „mówi” ani „ktoś mówi” |
| &simpletts2 | W ogóle nie odczytuj nazw uczestników czatu |
| &ttscommand | Włącz własne polecenie TTS (domyślnie: !say) |
| &readevents | Uwzględniaj zdarzenia transmisji w TTS |
| &skipmessages=3 | Odczytuj tylko co trzecią wiadomość |
?ttsprovider=kokoro&voicekokoro=af_bella&kokorospeed=1.2&voicekokoro=ef_dora dla hiszpańskiego lub &voicekokoro=pf_dora dla portugalskiego brazylijskiego. Zmiana &speech= sama nie zmienia wybranego głosu. Istniejące identyfikatory głosów angielskich nadal działają.?ttsprovider=piper&pipervoice=en_US-hfc_female-medium&pipervoice=pt_BR-faber-medium lub &pipervoice=pt_BR-edresson-low&pipervoice=es_ES-davefx-medium lub &pipervoice=es_MX-ald-medium&piperspeed=1.0?ttsprovider=kitten&kittenvoice=expr-voice-4-f?ttsprovider=espeak&espeakvoice=en&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br&speech=es-ES&ttsprovider=espeak&espeakvoice=es&espeakspeed=175?speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium?speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br?speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium?speech=es-ES&ttsprovider=espeak&espeakvoice=es?ttsprovider=openai?ttsprovider=customtts lub ?ttsprovider=localtts dla samodzielnie hostowanego punktu końcowego&openaiendpoint=http://localhost:8880/v1/audio/speechlocalhost i 127.0.0.1 oznaczają ten sam komputer, który odtwarza stronę TTS. Jeśli OBS działa na innym komputerze niż serwer TTS, użyj zamiast tego adresu IP komputera serwera w sieci LAN.npm run local-tts-bridge na komputerze OBS i skieruj SSN do http://127.0.0.1:8124/v1/audio/speech{ model, input, voice, response_format, speed } i obsługuje binarny dźwięk, adresy dźwięku w JSON oraz dźwięk base64 w JSON&voiceopenai=af_bella, szybkość: &openaispeed=1.0. Użyj nazwy głosu obsługiwanej przez serwer; głosy Kokoro wyglądają jak af_bella, natomiast głosy w stylu openedai-speech/OpenAI mogą wyglądać jak nova lub echo.?ttsprovider=google&ttskey=YOUR_API_KEY&voicegoogle=en-GB-Standard-A&googlelang=en-US?ttsprovider=gemini&geminikey=YOUR_API_KEY&geminimodel=gemini-2.5-flash-preview-tts&voicegemini=Kore, język: &geminilang=th-TH&geministyle=Read aloud in a warm tone.?ttsprovider=elevenlabs&elevenlabskey=YOUR_API_KEY&voice11=YOUR_VOICE_ID&elevenlabsmodel=eleven_multilingual_v2Wybierz Fish Audio i wpisz klucz API oraz opcjonalny identyfikator głosu. Domyślny model to s2.1-pro-free. Konfiguracja, opcje modeli i ograniczenia dostępu przeglądarki.
?ttsprovider=speechify&speechifykey=YOUR_API_KEY&voicespeechify=henry&speechifymodel=simba-3.0 (domyślnie) lub &speechifymodel=simba-3.2 dla angielskiego.&speechifyspeed=1.2 (zakres od 0.5 do 3.0; normalna wartość to 1.0).127.0.0.1.ttsquick z adresu OBS, jeśli występuje.Ta lista pokazuje wyłącznie głosy System TTS w przeglądarce wyświetlającej ten poradnik. Nie testuje to OBS, oddzielnego okna aplikacji SSN ani dostawców takich jak Kokoro. Pusta lista nie oznacza, że inni dostawcy TTS w SSN są niedostępni.