Przewodnik konfiguracji TTS

Usłysz swój czat w trzech krokach. Zacznij bezpłatnie, bez konta ani klucza API.

1. Włącz odczytywanie czatu

Czat nie jest jeszcze połączony? Zacznij tutaj: zainstaluj SSN, dodaj źródło i otwórz dok.

Otwórz panel rozszerzenia SSN lub w aplikacji komputerowej „Źródła i ustawienia”.

W sekcji Główna nakładka czatu i dok sterowania, rozwiń Wiadomość — synteza mowy. Włącz przełącznik pokazany tutaj:

Rzeczywisty panel: Message — Text to Speech, z włączonym Enable TTS in dock
Niebieski przełącznik = odczytywanie czatu jest włączone.

2. Wybierz bezpłatny głos

W tej samej sekcji przewiń do Dostawca usługi TTS. Wybierz Piper TTS, a następnie głos.

Rzeczywisty panel: wybrany Piper TTS z głosem English US Female HFC Medium
Piper nie wymaga konta ani klucza API. Daj czas na pierwsze pobranie głosu.

Użyj kopiuj link obok Główna nakładka czatu i dok sterowania , aby uzyskać zaktualizowany link.

3. Odtwórz go w OBS

  1. Dodaj w OBS Źródło przeglądarki i wklej ten link.
  2. Włącz Steruj dźwiękiem przez OBS (Control audio via OBS) we właściwościach.
  3. Wyślij wiadomość na czacie. Sprawdź wskaźnik dźwięku źródła, a następnie wykonaj krótkie nagranie.

Chcesz słyszeć dźwięk u siebie? W zaawansowanych właściwościach dźwięku OBS wybierz Monitorowanie i wyjście dla tego źródła. Pozostaw tylko jedną kopię odczytującą czat.

Posłuchaj bezpłatnych głosów

Wolisz inne brzmienie? Te cztery głosy są bezpłatne. Naciśnij odtwarzanie, aby porównać.

Piper

Angielski USA, żeński (HFC), średnia jakość.
en_US-hfc_female-medium

Zobacz ustawienia i głosy

Kokoro

Bella, amerykański głos żeński. Testowany z użyciem CPU/WASM, q8.
af_bella

Zobacz ustawienia i głosy

Kitten

Głos 4, żeński. Dołączony model nano v0.1.
expr-voice-4-f

Zobacz ustawienia i głosy

eSpeak

Angielski. Głos syntetyczny o małym zapotrzebowaniu na zasoby.
en

Zobacz ustawienia i głosy

Próbki hiszpańskie i portugalskie

W ustawieniach SSN wybierz język nad listą głosów, a następnie użyj Test. Piper oferuje Hiszpanię, Meksyk, Brazylię i Portugalię; Kokoro dodaje trzy głosy hiszpańskie i trzy portugalskie brazylijskie.

Piper — hiszpański (Hiszpania)

DaveFX

Kokoro — hiszpański

Dora

Piper — portugalski (Brazylia)

Faber

Kokoro — portugalski (Brazylia)

Dora

Bezpłatna lokalna synteza z początkowym pobieraniem. Próbki pomijają czas ładowania. Piper jest lżejszym punktem wyjścia; Kokoro może działać wolno na CPU. Użyj Piper, jeśli mowa nie nadąża za czatem.

Teksty próbek i szczegóły testów

Cztery angielskie próbki odczytują: Witaj na transmisji! Dzięki za dołączenie. W jaką grę zagramy następnie? Odczytywanie nazw jest wyłączone.

Sprawdzono 7 września 2026 r. w OBS 32.2.2 na Windows 11: wiadomość czatu dotarła do rzeczywistego doku, wygenerowała mowę, poruszyła wskaźnik źródła przeglądarkowego i znalazła się w nagraniu. Kokoro zaczynało mówić zauważalnie później w tym teście na CPU. Te klipy prezentują głos, a nie czas oczekiwania.

System TTS udostępnił na tym komputerze pięć głosów, ale nie wygenerował dźwięku w nagraniu źródła przeglądarkowego. Ten wynik dotyczy konkretnej konfiguracji; zawsze testuj końcowy adres URL i nagranie. Głosów chmurowych nie uwzględniono, ponieważ nie użyto płatnych danych dostępowych.

Potrzebujesz pomocy?

Czy moja platforma czatu obsługuje TTS?

Jeśli SSN odbiera czat jako tekst, może go odczytać. YouTube, Twitch, TikTok i inne źródła używają tej samej funkcji. Twoja platforma czatu nie potrzebuje własnej obsługi TTS.

Brak mowy?

Sprawdź, czy dok odbiera czat, a następnie przełącznik TTS, dostawcę i filtry. Użyj nowo skopiowanego linku. Pozwól zakończyć pierwsze pobieranie modelu.

Działa w Chrome/Edge, ale nie w OBS?

OBS ma oddzielną przeglądarkę i listę głosów. System TTS może tam nie działać, nawet jeśli pokazuje głosy. Wypróbuj Piper, Kokoro, Kitten lub eSpeak. Wirtualny kabel audio nie naprawi braku mowy.

Wskaźnik się porusza, ale nagranie jest ciche?

Sprawdź wyciszenie i przypisania ścieżek nagrywania w OBS. Użyj Monitor and Output, jeśli chcesz też słyszeć dźwięk; unikaj ponownego przechwytywania tego wyjścia monitorowania. Poradnik dźwięku OBS.

Czy mogę zamiast tego użyć doku OBS lub Featured Chat?

Niestandardowy dok przeglądarkowy OBS to panel sterowania, a nie źródło przeglądarkowe sceny użyte powyżej. Dla Featured Chat włącz TTS we własnych opcjach tej nakładki w panelu i skopiuj jej link. Pozostaw tylko jedną mówiącą stronę, aby uniknąć podwójnego głosu.

Porównaj wszystkich dostawców: wymagania, koszty i kompromisy

Zacznij od Piper, aby uzyskać bezpłatny lokalny głos, lub porównaj Kokoro, jeśli wolisz jego brzmienie. Wypróbuj eSpeak, gdy szybkość reakcji jest ważniejsza niż realizm. Kitten to inna kompaktowa opcja angielska. Posłuchaj przed wyborem.

DostawcaDobre doKompromisWymagania / koszt
KokoroGłosy angielskie, hiszpańskie i portugalskie brazylijskie.Więcej pracy CPU; rozpoczęcie mowy może być powolne.Bezpłatne, bez klucza. Pobiera zasoby modelu/głosów; CPU lub obsługiwane WebGPU.
PiperLokalne głosy neuronowe; opcje angielskie, hiszpańskie i portugalskie.Jakość i wymowa różnią się między głosami.Bezpłatne, bez klucza. Pobiera wybrany model (HFC medium: około 63 MB) oraz pliki silnika.
KittenKompaktowy model angielski, osiem głosów do wyboru.Mniej języków i stylów głosu.Bezpłatne, bez klucza. Obecny dołączony model: około 24 MB plus pliki silnika/głosów; CPU.
eSpeakLekki, wiele języków, szybki start.Celowo syntetyczne/robotyczne brzmienie.Bezpłatne, bez klucza. Wczytuje dołączone pliki silnika/języka; nie wymaga modelu neuronowego ani GPU.
Systemowy TTSUżywa głosów udostępnianych przez przeglądarkę lub aplikację komputerową.Lista głosów i przechwytywanie w OBS różnią się; niektóre głosy potrzebują internetu.Bez opłaty za dostawcę SSN. Wymaga działającego głosu systemowego/przeglądarkowego; przetestuj na rzeczywistej stronie odtwarzania.
ElevenLabsIdentyfikatory głosów, wybór modelu i ustawienia stabilności/stylu.Mogą obowiązywać limity konta, opóźnienia sieci i opłaty API.Internet, klucz API i dostępny identyfikator głosu. Tekst czatu trafia do dostawcy.
Google CloudNazwane głosy oraz ustawienia języka, tempa i wysokości.Nie każdy głos obsługuje każde ustawienie.Internet, włączone Cloud TTS API, klucz API i zgodny głos/język. Obowiązują rozliczenia/limity.
GeminiStyle głosów i pisemne instrukcje sposobu mówienia.Modele w wersji podglądowej i limity mogą się zmieniać; opóźnienie jest różne.Internet, klucz API Gemini i dostęp do wybranego modelu TTS. Sprawdź limity i rozliczenia konta.
SpeechifyIdentyfikator głosu z ustawieniami szybkości, języka i modelu.Wymaga dostępu do API; dostępne głosy zależą od konta.Internet i klucz API Speechify. Obowiązują warunki/limity użycia API.
OpenAINazwane głosy z ustawieniami modelu i formatu.Wymagane rozliczanie API i internet; subskrypcja konta jest oddzielna.Klucz API z dostępem do TTS. Tekst czatu jest wysyłany do skonfigurowanego punktu końcowego.
Własny / lokalnyUżyj własnego zgodnego serwera głosowego.Najwięcej konfiguracji: punkt końcowy, model, głos i dostęp przeglądarki muszą do siebie pasować.Dostępny punkt końcowy mowy zgodny z OpenAI; klucz, jeśli jest wymagany. Koszty lokalnego sprzętu lub hostingu są różne.

Powyższe rozmiary pobierania dotyczą plików modeli, a nie całego zużycia pamięci ani wszystkich wymaganych zasobów. Lokalni dostawcy używają komputera uruchamiającego dok/nakładkę; pierwsze użycie może być wolniejsze, a OBS ma własną pamięć podręczną. Dostawcy chmurowi oszczędzają lokalne obliczenia, ale wysyłają tekst poza urządzenie.

OBS: czterej lokalni dostawcy poniżej przeszli testy nagrywania źródła przeglądarkowego. Dostawcy chmurowi/własni zwracają dźwięk do odtworzenia na stronie, ale w tym przeglądzie nie testowano ich z rzeczywistymi kontami. System TTS wymaga oddzielnego testu, nawet gdy pokazuje głosy.

Ustawienia dostawców i nazwy głosów

Rzeczywiste ustawienia aplikacji komputerowej, zarejestrowane na świeżym profilu. Otwórz wybranego dostawcę; pola kluczy API są celowo puste. Te elementy konfigurują wybrany dok lub nakładkę SSN. Wybierz zrzut ekranu, aby zobaczyć go w pełnym rozmiarze.

Systemowy TTS

Lista języków na tym świeżym profilu jest pusta. Dostępne głosy zależą od przeglądarki/aplikacji i zainstalowanych głosów; nie ma uniwersalnej listy głosów SSN.

Rzeczywiste ustawienia dostawcy System TTS w SSN
Kokoro

Wybierz głos w SSN; model ładuje się na stronie, która mówi. Dostępne są głosy angielskie USA/Wielka Brytania, hiszpańskie i portugalskie brazylijskie. Użyj filtra języka, aby znaleźć głosy; Test odtwarza krótką frazę w wybranym języku. Aby zmniejszyć użycie CPU, wypróbuj Piper.

Rzeczywiste ustawienia dostawcy Kokoro w SSN
Nazwy głosów i wartości URL
  • Heart (amerykański żeński) — af_heart
  • Alloy (amerykański żeński) — af_alloy
  • Aoede (amerykański żeński) — af_aoede
  • Bella (amerykański żeński) — af_bella
  • Jessica (amerykański żeński) — af_jessica
  • Kore (amerykański żeński) — af_kore
  • Nicole (amerykański żeński) — af_nicole
  • Nova (amerykański żeński) — af_nova
  • River (amerykański żeński) — af_river
  • Sarah (amerykański żeński) — af_sarah
  • Sky (amerykański żeński) — af_sky
  • Adam (amerykański męski) — am_adam
  • Echo (amerykański męski) — am_echo
  • Eric (amerykański męski) — am_eric
  • Fenrir (amerykański męski) — am_fenrir
  • Liam (amerykański męski) — am_liam
  • Michael (amerykański męski) — am_michael
  • Onyx (amerykański męski) — am_onyx
  • Puck (amerykański męski) — am_puck
  • Santa (amerykański męski) — am_santa
  • Emma (brytyjski żeński) — bf_emma
  • Isabella (brytyjski żeński) — bf_isabella
  • George (brytyjski męski) — bm_george
  • Lewis (brytyjski męski) — bm_lewis
  • Alice (brytyjski żeński) — bf_alice
  • Lily (brytyjski żeński) — bf_lily
  • Daniel (brytyjski męski) — bm_daniel
  • Fable (brytyjski męski) — bm_fable
  • Dora (hiszpański) — ef_dora
  • Alex (hiszpański) — em_alex
  • Santa (hiszpański) — em_santa
  • Dora (portugalski brazylijski) — pf_dora
  • Alex (portugalski brazylijski) — pm_alex
  • Santa (portugalski brazylijski) — pm_santa
Kitten

Osiem głosów angielskich: warianty męskie i żeńskie o numerach 2, 3, 4 i 5. Próbka używa Voice 4 (Female).

Rzeczywiste ustawienia dostawcy Kitten w SSN
Nazwy głosów i wartości URL
  • Głos 2 (męski) — expr-voice-2-m
  • Głos 2 (żeński) — expr-voice-2-f
  • Głos 3 (męski) — expr-voice-3-m
  • Głos 3 (żeński) — expr-voice-3-f
  • Głos 4 (męski) — expr-voice-4-m
  • Głos 4 (żeński) — expr-voice-4-f
  • Głos 5 (męski) — expr-voice-5-m
  • Głos 5 (żeński) — expr-voice-5-f
Piper

Wybierz zgodny język i model. Próbka używa HFC medium. Samo ustawienie języka nie tłumaczy głosu.

Rzeczywiste ustawienia dostawcy Piper w SSN
Nazwy głosów i wartości URL
  • Angielski USA, żeński (HFC) — średnia jakość — en_US-hfc_female-medium
  • Hiszpański z Hiszpanii (DaveFX) — średnia jakość — es_ES-davefx-medium
  • Hiszpański meksykański (Ald) — średnia jakość — es_MX-ald-medium
  • Portugalski brazylijski (Faber) — średnia jakość — pt_BR-faber-medium
  • Portugalski brazylijski (Edresson) — niska jakość — pt_BR-edresson-low
  • Portugalski z Portugalii (Tugao) — średnia jakość — pt_PT-tugão-medium
eSpeak

Wybierz głos danego języka i opcjonalnie dostosuj tempo mowy. Ten silnik celowo brzmi robotycznie.

Rzeczywiste ustawienia dostawcy eSpeak w SSN
Nazwy głosów i wartości URL
  • Angielski — en
  • Hiszpański — es
  • Portugalski brazylijski — pt-br
  • Portugalski z Portugalii — pt-pt
ElevenLabs

Wpisz klucz API, a następnie użyj List My Available Voices, aby znaleźć identyfikator głosu dostępnego dla Twojego konta. Dokumentacja dostawców.

Rzeczywiste ustawienia dostawcy ElevenLabs w SSN
Google Cloud

Wpisz klucz API Google Cloud TTS i dokładną nazwę głosu wraz z pasującym językiem. Nazwy głosów i obsługiwane ustawienia.

Rzeczywiste ustawienia dostawcy Google Cloud w SSN
Gemini

Wybierz obsługiwany model TTS i głos; instrukcje stylu zmieniają sposób mówienia. To ustawienia API Gemini, oddzielne od Google Cloud TTS. Przykłady głosów i wymagania.

Rzeczywiste ustawienia dostawcy Gemini w SSN
Fish Audio

Wybierz Fish Audio w menu dostawcy TTS doku czatu, nakładki wyróżnionych wiadomości, strony TTS lub Flow Actions. Wpisz własny Klucz API Fish Audio, a następnie użyj istniejącego przycisku Test TTS. Opcjonalny Voice ID wybiera głos z Fish Audio; skopiuj identyfikator modelu głosu, a nie jego nazwę lub adres strony. Pozostaw puste, aby użyć domyślnego głosu usługi.

Opcje zaawansowane obejmują model i tempo mowy (0.5–2). SSN domyślnie używa s2.1-pro-free; dostępność bezpłatnego planu i warunki uczciwego użycia określa Fish Audio. Płatne modele wymagają środków na koncie. SSN nie ponawia nieudanego bezpłatnego żądania z płatnym modelem. Do regulacji głośności dla widzów użyj More TTS options. Tekst jest wysyłany do Fish Audio, a język wykrywa usługa.

Konfiguracja OBS / przeglądarki: Uruchom istniejący lokalny most TTS w trybie Fish na komputerze OBS. Ustaw zmienną środowiskową SSN_TTS_TARGET_BEARER na swój klucz API Fish i uruchom node scripts/local-tts-bridge.cjs --mode fish. W panelu Fish Audio ustaw Adres mostu OBS / przeglądarki na http://127.0.0.1:8124/v1/audio/speech; wklej token lokalnego mostu wypisany w terminalu do pola panelu Klucz API . Token zmienia się po ponownym uruchomieniu, chyba że ustawisz SSN_TTS_BRIDGE_TOKEN na długi losowy sekret; zachowaj prywatność linków nakładek zawierających token. Pozostaw most uruchomiony, przetestuj głos i użyj wygenerowanego adresu nakładki w OBS. Włącz Control audio via OBS w ustawieniach źródła przeglądarkowego, jeśli chcesz jego dźwięk w mikserze OBS. Bezpośrednie żądania Fish z hostowanych stron przeglądarki nie mają zgody CORS; most zapewnia odpowiedź audio dostępną dla przeglądarki.

Z mostem dodaj &fishendpoint=http%3A%2F%2F127.0.0.1%3A8124%2Fv1%2Faudio%2Fspeech do adresu URL i pomiń fishkey , gdy most przechowuje klucz.

Parametry URL: &ttsprovider=fish&fishkey=YOUR_KEY&voicefish=VOICE_ID&fishmodel=s2.1-pro-free&fishspeed=1. Włącz TTS za pomocą zwykłych elementów sterowania. Zachowaj prywatność wygenerowanych adresów zawierających klucz. Istniejące nadpisanie głosu Speak Text w Event Flow przyjmuje identyfikator głosu Fish, gdy strona odbierająca używa Fish Audio.

Dokumentacja API Fish Audio · Ogłoszenie bezpłatnego modelu i warunki

Speechify

Poradnik Speechify krok po kroku: klucz API, głosy, szybkość i głośność dla widzów.

Wpisz klucz API i identyfikator głosu ze swojego konta API Speechify. Konfiguracja dostawcy.

Rzeczywiste ustawienia dostawcy Speechify w SSN
OpenAI

Wybierz obsługiwany głos/model i wpisz klucz API. Subskrypcja ChatGPT nie zapewnia środków na API. Dla OpenAI zachowaj domyślny punkt końcowy.

Rzeczywiste ustawienia dostawcy OpenAI w SSN
Własny / lokalny TTS

Ta opcja używa ustawień zgodnych z OpenAI, więc nagłówek nadal brzmi OpenAI. Wpisz punkt końcowy swojego serwera oraz obsługiwany głos/model; uwierzytelnianie zależy od serwera. Zobacz poradnik serwera lokalnego.

Rzeczywiste ustawienia dostawcy Custom / Local TTS w SSN
Zaawansowane: ręczna edycja adresu TTS

Dobre pierwsze testy:

dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kokoro
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=piper
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kitten

Dla portugalskiego lub hiszpańskiego zacznij zamiast tego od jednego z tych głosów:

dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium
dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=espeak&espeakvoice=es

Pełna dokumentacja TTS · Poradnik lokalnego serwera TTS

Zaawansowane: uruchom własny lokalny serwer TTS

Lokalny serwer TTS jest przydatny, gdy chcesz prywatnych głosów, konkretnego modelu głosu lub serwera takiego jak Kokoro-FastAPI czy openedai-speech. Strona odtwarzająca TTS musi mieć dostęp do punktu końcowego.

Schemat pokazujący źródło przeglądarkowe OBS wysyłające żądania TTS przez lokalny most TTS Social Stream Ninja do serwera TTS
W OBS lokalny most zwykle działa najlepiej na tym samym komputerze co OBS.
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=customtts&openaiendpoint=http://127.0.0.1:8124/v1/audio/speech&voiceopenai=af_bella

localhost oznacza komputer uruchamiający stronę. Jeśli serwer TTS znajduje się na innym komputerze, użyj jego adresu IP w sieci LAN lub uruchom most na komputerze OBS.