Przewodnik konfiguracji TTS

Odczytuj czat na głos podczas transmisji. Bezpłatnie, bez konta i klucza API.

Skonfiguruj w 5 krokach

Czat nie jest jeszcze połączony? Zacznij tutaj w pierwszej kolejności.

  1. Otwórz panel rozszerzenia SSN lub „Źródła i ustawienia” w aplikacji komputerowej.
  2. W sekcji Główna nakładka czatu i dok sterowania, rozwiń Wiadomość – zamiana tekstu na mowę.
  3. Włącz Czytaj przychodzące wiadomości.
Rzeczywisty panel: Message — Text to Speech, z włączonym Enable TTS in dock
Niebieski przełącznik = odczytywanie czatu jest włączone.
  1. Przewiń do Dostawca usługi syntezy mowy. Wybierz Piper TTS, a następnie głos.
  2. Kliknij kopiuj link obok Główna nakładka czatu i dok sterowania.
Rzeczywisty panel: wybrany Piper TTS z głosem English US Female HFC Medium
Piper jest bezpłatny. Bez konta i klucza API.
Pierwszy raz? Piper pobiera głos przy pierwszym użyciu. Poczekaj chwilę.

Odtwórz w OBS

  1. Dodaj Źródło przeglądarki i wklej skopiowany link.
  2. We właściwościach włącz Steruj dźwiękiem przez OBS (Control audio via OBS).
  3. Wyślij wiadomość na czacie. Wskaźnik audio źródła powinien się poruszyć.
  4. Zrób krótkie nagranie testowe i odtwórz je.
Chcesz słyszeć dźwięk u siebie? W OBS Zaawansowane właściwości dźwięku (Advanced Audio Properties), ustaw to źródło na Monitorowanie i wyjście.
Słyszysz każdą wiadomość dwa razy? Tylko jedna strona powinna czytać czat. Wyłącz TTS wszędzie indziej.

Posłuchaj bezpłatnych głosów

Wszystkie cztery są bezpłatne i działają na Twoim komputerze. Naciśnij odtwarzanie, aby porównać.

Piper

Angielski amerykański, kobiecy. Lekki i szybki.
en_US-hfc_female-medium

Ustawienia i głosy

Kokoro

Bella, angielski amerykański, kobiecy. Najbardziej naturalny, ale wolniejszy na CPU.
af_bella

Ustawienia i głosy

Kitten

Głos 4, żeński. Mały model angielski.
expr-voice-4-f

Ustawienia i głosy

eSpeak

Angielski. Robotyczny, ale mały i szybki.
en

Ustawienia i głosy

Próbki hiszpańskie i portugalskie

W SSN wybierz język nad listą głosów i naciśnij Test. Piper ma głosy dla Hiszpanii, Meksyku, Brazylii i Portugalii. Kokoro ma trzy hiszpańskie i trzy brazylijskie portugalskie głosy.

Piper — hiszpański (Hiszpania)

DaveFX

Kokoro — hiszpański

Dora

Piper — portugalski (Brazylia)

Faber

Kokoro — portugalski (Brazylia)

Dora

Piper jest lżejszym wyborem. Jeśli Kokoro nie nadąża za czatem, przełącz na Piper.

Jak powstały te próbki

Próbki angielskie czytają: Witaj na transmisji! Dzięki za dołączenie. W jaką grę zagramy następnie? Odczytywanie nazw było wyłączone. Klipy pomijają czas ładowania.

Testowano 7 września 2026 r. w OBS 32.2.2 na Windows 11. Prawdziwa wiadomość dotarła do Docka, została odczytana, poruszyła wskaźnik źródła przeglądarkowego i trafiła do nagrania. Kokoro na CPU zaczynało zauważalnie później.

Na tym komputerze systemowy TTS pokazywał pięć głosów, ale nagranie OBS było bez dźwięku. Twój komputer może działać inaczej, więc zawsze testuj własny link. Głosów chmurowych nie testowano (brak płatnych kont).

Wybierz dostawcę

Zacznij od Piper. Wypróbuj Kokoro, jeśli bardziej podoba Ci się jego brzmienie. Bezpłatne głosy działają na Twoim komputerze. Chmurowe wymagają konta i klucza API, a tekst czatu trafia do tej firmy.

DostawcaDobre doPamiętajKoszt
PiperNaturalne głosy; angielski, hiszpański, portugalski.Jakość zależy od głosu. HFC medium ma około 63 MB.Bezpłatne, bez klucza
KokoroNajbardziej naturalne bezpłatne głosy; angielski, hiszpański, portugalski brazylijski.Większe obciążenie CPU. Pierwsza mowa może być powolna. Szybciej na obsługiwanym GPU.Bezpłatne, bez klucza
KittenMały model angielski, osiem głosów.Tylko angielski. Dołączony model ma około 24 MB.Bezpłatne, bez klucza
eSpeakBardzo lekki, wiele języków, szybki start.Celowo brzmi robotycznie.Bezpłatne, bez klucza
Systemowy TTSGłosy już dostępne w przeglądarce lub komputerze.Często nieme w OBS. Niektóre głosy wymagają internetu.Bezpłatne
ElevenLabsWybór głosów według ID; stabilność i styl.Limity konta i opóźnienie sieci.Mogą obowiązywać opłaty API
Google CloudNazwane głosy; język, tempo i wysokość.Nie każdy głos obsługuje każdą opcję. API Cloud TTS musi być włączone.Obowiązują rozliczenia i limity
GeminiStyle głosów i pisemne instrukcje sposobu mówienia.Modele podglądowe i limity mogą się zmieniać.Sprawdź limity Gemini
Fish AudioBezpłatny model z własnym kluczem; ID głosów.OBS wymaga lokalnego mostka SSN.Bezpłatny poziom ustalany przez Fish Audio
SpeechifyID głosu z szybkością, językiem i modelem.Głosy zależą od konta.Obowiązują warunki API
OpenAINazwane głosy, ustawienia modelu i formatu.Subskrypcja ChatGPT nie obejmuje środków API.Rozliczenia API
Własny / lokalnyTwój własny serwer głosowy.Najwięcej konfiguracji. Zobacz poradnik serwera lokalnego.Twój sprzęt lub hosting
Rozmiary pobierania i uwagi z testów OBS

Rozmiary dotyczą tylko plików modeli, nie zużycia pamięci. Bezpłatne głosy działają na komputerze odtwarzającym Dock lub nakładkę. Pierwsze użycie jest wolniejsze. OBS ma własną pamięć pobrań, oddzielną od Chrome.

Piper, Kokoro, Kitten i eSpeak przeszły testy nagrania źródła przeglądarkowego OBS. Głosy chmurowe i własne też grają przez stronę, ale nie testowano ich z aktywnymi kontami. Systemowy TTS przetestuj osobno, nawet gdy pokazuje głosy.

Rozwiązywanie problemów

ProblemSpróbuj tego
Czy moja platforma czatu obsługuje TTS?Tak, jeśli SSN odbiera czat jako tekst. YouTube, Twitch, TikTok i pozostałe działają tak samo. Platforma nie potrzebuje własnego TTS.
Brak mowySprawdź, czy Dock pokazuje czat. Potem sprawdź przełącznik TTS, dostawcę i filtry. Użyj świeżo skopiowanego linku. Poczekaj na pierwsze pobranie głosu.
Działa w Chrome lub Edge, nie w OBSOBS ma własną przeglądarkę i listę głosów. Systemowy TTS często tam nie działa. Przełącz na Piper, Kokoro, Kitten lub eSpeak. Wirtualny kabel audio nie naprawi braku mowy.
Wskaźnik się porusza, ale nagranie jest niemeSprawdź wyciszenie i ścieżki nagrania w OBS. Nie przechwytuj ponownie wyjścia odsłuchowego. Zobacz Poradnik dźwięku OBS.
Mowa nie nadąża za czatemPrzełącz z Kokoro na Piper lub wypróbuj eSpeak.
Każda wiadomość jest czytana dwa razyMówi więcej niż jedna strona. Pozostaw TTS włączone tylko w jednym miejscu.
Chcę, aby mówił dok OBS lub Featured ChatNiestandardowy dok przeglądarki OBS jest panelem sterowania, nie źródłem sceny. Dla Featured Chat włącz TTS w opcjach tej nakładki i skopiuj jej link.

Więcej rozwiązań: Dokumentacja TTS · problemy lokalnego serwera.

Ustawienia dostawcy

Prawdziwe zrzuty z aplikacji komputerowej ze świeżym profilem (pola kluczy puste). Otwórz dostawcę, aby zobaczyć ustawienia. Kliknij zrzut, aby powiększyć.

Systemowy TTS

Lista głosów zależy od przeglądarki lub aplikacji i zainstalowanych głosów. Nie ma stałej listy SSN. Ten nowy profil pokazał pustą listę języków.

Rzeczywiste ustawienia dostawcy System TTS w SSN
Kokoro

Wybierz głos. Znajdź go filtrem języka i Test aby posłuchać. Model ładuje się na stronie, która mówi. Głosy: angielski amerykański i brytyjski, hiszpański, portugalski brazylijski. Za wolno? Wypróbuj Piper.

Rzeczywiste ustawienia dostawcy Kokoro w SSN
Nazwy głosów i wartości linku
  • Heart (amerykański żeński) — af_heart
  • Alloy (amerykański żeński) — af_alloy
  • Aoede (amerykański żeński) — af_aoede
  • Bella (amerykański żeński) — af_bella
  • Jessica (amerykański żeński) — af_jessica
  • Kore (amerykański żeński) — af_kore
  • Nicole (amerykański żeński) — af_nicole
  • Nova (amerykański żeński) — af_nova
  • River (amerykański żeński) — af_river
  • Sarah (amerykański żeński) — af_sarah
  • Sky (amerykański żeński) — af_sky
  • Adam (amerykański męski) — am_adam
  • Echo (amerykański męski) — am_echo
  • Eric (amerykański męski) — am_eric
  • Fenrir (amerykański męski) — am_fenrir
  • Liam (amerykański męski) — am_liam
  • Michael (amerykański męski) — am_michael
  • Onyx (amerykański męski) — am_onyx
  • Puck (amerykański męski) — am_puck
  • Santa (amerykański męski) — am_santa
  • Emma (brytyjski żeński) — bf_emma
  • Isabella (brytyjski żeński) — bf_isabella
  • George (brytyjski męski) — bm_george
  • Lewis (brytyjski męski) — bm_lewis
  • Alice (brytyjski żeński) — bf_alice
  • Lily (brytyjski żeński) — bf_lily
  • Daniel (brytyjski męski) — bm_daniel
  • Fable (brytyjski męski) — bm_fable
  • Dora (hiszpański): ef_dora
  • Alex (hiszpański): em_alex
  • Santa (hiszpański): em_santa
  • Dora (portugalski brazylijski): pf_dora
  • Alex (portugalski brazylijski): pm_alex
  • Santa (portugalski brazylijski): pm_santa
Kitten

Osiem angielskich głosów: męskie i żeńskie wersje głosów 2, 3, 4 i 5. Próbka używa głosu 4 (żeńskiego).

Rzeczywiste ustawienia dostawcy Kitten w SSN
Nazwy głosów i wartości linku
  • Głos 2 (męski) — expr-voice-2-m
  • Głos 2 (żeński) — expr-voice-2-f
  • Głos 3 (męski) — expr-voice-3-m
  • Głos 3 (żeński) — expr-voice-3-f
  • Głos 4 (męski) — expr-voice-4-m
  • Głos 4 (żeński) — expr-voice-4-f
  • Głos 5 (męski) — expr-voice-5-m
  • Głos 5 (żeński) — expr-voice-5-f
Piper

Wybierz głos pasujący do języka. Sama zmiana języka nie zmienia głosu. Próbka używa HFC medium.

Rzeczywiste ustawienia dostawcy Piper w SSN
Nazwy głosów i wartości linku
  • Angielski USA, żeński (HFC) — średnia jakość — en_US-hfc_female-medium
  • Hiszpański z Hiszpanii (DaveFX) — średnia jakość — es_ES-davefx-medium
  • Hiszpański meksykański (Ald) — średnia jakość — es_MX-ald-medium
  • Portugalski brazylijski (Faber) — średnia jakość — pt_BR-faber-medium
  • Portugalski brazylijski (Edresson) — niska jakość — pt_BR-edresson-low
  • Portugalski z Portugalii (Tugao) — średnia jakość — pt_PT-tugão-medium
eSpeak

Wybierz głos języka. Możesz zmienić tempo mowy. Celowo brzmi robotycznie.

Rzeczywiste ustawienia dostawcy eSpeak w SSN
Nazwy głosów i wartości linku
  • Angielski — en
  • Hiszpański — es
  • Portugalski brazylijski — pt-br
  • Portugalski z Portugalii — pt-pt
ElevenLabs

Wpisz klucz API. Potem kliknij Pokaż moje dostępne głosy aby znaleźć ID głosu dostępnego na koncie. Dokumentacja ElevenLabs.

Rzeczywiste ustawienia dostawcy ElevenLabs w SSN
Google Cloud

Wpisz klucz API Google Cloud TTS, dokładną nazwę głosu i pasujący język. Nazwy głosów i obsługiwane ustawienia.

Rzeczywiste ustawienia dostawcy Google Cloud w SSN
Gemini

Wybierz model TTS i głos. Instrukcje stylu zmieniają sposób czytania. To używa API Gemini, nie Google Cloud TTS. Przykłady głosów i wymagania.

Rzeczywiste ustawienia dostawcy Gemini w SSN
Fish Audio

Działa w Docku czatu, nakładce wyróżnionych wiadomości, stronie TTS i Flow Actions.

  1. Wybierz Fish Audio jako dostawcę TTS.
  2. Wklej swój Klucz API Fish Audio.
  3. Opcjonalnie: wklej Identyfikator głosu z Fish Audio. Skopiuj ID modelu głosu, nie nazwę ani link strony. Dla głosu domyślnego zostaw puste.
  4. Naciśnij Przetestuj TTS.

Domyślny model to s2.1-pro-free. Fish Audio ustala ofertę bezpłatną i zasady uczciwego użycia. Płatne modele wymagają środków na koncie. SSN nigdy nie przełącza na płatny model po błędzie bezpłatnego żądania. Szybkość wynosi od 0,5 do 2. Fish Audio wykrywa język. Tekst czatu jest wysyłany do Fish Audio.

Dla OBS: uruchom lokalny mostek

Fish Audio blokuje bezpośrednie żądania ze stron internetowych, więc OBS potrzebuje narzędzia SSN: lokalny mostek (wymaga Node.js). Uruchom na komputerze z OBS.

  1. Ustaw SSN_TTS_TARGET_BEARER na swój klucz API Fish w zmiennej środowiskowej.
  2. W folderze SSN uruchom node scripts/local-tts-bridge.cjs --mode fish. Pozostaw uruchomione.
  3. W panelu Fish Audio ustaw URL mostka na http://127.0.0.1:8124/v1/audio/speech.
  4. Wklej token mostka pokazany w terminalu do Klucz API .
  5. Przetestuj głos, potem dodaj link nakładki do OBS. Włącz Steruj dźwiękiem przez OBS (Control audio via OBS).
Token zmienia się przy każdym restarcie mostka. Aby pozostał taki sam, ustaw SSN_TTS_BRIDGE_TOKEN na długi losowy sekret. Zachowaj linki z tokenem lub kluczem prywatnie.
Ustawienia linku Fish Audio
&ttsprovider=fish&fishkey=YOUR_KEY&voicefish=VOICE_ID&fishmodel=s2.1-pro-free&fishspeed=1

Z mostem dodaj &fishendpoint=http%3A%2F%2F127.0.0.1%3A8124%2Fv1%2Faudio%2Fspeech. Pomiń fishkey jeśli mostek przechowuje klucz. Opcja Event Flow Odczytaj tekst (Speak Text) nadpisania głosu przyjmuje ID głosu Fish, gdy odbierająca strona używa Fish Audio.

Dokumentacja API Fish Audio · Ogłoszenie bezpłatnego modelu i warunki

Speechify

Wpisz klucz API i identyfikator głosu ze swojego konta API Speechify. Poradnik Speechify krok po kroku · Konfiguracja Speechify.

Rzeczywiste ustawienia dostawcy Speechify w SSN
OpenAI

Wybierz głos i model oraz wpisz klucz API. Subskrypcja ChatGPT nie daje środków API. Zachowaj domyślny adres usługi.

Rzeczywiste ustawienia dostawcy OpenAI w SSN
Własny / lokalny TTS

Używa ustawień OpenAI, więc nagłówek nadal brzmi OpenAI. Wpisz adres serwera oraz obsługiwany głos i model. Potrzeba klucza zależy od serwera. Zobacz poradnik serwera lokalnego.

Rzeczywiste ustawienia dostawcy Custom / Local TTS w SSN

Szybsze Kokoro i Kitten

W sekcji Kokoro lub Kitten otwórz Generowanie i odtwarzanie. Te opcje generują mowę w tle, by strona działała płynnie.

Chcę…Zrób to
Włącz dla KokoroUstaw Przetwarzanie na Generowanie w tle.
Włącz dla KittenWybierz Kitten 0.8 model: Nano (najmniejszy), Micro lub Mini.
Usłysz mowę szybciejZacznij, gdy mowa napływa. Odtwarza każdą część, gdy jest gotowa. Wolne komputery mogą robić przerwy między częściami.
Unikaj przerwOdtwórz całą wiadomość. Najpierw czeka na całą wiadomość.
Napraw problemy GPU (Kokoro)Ustaw Procesor w tle na CPU.
Najlepsza jakość KokoroPełna jakość. Większe pobieranie, więcej pamięci.
Więcej szczegółów i ustawienia linku

Automatyczne używa obsługiwanego GPU, jeśli jest dostępne, w przeciwnym razie CPU. Automatyczna jakość wybiera FP16 na zgodnych GPU, pełną precyzję na innych obsługiwanych GPU i kompaktowy model na CPU. Wymuszenie GPU, gdy go nie ma, powoduje błąd.

Kitten 0.8 działa na CPU, tylko po angielsku. Każdy model pobiera się przy pierwszym użyciu. Każda przeglądarka i OBS mają własną kopię. NeuroSync w obu przypadkach otrzymuje cały plik audio. Stare linki działają jak wcześniej, dopóki nie zmienisz tych opcji.

Kokoro: &kokororuntime=worker, opcjonalne &kokoroplayback=stream, &kokorodevice=wasm lub webgpu, &kokorodtype=q8, fp16 lub fp32. Strumieniowanie lub FP32 automatycznie włącza generowanie w tle.

Kitten: &kittenmodel=nano (lub micro, mini), opcjonalnie &kittenplayback=stream.

Dalsze kroki

Chcę…Przejdź tutaj
Edytuj link TTS ręcznie lub zobacz wszystkie opcjeDokumentacja TTS
Użyj hiszpańskich lub portugalskich głosów w linkuDokumentacja TTS: opcje dostawców
Uruchom własny serwer głosowy lub sklonuj głosPoradnik lokalnej AI TTS
Skonfiguruj SpeechifyPoradnik Speechify

Szybki link do wypróbowania: dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=piper