Skonfiguruj w 5 krokach
Czat nie jest jeszcze połączony? Zacznij tutaj w pierwszej kolejności.
- Otwórz panel rozszerzenia SSN lub „Źródła i ustawienia” w aplikacji komputerowej.
- W sekcji Główna nakładka czatu i dok sterowania, rozwiń Wiadomość – zamiana tekstu na mowę.
- Włącz Czytaj przychodzące wiadomości.
- Przewiń do Dostawca usługi syntezy mowy. Wybierz Piper TTS, a następnie głos.
- Kliknij kopiuj link obok Główna nakładka czatu i dok sterowania.
Odtwórz w OBS
- Dodaj Źródło przeglądarki i wklej skopiowany link.
- We właściwościach włącz Steruj dźwiękiem przez OBS (Control audio via OBS).
- Wyślij wiadomość na czacie. Wskaźnik audio źródła powinien się poruszyć.
- Zrób krótkie nagranie testowe i odtwórz je.
Posłuchaj bezpłatnych głosów
Wszystkie cztery są bezpłatne i działają na Twoim komputerze. Naciśnij odtwarzanie, aby porównać.
Kokoro
Bella, angielski amerykański, kobiecy. Najbardziej naturalny, ale wolniejszy na CPU.af_bella
Próbki hiszpańskie i portugalskie
W SSN wybierz język nad listą głosów i naciśnij Test. Piper ma głosy dla Hiszpanii, Meksyku, Brazylii i Portugalii. Kokoro ma trzy hiszpańskie i trzy brazylijskie portugalskie głosy.
Piper — hiszpański (Hiszpania)
DaveFX
Kokoro — hiszpański
Dora
Piper — portugalski (Brazylia)
Faber
Kokoro — portugalski (Brazylia)
Dora
Piper jest lżejszym wyborem. Jeśli Kokoro nie nadąża za czatem, przełącz na Piper.
Jak powstały te próbki
Próbki angielskie czytają: Witaj na transmisji! Dzięki za dołączenie. W jaką grę zagramy następnie? Odczytywanie nazw było wyłączone. Klipy pomijają czas ładowania.
Testowano 7 września 2026 r. w OBS 32.2.2 na Windows 11. Prawdziwa wiadomość dotarła do Docka, została odczytana, poruszyła wskaźnik źródła przeglądarkowego i trafiła do nagrania. Kokoro na CPU zaczynało zauważalnie później.
Na tym komputerze systemowy TTS pokazywał pięć głosów, ale nagranie OBS było bez dźwięku. Twój komputer może działać inaczej, więc zawsze testuj własny link. Głosów chmurowych nie testowano (brak płatnych kont).
Wybierz dostawcę
Zacznij od Piper. Wypróbuj Kokoro, jeśli bardziej podoba Ci się jego brzmienie. Bezpłatne głosy działają na Twoim komputerze. Chmurowe wymagają konta i klucza API, a tekst czatu trafia do tej firmy.
| Dostawca | Dobre do | Pamiętaj | Koszt |
|---|---|---|---|
| Piper | Naturalne głosy; angielski, hiszpański, portugalski. | Jakość zależy od głosu. HFC medium ma około 63 MB. | Bezpłatne, bez klucza |
| Kokoro | Najbardziej naturalne bezpłatne głosy; angielski, hiszpański, portugalski brazylijski. | Większe obciążenie CPU. Pierwsza mowa może być powolna. Szybciej na obsługiwanym GPU. | Bezpłatne, bez klucza |
| Kitten | Mały model angielski, osiem głosów. | Tylko angielski. Dołączony model ma około 24 MB. | Bezpłatne, bez klucza |
| eSpeak | Bardzo lekki, wiele języków, szybki start. | Celowo brzmi robotycznie. | Bezpłatne, bez klucza |
| Systemowy TTS | Głosy już dostępne w przeglądarce lub komputerze. | Często nieme w OBS. Niektóre głosy wymagają internetu. | Bezpłatne |
| ElevenLabs | Wybór głosów według ID; stabilność i styl. | Limity konta i opóźnienie sieci. | Mogą obowiązywać opłaty API |
| Google Cloud | Nazwane głosy; język, tempo i wysokość. | Nie każdy głos obsługuje każdą opcję. API Cloud TTS musi być włączone. | Obowiązują rozliczenia i limity |
| Gemini | Style głosów i pisemne instrukcje sposobu mówienia. | Modele podglądowe i limity mogą się zmieniać. | Sprawdź limity Gemini |
| Fish Audio | Bezpłatny model z własnym kluczem; ID głosów. | OBS wymaga lokalnego mostka SSN. | Bezpłatny poziom ustalany przez Fish Audio |
| Speechify | ID głosu z szybkością, językiem i modelem. | Głosy zależą od konta. | Obowiązują warunki API |
| OpenAI | Nazwane głosy, ustawienia modelu i formatu. | Subskrypcja ChatGPT nie obejmuje środków API. | Rozliczenia API |
| Własny / lokalny | Twój własny serwer głosowy. | Najwięcej konfiguracji. Zobacz poradnik serwera lokalnego. | Twój sprzęt lub hosting |
Rozmiary pobierania i uwagi z testów OBS
Rozmiary dotyczą tylko plików modeli, nie zużycia pamięci. Bezpłatne głosy działają na komputerze odtwarzającym Dock lub nakładkę. Pierwsze użycie jest wolniejsze. OBS ma własną pamięć pobrań, oddzielną od Chrome.
Piper, Kokoro, Kitten i eSpeak przeszły testy nagrania źródła przeglądarkowego OBS. Głosy chmurowe i własne też grają przez stronę, ale nie testowano ich z aktywnymi kontami. Systemowy TTS przetestuj osobno, nawet gdy pokazuje głosy.
Rozwiązywanie problemów
| Problem | Spróbuj tego |
|---|---|
| Czy moja platforma czatu obsługuje TTS? | Tak, jeśli SSN odbiera czat jako tekst. YouTube, Twitch, TikTok i pozostałe działają tak samo. Platforma nie potrzebuje własnego TTS. |
| Brak mowy | Sprawdź, czy Dock pokazuje czat. Potem sprawdź przełącznik TTS, dostawcę i filtry. Użyj świeżo skopiowanego linku. Poczekaj na pierwsze pobranie głosu. |
| Działa w Chrome lub Edge, nie w OBS | OBS ma własną przeglądarkę i listę głosów. Systemowy TTS często tam nie działa. Przełącz na Piper, Kokoro, Kitten lub eSpeak. Wirtualny kabel audio nie naprawi braku mowy. |
| Wskaźnik się porusza, ale nagranie jest nieme | Sprawdź wyciszenie i ścieżki nagrania w OBS. Nie przechwytuj ponownie wyjścia odsłuchowego. Zobacz Poradnik dźwięku OBS. |
| Mowa nie nadąża za czatem | Przełącz z Kokoro na Piper lub wypróbuj eSpeak. |
| Każda wiadomość jest czytana dwa razy | Mówi więcej niż jedna strona. Pozostaw TTS włączone tylko w jednym miejscu. |
| Chcę, aby mówił dok OBS lub Featured Chat | Niestandardowy dok przeglądarki OBS jest panelem sterowania, nie źródłem sceny. Dla Featured Chat włącz TTS w opcjach tej nakładki i skopiuj jej link. |
Więcej rozwiązań: Dokumentacja TTS · problemy lokalnego serwera.
Ustawienia dostawcy
Prawdziwe zrzuty z aplikacji komputerowej ze świeżym profilem (pola kluczy puste). Otwórz dostawcę, aby zobaczyć ustawienia. Kliknij zrzut, aby powiększyć.
Systemowy TTS
Lista głosów zależy od przeglądarki lub aplikacji i zainstalowanych głosów. Nie ma stałej listy SSN. Ten nowy profil pokazał pustą listę języków.

Kokoro
Wybierz głos. Znajdź go filtrem języka i Test aby posłuchać. Model ładuje się na stronie, która mówi. Głosy: angielski amerykański i brytyjski, hiszpański, portugalski brazylijski. Za wolno? Wypróbuj Piper.

Nazwy głosów i wartości linku
- Heart (amerykański żeński) —
af_heart - Alloy (amerykański żeński) —
af_alloy - Aoede (amerykański żeński) —
af_aoede - Bella (amerykański żeński) —
af_bella - Jessica (amerykański żeński) —
af_jessica - Kore (amerykański żeński) —
af_kore - Nicole (amerykański żeński) —
af_nicole - Nova (amerykański żeński) —
af_nova - River (amerykański żeński) —
af_river - Sarah (amerykański żeński) —
af_sarah - Sky (amerykański żeński) —
af_sky - Adam (amerykański męski) —
am_adam - Echo (amerykański męski) —
am_echo - Eric (amerykański męski) —
am_eric - Fenrir (amerykański męski) —
am_fenrir - Liam (amerykański męski) —
am_liam - Michael (amerykański męski) —
am_michael - Onyx (amerykański męski) —
am_onyx - Puck (amerykański męski) —
am_puck - Santa (amerykański męski) —
am_santa - Emma (brytyjski żeński) —
bf_emma - Isabella (brytyjski żeński) —
bf_isabella - George (brytyjski męski) —
bm_george - Lewis (brytyjski męski) —
bm_lewis - Alice (brytyjski żeński) —
bf_alice - Lily (brytyjski żeński) —
bf_lily - Daniel (brytyjski męski) —
bm_daniel - Fable (brytyjski męski) —
bm_fable - Dora (hiszpański):
ef_dora - Alex (hiszpański):
em_alex - Santa (hiszpański):
em_santa - Dora (portugalski brazylijski):
pf_dora - Alex (portugalski brazylijski):
pm_alex - Santa (portugalski brazylijski):
pm_santa
Kitten
Osiem angielskich głosów: męskie i żeńskie wersje głosów 2, 3, 4 i 5. Próbka używa głosu 4 (żeńskiego).

Nazwy głosów i wartości linku
- Głos 2 (męski) —
expr-voice-2-m - Głos 2 (żeński) —
expr-voice-2-f - Głos 3 (męski) —
expr-voice-3-m - Głos 3 (żeński) —
expr-voice-3-f - Głos 4 (męski) —
expr-voice-4-m - Głos 4 (żeński) —
expr-voice-4-f - Głos 5 (męski) —
expr-voice-5-m - Głos 5 (żeński) —
expr-voice-5-f
Piper
Wybierz głos pasujący do języka. Sama zmiana języka nie zmienia głosu. Próbka używa HFC medium.

Nazwy głosów i wartości linku
- Angielski USA, żeński (HFC) — średnia jakość —
en_US-hfc_female-medium - Hiszpański z Hiszpanii (DaveFX) — średnia jakość —
es_ES-davefx-medium - Hiszpański meksykański (Ald) — średnia jakość —
es_MX-ald-medium - Portugalski brazylijski (Faber) — średnia jakość —
pt_BR-faber-medium - Portugalski brazylijski (Edresson) — niska jakość —
pt_BR-edresson-low - Portugalski z Portugalii (Tugao) — średnia jakość —
pt_PT-tugão-medium
eSpeak
Wybierz głos języka. Możesz zmienić tempo mowy. Celowo brzmi robotycznie.

Nazwy głosów i wartości linku
- Angielski —
en - Hiszpański —
es - Portugalski brazylijski —
pt-br - Portugalski z Portugalii —
pt-pt
ElevenLabs
Wpisz klucz API. Potem kliknij Pokaż moje dostępne głosy aby znaleźć ID głosu dostępnego na koncie. Dokumentacja ElevenLabs.

Google Cloud
Wpisz klucz API Google Cloud TTS, dokładną nazwę głosu i pasujący język. Nazwy głosów i obsługiwane ustawienia.

Gemini
Wybierz model TTS i głos. Instrukcje stylu zmieniają sposób czytania. To używa API Gemini, nie Google Cloud TTS. Przykłady głosów i wymagania.

Fish Audio
Działa w Docku czatu, nakładce wyróżnionych wiadomości, stronie TTS i Flow Actions.
- Wybierz Fish Audio jako dostawcę TTS.
- Wklej swój Klucz API Fish Audio.
- Opcjonalnie: wklej Identyfikator głosu z Fish Audio. Skopiuj ID modelu głosu, nie nazwę ani link strony. Dla głosu domyślnego zostaw puste.
- Naciśnij Przetestuj TTS.
Domyślny model to s2.1-pro-free. Fish Audio ustala ofertę bezpłatną i zasady uczciwego użycia. Płatne modele wymagają środków na koncie. SSN nigdy nie przełącza na płatny model po błędzie bezpłatnego żądania. Szybkość wynosi od 0,5 do 2. Fish Audio wykrywa język. Tekst czatu jest wysyłany do Fish Audio.
Dla OBS: uruchom lokalny mostek
Fish Audio blokuje bezpośrednie żądania ze stron internetowych, więc OBS potrzebuje narzędzia SSN: lokalny mostek (wymaga Node.js). Uruchom na komputerze z OBS.
- Ustaw
SSN_TTS_TARGET_BEARERna swój klucz API Fish w zmiennej środowiskowej. - W folderze SSN uruchom
node scripts/local-tts-bridge.cjs --mode fish. Pozostaw uruchomione. - W panelu Fish Audio ustaw URL mostka na
http://127.0.0.1:8124/v1/audio/speech. - Wklej token mostka pokazany w terminalu do Klucz API .
- Przetestuj głos, potem dodaj link nakładki do OBS. Włącz Steruj dźwiękiem przez OBS (Control audio via OBS).
SSN_TTS_BRIDGE_TOKEN na długi losowy sekret. Zachowaj linki z tokenem lub kluczem prywatnie.Ustawienia linku Fish Audio
&ttsprovider=fish&fishkey=YOUR_KEY&voicefish=VOICE_ID&fishmodel=s2.1-pro-free&fishspeed=1
Z mostem dodaj &fishendpoint=http%3A%2F%2F127.0.0.1%3A8124%2Fv1%2Faudio%2Fspeech. Pomiń fishkey jeśli mostek przechowuje klucz. Opcja Event Flow Odczytaj tekst (Speak Text) nadpisania głosu przyjmuje ID głosu Fish, gdy odbierająca strona używa Fish Audio.
Dokumentacja API Fish Audio · Ogłoszenie bezpłatnego modelu i warunki
Speechify
Wpisz klucz API i identyfikator głosu ze swojego konta API Speechify. Poradnik Speechify krok po kroku · Konfiguracja Speechify.

OpenAI
Wybierz głos i model oraz wpisz klucz API. Subskrypcja ChatGPT nie daje środków API. Zachowaj domyślny adres usługi.

Własny / lokalny TTS
Używa ustawień OpenAI, więc nagłówek nadal brzmi OpenAI. Wpisz adres serwera oraz obsługiwany głos i model. Potrzeba klucza zależy od serwera. Zobacz poradnik serwera lokalnego.

Szybsze Kokoro i Kitten
W sekcji Kokoro lub Kitten otwórz Generowanie i odtwarzanie. Te opcje generują mowę w tle, by strona działała płynnie.
| Chcę… | Zrób to |
|---|---|
| Włącz dla Kokoro | Ustaw Przetwarzanie na Generowanie w tle. |
| Włącz dla Kitten | Wybierz Kitten 0.8 model: Nano (najmniejszy), Micro lub Mini. |
| Usłysz mowę szybciej | Zacznij, gdy mowa napływa. Odtwarza każdą część, gdy jest gotowa. Wolne komputery mogą robić przerwy między częściami. |
| Unikaj przerw | Odtwórz całą wiadomość. Najpierw czeka na całą wiadomość. |
| Napraw problemy GPU (Kokoro) | Ustaw Procesor w tle na CPU. |
| Najlepsza jakość Kokoro | Pełna jakość. Większe pobieranie, więcej pamięci. |
Więcej szczegółów i ustawienia linku
Automatyczne używa obsługiwanego GPU, jeśli jest dostępne, w przeciwnym razie CPU. Automatyczna jakość wybiera FP16 na zgodnych GPU, pełną precyzję na innych obsługiwanych GPU i kompaktowy model na CPU. Wymuszenie GPU, gdy go nie ma, powoduje błąd.
Kitten 0.8 działa na CPU, tylko po angielsku. Każdy model pobiera się przy pierwszym użyciu. Każda przeglądarka i OBS mają własną kopię. NeuroSync w obu przypadkach otrzymuje cały plik audio. Stare linki działają jak wcześniej, dopóki nie zmienisz tych opcji.
Kokoro: &kokororuntime=worker, opcjonalne &kokoroplayback=stream, &kokorodevice=wasm lub webgpu, &kokorodtype=q8, fp16 lub fp32. Strumieniowanie lub FP32 automatycznie włącza generowanie w tle.
Kitten: &kittenmodel=nano (lub micro, mini), opcjonalnie &kittenplayback=stream.
Dalsze kroki
| Chcę… | Przejdź tutaj |
|---|---|
| Edytuj link TTS ręcznie lub zobacz wszystkie opcje | Dokumentacja TTS |
| Użyj hiszpańskich lub portugalskich głosów w linku | Dokumentacja TTS: opcje dostawców |
| Uruchom własny serwer głosowy lub sklonuj głos | Poradnik lokalnej AI TTS |
| Skonfiguruj Speechify | Poradnik Speechify |
Szybki link do wypróbowania: dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=piper