Poradnik TTS Social Stream Ninja

Pełny poradnik opcji głosów syntezy mowy, zgodności przeglądarek i przechwytywania dźwięku

Polski

Przegląd

SSN może odczytywać przechwycony tekst czatu z każdego obsługiwanego źródła; platforma czatu nie potrzebuje własnej funkcji TTS. Dok lub nakładka z włączonym TTS odczytuje otrzymane wiadomości zgodnie z filtrami i ustawieniami TTS. Zacznij od krótkiego poradnika konfiguracji; ta strona opisuje opcje głosów i ustawienia zaawansowane. Porównaj dostawców, posłuchaj próbek i zobacz ustawienia.

Szybki start: Użyj dock.html?session=YOUR_SESSION&speech=en-US. Domyślnie używa System TTS. Dla bezpłatnego dostawcy w OBS dodaj również &ttsprovider=kokoro. Pozostaw tę stronę otwartą i połączoną; mówić powinna tylko jedna kopia.

Gdzie używa się TTS?

System TTS to nie to samo co wszystkie bezpłatne TTS:
  • Głosy systemowe zależą od przeglądarki i systemu operacyjnego. OBS może nie udostępniać żadnych użytecznych głosów, nawet gdy Chrome/Edge działa.
  • Brak głosu to co innego niż odtwarzanie mowy poza przechwytywaniem dźwięku OBS. Routing dźwięku nie naprawi braku obsługi mowy.
  • Bezpłatni dostawcy, tacy jak Kokoro, Piper, Kitten i eSpeak, zamiast tego generują dźwięk strony. TTS w OBS nie wymaga płatności.
  • Sprawdź dostępność głosu, a następnie przechwytywanie dźwięku.

Opcje dostawców TTS

System TTS (bezpłatne)

Lokalne / bezpłatne opcje TTS (bez klucza API)

Chcesz całkowicie lokalne TTS z AI? Kilka wysokiej jakości głosów AI jest wbudowanych bezpośrednio w Social Stream Ninja i działa w przeglądarce — bez klucza API, chmury ani dodatkowej instalacji. Zobacz Poradnik lokalnego TTS AI , aby uzyskać instrukcje konfiguracji i opcje własnego serwera.
Dostawca Koszt Przechwytywanie w OBS Funkcje
Kokoro TTS Bezpłatne Bezpośrednio AI w przeglądarce, doskonała jakość, dziesiątki głosów
Piper TTS Bezpłatne Bezpośrednio Szybki neuronowy TTS w przeglądarce, przyjazny dla CPU
Kitten TTS Bezpłatne Bezpośrednio W przeglądarce, lekki model ONNX
eSpeak-NG Bezpłatne Bezpośrednio Klasyczny, z otwartym kodem, działa na dowolnym sprzęcie

Płatne / chmurowe opcje TTS (bezpośredni dźwięk przeglądarki)

Dostawca Koszt Przechwytywanie w OBS Funkcje
OpenAI TTS Obowiązują opłaty API (lub bezpłatnie lokalnie) Bezpośrednio Wysoka jakość; obsługuje również lokalne serwery przez własny punkt końcowy
Google Cloud Obowiązują opłaty API Bezpośrednio Profesjonalna jakość, wiele języków
ElevenLabs Dostępny bezpłatny plan Bezpośrednio Własne trenowanie głosu, naturalne brzmienie
Speechify Obowiązują opłaty API Bezpośrednio Wysokiej jakości głosy, wiele języków
Gemini TTS Obowiązują opłaty API Bezpośrednio API generatywnego języka Google

Dostępność głosów systemowych

To typowe możliwości, a nie gwarancje dla każdej instalacji. OBS używa własnej wbudowanej przeglądarki i nie dziedziczy listy głosów zainstalowanego Chrome/Edge. Udany test w aplikacji SSN nie testuje oddzielnego źródła przeglądarkowego OBS.

Chrome

✓ Głosy systemowe dostępne w obsługiwanych instalacjach

Głosy Google + głosy systemowe

Edge

✓ Głosy systemowe dostępne w obsługiwanych instalacjach

Głosy Microsoft + pakiety TTS Windows

Firefox

⚠ Ograniczona obsługa

Tylko lokalne języki systemowe

Opera

⚠ Ograniczona obsługa

Oparte na Chromium; dostępne głosy zależą od instalacji

Ograniczenia przeglądarki:

Metody przechwytywania dźwięku TTS Windows w OBS

Dźwięk strony: bezpłatni dostawcy lokalni i chmurowi

Lokalni dostawcy SSN działający w przeglądarce i chmurowi dostawcy dźwięku odtwarzają wygenerowany dźwięk przez stronę:

Metody przechwytywania System TTS

Ważne: Najpierw potwierdź, że System TTS generuje mowę. Wbudowana przeglądarka OBS może nie udostępniać użytecznego głosu systemowego. Jeśli nie generuje mowy, zmiana routingu dźwięku nie pomoże. Wybierz innego dostawcę albo generuj mowę w obsługiwanej przeglądarce i przechwytuj jej dźwięk.

W szczególności dla System TTS:

Programy do routingu do pobrania: VB-Audio Virtual Cable | Voicemeeter | Audio Router (starsze)

Najpierw spróbuj przechwycić mówiącą przeglądarkę przez dźwięk aplikacji lub pulpitu OBS, tam gdzie jest to obsługiwane. Poniższe metody wirtualnego kabla są opcjonalnymi alternatywami; nie dodają obsługi mowy do OBS.

Metoda 1: domyślny routing dźwięku z wirtualnym kablem

1. Set VB-Audio Virtual Cable as Windows default output - Sound Settings > Output > CABLE Input 2. OBS: - Add Audio Input Capture - Source: CABLE Output - Monitor: Monitor and Output, or Monitor Only if another source handles stream output

Metoda 2: routing aplikacji w Windows 10

1. Sound Settings > App volume and device preferences 2. Find browser in list 3. Output: CABLE Input 4. OBS setup same as Method 1

Metoda 3: routing aplikacji w Windows 11

1. Settings > System > Sound > Volume Mixer 2. Locate browser 3. Output: CABLE Input 4. OBS setup same as Method 1

Metoda 4: program Audio Router

1. Install Audio Router 2. Route browser to CABLE Input 3. OBS setup same as Method 1

Metoda 5: Voicemeeter (zaawansowane)

1. Install Voicemeeter 2. Set as Windows default output 3. Route: - Hardware out > speakers - Virtual out > OBS 4. OBS captures Voicemeeter output

Testowanie konfiguracji

1. Play TTS 2. Check OBS meter 3. Verify system audio 4. Adjust levels if needed
Alternatywy: Użyj bezpłatnego wbudowanego dostawcy, takiego jak Kokoro, Piper, Kitten lub eSpeak, dostawcy chmurowego albo własnego serwera TTS.

Instalowanie dodatkowych pakietów językowych

Windows 11

  1. Przejdź do Start > Ustawienia > Czas i język > Mowa
  2. W sekcji Zarządzaj głosami, kliknij Dodaj głosy
  3. Wybierz żądane języki i kliknij Dodaj
  4. Uruchom ponownie przeglądarki, aby odświeżyć dostępne głosy

Windows 10

Postępuj zgodnie z instrukcjami w oficjalnym poradniku Microsoft , aby zainstalować pakiety językowe.

Wskazówka: Niektóre głosy zewnętrzne mogą nie pojawiać się w przeglądarkach z powodu problemów ze zgodnością. Firefox często pokazuje więcej głosów systemowych niż przeglądarki oparte na Chromium.

Parametry URL konfiguracji TTS

Parametry podstawowe

Parametr Opis Przykład
&speech Włącz TTS z kodem języka &speech=en-US
&pitch Wysokość głosu (od 0.1 do 2.0) &pitch=1.2
&volume Poziom głośności (od 0.0 do 1.0) &volume=0.8
&rate Tempo mowy (od 0.1 do 10.0) &rate=1.5
&voice Częściowe dopasowanie nazwy głosu &voice=google
&ttsprovider Wybierz dostawcę: kokoro, piper, kitten, espeak, openai, customtts, localtts, elevenlabs, google, speechify, gemini &ttsprovider=customtts

Parametry zaawansowane

Parametr Opis
&simpletts Nie mów „mówi” ani „ktoś mówi”
&simpletts2 W ogóle nie odczytuj nazw uczestników czatu
&ttscommand Włącz własne polecenie TTS (domyślnie: !say)
&readevents Uwzględniaj zdarzenia transmisji w TTS
&skipmessages=3 Odczytuj tylko co trzecią wiadomość

Konfiguracja dostawcy TTS

Kokoro TTS (bezpłatne, wbudowane)

Piper TTS (bezpłatne, wbudowane)

Kitten TTS (bezpłatne, wbudowane)

eSpeak-NG (bezpłatne, wbudowane)

Przykłady TTS po portugalsku i hiszpańsku

OpenAI / TTS serwera lokalnego

Google Cloud TTS

Gemini TTS

ElevenLabs TTS

Fish Audio TTS

Wybierz Fish Audio i wpisz klucz API oraz opcjonalny identyfikator głosu. Domyślny model to s2.1-pro-free. Konfiguracja, opcje modeli i ograniczenia dostępu przeglądarki.

Speechify TTS

Rozwiązywanie problemów

Typowe problemy

Dobre praktyki

Sprawdź głosy systemowe tej przeglądarki

Ta lista pokazuje wyłącznie głosy System TTS w przeglądarce wyświetlającej ten poradnik. Nie testuje to OBS, oddzielnego okna aplikacji SSN ani dostawców takich jak Kokoro. Pusta lista nie oznacza, że inni dostawcy TTS w SSN są niedostępni.