Guida alla configurazione della sintesi vocale

Ascolta la chat in tre passaggi. Inizia gratis, senza account o chiave API.

1. Attiva la lettura della chat

Non hai ancora collegato una chat? Inizia qui: installa SSN, aggiungi la sorgente e apri il dock.

Apri popup dell'estensione SSN oppure la sezione dell'app desktop Sorgenti e impostazioni.

Sotto Overlay chat principale e dock di controllo (Main chat overlay & control dock), espandi Messaggio — Sintesi vocale (Message — Text to Speech). Attiva l'interruttore mostrato qui:

Popup reale: Message — Text to Speech, con Enable TTS in dock attivato
Interruttore blu = lettura chat attiva.

2. Scegli una voce gratuita

Nella stessa sezione, scorri fino a Provider del servizio TTS. Scegli Piper TTS, poi una voce.

Popup reale: Piper TTS selezionato, con voce English US Female HFC Medium
Piper non richiede account o chiave API. Lascia il tempo necessario al primo download della voce.

Usa copia link accanto a Overlay chat principale e dock di controllo (Main chat overlay & control dock) per ottenere il link aggiornato.

3. Riproducila in OBS

  1. Aggiungi in OBS una Sorgente browser e incolla quel link.
  2. Attiva Controlla l'audio tramite OBS nelle sue proprietà.
  3. Invia un messaggio chat. Controlla l'indicatore audio della sorgente, poi fai una breve registrazione.

Vuoi ascoltarlo? Nelle Proprietà audio avanzate di OBS, scegli Monitora e invia all'uscita (Monitor and Output) per quella sorgente. Mantieni una sola copia che legge la chat.

Ascolta le voci gratuite

Preferisci un altro suono? Queste quattro voci sono gratuite. Premi riproduci per confrontarle.

Piper

Inglese USA femminile (HFC), qualità media.
en_US-hfc_female-medium

Vedi impostazioni e voci

Kokoro

Bella, femminile americana. Provata con CPU/WASM, q8.
af_bella

Vedi impostazioni e voci

Kitten

Voce 4, femminile. Modello nano v0.1 incluso.
expr-voice-4-f

Vedi impostazioni e voci

eSpeak

Inglese. Una voce sintetica con un ingombro ridotto.
en

Vedi impostazioni e voci

Campioni in spagnolo e portoghese

Scegli una lingua sopra l'elenco delle voci nelle impostazioni SSN, poi usa Prova. Piper offre Spagna, Messico, Brasile e Portogallo; Kokoro aggiunge tre voci spagnole e tre portoghesi brasiliane.

Piper - Spagnolo (Spagna)

DaveFX

Kokoro - Spagnolo

Dora

Piper - Portoghese (Brasile)

Faber

Kokoro - Portoghese (Brasile)

Dora

Sintesi locale gratuita, con un download iniziale. I campioni omettono il tempo di caricamento. Piper è il punto di partenza più leggero; Kokoro può essere lento su CPU. Usa Piper se il parlato resta indietro rispetto alla chat.

Testi dei campioni e dettagli dei test

I quattro campioni inglesi leggono: Benvenuto nella diretta! Grazie per essere qui. A quale gioco dovremmo giocare adesso? La lettura dei nomi è disattivata.

Verificato il 7 settembre 2026 in OBS 32.2.2 su Windows 11: un messaggio chat ha raggiunto il dock reale, generato la voce, mosso l'indicatore della sorgente browser ed è comparso in una registrazione. In questo test su CPU, Kokoro ha impiegato sensibilmente più tempo a iniziare a parlare. Queste clip mostrano la voce, non il tempo di attesa.

System TTS esponeva cinque voci su questa macchina ma non ha prodotto audio nella registrazione della sorgente browser. Questo risultato riguarda questa specifica configurazione; prova sempre l'URL finale e la registrazione. Le voci cloud non sono incluse perché non sono state usate credenziali a pagamento.

Ti serve aiuto?

La mia piattaforma chat supporta TTS?

Se SSN riceve la chat come testo, può leggerla ad alta voce. YouTube, Twitch, TikTok e le altre sorgenti usano la stessa funzionalità. La piattaforma chat non deve avere un proprio supporto TTS.

Non senti la voce?

Verifica che il dock riceva la chat, poi controlla interruttore TTS, provider e filtri. Usa il link appena copiato. Attendi il completamento del primo download del modello.

Funziona in Chrome/Edge, ma non in OBS?

OBS ha un browser e un elenco di voci separati. System TTS potrebbe non funzionare lì, anche se elenca delle voci. Prova Piper, Kokoro, Kitten o eSpeak. Un cavo audio virtuale non può risolvere l'assenza della voce.

L'indicatore si muove, ma la registrazione è silenziosa?

Controlla muto e assegnazioni delle tracce di registrazione in OBS. Usa Monitoraggio e uscita se vuoi ascoltarlo anche tu; evita di acquisire una seconda volta quell'uscita di monitoraggio. Guida audio OBS.

Posso usare invece un dock OBS o Featured Chat?

Un dock browser personalizzato OBS è un pannello di controllo, non la sorgente browser di scena usata sopra. Per Featured Chat, attiva TTS nelle opzioni del popup proprie dell'overlay e copia il suo link. Mantieni una sola pagina che parla per evitare voci duplicate.

Confronta tutti i provider: requisiti, costi e compromessi

Inizia con Piper per una voce locale gratuita oppure confronta Kokoro se ne preferisci il suono. Prova eSpeak quando la reattività conta più del realismo. Kitten è un'altra opzione compatta in inglese. Ascolta prima di decidere.

ProviderAdatto aCompromessoRequisiti / costo
KokoroVoci in inglese, spagnolo e portoghese brasiliano.Più lavoro per la CPU; il primo parlato può essere lento.Gratuito, senza chiave. Scarica risorse di modello/voce; CPU o WebGPU supportato.
PiperVoci neurali locali; opzioni in inglese, spagnolo e portoghese.Qualità e pronuncia variano a seconda della voce.Gratuito, senza chiave. Scarica il modello selezionato (HFC medium: circa 63 MB), più i file del motore.
KittenModello inglese compatto, otto voci disponibili.Meno lingue e stili vocali.Gratuito, senza chiave. Modello attualmente incluso: circa 24 MB, più file del motore/delle voci; CPU.
eSpeakLeggero, molte lingue, avvio rapido.Suono volutamente sintetico/robotico.Gratuito, senza chiave. Carica i file del motore/delle lingue inclusi; non richiede modello neurale o GPU.
TTS di sistemaUsa le voci esposte dal browser o dall'app desktop.Elenco delle voci e acquisizione OBS variano; alcune voci richiedono Internet.Nessun costo di provider SSN. Richiede una voce di sistema/browser funzionante; provala sulla pagina di riproduzione effettiva.
ElevenLabsID voce, selezione del modello e controlli di stabilità/stile.Possono applicarsi limiti dell'account, ritardi di rete e costi API.Internet, chiave API e ID voce accessibile. Il testo chat viene inviato al provider.
Google CloudVoci con nome e controlli di lingua, velocità e tono.Non tutte le voci supportano ogni controllo.Internet, API Cloud TTS attivata, chiave API e voce/lingua corrispondenti. Si applicano fatturazione/quote.
GeminiStili vocali e istruzioni scritte per la resa.Modelli in anteprima e quote possono cambiare; la latenza varia.Internet, chiave API Gemini e accesso al modello TTS selezionato. Controlla limiti/fatturazione dell'account.
SpeechifyID voce con controlli di velocità, lingua e modello.Richiede accesso API; le voci disponibili dipendono dall'account.Internet e chiave API Speechify. Si applicano condizioni/limiti di utilizzo API.
OpenAIVoci con nome e controlli di modello e formato.Sono necessari fatturazione API e Internet; l'abbonamento dell'account è separato.Chiave API con accesso TTS. Il testo chat viene inviato all'endpoint configurato.
Personalizzato / LocaleUsa il tuo server vocale compatibile.Configurazione più impegnativa: endpoint, modello, voce e accesso browser devono essere coerenti.Un endpoint vocale compatibile con OpenAI raggiungibile; chiave, se richiesta. I costi di hardware locale o hosting variano.

Le dimensioni di download sopra indicate si riferiscono ai file dei modelli, non alla memoria totale usata o a tutte le risorse necessarie. I provider locali usano il computer che esegue il dock/overlay; il primo uso può essere più lento e OBS ha la propria cache. I provider cloud risparmiano elaborazione locale, ma inviano il testo fuori dal dispositivo.

OBS: i quattro provider locali qui sotto hanno superato i test di registrazione della sorgente browser. I provider cloud/personalizzati restituiscono audio da riprodurre sulla pagina, ma non sono stati provati con account reali in questa verifica. System TTS richiede un test separato anche quando elenca delle voci.

Impostazioni dei provider e nomi delle voci

Impostazioni reali dell'app desktop, acquisite con un profilo nuovo. Apri il provider desiderato; i campi delle chiavi API sono volutamente vuoti. Questi controlli configurano il dock o l'overlay SSN selezionato. Seleziona uno screenshot per vederlo a dimensione intera.

TTS di sistema

L'elenco delle lingue è vuoto in questo nuovo profilo. Le voci disponibili dipendono dal browser/dall'app e dalle voci installate; non esiste un elenco universale di voci SSN.

Impostazioni reali del provider SSN System TTS
Kokoro

Scegli una voce in SSN; il modello viene caricato sulla pagina che parla. La selezione include inglese USA/Regno Unito, spagnolo e portoghese brasiliano. Usa il filtro lingua per trovare le voci; Test riproduce una breve frase nella lingua selezionata. Per usare meno CPU, prova Piper.

Impostazioni reali del provider SSN Kokoro
Nomi delle voci e valori URL
  • Heart (femminile americana) — af_heart
  • Alloy (femminile americana) — af_alloy
  • Aoede (femminile americana) — af_aoede
  • Bella (femminile americana) — af_bella
  • Jessica (femminile americana) — af_jessica
  • Kore (femminile americana) — af_kore
  • Nicole (femminile americana) — af_nicole
  • Nova (femminile americana) — af_nova
  • River (femminile americana) — af_river
  • Sarah (femminile americana) — af_sarah
  • Sky (femminile americana) — af_sky
  • Adam (maschile americana) — am_adam
  • Echo (maschile americana) — am_echo
  • Eric (maschile americana) — am_eric
  • Fenrir (maschile americana) — am_fenrir
  • Liam (maschile americana) — am_liam
  • Michael (maschile americana) — am_michael
  • Onyx (maschile americana) — am_onyx
  • Puck (maschile americana) — am_puck
  • Santa (maschile americana) — am_santa
  • Emma (femminile britannica) — bf_emma
  • Isabella (femminile britannica) — bf_isabella
  • George (maschile britannica) — bm_george
  • Lewis (maschile britannica) — bm_lewis
  • Alice (femminile britannica) — bf_alice
  • Lily (femminile britannica) — bf_lily
  • Daniel (maschile britannica) — bm_daniel
  • Fable (maschile britannica) — bm_fable
  • Dora (spagnolo) - ef_dora
  • Alex (spagnolo) - em_alex
  • Santa (spagnolo) - em_santa
  • Dora (portoghese brasiliano) - pf_dora
  • Alex (portoghese brasiliano) - pm_alex
  • Santa (portoghese brasiliano) - pm_santa
Kitten

Otto voci inglesi: varianti maschili e femminili numerate 2, 3, 4 e 5. Il campione usa Voice 4 (Female).

Impostazioni reali del provider SSN Kitten
Nomi delle voci e valori URL
  • Voce 2 (maschile) — expr-voice-2-m
  • Voce 2 (femminile) — expr-voice-2-f
  • Voce 3 (maschile) — expr-voice-3-m
  • Voce 3 (femminile) — expr-voice-3-f
  • Voce 4 (maschile) — expr-voice-4-m
  • Voce 4 (femminile) — expr-voice-4-f
  • Voce 5 (maschile) — expr-voice-5-m
  • Voce 5 (femminile) — expr-voice-5-f
Piper

Scegli lingua e modello corrispondenti. Il campione usa HFC medium. L'impostazione della lingua da sola non traduce una voce.

Impostazioni reali del provider SSN Piper
Nomi delle voci e valori URL
  • Inglese USA femminile (HFC) - Media — en_US-hfc_female-medium
  • Spagnolo della Spagna (DaveFX) - Media — es_ES-davefx-medium
  • Spagnolo del Messico (Ald) - Media — es_MX-ald-medium
  • Portoghese brasiliano (Faber) - Media — pt_BR-faber-medium
  • Portoghese brasiliano (Edresson) - Bassa — pt_BR-edresson-low
  • Portoghese del Portogallo (Tugao) - Media — pt_PT-tugão-medium
eSpeak

Scegli una voce nella lingua desiderata e, se vuoi, regola la velocità di parlato. Questo motore ha un suono robotico per scelta progettuale.

Impostazioni reali del provider SSN eSpeak
Nomi delle voci e valori URL
  • Inglese — en
  • Spagnolo — es
  • Portoghese brasiliano — pt-br
  • Portoghese del Portogallo — pt-pt
ElevenLabs

Inserisci la chiave API, poi usa List My Available Voices per trovare un ID voce utilizzabile dal tuo account. Riferimento dei provider.

Impostazioni reali del provider SSN ElevenLabs
Google Cloud

Inserisci una chiave API Google Cloud TTS e il nome esatto della voce, con la lingua corrispondente. Nomi delle voci e controlli supportati.

Impostazioni reali del provider SSN Google Cloud
Gemini

Seleziona un modello TTS e una voce supportati; le istruzioni di stile cambiano la resa. Queste sono impostazioni dell'API Gemini, separate da Google Cloud TTS. Esempi di voci e requisiti.

Impostazioni reali del provider SSN Gemini
Fish Audio

Seleziona Fish Audio nel menu del provider TTS per dock chat, overlay dei messaggi in evidenza, pagina TTS o Flow Actions. Inserisci la tua Chiave API Fish Audio, poi usa il pulsante Test TTS esistente. Un Voice ID facoltativo seleziona una voce da Fish Audio; copia l'ID del modello vocale, non il nome o l'URL della pagina. Lascialo vuoto per usare la voce predefinita del servizio.

Le opzioni avanzate includono modello e velocità di parlato (0,5–2). SSN usa come predefinito s2.1-pro-free; disponibilità del piano gratuito e condizioni di uso corretto sono gestite da Fish Audio. I modelli a pagamento richiedono credito nell'account. SSN non riprova una richiesta gratuita non riuscita usando un modello a pagamento. Usa More TTS options per il volume degli spettatori. Il testo viene inviato a Fish Audio e il servizio ne rileva la lingua.

Configurazione OBS / browser: Esegui il bridge TTS locale già incluso in SSN in modalità Fish sul computer di OBS. Imposta la sua variabile d'ambiente SSN_TTS_TARGET_BEARER sulla tua chiave API Fish e avvia node scripts/local-tts-bridge.cjs --mode fish. Nel pannello Fish Audio, imposta URL bridge OBS / browser a http://127.0.0.1:8124/v1/audio/speech; incolla il token del bridge locale stampato nel terminale nel campo del popup Chiave API . Il token cambia al riavvio, a meno che tu non imposti SSN_TTS_BRIDGE_TOKEN su un segreto casuale lungo; mantieni privati i link overlay che contengono il token. Lascia il bridge in esecuzione, prova la voce e usa l'URL overlay generato in OBS. Attiva Controlla l'audio tramite OBS nelle impostazioni della sorgente browser se vuoi il suo audio nel mixer OBS. Le richieste dirette a Fish dalle pagine browser ospitate non hanno autorizzazione CORS; il bridge fornisce la risposta audio accessibile dal browser.

Con il bridge, aggiungi &fishendpoint=http%3A%2F%2F127.0.0.1%3A8124%2Fv1%2Faudio%2Fspeech all'URL e ometti fishkey quando la chiave è gestita dal bridge.

Parametri URL: &ttsprovider=fish&fishkey=YOUR_KEY&voicefish=VOICE_ID&fishmodel=s2.1-pro-free&fishspeed=1. Attiva TTS con i normali controlli. Mantieni privati gli URL generati che contengono la tua chiave. L'opzione di sostituzione della voce dell'azione Speak Text di Event Flow accetta un ID voce Fish quando la pagina ricevente usa Fish Audio.

Riferimento API Fish Audio · Annuncio e condizioni del modello gratuito

Speechify

Guida passo passo a Speechify: chiave API, voci, velocità e volume degli spettatori.

Inserisci la chiave API e l'ID voce del tuo account API Speechify. Configurazione del provider.

Impostazioni reali del provider SSN Speechify
OpenAI

Scegli voce/modello supportati e inserisci una chiave API. Un abbonamento ChatGPT non fornisce crediti API. Mantieni l'endpoint predefinito per OpenAI.

Impostazioni reali del provider SSN OpenAI
TTS personalizzato / locale

Questa opzione riutilizza i controlli compatibili con OpenAI, quindi l'intestazione indica ancora OpenAI. Inserisci l'endpoint del server e una voce/un modello supportati; l'autenticazione dipende dal server. Consulta la guida al server locale.

Impostazioni reali del provider SSN Custom / Local TTS
Avanzate: modifica manualmente un URL TTS

Buone prove iniziali:

dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kokoro
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=piper
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kitten

Per portoghese o spagnolo, inizia invece con una di queste:

dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium
dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=espeak&espeakvoice=es

Riferimento completo della sintesi vocale · Guida al server TTS locale

Avanzate: esegui il tuo server TTS locale

Un server TTS locale è utile quando vuoi voci private, un modello vocale specifico o un server come Kokoro-FastAPI oppure openedai-speech. La pagina che riproduce TTS deve poter raggiungere l'endpoint.

Diagramma che mostra la sorgente browser OBS mentre invia richieste TTS tramite il bridge TTS locale Social Stream Ninja a un server TTS
Per OBS, il bridge locale in genere funziona meglio sullo stesso computer di OBS.
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=customtts&openaiendpoint=http://127.0.0.1:8124/v1/audio/speech&voiceopenai=af_bella

localhost indica il computer che esegue la pagina. Se il server TTS è su un altro computer, usa l'IP LAN di quel computer oppure esegui il bridge sul computer di OBS.