Guia de configuração de TTS

Tenha seu chat lido em voz alta na transmissão. Grátis, sem conta nem chave de API.

Configure em 5 etapas

Ainda sem chat conectado? Comece aqui primeiro.

  1. Abra: popup da extensão SSN, ou Fontes e configurações no aplicativo para desktop.
  2. Em Overlay principal de chat e dock de controle, expanda Mensagem – Texto para fala.
  3. Ative Ler mensagens recebidas em voz alta.
Popup real: Mensagem — Síntese de voz, com Ativar TTS no dock ligado
Interruptor azul = leitura do chat ativada.
  1. Role até Provedor do serviço de síntese de voz. Escolha Piper TTS, depois uma voz.
  2. Clique em copiar link ao lado de Overlay principal de chat e dock de controle.
Popup real: Piper TTS selecionado, com voz English US Female HFC Medium
Piper é gratuito. Sem conta nem chave de API.
É sua primeira vez? O Piper baixa a voz no primeiro uso. Aguarde um momento.

Reproduza no OBS

  1. Adicione uma ação Fonte de navegador e cole o link copiado.
  2. Nas propriedades, ative Controlar áudio pelo OBS (Control audio via OBS).
  3. Envie uma mensagem no chat. O medidor de áudio da fonte deve se mover.
  4. Faça uma gravação de teste curta e reproduza.
Quer ouvir também? No OBS Propriedades avançadas de áudio, defina essa fonte como Monitorar e enviar (Monitor and Output).
Ouve cada mensagem duas vezes? Só uma página deve ler o chat. Desative o TTS em todos os outros lugares.

Ouça as vozes gratuitas

Os quatro são gratuitos e rodam no seu computador. Aperte reproduzir para comparar.

Piper

Inglês americano, feminina. Leve e rápida.
en_US-hfc_female-medium

Configurações e vozes

Kokoro

Bella, inglês americano, feminina. Mais natural, mas mais lenta na CPU.
af_bella

Configurações e vozes

Kitten

Voz 4, feminina. Modelo pequeno em inglês.
expr-voice-4-f

Configurações e vozes

eSpeak

Inglês. Robótico, mas pequeno e rápido.
en

Configurações e vozes

Amostras em espanhol e português

Escolha um idioma acima da lista de vozes no SSN e pressione Teste. O Piper tem vozes da Espanha, México, Brasil e Portugal. O Kokoro tem três vozes em espanhol e três em português brasileiro.

Piper - Espanhol (Espanha)

DaveFX

Kokoro - Espanhol

Dora

Piper - Português (Brasil)

Faber

Kokoro - Português (Brasil)

Dora

Piper é a opção mais leve. Se o Kokoro atrasar em relação ao chat, mude para Piper.

Como essas amostras foram feitas

As amostras em inglês leem: Bem-vindo à transmissão! Obrigado por participar. Qual jogo devemos jogar a seguir? A leitura de nomes estava desativada. Os clipes omitem o tempo de carregamento.

Testado em 7 de setembro de 2026 no OBS 32.2.2 com Windows 11. Uma mensagem real chegou ao dock, foi falada, moveu o medidor da fonte de navegador e apareceu na gravação. Kokoro demorou bem mais para começar na CPU.

Nesse PC, o TTS do sistema listou cinco vozes, mas não produziu som na gravação do OBS. Seu PC pode ser diferente: teste sempre seu próprio link. Vozes na nuvem não foram testadas por falta de contas pagas.

Escolha um provedor

Comece com Piper. Experimente Kokoro se gostar mais do som. As vozes gratuitas rodam no seu computador. Vozes na nuvem precisam de conta e chave de API, e o texto do chat é enviado à empresa.

ProvedorBom paraLembre-seCusto
PiperVozes naturais; inglês, espanhol e português.A qualidade varia por voz. HFC medium tem cerca de 63 MB.Grátis, sem chave
KokoroAs vozes gratuitas mais naturais; inglês, espanhol e português brasileiro.Exige mais da CPU. A primeira fala pode demorar. Mais rápido com uma GPU compatível.Grátis, sem chave
KittenModelo pequeno em inglês, oito vozes.Só inglês. O modelo incluído tem cerca de 24 MB.Grátis, sem chave
eSpeakMuito leve, muitos idiomas e início rápido.O som robótico é intencional.Grátis, sem chave
Síntese de voz do sistemaVozes já disponíveis no navegador ou PC.Muitas vezes não tem som no OBS. Algumas vozes precisam de internet.Gratuito
ElevenLabsEscolha vozes por ID; controles de estabilidade e estilo.Limites da conta e atraso de rede.Pode haver cobranças de API
Google CloudVozes com nome; idioma, velocidade e tom.Nem toda voz aceita todos os controles. A API Cloud TTS precisa estar ativada.Aplicam-se cobrança e cotas
GeminiEstilos de voz e instruções escritas de interpretação.Modelos de prévia e cotas podem mudar.Confira seus limites do Gemini
Fish AudioModelo gratuito com sua própria chave; IDs de voz.O OBS precisa da ponte local do SSN.Plano gratuito definido pelo Fish Audio
SpeechifyID de voz com velocidade, idioma e modelo.As vozes dependem da sua conta.Aplicam-se os termos da API
OpenAIVozes com nome, controles de modelo e formato.Uma assinatura do ChatGPT não inclui crédito de API.Cobrança da API
Personalizado / LocalSeu próprio servidor de voz.Exige mais configuração. Veja o guia de servidor local.Seu hardware ou hospedagem
Tamanhos de download e notas de testes no OBS

Os tamanhos são só dos arquivos do modelo, não do uso de memória. As vozes gratuitas rodam no computador que reproduz o dock ou a sobreposição. O primeiro uso é mais lento. O OBS mantém seu próprio cache de downloads, separado do Chrome.

Piper, Kokoro, Kitten e eSpeak passaram nos testes de gravação da fonte de navegador do OBS. Vozes na nuvem e personalizadas também reproduzem pela página, mas não foram testadas com contas reais. Teste o TTS do sistema separadamente, mesmo que liste vozes.

Resolver problemas

ProblemaTente isto
Minha plataforma de chat suporta TTS?Sim, se o SSN receber o chat como texto. YouTube, Twitch, TikTok e as demais funcionam da mesma forma. A plataforma não precisa de TTS próprio.
Nenhuma falaConfira se o dock mostra o chat. Depois verifique a opção TTS, o provedor e os filtros. Use um link recém-copiado. Deixe o primeiro download da voz terminar.
Funciona no Chrome ou Edge, mas não no OBSO OBS tem seu próprio navegador e lista de vozes. O TTS do sistema costuma falhar nele. Mude para Piper, Kokoro, Kitten ou eSpeak. Um cabo de áudio virtual não resolve a ausência de fala.
O medidor se move, mas a gravação fica sem somConfira o mudo e as faixas de gravação no OBS. Não capture a saída de monitoramento uma segunda vez. Veja o Guia de áudio do OBS.
A fala atrasa em relação ao chatMude do Kokoro para Piper ou tente eSpeak.
Todas as mensagens são lidas duas vezesMais de uma página está falando. Mantenha o TTS ativo em um só lugar.
Quero que um dock do OBS ou Featured Chat faleUm dock de navegador personalizado do OBS é um painel de controle, não uma fonte de cena. Para Featured Chat, ative o TTS nas opções da própria sobreposição e copie o link.

Mais soluções: Referência de TTS · problemas do servidor local.

Configurações do provedor

Capturas reais do aplicativo desktop com um perfil novo (campos de chave vazios). Abra um provedor para ver suas configurações. Clique em uma captura para ampliar.

Síntese de voz do sistema

A lista de vozes depende do navegador ou aplicativo e das vozes instaladas. Não há lista fixa do SSN. Este perfil novo mostrou uma lista de idiomas vazia.

Configurações reais do provedor TTS do sistema do SSN
Kokoro

Escolha uma voz. Use o filtro de idioma para encontrar uma e pressione Teste para ouvi-la. O modelo carrega na página que fala. Vozes: inglês americano e britânico, espanhol e português brasileiro. Muito lento? Experimente Piper.

Configurações reais do provedor Kokoro do SSN
Nomes de voz e valores do link
  • Heart (feminina americana) — af_heart
  • Alloy (feminina americana) — af_alloy
  • Aoede (feminina americana) — af_aoede
  • Bella (feminina americana) — af_bella
  • Jessica (feminina americana) — af_jessica
  • Kore (feminina americana) — af_kore
  • Nicole (feminina americana) — af_nicole
  • Nova (feminina americana) — af_nova
  • River (feminina americana) — af_river
  • Sarah (feminina americana) — af_sarah
  • Sky (feminina americana) — af_sky
  • Adam (masculina americana) — am_adam
  • Echo (masculina americana) — am_echo
  • Eric (masculina americana) — am_eric
  • Fenrir (masculina americana) — am_fenrir
  • Liam (masculina americana) — am_liam
  • Michael (masculina americana) — am_michael
  • Onyx (masculina americana) — am_onyx
  • Puck (masculina americana) — am_puck
  • Santa (masculina americana) — am_santa
  • Emma (feminina britânica) — bf_emma
  • Isabella (feminina britânica) — bf_isabella
  • George (masculina britânica) — bm_george
  • Lewis (masculina britânica) — bm_lewis
  • Alice (feminina britânica) — bf_alice
  • Lily (feminina britânica) — bf_lily
  • Daniel (masculina britânica) — bm_daniel
  • Fable (masculina britânica) — bm_fable
  • Dora (espanhol): ef_dora
  • Alex (espanhol): em_alex
  • Santa (espanhol): em_santa
  • Dora (português brasileiro): pf_dora
  • Alex (português brasileiro): pm_alex
  • Santa (português brasileiro): pm_santa
Kitten

Oito vozes em inglês: versões masculina e feminina das vozes 2, 3, 4 e 5. A amostra usa Voz 4 (Feminina).

Configurações reais do provedor Kitten do SSN
Nomes de voz e valores do link
  • Voz 2 (masculina) — expr-voice-2-m
  • Voz 2 (feminina) — expr-voice-2-f
  • Voz 3 (masculina) — expr-voice-3-m
  • Voz 3 (feminina) — expr-voice-3-f
  • Voz 4 (masculina) — expr-voice-4-m
  • Voz 4 (feminina) — expr-voice-4-f
  • Voz 5 (masculina) — expr-voice-5-m
  • Voz 5 (feminina) — expr-voice-5-f
Piper

Escolha uma voz compatível com seu idioma. Mudar só o idioma não muda a voz. A amostra usa HFC medium.

Configurações reais do provedor Piper do SSN
Nomes de voz e valores do link
  • Inglês dos EUA, feminina (HFC) - Média — en_US-hfc_female-medium
  • Espanhol da Espanha (DaveFX) - Média — es_ES-davefx-medium
  • Espanhol do México (Ald) - Média — es_MX-ald-medium
  • Português brasileiro (Faber) - Média — pt_BR-faber-medium
  • Português brasileiro (Edresson) - Baixa — pt_BR-edresson-low
  • Português de Portugal (Tugao) - Média — pt_PT-tugão-medium
eSpeak

Escolha uma voz do idioma. Você pode mudar a velocidade. O som robótico é intencional.

Configurações reais do provedor eSpeak do SSN
Nomes de voz e valores do link
  • Inglês — en
  • Espanhol — es
  • Português do Brasil — pt-br
  • Português de Portugal — pt-pt
ElevenLabs

Digite sua chave de API. Depois clique em Listar minhas vozes disponíveis para encontrar um ID de voz que sua conta possa usar. Referência do ElevenLabs.

Configurações reais do provedor ElevenLabs do SSN
Google Cloud

Digite uma chave de API do Google Cloud TTS, o nome exato da voz e o idioma correspondente. Nomes de vozes e controles compatíveis.

Configurações reais do provedor Google Cloud do SSN
Gemini

Escolha um modelo TTS e uma voz. As instruções de estilo mudam a forma de ler. Usa a API Gemini, não Google Cloud TTS. Exemplos de vozes e requisitos.

Configurações reais do provedor Gemini do SSN
Fish Audio

Funciona no dock de chat, na sobreposição de destaques, na página TTS e nas ações de fluxo.

  1. Escolha Fish Audio como provedor de TTS.
  2. Cole o link do seu Chave de API do Fish Audio.
  3. Opcional: cole um ID da voz de Fish Audio. Copie o ID do modelo da voz, não o nome nem o link da página. Deixe vazio para usar a voz padrão.
  4. Pressione Testar TTS.

O modelo padrão é s2.1-pro-free. O Fish Audio decide o que é gratuito e seus termos de uso justo. Modelos pagos exigem crédito na conta. O SSN nunca muda para um modelo pago se uma solicitação gratuita falhar. A velocidade vai de 0.5 a 2. O Fish Audio detecta o idioma. O texto do chat é enviado ao Fish Audio.

Para OBS: execute a ponte local

O Fish Audio bloqueia solicitações diretas de páginas web, então o OBS precisa da ponte local do SSN (requer Node.js). Execute no computador do OBS.

  1. Defina SSN_TTS_TARGET_BEARER como variável de ambiente com sua chave de API do Fish.
  2. Na pasta do SSN, execute node scripts/local-tts-bridge.cjs --mode fish. Deixe em execução.
  3. No painel do Fish Audio, defina URL da ponte como http://127.0.0.1:8124/v1/audio/speech.
  4. Cole o token da ponte mostrado no terminal em Chave de API campo.
  5. Teste a voz e adicione o link da sobreposição ao OBS. Ative Controlar áudio pelo OBS (Control audio via OBS).
O token muda sempre que a ponte reinicia. Para manter o mesmo, defina SSN_TTS_BRIDGE_TOKEN com um segredo aleatório longo. Mantenha privados os links com token ou chave.
Configurações de link do Fish Audio
&ttsprovider=fish&fishkey=YOUR_KEY&voicefish=VOICE_ID&fishmodel=s2.1-pro-free&fishspeed=1

Com a ponte, adicione &fishendpoint=http%3A%2F%2F127.0.0.1%3A8124%2Fv1%2Faudio%2Fspeech. Omita fishkey se a ponte guardar sua chave. A opção Falar texto do Event Flow permite substituir a voz por um ID do Fish quando a página receptora usa Fish Audio.

Referência da API do Fish Audio · Anúncio e termos do modelo gratuito

Speechify

Insira a chave de API e o ID da voz da sua conta de API do Speechify. Guia passo a passo do Speechify · Configuração do Speechify.

Configurações reais do provedor Speechify do SSN
OpenAI

Escolha uma voz e um modelo e digite uma chave de API. Uma assinatura do ChatGPT não inclui crédito de API. Mantenha o endpoint padrão.

Configurações reais do provedor OpenAI do SSN
TTS personalizado / local

Reutiliza as configurações do OpenAI, então o título continua dizendo OpenAI. Digite o endereço do servidor e uma voz e um modelo compatíveis. A necessidade de chave depende do servidor. Veja o guia de servidor local.

Configurações reais do provedor de TTS personalizado / local do SSN

Kokoro e Kitten mais rápidos

Em Kokoro ou Kitten, abra Geração e reprodução. Essas opções geram a fala em segundo plano para manter a página fluida.

Quero…Faça isto
Ativar para KokoroDefina Processamento como Geração em segundo plano.
Ativar para KittenEscolha Kitten 0.8 como modelo: Nano (menor), Micro ou Mini.
Ouça a fala mais cedoComeçar quando a fala chegar. Reproduz cada parte quando estiver pronta. PCs lentos podem pausar entre partes.
Evite pausasReproduzir mensagem completa. Espera primeiro a mensagem completa.
Resolver problemas de GPU (Kokoro)Defina Processador em segundo plano como CPU.
Melhor qualidade do KokoroQualidade completa. Download maior, mais memória.
Mais detalhes e configurações de link

Automático usa uma GPU compatível se houver; caso contrário, a CPU. A qualidade automática escolhe FP16 em GPUs compatíveis, precisão completa em outras GPUs suportadas e o modelo compacto na CPU. Se você forçar GPU sem uma disponível, ocorrerá um erro.

Kitten 0.8 roda na CPU, apenas em inglês. Cada modelo é baixado no primeiro uso. Cada navegador ou OBS mantém sua própria cópia. O NeuroSync recebe o arquivo de áudio completo em ambos os casos. Links antigos continuam funcionando como antes, a menos que você altere essas opções.

Kokoro: &kokororuntime=worker, opcional &kokoroplayback=stream, &kokorodevice=wasm ou webgpu, &kokorodtype=q8, fp16 ou fp32. Streaming ou FP32 ativa a geração em segundo plano automaticamente.

Kitten: &kittenmodel=nano (ou micro, mini), opcional &kittenplayback=stream.

Vá além

Quero…Vá aqui
Editar meu link TTS manualmente ou ver todas as opçõesReferência de TTS
Usar vozes em espanhol ou português em um linkReferência TTS: opções de provedor
Executar meu próprio servidor de voz ou clonar uma vozGuia de TTS local com IA
Configurar SpeechifyGuia do Speechify

Um link rápido para testar: dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=piper