Guia de configuração de TTS

Ouça seu chat em três etapas. Comece gratuitamente, sem conta nem chave de API.

1. Ative a leitura do chat

Ainda sem chat conectado? Comece aqui: instale o SSN, adicione sua fonte e abra o dock.

Abra: popup da extensão SSN ou a seção do aplicativo para desktop chamada Fontes e configurações.

Em Overlay principal de chat e dock de controle, expanda Mensagem — Texto em fala (Message — Text to Speech). Ative o interruptor mostrado aqui:

Popup real: Mensagem — Síntese de voz, com Ativar TTS no dock ligado
Interruptor azul = leitura do chat ativada.

2. Escolha uma voz gratuita

Na mesma seção, role até Provedor de serviço TTS. Escolha Piper TTS, depois uma voz.

Popup real: Piper TTS selecionado, com voz English US Female HFC Medium
Piper não precisa de conta nem chave de API. Aguarde o primeiro download da voz.

Use copiar link ao lado de Overlay principal de chat e dock de controle para obter o link atualizado.

3. Reproduza no OBS

  1. Adicione no OBS uma Fonte de navegador e cole esse link.
  2. Ative Controlar áudio pelo OBS (Control audio via OBS) nas propriedades.
  3. Envie uma mensagem no chat. Verifique o medidor de áudio da fonte e faça uma gravação curta.

Quer ouvir também? Nas Propriedades avançadas de áudio do OBS, escolha Monitorar e enviar (Monitor and Output) para essa fonte. Mantenha apenas uma cópia lendo o chat.

Ouça as vozes gratuitas

Prefere outro som? Estas quatro vozes são gratuitas. Pressione reproduzir para comparar.

Piper

Inglês dos EUA, feminina (HFC), qualidade média.
en_US-hfc_female-medium

Ver configurações e vozes

Kokoro

Bella, feminina americana. Testada usando CPU/WASM, q8.
af_bella

Ver configurações e vozes

Kitten

Voz 4, feminina. Modelo nano v0.1 incluído.
expr-voice-4-f

Ver configurações e vozes

eSpeak

Inglês. Uma voz sintética com baixo consumo de recursos.
en

Ver configurações e vozes

Amostras em espanhol e português

Escolha um idioma acima da lista de vozes nas configurações do SSN e depois use Teste. O Piper oferece Espanha, México, Brasil e Portugal; o Kokoro adiciona três vozes em espanhol e três em português brasileiro.

Piper - Espanhol (Espanha)

DaveFX

Kokoro - Espanhol

Dora

Piper - Português (Brasil)

Faber

Kokoro - Português (Brasil)

Dora

Síntese local gratuita com download inicial. As amostras omitem o tempo de carregamento. Piper é o ponto de partida mais leve; Kokoro pode ser lento em CPU. Use Piper se a fala ficar atrasada em relação ao chat.

Texto das amostras e detalhes dos testes

As quatro amostras em inglês leem: Bem-vindo à transmissão! Obrigado por participar. Qual jogo devemos jogar a seguir? A leitura dos nomes está desativada.

Verificado em 7 de setembro de 2026 no OBS 32.2.2, Windows 11: uma mensagem de chat chegou ao dock real, gerou fala, moveu o medidor da fonte de navegador e apareceu em uma gravação. O Kokoro demorou consideravelmente mais para começar a falar neste teste em CPU. Estes clipes mostram a voz, não o tempo de espera.

O TTS do sistema disponibilizou cinco vozes nesta máquina, mas não produziu áudio na gravação da fonte de navegador. Esse resultado é específico desta configuração; sempre teste a URL final e a gravação. Vozes de nuvem não estão incluídas porque não foram usadas credenciais pagas.

Precisa de ajuda?

Minha plataforma de chat suporta TTS?

Se o SSN recebe o chat como texto, pode lê-lo em voz alta. YouTube, Twitch, TikTok e outras fontes usam o mesmo recurso. Sua plataforma de chat não precisa ter suporte próprio a TTS.

Sem fala?

Verifique se o dock recebe chat e depois confira o interruptor de TTS, provedor e filtros. Use o link recém-copiado. Aguarde o primeiro download do modelo terminar.

Funciona no Chrome/Edge, mas não no OBS?

O OBS tem um navegador e uma lista de vozes separados. O TTS do sistema pode não funcionar nele, mesmo quando lista vozes. Experimente Piper, Kokoro, Kitten ou eSpeak. Um cabo de áudio virtual não corrige ausência de fala.

O medidor se move, mas a gravação está sem som?

Verifique o mudo e a atribuição de faixas de gravação no OBS. Use Monitorar e enviar se também quiser ouvir; evite capturar essa saída de monitoramento uma segunda vez. Guia de áudio do OBS.

Posso usar um dock do OBS ou chat em destaque?

Um dock personalizado de navegador do OBS é um painel de controle, não a fonte de navegador da cena usada acima. Para chat em destaque, ative TTS nas próprias opções do popup dessa sobreposição e copie o link. Mantenha uma única página falando para evitar vozes duplicadas.

Compare todos os provedores: requisitos, custo e limitações

Comece com Piper para uma voz local gratuita ou compare Kokoro se preferir seu som. Experimente eSpeak quando a rapidez de resposta for mais importante que o realismo. Kitten é outra opção compacta em inglês. Ouça antes de decidir.

ProvedorBom paraLimitaçãoRequisitos / custo
KokoroVozes em inglês, espanhol e português brasileiro.Mais trabalho de CPU; a primeira fala pode demorar.Gratuito, sem chave. Baixa arquivos de modelo/voz; CPU ou WebGPU compatível.
PiperVozes neurais locais; opções em inglês, espanhol e português.Qualidade e pronúncia variam conforme a voz.Gratuito, sem chave. Baixa o modelo selecionado (HFC medium: cerca de 63 MB), além dos arquivos do mecanismo.
KittenModelo compacto em inglês, oito opções de voz.Menos idiomas e estilos de voz.Gratuito, sem chave. Modelo incluído atual: cerca de 24 MB, além dos arquivos de mecanismo/voz; CPU.
eSpeakLeve, muitos idiomas, início rápido.Som deliberadamente sintético/robótico.Gratuito, sem chave. Carrega arquivos de mecanismo/idioma incluídos; não exige modelo neural nem GPU.
Síntese de voz do sistemaUsa as vozes disponibilizadas pelo navegador ou aplicativo para desktop.A lista de vozes e a captura no OBS variam; algumas vozes precisam de internet.Sem taxa de provedor do SSN. Exige uma voz funcional do sistema/navegador; teste na página real de reprodução.
ElevenLabsIDs de voz, seleção de modelo e controles de estabilidade/estilo.Podem se aplicar limites da conta, atraso de rede e cobranças de API.Internet, chave de API e ID de voz acessível. O texto do chat vai para o provedor.
Google CloudVozes identificadas pelo nome e controles de idioma, velocidade e tom.Nem todas as vozes aceitam todos os controles.Internet, API Cloud TTS ativada, chave de API e voz/idioma correspondentes. Aplicam-se faturamento/cotas.
GeminiEstilos de voz e instruções escritas de interpretação.Modelos em prévia e cotas podem mudar; a latência varia.Internet, chave de API do Gemini e acesso ao modelo de TTS selecionado. Verifique limites/faturamento da conta.
SpeechifyID de voz com controles de velocidade, idioma e modelo.Precisa de acesso à API; as vozes disponíveis dependem da conta.Internet e chave de API do Speechify. Aplicam-se termos/limites de uso da API.
OpenAIVozes identificadas pelo nome com controles de modelo e formato.Exige faturamento da API e internet; a assinatura da conta é separada.Chave de API com acesso a TTS. O texto do chat é enviado ao endpoint configurado.
Personalizado / LocalUse seu próprio servidor de voz compatível.Mais configuração: endpoint, modelo, voz e acesso do navegador precisam estar alinhados.Um endpoint acessível de fala compatível com OpenAI; chave, se exigida. Os custos de hardware local ou hospedagem variam.

Os tamanhos de download acima são dos arquivos de modelo, não do uso total de memória nem de todos os arquivos necessários. Provedores locais usam o computador que executa o dock/sobreposição; o primeiro uso pode ser mais lento, e o OBS tem seu próprio cache. Provedores de nuvem economizam processamento local, mas enviam o texto para fora do dispositivo.

OBS: os quatro provedores locais abaixo passaram nos testes de gravação da fonte de navegador. Provedores de nuvem/personalizados retornam áudio para a página reproduzir, mas não foram testados com contas reais nesta revisão. O TTS do sistema precisa de um teste separado, mesmo quando lista vozes.

Configurações dos provedores e nomes das vozes

Configurações reais do aplicativo para desktop, capturadas em um perfil novo. Abra o provedor desejado; os campos de chave de API estão vazios intencionalmente. Estes controles configuram o dock ou a sobreposição selecionada do SSN. Selecione uma captura para vê-la em tamanho completo.

Síntese de voz do sistema

A lista de idiomas está vazia neste perfil novo. As vozes disponíveis dependem do navegador/aplicativo e das vozes instaladas; não existe uma lista universal de vozes do SSN.

Configurações reais do provedor TTS do sistema do SSN
Kokoro

Escolha uma voz no SSN; o modelo carrega na página que fala. A seleção inclui inglês dos EUA/Reino Unido, espanhol e português brasileiro. Use o filtro de idioma para encontrar vozes; Test reproduz uma frase curta no idioma selecionado. Para menor uso de CPU, experimente Piper.

Configurações reais do provedor Kokoro do SSN
Nomes de vozes e valores de URL
  • Heart (feminina americana) — af_heart
  • Alloy (feminina americana) — af_alloy
  • Aoede (feminina americana) — af_aoede
  • Bella (feminina americana) — af_bella
  • Jessica (feminina americana) — af_jessica
  • Kore (feminina americana) — af_kore
  • Nicole (feminina americana) — af_nicole
  • Nova (feminina americana) — af_nova
  • River (feminina americana) — af_river
  • Sarah (feminina americana) — af_sarah
  • Sky (feminina americana) — af_sky
  • Adam (masculina americana) — am_adam
  • Echo (masculina americana) — am_echo
  • Eric (masculina americana) — am_eric
  • Fenrir (masculina americana) — am_fenrir
  • Liam (masculina americana) — am_liam
  • Michael (masculina americana) — am_michael
  • Onyx (masculina americana) — am_onyx
  • Puck (masculina americana) — am_puck
  • Santa (masculina americana) — am_santa
  • Emma (feminina britânica) — bf_emma
  • Isabella (feminina britânica) — bf_isabella
  • George (masculina britânica) — bm_george
  • Lewis (masculina britânica) — bm_lewis
  • Alice (feminina britânica) — bf_alice
  • Lily (feminina britânica) — bf_lily
  • Daniel (masculina britânica) — bm_daniel
  • Fable (masculina britânica) — bm_fable
  • Dora (espanhol) - ef_dora
  • Alex (espanhol) - em_alex
  • Santa (espanhol) - em_santa
  • Dora (português brasileiro) - pf_dora
  • Alex (português brasileiro) - pm_alex
  • Santa (português brasileiro) - pm_santa
Kitten

Oito vozes em inglês: variantes masculinas e femininas numeradas 2, 3, 4 e 5. A amostra usa Voice 4 (Female).

Configurações reais do provedor Kitten do SSN
Nomes de vozes e valores de URL
  • Voz 2 (masculina) — expr-voice-2-m
  • Voz 2 (feminina) — expr-voice-2-f
  • Voz 3 (masculina) — expr-voice-3-m
  • Voz 3 (feminina) — expr-voice-3-f
  • Voz 4 (masculina) — expr-voice-4-m
  • Voz 4 (feminina) — expr-voice-4-f
  • Voz 5 (masculina) — expr-voice-5-m
  • Voz 5 (feminina) — expr-voice-5-f
Piper

Escolha idioma e modelo correspondentes. A amostra usa HFC medium. Uma configuração de idioma sozinha não traduz uma voz.

Configurações reais do provedor Piper do SSN
Nomes de vozes e valores de URL
  • Inglês dos EUA, feminina (HFC) - Média — en_US-hfc_female-medium
  • Espanhol da Espanha (DaveFX) - Média — es_ES-davefx-medium
  • Espanhol do México (Ald) - Média — es_MX-ald-medium
  • Português brasileiro (Faber) - Média — pt_BR-faber-medium
  • Português brasileiro (Edresson) - Baixa — pt_BR-edresson-low
  • Português de Portugal (Tugao) - Média — pt_PT-tugão-medium
eSpeak

Escolha uma voz de idioma e, opcionalmente, ajuste a velocidade de fala. Este mecanismo tem som robótico por natureza.

Configurações reais do provedor eSpeak do SSN
Nomes de vozes e valores de URL
  • Inglês — en
  • Espanhol — es
  • Português do Brasil — pt-br
  • Português de Portugal — pt-pt
ElevenLabs

Insira sua chave de API e use List My Available Voices para encontrar um ID de voz disponível para sua conta. Referência de provedores.

Configurações reais do provedor ElevenLabs do SSN
Google Cloud

Insira uma chave de API do Google Cloud TTS e o nome exato da voz, com o idioma correspondente. Nomes de vozes e controles compatíveis.

Configurações reais do provedor Google Cloud do SSN
Gemini

Selecione um modelo de TTS e uma voz compatíveis; instruções de estilo alteram a interpretação. Estas são configurações da API Gemini, separadas do Google Cloud TTS. Exemplos de vozes e requisitos.

Configurações reais do provedor Gemini do SSN
Fish Audio

Selecione Fish Audio no menu de provedor de TTS do dock de chat, sobreposição de destaque, página TTS ou Flow Actions. Insira sua própria Chave de API do Fish Audio, depois use o botão Test TTS existente. Um ID de voz opcional seleciona uma voz de Fish Audio; copie o ID do modelo de voz, não o nome nem a URL da página. Deixe vazio para usar a voz padrão do serviço.

As opções avançadas incluem modelo e velocidade de fala (0.5–2). O SSN usa por padrão s2.1-pro-free; a disponibilidade do plano gratuito e os termos de uso justo são controlados pelo Fish Audio. Modelos pagos exigem crédito na conta. O SSN não repete uma solicitação gratuita que falhou usando um modelo pago. Use Mais opções de TTS para o volume dos espectadores. O texto é enviado ao Fish Audio, e o serviço detecta o idioma.

Configuração de OBS / navegador: Execute a ferramenta existente do SSN ponte local de TTS no modo Fish no computador do OBS. Defina a variável de ambiente SSN_TTS_TARGET_BEARER com sua chave de API do Fish e inicie node scripts/local-tts-bridge.cjs --mode fish. No painel Fish Audio, defina URL da ponte para OBS / navegador como http://127.0.0.1:8124/v1/audio/speech; cole o token da ponte local impresso no terminal no campo do popup Chave de API . O token muda ao reiniciar, a menos que você defina SSN_TTS_BRIDGE_TOKEN como um segredo aleatório longo; mantenha privados os links de sobreposição que contêm token. Deixe a ponte em execução, teste a voz e use a URL gerada de sobreposição no OBS. Ative Control audio via OBS nas configurações da fonte de navegador se quiser o áudio no mixer do OBS. Solicitações diretas ao Fish a partir de páginas hospedadas não têm permissão CORS; a ponte fornece a resposta de áudio acessível ao navegador.

Com a ponte, adicione &fishendpoint=http%3A%2F%2F127.0.0.1%3A8124%2Fv1%2Faudio%2Fspeech à URL e omita fishkey quando a ponte armazena a chave.

Parâmetros de URL: &ttsprovider=fish&fishkey=YOUR_KEY&voicefish=VOICE_ID&fishmodel=s2.1-pro-free&fishspeed=1. Ative o TTS pelos controles normais. Mantenha privadas as URLs geradas que contenham sua chave. A substituição de voz existente em Speak Text do Event Flow aceita um ID de voz Fish quando a página receptora usa Fish Audio.

Referência da API do Fish Audio · Anúncio e termos do modelo gratuito

Speechify

Guia passo a passo do Speechify: chave de API, vozes, velocidade e volume dos espectadores.

Insira a chave de API e o ID da voz da sua conta de API do Speechify. Configuração do provedor.

Configurações reais do provedor Speechify do SSN
OpenAI

Escolha uma voz/modelo compatível e insira uma chave de API. Uma assinatura ChatGPT não fornece créditos de API. Mantenha o endpoint padrão para OpenAI.

Configurações reais do provedor OpenAI do SSN
TTS personalizado / local

Esta opção reutiliza os controles compatíveis com OpenAI, então o título ainda diz OpenAI. Insira o endpoint do servidor e a voz/modelo compatíveis; a autenticação depende do servidor. Consulte o guia de servidor local.

Configurações reais do provedor de TTS personalizado / local do SSN
Avançado: editar uma URL de TTS manualmente

Bons primeiros testes:

dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kokoro
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=piper
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kitten

Para português ou espanhol, comece com uma destas opções:

dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium
dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=espeak&espeakvoice=es

Referência completa de TTS · Guia de servidor local de TTS

Avançado: executar seu próprio servidor local de TTS

Um servidor local de TTS é útil quando você quer vozes privadas, um modelo específico de voz ou um servidor como Kokoro-FastAPI ou openedai-speech. A página que reproduz o TTS precisa conseguir acessar o endpoint.

Diagrama mostrando a fonte de navegador do OBS enviando solicitações de TTS pela ponte local de TTS do Social Stream Ninja a um servidor de TTS
Para o OBS, a ponte local geralmente funciona melhor quando executada no mesmo computador do OBS.
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=customtts&openaiendpoint=http://127.0.0.1:8124/v1/audio/speech&voiceopenai=af_bella

localhost significa o computador que executa a página. Se o servidor de TTS estiver em outro computador, use o IP dele na rede local ou execute a ponte no computador do OBS.