Guía completa de voces de texto a voz, compatibilidad de navegadores y captura de audio
SSN puede leer texto de chat capturado de cualquier fuente compatible; la plataforma de chat no necesita su propia función TTS. Tu panel o superposición con TTS activado lee los mensajes que recibe, según sus filtros y ajustes TTS. Empieza por la guía breve de configuración; esta página cubre las opciones de voz y los ajustes avanzados. Compara proveedores, escucha muestras y consulta los ajustes.
dock.html?session=YOUR_SESSION&speech=en-US. Utiliza la voz del sistema de forma predeterminada. Para un proveedor gratuito en OBS, añade también &ttsprovider=kokoro. Mantén esta página abierta y conectada; solo debe hablar una copia.
| Proveedor | Costo | Captura de OBS | Funciones |
|---|---|---|---|
| Kokoro TTS | Gratis | Directo | IA en el navegador, excelente calidad, docenas de voces |
| Piper TTS | Gratis | Directo | TTS neuronal en el navegador, rápido y adecuado para CPU |
| Kitten TTS | Gratis | Directo | En el navegador, modelo ONNX ligero |
| eSpeak-NG | Gratis | Directo | Clásico y de código abierto, funciona en cualquier equipo |
| Proveedor | Costo | Captura de OBS | Funciones |
|---|---|---|---|
| OpenAI TTS | Se aplican costos de API (o local gratuito) | Directo | Alta calidad; también admite servidores locales mediante un endpoint personalizado |
| Google Cloud | Se aplican costos de API | Directo | Calidad profesional, varios idiomas |
| ElevenLabs | Plan gratuito disponible | Directo | Entrenamiento de voz personalizado, sonido natural |
| Speechify | Se aplican costos de API | Directo | Voces de alta calidad, varios idiomas |
| Gemini TTS | Se aplican costos de API | Directo | API de lenguaje generativo de Google |
Estas son capacidades habituales, no garantías para cada instalación. OBS utiliza su propio navegador integrado y no hereda la lista de voces de Chrome/Edge instalado. Una prueba correcta de la aplicación SSN no prueba una fuente de navegador independiente de OBS.
✓ Voces del sistema disponibles en instalaciones compatibles
Voces de Google + voces del sistema
✓ Voces del sistema disponibles en instalaciones compatibles
Voces de Microsoft + paquetes TTS de Windows
⚠ Compatibilidad limitada
Solo idiomas locales del sistema
⚠ Compatibilidad limitada
Basado en Chromium; las voces disponibles varían según la instalación
Los proveedores locales de SSN basados en navegador y sus proveedores de audio en la nube reproducen el audio generado mediante la página:
Para la voz del sistema en particular:
Descargas de herramientas de enrutamiento: VB-Audio Virtual Cable | Voicemeeter | Audio Router (antiguo)
Prueba primero a capturar el navegador que habla mediante audio de aplicación o de escritorio de OBS, donde se admita. Los métodos de cable virtual siguientes son alternativas opcionales; no añaden compatibilidad de voz a OBS.
Sigue las instrucciones de la guía oficial de Microsoft para instalar paquetes de idioma.
| Parámetro | Descripción | Ejemplo |
|---|---|---|
| &speech | Activar TTS con código de idioma | &speech=en-US |
| &pitch | Tono de voz (0,1 a 2,0) | &pitch=1.2 |
| &volume | Nivel de volumen (0,0 a 1,0) | &volume=0.8 |
| &rate | Velocidad de lectura (0,1 a 10,0) | &rate=1.5 |
| &voice | Coincidencia parcial del nombre de voz | &voice=google |
| &ttsprovider | Seleccionar proveedor: kokoro, piper, kitten, espeak, openai, customtts, localtts, elevenlabs, google, speechify, gemini | &ttsprovider=customtts |
| Parámetro | Descripción |
|---|---|
| &simpletts | No decir «dice» ni «alguien dice» |
| &simpletts2 | No leer los nombres de chat |
| &ttscommand | Activar comando TTS personalizado (predeterminado: !say) |
| &readevents | Incluir eventos de la transmisión en TTS |
| &skipmessages=3 | Leer solo uno de cada 3 mensajes |
?ttsprovider=kokoro&voicekokoro=af_bella&kokorospeed=1.2&voicekokoro=ef_dora para español o &voicekokoro=pf_dora para portugués de Brasil. Cambiar &speech= por sí solo no cambia la voz seleccionada. Los ID de voces en inglés existentes siguen funcionando.?ttsprovider=piper&pipervoice=en_US-hfc_female-medium&pipervoice=pt_BR-faber-medium o &pipervoice=pt_BR-edresson-low&pipervoice=es_ES-davefx-medium o &pipervoice=es_MX-ald-medium&piperspeed=1.0?ttsprovider=kitten&kittenvoice=expr-voice-4-f?ttsprovider=espeak&espeakvoice=en&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br&speech=es-ES&ttsprovider=espeak&espeakvoice=es&espeakspeed=175?speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium?speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br?speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium?speech=es-ES&ttsprovider=espeak&espeakvoice=es?ttsprovider=openai?ttsprovider=customtts o ?ttsprovider=localtts para un endpoint de servidor propio&openaiendpoint=http://localhost:8880/v1/audio/speechlocalhost y 127.0.0.1 significan la misma computadora que reproduce la página TTS. Si OBS está en una computadora distinta del servidor TTS, utiliza la IP de la red local del servidor.npm run local-tts-bridge en la computadora con OBS y dirige SSN a http://127.0.0.1:8124/v1/audio/speech{ model, input, voice, response_format, speed } y admite audio binario, URL de audio en JSON y audio en base64 en JSON&voiceopenai=af_bella, velocidad: &openaispeed=1.0. Utiliza un nombre de voz que admita tu servidor; las voces de Kokoro son como af_bella, mientras que las voces de openedai-speech o del estilo de OpenAI pueden ser nova o echo.?ttsprovider=google&ttskey=YOUR_API_KEY&voicegoogle=en-GB-Standard-A&googlelang=en-US?ttsprovider=gemini&geminikey=YOUR_API_KEY&geminimodel=gemini-2.5-flash-preview-tts&voicegemini=Kore, idioma: &geminilang=th-TH&geministyle=Read aloud in a warm tone.?ttsprovider=elevenlabs&elevenlabskey=YOUR_API_KEY&voice11=YOUR_VOICE_ID&elevenlabsmodel=eleven_multilingual_v2Elige Fish Audio e introduce tu clave de API, con un ID de voz opcional. El modelo predeterminado es s2.1-pro-free. Configuración, opciones de modelos y limitaciones de acceso del navegador.
?ttsprovider=speechify&speechifykey=YOUR_API_KEY&voicespeechify=henry&speechifymodel=simba-3.0 (predeterminado), o &speechifymodel=simba-3.2 para inglés.&speechifyspeed=1.2 (intervalo de 0,5 a 3,0; lo normal es 1,0).127.0.0.1.ttsquick de la URL de OBS si está presente.Esto enumera Solo voces del sistema del navegador que muestra esta guía. No prueba OBS, una ventana independiente de SSN ni proveedores como Kokoro. Una lista vacía no significa que los demás proveedores TTS de SSN no estén disponibles.