文本转语音语音选项、浏览器兼容性及音频捕获完整指南
SSN 可以朗读从任意支持来源捕获的聊天文字;聊天平台本身无需提供 TTS 功能。 启用 TTS 的停靠面板或叠加层会根据过滤器及 TTS 设置,朗读收到的消息。先阅读 简明设置指南;本页介绍语音选项和高级设置。 比较提供商、试听示例并查看设置。
dock.html?session=YOUR_SESSION&speech=en-US。默认使用 System TTS。若要使用免费的 OBS 提供商,还需添加 &ttsprovider=kokoro。保持此页面打开并连接;仅应有一个副本发声。
| 提供商 | 费用 | OBS 捕获 | 功能 |
|---|---|---|---|
| Kokoro TTS | 免费 | 直接 | 浏览器内 AI,音质出色,提供数十种语音 |
| Piper TTS | 免费 | 直接 | 在浏览器中运行、快速且适合 CPU 的神经网络 TTS |
| Kitten TTS | 免费 | 直接 | 在浏览器中运行的轻量 ONNX 模型 |
| eSpeak-NG | 免费 | 直接 | 经典开源方案,可在任意硬件上运行 |
| 提供商 | 费用 | OBS 捕获 | 功能 |
|---|---|---|---|
| OpenAI TTS | 适用 API 费用(或免费本地运行) | 直接 | 高品质;也通过自定义端点支持本地服务器 |
| Google Cloud | 适用 API 费用 | 直接 | 专业品质,支持多种语言 |
| ElevenLabs | 提供免费额度 | 直接 | 自定义语音训练,音色自然 |
| Speechify | 适用 API 费用 | 直接 | 高品质语音,支持多种语言 |
| Gemini TTS | 适用 API 费用 | 直接 | Google 生成式语言 API |
这些是典型能力,并非对所有安装环境的保证。OBS 使用自己的嵌入式浏览器,不会继承已安装 Chrome/Edge 的语音列表。SSN 应用测试成功不代表单独的 OBS 浏览器源也已通过测试。
✓ 在支持的安装环境中可使用系统语音
Google 提供的语音 + 系统语音
✓ 在支持的安装环境中可使用系统语音
Microsoft 语音 + Windows TTS 包
⚠ 支持有限
仅支持本地系统语言
⚠ 支持有限
基于 Chromium;可用语音因安装环境而异
SSN 的浏览器内本地提供商及云端音频提供商通过页面播放生成的音频:
专门针对 System TTS:
音频路由工具下载: VB-Audio Virtual Cable | Voicemeeter | Audio Router(旧版)
在支持的情况下,先尝试用 OBS 应用音频或桌面音频捕获正在发声的浏览器。下方虚拟音频线方法是可选替代方案;不会为 OBS 增加语音支持。
请按照以下资料中的说明操作: Microsoft 官方指南 ,了解语言包安装方法。
| 参数 | 说明 | 示例 |
|---|---|---|
| &speech | 使用语言代码启用 TTS | &speech=en-US |
| &pitch | 语音音高(0.1 至 2.0) | &pitch=1.2 |
| &volume | 音量(0.0 至 1.0) | &volume=0.8 |
| &rate | 语速(0.1 至 10.0) | &rate=1.5 |
| &voice | 部分匹配语音名称 | &voice=google |
| &ttsprovider | 选择提供商:kokoro、piper、kitten、espeak、openai、customtts、localtts、elevenlabs、google、speechify、gemini | &ttsprovider=customtts |
| 参数 | 说明 |
|---|---|
| &simpletts | 不说“says”或“someone says” |
| &simpletts2 | 完全不朗读聊天用户名 |
| &ttscommand | 启用自定义 TTS 命令(默认:!say) |
| &readevents | 将直播事件纳入 TTS |
| &skipmessages=3 | 每3条消息只朗读1条 |
?ttsprovider=kokoro&voicekokoro=af_bella&kokorospeed=1.2&voicekokoro=ef_dora 用于西班牙语,或 &voicekokoro=pf_dora 用于巴西葡萄牙语。更改 &speech= 本身不会改变所选语音。现有英语语音 ID 仍然可用。?ttsprovider=piper&pipervoice=en_US-hfc_female-medium&pipervoice=pt_BR-faber-medium 或 &pipervoice=pt_BR-edresson-low&pipervoice=es_ES-davefx-medium 或 &pipervoice=es_MX-ald-medium&piperspeed=1.0?ttsprovider=kitten&kittenvoice=expr-voice-4-f?ttsprovider=espeak&espeakvoice=en&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br&speech=es-ES&ttsprovider=espeak&espeakvoice=es&espeakspeed=175?speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium?speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br?speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium?speech=es-ES&ttsprovider=espeak&espeakvoice=es?ttsprovider=openai?ttsprovider=customtts 或 ?ttsprovider=localtts 用于自托管端点&openaiendpoint=http://localhost:8880/v1/audio/speechlocalhost 和 127.0.0.1 指播放 TTS 页面的同一台电脑。如果 OBS 与 TTS 服务器不在同一台电脑上,请改用服务器电脑的局域网 IP。npm run local-tts-bridge ,在 OBS 电脑上运行,并将 SSN 指向 http://127.0.0.1:8124/v1/audio/speech{ model, input, voice, response_format, speed } ,并支持二进制音频、JSON 音频 URL 及 JSON base64 音频&voiceopenai=af_bella,速度: &openaispeed=1.0。使用服务器支持的语音名称;Kokoro 语音类似 af_bella,而 openedai-speech/OpenAI 风格的语音可能类似 nova 或 echo.?ttsprovider=google&ttskey=YOUR_API_KEY&voicegoogle=en-GB-Standard-A&googlelang=en-US?ttsprovider=gemini&geminikey=YOUR_API_KEY&geminimodel=gemini-2.5-flash-preview-tts&voicegemini=Kore,语言: &geminilang=th-TH&geministyle=Read aloud in a warm tone.?ttsprovider=elevenlabs&elevenlabskey=YOUR_API_KEY&voice11=YOUR_VOICE_ID&elevenlabsmodel=eleven_multilingual_v2选择 Fish Audio 并输入 API 密钥,可选填语音 ID。默认模型为 s2.1-pro-free. 设置、模型选项及浏览器访问限制.
?ttsprovider=speechify&speechifykey=YOUR_API_KEY&voicespeechify=henry&speechifymodel=simba-3.0 (默认),或 &speechifymodel=simba-3.2 用于英语。&speechifyspeed=1.2 (范围 0.5 至 3.0;正常为 1.0)。127.0.0.1.ttsquick ,如 OBS URL 中存在则移除。此处列出 仅限显示本指南的浏览器中的 System TTS 语音。它不测试 OBS、独立 SSN 应用窗口或 Kokoro 等提供商。列表为空并不表示 SSN 的其他 TTS 提供商不可用。