文字转语音音色指南

所有文本转语音选项:提供商、链接设置、系统音色和 OBS 音频。

从这里开始

初次使用 TTS? 请遵循 文字转语音设置指南。只需五步,本页则是完整参考。

SSN 可朗读采集到的文本聊天,平台无需自带 TTS。开启 TTS 的 Dock 或叠加层按照自身过滤条件朗读。

最简单的链接使用系统音色开启 TTS:

dock.html?session=YOUR_SESSION&speech=en-US

在 OBS 中添加通过页面播放的免费音色:

dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=piper

保持该页面打开并连接,只让一个页面朗读。

系统 TTS 不等于免费 TTS。 系统音色来自浏览器和电脑。即使 Chrome 可用,OBS 也常常没有。Kokoro、Piper、Kitten 和 eSpeak 免费且自行生成音频,因此可在 OBS 使用。不必付费才能在 OBS 使用 TTS。

TTS 也在 CAPTION.Ninja中也可用于字幕、转写和翻译。两者均提供免费和付费音色。

提供商

使用以下参数选择提供商: &ttsprovider=。试听和对比请见 设置指南.

提供商链接参数值费用说明
系统 TTS(默认)免费浏览器音色,在 OBS 中常常无声。
Kokorokokoro免费在浏览器运行,最佳免费音质,数十种音色。
Piperpiper免费在浏览器运行,快速且 CPU 负载低。
Kittenkitten免费在浏览器运行,小型模型。
eSpeak-NGespeak免费经典机械音,任何电脑都能运行。
OpenAIopenaiAPI 费用高音质。
自己的服务器customtts 或 localtts免费任何兼容 OpenAI 的服务器。参见 本地 TTS 指南.
Google CloudgoogleAPI 费用多语言。
GeminigeminiAPI 费用控制朗读方式的风格指令。
ElevenLabselevenlabs提供免费额度自然音色、自定义音色训练。
SpeechifyspeechifyAPI 费用多语言。
Fish Audiofish有免费模型OBS 需要本地桥接。
除系统 TTS 外,所有提供商都通过页面播放声音。在 OBS 中只需开启 通过 OBS 控制音频.

链接设置

将这些添加到 Dock 或叠加层链接末尾。

设置功能示例
&speech指定语言代码并开启 TTS。&speech=en-US
&ttsprovider选择提供商(见上文)。&ttsprovider=kokoro
&volume音量,0.0 至 1.0。&volume=0.8
&rate语速,0.1 至 10.0。&rate=1.5
&pitch音高,0.1 至 2.0。&pitch=1.2
&voice按部分名称选择系统音色。&voice=google
&simpletts不朗读“says”或“someone says”。&simpletts
&simpletts2完全不朗读姓名。&simpletts2
&ttscommand只读以命令开头的消息(默认 !say).&ttscommand=!say
&readevents也朗读订阅和捐款等事件。&readevents
&skipmessages每 N 条消息只读一条。&skipmessages=3
&ttsquick超过指定字符数时截断语音。消息被截断时请移除。&ttsquick=100

提供商设置

将这些添加在以下内容之后: &ttsprovider=。在弹窗中选择提供商时也会显示相同设置。

提供商设置
Kokoro音色 &voicekokoro=af_bella · 速度 &kokorospeed=1.2。西班牙语: ef_dora。巴西葡萄牙语: pf_dora. 后台生成选项.
Piper音色 &pipervoice=en_US-hfc_female-medium · 速度 &piperspeed=1.0。葡萄牙语: pt_BR-faber-medium, pt_BR-edresson-low。西班牙语: es_ES-davefx-medium, es_MX-ald-medium.
Kitten音色 &kittenvoice=expr-voice-4-f.
eSpeak-NG音色 &espeakvoice=en · 速度 &espeakspeed=175.
OpenAI / 自己的服务器音色 &voiceopenai=nova · 速度 &openaispeed=1.0 · 服务器 &openaiendpoint=http://localhost:8880/v1/audio/speech。本地服务器无需密钥。 所有本地服务器设置.
Google Cloud密钥 &ttskey=YOUR_API_KEY · 音色 &voicegoogle=en-GB-Standard-A · 语言 &googlelang=en-US.
Gemini密钥 &geminikey=YOUR_API_KEY · 模型 &geminimodel=gemini-2.5-flash-preview-tts · 音色 &voicegemini=Kore · 语言 &geminilang=th-TH · 风格 &geministyle=Read aloud in a warm tone.
ElevenLabs密钥 &elevenlabskey=YOUR_API_KEY · 音色 ID &voice11=YOUR_VOICE_ID · 模型 &elevenlabsmodel=eleven_multilingual_v2。也可调整稳定性、相似度和风格。
Speechify密钥 &speechifykey=YOUR_API_KEY · 音色 &voicespeechify=henry · 模型 &speechifymodel=simba-3.0 (默认)或 simba-3.2 用于英语 · 速度 &speechifyspeed=1.2 (0.5 至 3.0)。 Speechify 指南.
Fish AudioAPI 密钥和可选音色 ID。默认模型 s2.1-pro-free. 设置与 OBS 桥接.
选择与你的语言匹配的音色。 更改 &speech= 本身不会改变音色,旧英语音色 ID 仍有效。
现成的西班牙语和葡萄牙语链接
语言最佳免费音质(已测试)最快备用方案(已测试)
葡萄牙语&speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br
西班牙语&speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium&speech=es-ES&ttsprovider=espeak&espeakvoice=es

Kokoro 也可用: &voicekokoro=ef_dora (西班牙语)或 pf_dora (巴西葡萄牙语)。云端音色请在 Google Cloud、ElevenLabs、Speechify、Gemini 或兼容 OpenAI 的本地服务器中选择支持该语言的音色。

系统音色

系统 TTS 使用浏览器和电脑已有的音色。以下是常见情况,不是保证。

浏览器系统音色
Chrome支持。Google 音色加系统音色。
Edge支持。Microsoft 音色加 Windows 语言包。
Firefox有限,仅本地系统音色。
Opera有限,取决于安装环境。
Safari需要点击后才能播放声音。
OBS使用自己的浏览器,不共享 Chrome 或 Edge 的音色。在 SSN 应用测试不等于测试 OBS。

检查此浏览器的系统音色。仅列出当前浏览器的系统 TTS 音色,不测试 OBS 或 Kokoro 等提供商。列表为空不代表其他提供商不可用。

在 Windows 添加更多音色

  1. 打开 开始 > 设置 > 时间和语言 > 语音.
  2. 位于 管理语音,点击 添加语音.
  3. 选择语言并点击 添加.
  4. 重启浏览器。

这是 Windows 11 的方法。Windows 10 请参见 Microsoft 指南。部分第三方音色不会出现在浏览器中。Firefox 往往比基于 Chrome 的浏览器显示更多系统音色。

将系统 TTS 送入 OBS

使用其他提供商? 无需此步骤,开启 通过 OBS 控制音频 ,在浏览器源中开启,无需虚拟音频线。
  1. 先确认系统 TTS 确实发声。OBS 可能没有可用音色;没有语音时,调整音频路由也无济于事,请换其他提供商。
  2. 若语音在另一浏览器播放,请用 OBS 的应用或桌面音频采集捕获它。
  3. 仍有问题?通过下方虚拟音频线方法路由浏览器声音。
通过虚拟音频线传递声音(Windows)

下载: VB-Audio Virtual Cable (免费)· Voicemeeter · Audio Router(旧版)

方法执行操作
整台电脑设置 CABLE Input 作为 Windows 默认输出(声音设置 > 输出)。
单个应用,Windows 11设置 > 系统 > 声音 > 音量混合器。将浏览器输出设为 CABLE Input.
单个应用,Windows 10声音设置 > 应用音量和设备首选项。将浏览器输出设为 CABLE Input.
Audio Router较旧的软件。将浏览器音频送到 CABLE Input.
Voicemeeter设为 Windows 默认输出。将硬件输出送往扬声器,虚拟输出送往 OBS。

然后在 OBS 中添加 音频输入捕获(Audio Input Capture),选择 CABLE Output (或 Voicemeeter 输出),将监听设为 监听并输出。使用 仅监听 ,如果其他来源已将该音频送入直播。

测试:播放 TTS,查看 OBS 音量表,确认听得到,再调整音量。

解决问题

问题试试这个
没有声音确认 TTS 已开启、朗读页面保持打开、浏览器源未静音。普通浏览器中请点击一次页面。
OBS 中无声完全没有语音?先检查提供商。已有语音则检查 通过 OBS 控制音频、混音器静音和输出音轨。或采集正在朗读的浏览器。
云端音色不工作检查 API 密钥和提供商名称。没有密钥时 SSN 回退到系统 TTS,而它在 OBS 中可能无声。
本地服务器在应用中可用,OBS 不可用OBS 是独立浏览器。请在 OBS 电脑上检查服务器,尤其使用 127.0.0.1。请参阅 localhost 规则.
只读第一个字母或几个单词移除 ttsquick ,从 OBS 链接移除。
新音色没有出现添加语言包后重启浏览器。
Safari 不朗读Safari 的自动 TTS 有限制。点击一次页面以允许音频。

良好使用习惯

  • 使用通过页面播放的提供商,这是最简单的 OBS 设置,而且有免费选项。
  • 开播前用短消息测试。
  • 观众可以输入任何内容,请准备快速关闭 TTS 的办法。