TTS 設定指南

三步即可聽到聊天。免費開始,不需帳號或 API 金鑰。

1. 開啟聊天朗讀

尚未連接聊天? 從這裡開始:安裝 SSN、加入來源並開啟停駐面板。

開啟 SSN 擴充功能彈出選單 或桌面應用程式的 來源與設定.

位於 主聊天疊加畫面與控制停駐面板,展開 訊息 — 文字轉語音。開啟此處所示的開關:

實際彈出選單:Message — Text to Speech,已開啟 Enable TTS in dock
藍色開關 = 聊天朗讀已開啟。

2. 選擇免費語音

在同一區段中,捲動至 TTS 服務提供者。選擇 Piper TTS,然後選擇語音。

實際彈出選單:已選擇 Piper TTS,語音為 English US Female HFC Medium
Piper 不需帳號或 API 金鑰。首次使用請等待語音下載。

使用 複製連結 ,位於下列選項旁: 主聊天疊加畫面與控制停駐面板 以取得更新後的連結。

3. 在 OBS 中播放

  1. 新增 OBS 瀏覽器來源 並貼上該連結。
  2. 啟用 透過 OBS 控制音訊 ,在其內容中設定。
  3. 傳送一則聊天訊息。檢查來源音量表,再錄製一小段。

想自己聽到嗎? 在 OBS 進階音訊屬性中,選擇 監聽並輸出 為該來源設定。僅保留一個副本朗讀聊天。

試聽免費語音

喜歡其他音色?這四種語音免費。點選播放進行比較。

Piper

美式英語女聲(HFC),中等品質。
en_US-hfc_female-medium

查看設定與語音

Kokoro

Bella,美式女聲。使用 CPU/WASM、q8 測試。
af_bella

查看設定與語音

Kitten

Voice 4,女聲。隨附 nano v0.1 模型。
expr-voice-4-f

查看設定與語音

eSpeak

英語。資源占用小的合成語音。
en

查看設定與語音

西班牙語與葡萄牙語範例

在 SSN 設定的語音清單上方選擇語言,然後使用 測試。Piper 提供西班牙、墨西哥、巴西及葡萄牙語音;Kokoro 另提供三種西班牙語及三種巴西葡萄牙語語音。

Piper - 西班牙語(西班牙)

DaveFX

Kokoro - 西班牙語

Dora

Piper - 葡萄牙語(巴西)

Faber

Kokoro - 葡萄牙語(巴西)

Dora

免費本機合成,首次需要下載。範例不包含載入時間。Piper 是較輕量的入門選擇;Kokoro 在 CPU 上可能較慢。若語音跟不上聊天,請使用 Piper。

範例文字與測試詳情

四個英語範例朗讀以下內容: 歡迎來到直播!感謝加入。接下來我們玩什麼遊戲? 已停用名稱朗讀。

已於 2026 年 9 月 7 日在 Windows 11 的 OBS 32.2.2 中驗證:聊天訊息到達真實停駐面板、產生語音、讓瀏覽器來源音量表產生變化,並出現在錄製內容中。此次 CPU 測試中,Kokoro 開始發聲的等待時間明顯較長。這些片段用於試聽語音,不反映等待時間。

System TTS 在此電腦上提供了五種語音,但瀏覽器來源錄製中未產生音訊。該結果僅針對這套設定;請一律測試最終 URL 及錄製結果。由於未使用付費憑證,本次未包含雲端語音。

需要協助?

我的聊天平台支援 TTS 嗎?

若 SSN 以文字形式接收到聊天,就能將其朗讀。YouTube、Twitch、TikTok 及其他來源使用相同功能。聊天平台本身不需要支援 TTS。

沒有語音?

先檢查停駐面板是否接收到聊天,再檢查 TTS 開關、供應商及篩選器。使用新複製的連結。等待首次模型下載完成。

Chrome/Edge 可用,但 OBS 不可用?

OBS 使用獨立的瀏覽器及語音清單。即使列出了語音,System TTS 也可能無法運作。請嘗試 Piper、Kokoro、Kitten 或 eSpeak。虛擬音訊線無法解決未產生語音的問題。

音量表有變化,但錄製無聲?

檢查 OBS 中的靜音及錄音軌道指派。若也想自己聽到,請使用 Monitor and Output;避免再次擷取該監聽輸出。 OBS 音訊指南.

可以改用 OBS 停駐面板或精選聊天嗎?

OBS 自訂瀏覽器停駐面板是控制面板,並非上方使用的場景瀏覽器來源。對於精選聊天,請在該疊加畫面自己的彈出選項中啟用 TTS 並複製連結。僅保持一個頁面發聲,避免重複語音。

比較所有供應商:需求、費用及取捨

免費本機語音先試 Piper;若更喜歡 Kokoro 的音色,也可進行比較。 若反應速度比逼真程度更重要,請嘗試 eSpeak。Kitten 也是小型英語選項。決定前先試聽。

提供者適合用途取捨需求 / 費用
Kokoro英語、西班牙語及巴西葡萄牙語語音。CPU 運算較多;首次發聲可能較慢。免費,不需金鑰。下載模型/語音資源;使用 CPU 或受支援的 WebGPU。
Piper本機神經網路語音;提供英語、西班牙語及葡萄牙語選項。品質及發音因語音而異。免費,不需金鑰。下載所選模型(HFC medium 約 63 MB)及引擎檔案。
Kitten小型英語模型,提供八種語音。語言及語音風格較少。免費,不需金鑰。目前隨附模型約 24 MB,另需引擎/語音檔案;使用 CPU。
eSpeak輕量、多語言、啟動快。刻意採用合成/機器人音色。免費,不需金鑰。載入隨附引擎/語言檔案;不需神經網路模型或 GPU。
系統 TTS使用瀏覽器或桌面應用程式提供的語音。語音清單及 OBS 擷取情況各異;部分語音需要網際網路。無 SSN 供應商費用。需要可用的系統/瀏覽器語音;請在實際播放頁面測試。
ElevenLabs語音 ID、模型選擇及穩定性/風格控制項。可能存在帳號限制、網路延遲及 API 費用。需要網際網路、API 金鑰及可存取的語音 ID。聊天文字會傳送給供應商。
Google Cloud具名語音,提供語言、語速及音高控制項。並非每種語音都支援所有控制項。需要網際網路、已啟用的 Cloud TTS API、API 金鑰及相符的語音/語言。適用計費/配額。
Gemini語音風格及文字表達指示。預覽模型及配額可能變更;延遲各異。需要網際網路、Gemini API 金鑰及所選 TTS 模型的存取權限。請檢查帳號限制/計費。
Speechify語音 ID,附帶速度、語言及模型控制項。需要 API 存取權限;可用語音取決於帳號。需要網際網路及 Speechify API 金鑰。適用 API 使用條款/限制。
OpenAI具名語音,提供模型及格式控制項。需要 API 計費及網際網路;帳號訂閱另外計算。具有 TTS 存取權限的 API 金鑰。聊天文字會傳送至設定的端點。
自訂 / 本機使用自己的相容語音伺服器。設定最多:端點、模型、語音及瀏覽器存取必須一致。可存取的 OpenAI 相容語音端點;若有要求還需金鑰。本機硬體或託管成本各異。

上方下載大小僅指模型檔案,不是總記憶體用量或全部所需資源。本機供應商使用執行停駐面板/疊加畫面的電腦;首次使用可能較慢,且 OBS 有自己的快取。雲端供應商節省本機運算資源,但會將文字傳送至裝置外。

OBS: 下方四個本機供應商通過了瀏覽器來源錄製測試。雲端/自訂供應商會傳回音訊供頁面播放,但此次審查未使用真實帳號測試。即使 System TTS 列出了語音,也需要單獨測試。

供應商設定與語音名稱

實際桌面應用程式設定,使用全新設定檔擷取。開啟你要使用的供應商;API 金鑰欄位刻意留空。這些控制項設定所選的 SSN 停駐面板或疊加畫面。選取截圖可查看原始尺寸。

系統 TTS

此全新設定檔的語言清單為空。可用語音取決於瀏覽器/應用程式及已安裝語音;SSN 沒有統一通用的語音清單。

實際 SSN System TTS 供應商設定
Kokoro

在 SSN 中選擇語音;模型會在發聲頁面載入。可選英語美式/英式、西班牙語及巴西葡萄牙語。使用語言篩選器尋找語音;Test 會以所選語言播放短句。若想降低 CPU 使用率,請嘗試 Piper。

實際 SSN Kokoro 供應商設定
語音名稱及 URL 值
  • Heart(美式女聲)— af_heart
  • Alloy(美式女聲)— af_alloy
  • Aoede(美式女聲)— af_aoede
  • Bella(美式女聲)— af_bella
  • Jessica(美式女聲)— af_jessica
  • Kore(美式女聲)— af_kore
  • Nicole(美式女聲)— af_nicole
  • Nova(美式女聲)— af_nova
  • River(美式女聲)— af_river
  • Sarah(美式女聲)— af_sarah
  • Sky(美式女聲)— af_sky
  • Adam(美式男聲)— am_adam
  • Echo(美式男聲)— am_echo
  • Eric(美式男聲)— am_eric
  • Fenrir(美式男聲)— am_fenrir
  • Liam(美式男聲)— am_liam
  • Michael(美式男聲)— am_michael
  • Onyx(美式男聲)— am_onyx
  • Puck(美式男聲)— am_puck
  • Santa(美式男聲)— am_santa
  • Emma(英式女聲)— bf_emma
  • Isabella(英式女聲)— bf_isabella
  • George(英式男聲)— bm_george
  • Lewis(英式男聲)— bm_lewis
  • Alice(英式女聲)— bf_alice
  • Lily(英式女聲)— bf_lily
  • Daniel(英式男聲)— bm_daniel
  • Fable(英式男聲)— bm_fable
  • Dora(西班牙語)- ef_dora
  • Alex(西班牙語)- em_alex
  • Santa(西班牙語)- em_santa
  • Dora(巴西葡萄牙語)- pf_dora
  • Alex(巴西葡萄牙語)- pm_alex
  • Santa(巴西葡萄牙語)- pm_santa
Kitten

八種英語語音:編號為 2、3、4 和 5 的男聲及女聲。範例使用 Voice 4(Female)。

實際 SSN Kitten 供應商設定
語音名稱及 URL 值
  • Voice 2(男聲)— expr-voice-2-m
  • Voice 2(女聲)— expr-voice-2-f
  • Voice 3(男聲)— expr-voice-3-m
  • Voice 3(女聲)— expr-voice-3-f
  • Voice 4(男聲)— expr-voice-4-m
  • Voice 4(女聲)— expr-voice-4-f
  • Voice 5(男聲)— expr-voice-5-m
  • Voice 5(女聲)— expr-voice-5-f
Piper

選擇相符的語言和模型。範例使用 HFC medium。僅設定語言不會翻譯語音。

實際 SSN Piper 供應商設定
語音名稱及 URL 值
  • 美式英語女聲(HFC)- 中等品質 — en_US-hfc_female-medium
  • 西班牙西班牙語(DaveFX)- 中等品質 — es_ES-davefx-medium
  • 墨西哥西班牙語(Ald)- 中等品質 — es_MX-ald-medium
  • 巴西葡萄牙語(Faber)- 中等品質 — pt_BR-faber-medium
  • 巴西葡萄牙語(Edresson)- 低品質 — pt_BR-edresson-low
  • 葡萄牙葡萄牙語(Tugao)- 中等品質 — pt_PT-tugão-medium
eSpeak

選擇一種語言語音,並可選擇調整語速。該引擎刻意採用機器人音色。

實際 SSN eSpeak 供應商設定
語音名稱及 URL 值
  • 英語 — en
  • 西班牙語 — es
  • 巴西葡萄牙語 — pt-br
  • 葡萄牙葡萄牙語 — pt-pt
ElevenLabs

輸入 API 金鑰,再使用 List My Available Voices 尋找帳號可用的語音 ID。 供應商參考.

實際 SSN ElevenLabs 供應商設定
Google Cloud

輸入 Google Cloud TTS API 金鑰及精確的語音名稱,並選擇相符的語言。 語音名稱及支援的控制項.

實際 SSN Google Cloud 供應商設定
Gemini

選擇支援的 TTS 模型及語音;風格指示會改變表達方式。這些是 Gemini API 設定,與 Google Cloud TTS 獨立。 語音範例及需求.

實際 SSN Gemini 供應商設定
Fish Audio

選擇 Fish Audio ,位於聊天停駐面板、精選疊加畫面、TTS 頁面或 Flow Actions 的 TTS 供應商選單中。輸入自己的 Fish Audio API 金鑰,然後使用現有的 Test TTS 按鈕。選用的 Voice ID 可從以下位置選擇語音: Fish Audio;複製語音模型 ID,而非名稱或頁面 URL。留空則使用服務的預設語音。

進階選項包含模型及語速(0.5–2)。SSN 預設使用 s2.1-pro-free;免費額度的可用性及合理使用條款由 Fish Audio 決定。付費模型需要帳戶餘額。SSN 不會使用付費模型重試失敗的免費請求。觀眾音量請在 More TTS options 中設定。文字會傳送至 Fish Audio,由該服務偵測語言。

OBS / 瀏覽器設定: 執行 SSN 既有的 以 Fish 模式執行的本機 TTS 橋接 ,在 OBS 電腦上執行。將其 SSN_TTS_TARGET_BEARER 環境變數設為 Fish API 金鑰,並啟動 node scripts/local-tts-bridge.cjs --mode fish。在 Fish Audio 面板中,設定 OBS / 瀏覽器橋接 URL 為 http://127.0.0.1:8124/v1/audio/speech;將終端機顯示的本機橋接權杖貼至彈出選單的 API金鑰 欄位。權杖會在重新啟動後變更,除非設定 SSN_TTS_BRIDGE_TOKEN 為較長的隨機密鑰;請將含權杖的疊加畫面連結保密。保持橋接執行、測試語音,並在 OBS 中使用產生的疊加畫面 URL。若希望音訊進入 OBS 混音器,請在瀏覽器來源設定中啟用 Control audio via OBS。託管瀏覽器頁面直接向 Fish 發出的請求缺少 CORS 權限;橋接提供瀏覽器可存取的音訊回應。

使用橋接時,加入 &fishendpoint=http%3A%2F%2F127.0.0.1%3A8124%2Fv1%2Faudio%2Fspeech 至 URL,並省略 fishkey ,當金鑰由橋接持有時。

URL 參數: &ttsprovider=fish&fishkey=YOUR_KEY&voicefish=VOICE_ID&fishmodel=s2.1-pro-free&fishspeed=1。透過一般控制項啟用 TTS。請將包含金鑰的產生 URL 保密。接收頁面使用 Fish Audio 時,Event Flow 既有的 Speak Text 語音覆寫選項接受 Fish 語音 ID。

Fish Audio API 參考 · 免費模型公告及條款

Speechify

Speechify 逐步指南:API 金鑰、語音、速度及觀眾音量。

輸入 Speechify API 帳號的 API 金鑰及語音 ID。 供應商設定.

實際 SSN Speechify 供應商設定
OpenAI

選擇支援的語音/模型並輸入 API 金鑰。ChatGPT 訂閱不提供 API 額度。使用 OpenAI 時保留預設端點。

實際 SSN OpenAI 供應商設定
自訂 / 本機 TTS

此選項重用 OpenAI 相容控制項,因此標題仍顯示 OpenAI。輸入伺服器端點及其支援的語音/模型;驗證取決於伺服器。請參閱 本機伺服器指南.

實際 SSN Custom / Local TTS 供應商設定
進階:手動編輯 TTS URL

建議先進行的測試:

dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kokoro
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=piper
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kitten

若使用葡萄牙語或西班牙語,請先嘗試以下選項:

dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium
dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=espeak&espeakvoice=es

完整文字轉語音參考 · 本機 TTS 伺服器指南

進階:執行自己的本機 TTS 伺服器

需要私人語音、特定語音模型或 Kokoro-FastAPI、openedai-speech 等伺服器時,本機 TTS 伺服器很有用。播放 TTS 的頁面必須能存取端點。

示意圖:OBS 瀏覽器來源透過 Social Stream Ninja 本機 TTS 橋接向 TTS 伺服器傳送請求
對於 OBS,本機橋接通常與 OBS 在同一電腦上執行時效果最好。
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=customtts&openaiendpoint=http://127.0.0.1:8124/v1/audio/speech&voiceopenai=af_bella

localhost 指執行頁面的電腦。若 TTS 伺服器在另一台電腦上,請使用該電腦的區域網路 IP,或在 OBS 電腦上執行橋接。