คู่มือฉบับเต็มเกี่ยวกับตัวเลือกเสียงแปลงข้อความเป็นเสียงพูด ความเข้ากันได้ของเบราว์เซอร์ และการเก็บเสียง
SSN อ่านข้อความแชตที่เก็บจากแหล่งข้อมูลที่รองรับใดก็ได้ แพลตฟอร์มแชตไม่ต้องมีฟีเจอร์ TTS ของตัวเอง แผงด็อกหรือโอเวอร์เลย์ที่เปิด TTS อ่านข้อความที่รับมาตามตัวกรองและการตั้งค่า TTS เริ่มจาก คู่มือตั้งค่าแบบสั้น หน้านี้ครอบคลุมตัวเลือกเสียงและการตั้งค่าขั้นสูง เปรียบเทียบผู้ให้บริการ ฟังตัวอย่าง และดูการตั้งค่า
dock.html?session=YOUR_SESSION&speech=en-US ค่าเริ่มต้นคือ System TTS หากต้องการผู้ให้บริการฟรีสำหรับ OBS ให้เพิ่ม &ttsprovider=kokoro เปิดหน้านี้และเชื่อมต่อไว้ ควรมีเพียงหน้าเดียวที่พูด
| ผู้ให้บริการ | ค่าใช้จ่าย | การเก็บเสียงใน OBS | ฟีเจอร์ |
|---|---|---|---|
| Kokoro TTS | ฟรี | โดยตรง | AI ในเบราว์เซอร์ คุณภาพยอดเยี่ยม มีเสียงหลายสิบแบบ |
| Piper TTS | ฟรี | โดยตรง | TTS นิวรัลในเบราว์เซอร์ รวดเร็วและเหมาะกับ CPU |
| Kitten TTS | ฟรี | โดยตรง | โมเดล ONNX ขนาดเล็กในเบราว์เซอร์ |
| eSpeak-NG | ฟรี | โดยตรง | โอเพนซอร์สแบบดั้งเดิม ใช้ได้กับฮาร์ดแวร์ทุกแบบ |
| ผู้ให้บริการ | ค่าใช้จ่าย | การเก็บเสียงใน OBS | ฟีเจอร์ |
|---|---|---|---|
| OpenAI TTS | มีค่า API (หรือใช้ฟรีภายในเครื่อง) | โดยตรง | คุณภาพสูง รองรับเซิร์ฟเวอร์ภายในเครื่องผ่านปลายทางกำหนดเองด้วย |
| Google Cloud | มีค่า API | โดยตรง | คุณภาพระดับมืออาชีพ หลายภาษา |
| ElevenLabs | มีแพ็กเกจฟรี | โดยตรง | ฝึกเสียงกำหนดเอง เสียงเป็นธรรมชาติ |
| Speechify | มีค่า API | โดยตรง | เสียงคุณภาพสูง หลายภาษา |
| Gemini TTS | มีค่า API | โดยตรง | Generative Language API ของ Google |
สิ่งเหล่านี้คือความสามารถทั่วไป ไม่ใช่ข้อรับประกันสำหรับทุกการติดตั้ง OBS ใช้เบราว์เซอร์ฝังของตัวเองและไม่ได้รับรายการเสียงจาก Chrome/Edge ที่ติดตั้งอยู่ การทดสอบสำเร็จในแอป SSN ไม่ได้ทดสอบแหล่งข้อมูลเบราว์เซอร์แยกใน OBS
✓ มีเสียงระบบให้ใช้ในการติดตั้งที่รองรับ
เสียงจาก Google + เสียงระบบ
✓ มีเสียงระบบให้ใช้ในการติดตั้งที่รองรับ
เสียง Microsoft + แพ็ก Windows TTS
⚠ รองรับจำกัด
เฉพาะภาษาระบบภายในเครื่อง
⚠ รองรับจำกัด
ใช้ Chromium เสียงที่มีแตกต่างกันตามการติดตั้ง
ผู้ให้บริการภายในเครื่องแบบเบราว์เซอร์และผู้ให้บริการเสียงคลาวด์ของ SSN เล่นเสียงที่สร้างผ่านหน้าเว็บ:
สำหรับ System TTS โดยเฉพาะ:
ดาวน์โหลดเครื่องมือกำหนดเส้นทาง: VB-Audio Virtual Cable | Voicemeeter | Audio Router (รุ่นเก่า)
ลองเก็บเสียงเบราว์เซอร์ที่กำลังพูดด้วยการเก็บเสียงแอปหรือเดสก์ท็อปของ OBS ก่อนในระบบที่รองรับ วิธีสายเสียงเสมือนด้านล่างเป็นทางเลือกเสริม ไม่ได้เพิ่มการรองรับเสียงพูดให้ OBS
ทำตามคำแนะนำใน คู่มืออย่างเป็นทางการของ Microsoft สำหรับติดตั้งแพ็กภาษา
| พารามิเตอร์ | คำอธิบาย | ตัวอย่าง |
|---|---|---|
| &speech | เปิด TTS พร้อมรหัสภาษา | &speech=en-US |
| &pitch | ระดับเสียงสูงต่ำ (0.1–2.0) | &pitch=1.2 |
| &volume | ระดับความดัง (0.0–1.0) | &volume=0.8 |
| &rate | อัตราการพูด (0.1–10.0) | &rate=1.5 |
| &voice | จับคู่บางส่วนของชื่อเสียง | &voice=google |
| &ttsprovider | เลือกผู้ให้บริการ: kokoro, piper, kitten, espeak, openai, customtts, localtts, elevenlabs, google, speechify, gemini | &ttsprovider=customtts |
| พารามิเตอร์ | คำอธิบาย |
|---|---|
| &simpletts | ไม่พูดคำว่า "says" หรือ "someone says" |
| &simpletts2 | ไม่อ่านชื่อผู้แชตเลย |
| &ttscommand | เปิดคำสั่ง TTS กำหนดเอง (ค่าเริ่มต้น: !say) |
| &readevents | รวมอีเวนต์สตรีมใน TTS |
| &skipmessages=3 | อ่านทุกข้อความที่ 3 เท่านั้น |
?ttsprovider=kokoro&voicekokoro=af_bella&kokorospeed=1.2&voicekokoro=ef_dora สำหรับภาษาสเปน หรือ &voicekokoro=pf_dora สำหรับโปรตุเกสแบบบราซิล การเปลี่ยน &speech= เพียงอย่างเดียวไม่เปลี่ยนเสียงที่เลือก รหัสเสียงภาษาอังกฤษเดิมยังใช้ได้?ttsprovider=piper&pipervoice=en_US-hfc_female-medium&pipervoice=pt_BR-faber-medium หรือ &pipervoice=pt_BR-edresson-low&pipervoice=es_ES-davefx-medium หรือ &pipervoice=es_MX-ald-medium&piperspeed=1.0?ttsprovider=kitten&kittenvoice=expr-voice-4-f?ttsprovider=espeak&espeakvoice=en&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br&speech=es-ES&ttsprovider=espeak&espeakvoice=es&espeakspeed=175?speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium?speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br?speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium?speech=es-ES&ttsprovider=espeak&espeakvoice=es?ttsprovider=openai?ttsprovider=customtts หรือ ?ttsprovider=localtts สำหรับปลายทางที่โฮสต์เอง&openaiendpoint=http://localhost:8880/v1/audio/speechlocalhost และ 127.0.0.1 หมายถึงคอมพิวเตอร์เครื่องเดียวกับที่เล่นหน้า TTS หาก OBS อยู่คนละเครื่องกับเซิร์ฟเวอร์ TTS ให้ใช้ IP ภายใน LAN ของคอมพิวเตอร์เซิร์ฟเวอร์แทนnpm run local-tts-bridge บนคอมพิวเตอร์ OBS แล้วตั้งให้ SSN เชื่อมต่อไปยัง http://127.0.0.1:8124/v1/audio/speech{ model, input, voice, response_format, speed } และรองรับเสียงไบนารี URL เสียงใน JSON และเสียง base64 ใน JSON&voiceopenai=af_bella ความเร็ว: &openaispeed=1.0 ใช้ชื่อเสียงที่เซิร์ฟเวอร์รองรับ เสียง Kokoro มีชื่อ เช่น af_bella ส่วนเสียงแบบ openedai-speech/OpenAI อาจมีชื่อ เช่น nova หรือ echo.?ttsprovider=google&ttskey=YOUR_API_KEY&voicegoogle=en-GB-Standard-A&googlelang=en-US?ttsprovider=gemini&geminikey=YOUR_API_KEY&geminimodel=gemini-2.5-flash-preview-tts&voicegemini=Kore ภาษา: &geminilang=th-TH&geministyle=Read aloud in a warm tone.?ttsprovider=elevenlabs&elevenlabskey=YOUR_API_KEY&voice11=YOUR_VOICE_ID&elevenlabsmodel=eleven_multilingual_v2เลือก Fish Audio แล้วป้อนคีย์ API พร้อมรหัสเสียงตามต้องการ โมเดลเริ่มต้นคือ s2.1-pro-free. การตั้งค่า ตัวเลือกโมเดล และข้อจำกัดการเข้าถึงของเบราว์เซอร์.
?ttsprovider=speechify&speechifykey=YOUR_API_KEY&voicespeechify=henry&speechifymodel=simba-3.0 (ค่าเริ่มต้น) หรือ &speechifymodel=simba-3.2 สำหรับภาษาอังกฤษ&speechifyspeed=1.2 (ช่วง 0.5–3.0; ค่าปกติคือ 1.0)127.0.0.1.ttsquick ออกจาก URL ใน OBS หากมีรายการนี้แสดง เฉพาะเสียง System TTS ในเบราว์เซอร์ที่แสดงคู่มือนี้ ไม่ได้ทดสอบ OBS หน้าต่างแอป SSN แยกต่างหาก หรือผู้ให้บริการอย่าง Kokoro รายการว่างไม่ได้หมายความว่าผู้ให้บริการ TTS อื่นของ SSN ใช้ไม่ได้