คู่มือ TTS ของ Social Stream Ninja

คู่มือฉบับเต็มเกี่ยวกับตัวเลือกเสียงแปลงข้อความเป็นเสียงพูด ความเข้ากันได้ของเบราว์เซอร์ และการเก็บเสียง

ไทย

ภาพรวม

SSN อ่านข้อความแชตที่เก็บจากแหล่งข้อมูลที่รองรับใดก็ได้ แพลตฟอร์มแชตไม่ต้องมีฟีเจอร์ TTS ของตัวเอง แผงด็อกหรือโอเวอร์เลย์ที่เปิด TTS อ่านข้อความที่รับมาตามตัวกรองและการตั้งค่า TTS เริ่มจาก คู่มือตั้งค่าแบบสั้น หน้านี้ครอบคลุมตัวเลือกเสียงและการตั้งค่าขั้นสูง เปรียบเทียบผู้ให้บริการ ฟังตัวอย่าง และดูการตั้งค่า

เริ่มอย่างรวดเร็ว: ใช้ dock.html?session=YOUR_SESSION&speech=en-US ค่าเริ่มต้นคือ System TTS หากต้องการผู้ให้บริการฟรีสำหรับ OBS ให้เพิ่ม &ttsprovider=kokoro เปิดหน้านี้และเชื่อมต่อไว้ ควรมีเพียงหน้าเดียวที่พูด

ใช้ TTS ที่ใดบ้าง?

TTS ของระบบไม่ใช่ TTS ฟรีทุกชนิด:
  • เสียงระบบขึ้นอยู่กับเบราว์เซอร์และระบบปฏิบัติการ OBS อาจไม่มีเสียงที่ใช้ได้ แม้ Chrome/Edge จะทำงาน
  • การไม่มีเสียงให้ใช้ต่างจากการมีเสียงพูดอยู่นอกการเก็บเสียงของ OBS การกำหนดเส้นทางเสียงแก้ปัญหาการไม่รองรับเสียงพูดไม่ได้
  • ผู้ให้บริการฟรี เช่น Kokoro, Piper, Kitten และ eSpeak สร้างเสียงผ่านหน้าเว็บแทน ไม่ต้องเสียเงินเพื่อใช้ TTS ใน OBS
  • ตรวจสอบว่ามีเสียงให้ใช้ก่อน แล้วค่อยตรวจการเก็บเสียง

ตัวเลือกผู้ให้บริการ TTS

TTS ของระบบ (ฟรี)

ตัวเลือก TTS ภายในเครื่อง / ฟรี (ไม่ต้องใช้คีย์ API)

ต้องการ AI TTS ภายในเครื่องทั้งหมด? Social Stream Ninja มีเสียง AI คุณภาพสูงหลายเสียงในตัวที่ทำงานในเบราว์เซอร์ ไม่ต้องมีคีย์ API คลาวด์ หรือการติดตั้งเพิ่ม ดู คู่มือ AI TTS ในเครื่อง สำหรับคำแนะนำการตั้งค่าและตัวเลือกเซิร์ฟเวอร์ที่โฮสต์เอง
ผู้ให้บริการ ค่าใช้จ่าย การเก็บเสียงใน OBS ฟีเจอร์
Kokoro TTS ฟรี โดยตรง AI ในเบราว์เซอร์ คุณภาพยอดเยี่ยม มีเสียงหลายสิบแบบ
Piper TTS ฟรี โดยตรง TTS นิวรัลในเบราว์เซอร์ รวดเร็วและเหมาะกับ CPU
Kitten TTS ฟรี โดยตรง โมเดล ONNX ขนาดเล็กในเบราว์เซอร์
eSpeak-NG ฟรี โดยตรง โอเพนซอร์สแบบดั้งเดิม ใช้ได้กับฮาร์ดแวร์ทุกแบบ

ตัวเลือก TTS พรีเมียม / คลาวด์ (เสียงเบราว์เซอร์โดยตรง)

ผู้ให้บริการ ค่าใช้จ่าย การเก็บเสียงใน OBS ฟีเจอร์
OpenAI TTS มีค่า API (หรือใช้ฟรีภายในเครื่อง) โดยตรง คุณภาพสูง รองรับเซิร์ฟเวอร์ภายในเครื่องผ่านปลายทางกำหนดเองด้วย
Google Cloud มีค่า API โดยตรง คุณภาพระดับมืออาชีพ หลายภาษา
ElevenLabs มีแพ็กเกจฟรี โดยตรง ฝึกเสียงกำหนดเอง เสียงเป็นธรรมชาติ
Speechify มีค่า API โดยตรง เสียงคุณภาพสูง หลายภาษา
Gemini TTS มีค่า API โดยตรง Generative Language API ของ Google

ความพร้อมของเสียงระบบ

สิ่งเหล่านี้คือความสามารถทั่วไป ไม่ใช่ข้อรับประกันสำหรับทุกการติดตั้ง OBS ใช้เบราว์เซอร์ฝังของตัวเองและไม่ได้รับรายการเสียงจาก Chrome/Edge ที่ติดตั้งอยู่ การทดสอบสำเร็จในแอป SSN ไม่ได้ทดสอบแหล่งข้อมูลเบราว์เซอร์แยกใน OBS

Chrome

✓ มีเสียงระบบให้ใช้ในการติดตั้งที่รองรับ

เสียงจาก Google + เสียงระบบ

Edge

✓ มีเสียงระบบให้ใช้ในการติดตั้งที่รองรับ

เสียง Microsoft + แพ็ก Windows TTS

Firefox

⚠ รองรับจำกัด

เฉพาะภาษาระบบภายในเครื่อง

Opera

⚠ รองรับจำกัด

ใช้ Chromium เสียงที่มีแตกต่างกันตามการติดตั้ง

ข้อจำกัดเบราว์เซอร์:

วิธีเก็บเสียง Windows TTS สำหรับ OBS

เสียงผ่านหน้าเว็บ: ผู้ให้บริการฟรีภายในเครื่องและคลาวด์

ผู้ให้บริการภายในเครื่องแบบเบราว์เซอร์และผู้ให้บริการเสียงคลาวด์ของ SSN เล่นเสียงที่สร้างผ่านหน้าเว็บ:

วิธีเก็บเสียง TTS ของระบบ

สำคัญ: ยืนยันก่อนว่า System TTS สร้างเสียงพูดได้ เบราว์เซอร์ฝังของ OBS อาจไม่มีเสียงระบบที่ใช้ได้ หากไม่สร้างเสียง การเปลี่ยนเส้นทางเสียงจะไม่ช่วย เลือกผู้ให้บริการอื่น หรือสร้างเสียงในเบราว์เซอร์ที่รองรับแล้วเก็บเสียงจากเบราว์เซอร์นั้น

สำหรับ System TTS โดยเฉพาะ:

ดาวน์โหลดเครื่องมือกำหนดเส้นทาง: VB-Audio Virtual Cable | Voicemeeter | Audio Router (รุ่นเก่า)

ลองเก็บเสียงเบราว์เซอร์ที่กำลังพูดด้วยการเก็บเสียงแอปหรือเดสก์ท็อปของ OBS ก่อนในระบบที่รองรับ วิธีสายเสียงเสมือนด้านล่างเป็นทางเลือกเสริม ไม่ได้เพิ่มการรองรับเสียงพูดให้ OBS

วิธีที่ 1: เส้นทางเสียงเริ่มต้นด้วยสายเสียงเสมือน

1. Set VB-Audio Virtual Cable as Windows default output - Sound Settings > Output > CABLE Input 2. OBS: - Add Audio Input Capture - Source: CABLE Output - Monitor: Monitor and Output, or Monitor Only if another source handles stream output

วิธีที่ 2: กำหนดเส้นทางเสียงแอปใน Windows 10

1. Sound Settings > App volume and device preferences 2. Find browser in list 3. Output: CABLE Input 4. OBS setup same as Method 1

วิธีที่ 3: กำหนดเส้นทางเสียงแอปใน Windows 11

1. Settings > System > Sound > Volume Mixer 2. Locate browser 3. Output: CABLE Input 4. OBS setup same as Method 1

วิธีที่ 4: ซอฟต์แวร์ Audio Router

1. Install Audio Router 2. Route browser to CABLE Input 3. OBS setup same as Method 1

วิธีที่ 5: Voicemeeter (ขั้นสูง)

1. Install Voicemeeter 2. Set as Windows default output 3. Route: - Hardware out > speakers - Virtual out > OBS 4. OBS captures Voicemeeter output

ทดสอบการตั้งค่าของคุณ

1. Play TTS 2. Check OBS meter 3. Verify system audio 4. Adjust levels if needed
ทางเลือก: ใช้ผู้ให้บริการฟรีในตัว เช่น Kokoro, Piper, Kitten หรือ eSpeak ผู้ให้บริการคลาวด์ หรือเซิร์ฟเวอร์ TTS ที่โฮสต์เอง

ติดตั้งแพ็กภาษาเพิ่มเติม

Windows 11

  1. ไปที่ Start > Settings > Time & Language > Speech
  2. ใน จัดการเสียง (Manage Voices) คลิก เพิ่มเสียง (Add Voices)
  3. เลือกภาษาที่ต้องการแล้วคลิก เพิ่ม
  4. เริ่มเบราว์เซอร์ใหม่เพื่อรีเฟรชเสียงที่มี

Windows 10

ทำตามคำแนะนำใน คู่มืออย่างเป็นทางการของ Microsoft สำหรับติดตั้งแพ็กภาษา

เคล็ดลับ: เสียงจากภายนอกบางเสียงอาจไม่ปรากฏในเบราว์เซอร์เพราะปัญหาความเข้ากันได้ Firefox มักแสดงเสียงระบบมากกว่าเบราว์เซอร์ที่ใช้ Chromium

พารามิเตอร์ URL สำหรับตั้งค่า TTS

พารามิเตอร์พื้นฐาน

พารามิเตอร์ คำอธิบาย ตัวอย่าง
&speech เปิด TTS พร้อมรหัสภาษา &speech=en-US
&pitch ระดับเสียงสูงต่ำ (0.1–2.0) &pitch=1.2
&volume ระดับความดัง (0.0–1.0) &volume=0.8
&rate อัตราการพูด (0.1–10.0) &rate=1.5
&voice จับคู่บางส่วนของชื่อเสียง &voice=google
&ttsprovider เลือกผู้ให้บริการ: kokoro, piper, kitten, espeak, openai, customtts, localtts, elevenlabs, google, speechify, gemini &ttsprovider=customtts

พารามิเตอร์ขั้นสูง

พารามิเตอร์ คำอธิบาย
&simpletts ไม่พูดคำว่า "says" หรือ "someone says"
&simpletts2 ไม่อ่านชื่อผู้แชตเลย
&ttscommand เปิดคำสั่ง TTS กำหนดเอง (ค่าเริ่มต้น: !say)
&readevents รวมอีเวนต์สตรีมใน TTS
&skipmessages=3 อ่านทุกข้อความที่ 3 เท่านั้น

การตั้งค่าผู้ให้บริการ TTS

Kokoro TTS (ฟรี มีในตัว)

Piper TTS (ฟรี มีในตัว)

Kitten TTS (ฟรี มีในตัว)

eSpeak-NG (ฟรี มีในตัว)

ตัวอย่าง TTS ภาษาโปรตุเกสและสเปน

OpenAI / TTS จากเซิร์ฟเวอร์ภายในเครื่อง

Google Cloud TTS

Gemini TTS

ElevenLabs TTS

Fish Audio TTS

เลือก Fish Audio แล้วป้อนคีย์ API พร้อมรหัสเสียงตามต้องการ โมเดลเริ่มต้นคือ s2.1-pro-free. การตั้งค่า ตัวเลือกโมเดล และข้อจำกัดการเข้าถึงของเบราว์เซอร์.

Speechify TTS

การแก้ปัญหา

ปัญหาที่พบบ่อย

แนวทางแนะนำ

ตรวจสอบเสียงระบบของเบราว์เซอร์นี้

รายการนี้แสดง เฉพาะเสียง System TTS ในเบราว์เซอร์ที่แสดงคู่มือนี้ ไม่ได้ทดสอบ OBS หน้าต่างแอป SSN แยกต่างหาก หรือผู้ให้บริการอย่าง Kokoro รายการว่างไม่ได้หมายความว่าผู้ให้บริการ TTS อื่นของ SSN ใช้ไม่ได้