คู่มือตั้งค่า TTS

ฟังแชตของคุณในสามขั้นตอน เริ่มใช้ฟรีโดยไม่ต้องมีบัญชีหรือคีย์ API

1. เปิดการอ่านแชต

ยังไม่ได้เชื่อมแชตใช่ไหม? เริ่มที่นี่: ติดตั้ง SSN เพิ่มแหล่งข้อมูล แล้วเปิดแผงด็อก

เปิด ป๊อปอัปส่วนขยาย SSN หรือในแอปเดสก์ท็อปที่ แหล่งข้อมูลและการตั้งค่า (Sources and Settings).

ใน โอเวอร์เลย์แชตหลักและแผงด็อกควบคุม (Main chat overlay & control dock) ขยาย ข้อความ — การอ่านออกเสียง (Message — Text to Speech) เปิดสวิตช์ที่แสดงที่นี่:

ป๊อปอัปจริง: Message — Text to Speech โดยเปิด Enable TTS in dock
สวิตช์สีน้ำเงิน = เปิดการอ่านแชตแล้ว

2. เลือกเสียงฟรี

ในส่วนเดียวกัน เลื่อนไปที่ ผู้ให้บริการ TTS (TTS Service Provider) เลือก Piper TTS แล้วเลือกเสียง

ป๊อปอัปจริง: เลือก Piper TTS พร้อมเสียง English US Female HFC Medium
Piper ไม่ต้องมีบัญชีหรือคีย์ API เผื่อเวลาสำหรับการดาวน์โหลดเสียงครั้งแรก

ใช้ คัดลอกลิงก์ ข้าง โอเวอร์เลย์แชตหลักและแผงด็อกควบคุม (Main chat overlay & control dock) เพื่อรับลิงก์ที่อัปเดต

3. เล่นใน OBS

  1. เพิ่มแหล่งข้อมูล OBS แบบ แหล่งเบราว์เซอร์ (Browser Source) แล้ววางลิงก์นั้น
  2. เปิดใช้ ควบคุมเสียงผ่าน OBS (Control audio via OBS) ในคุณสมบัติ
  3. ส่งข้อความแชต ตรวจมาตรวัดเสียงของแหล่งข้อมูล แล้วบันทึกคลิปสั้น ๆ

อยากฟังด้วยตัวเอง? ใน Advanced Audio Properties ของ OBS ให้เลือก มอนิเตอร์และส่งออก (Monitor and Output) สำหรับแหล่งข้อมูลนั้น ให้มีเพียงหนึ่งหน้าที่อ่านแชต

ฟังเสียงฟรี

อยากได้เสียงแบบอื่น? เสียงทั้งสี่นี้ใช้ฟรี กดเล่นเพื่อเปรียบเทียบ

Piper

หญิงภาษาอังกฤษสหรัฐฯ (HFC) คุณภาพปานกลาง
en_US-hfc_female-medium

ดูการตั้งค่าและเสียง

Kokoro

Bella หญิงอเมริกัน ทดสอบด้วย CPU/WASM, q8
af_bella

ดูการตั้งค่าและเสียง

Kitten

เสียง 4 หญิง ใช้โมเดล nano v0.1 ที่มาพร้อมแอป
expr-voice-4-f

ดูการตั้งค่าและเสียง

eSpeak

ภาษาอังกฤษ เสียงสังเคราะห์ที่ใช้ทรัพยากรน้อย
en

ดูการตั้งค่าและเสียง

ตัวอย่างภาษาสเปนและโปรตุเกส

เลือกภาษาที่เหนือรายการเสียงในการตั้งค่า SSN แล้วใช้ ทดสอบ Piper มีเสียงสเปน เม็กซิโก บราซิล และโปรตุเกส ส่วน Kokoro เพิ่มเสียงสเปนสามเสียงและโปรตุเกสแบบบราซิลสามเสียง

Piper - สเปน (ประเทศสเปน)

DaveFX

Piper - โปรตุเกส (บราซิล)

Faber

Kokoro - โปรตุเกส (บราซิล)

Dora

สังเคราะห์เสียงภายในเครื่องฟรี พร้อมการดาวน์โหลดเริ่มต้น ตัวอย่างไม่รวมเวลาโหลด Piper เป็นจุดเริ่มต้นที่เบากว่า ส่วน Kokoro อาจช้าบน CPU ใช้ Piper หากเสียงพูดตามแชตไม่ทัน

ข้อความตัวอย่างและรายละเอียดการทดสอบ

ตัวอย่างภาษาอังกฤษทั้งสี่อ่านว่า: ยินดีต้อนรับสู่สตรีม! ขอบคุณที่มาร่วมกัน เราควรเล่นเกมอะไรต่อดี? ปิดการอ่านชื่อแล้ว

ตรวจสอบเมื่อ 7 กันยายน 2026 ด้วย OBS 32.2.2 บน Windows 11: ข้อความแชตเข้าถึงแผงด็อกจริง สร้างเสียงพูด ทำให้มาตรวัดแหล่งข้อมูลเบราว์เซอร์ขยับ และมีเสียงในไฟล์บันทึก Kokoro ใช้เวลานานกว่าอย่างเห็นได้ชัดกว่าจะเริ่มพูดในการทดสอบด้วย CPU นี้ คลิปเหล่านี้เป็นตัวอย่างเสียง ไม่รวมเวลารอ

TTS ของระบบแสดงห้าเสียงบนเครื่องนี้ แต่ไม่สร้างเสียงในไฟล์บันทึกจากแหล่งข้อมูลเบราว์เซอร์ ผลนี้เฉพาะกับการตั้งค่านี้ ควรทดสอบ URL สุดท้ายและไฟล์บันทึกเสมอ ไม่รวมเสียงคลาวด์เพราะไม่ได้ใช้ข้อมูลรับรองแบบชำระเงิน

ต้องการความช่วยเหลือ?

แพลตฟอร์มแชตของฉันรองรับ TTS ไหม?

หาก SSN รับแชตเป็นข้อความได้ ก็อ่านออกเสียงได้ YouTube, Twitch, TikTok และแหล่งข้อมูลอื่นใช้ฟีเจอร์เดียวกัน แพลตฟอร์มแชตไม่จำเป็นต้องรองรับ TTS เอง

ไม่มีเสียงพูด?

ตรวจสอบว่าแผงด็อกได้รับแชต แล้วตรวจสวิตช์ TTS ผู้ให้บริการ และตัวกรอง ใช้ลิงก์ที่เพิ่งคัดลอก รอให้ดาวน์โหลดโมเดลครั้งแรกเสร็จ

ทำงานใน Chrome/Edge แต่ไม่ทำงานใน OBS?

OBS มีเบราว์เซอร์และรายการเสียงแยกต่างหาก TTS ของระบบอาจไม่ทำงานในนั้น แม้มีรายชื่อเสียง ลอง Piper, Kokoro, Kitten หรือ eSpeak สายเสียงเสมือนไม่สามารถแก้กรณีที่ไม่มีเสียงพูดเกิดขึ้นได้

มาตรวัดขยับแต่ไฟล์บันทึกไม่มีเสียง?

ตรวจสอบการปิดเสียงและการกำหนดแทร็กบันทึกใน OBS ใช้ Monitor and Output หากต้องการฟังด้วย และหลีกเลี่ยงการเก็บเสียงมอนิเตอร์นั้นซ้ำอีกครั้ง คู่มือเสียง OBS.

ใช้แผงด็อก OBS หรือ Featured Chat แทนได้ไหม?

Custom Browser Dock ของ OBS เป็นแผงควบคุม ไม่ใช่แหล่งข้อมูลเบราว์เซอร์ในฉากที่ใช้ด้านบน สำหรับ Featured Chat ให้เปิด TTS ในตัวเลือกป๊อปอัปของโอเวอร์เลย์นั้นเองแล้วคัดลอกลิงก์ ให้มีเพียงหน้าเดียวที่พูดเพื่อป้องกันเสียงซ้ำ

เปรียบเทียบผู้ให้บริการทั้งหมด: ข้อกำหนด ค่าใช้จ่าย และข้อแลกเปลี่ยน

เริ่มด้วย Piper สำหรับเสียงภายในเครื่องฟรี หรือเปรียบเทียบ Kokoro หากชอบเสียงของมัน ลอง eSpeak เมื่อความรวดเร็วสำคัญกว่าความเหมือนเสียงจริง Kitten เป็นอีกตัวเลือกภาษาอังกฤษขนาดเล็ก ฟังก่อนตัดสินใจ

ผู้ให้บริการเหมาะสำหรับข้อแลกเปลี่ยนข้อกำหนด / ค่าใช้จ่าย
Kokoroเสียงภาษาอังกฤษ สเปน และโปรตุเกสแบบบราซิลใช้ CPU มากขึ้น เสียงครั้งแรกอาจเริ่มช้าฟรี ไม่ต้องมีคีย์ ดาวน์โหลดไฟล์โมเดล/เสียง ใช้ CPU หรือ WebGPU ที่รองรับ
Piperเสียงนิวรัลภายในเครื่อง มีตัวเลือกภาษาอังกฤษ สเปน และโปรตุเกสคุณภาพและการออกเสียงแตกต่างกันตามเสียงฟรี ไม่ต้องมีคีย์ ดาวน์โหลดโมเดลที่เลือก (HFC medium ประมาณ 63 MB) บวกไฟล์เอนจิน
Kittenโมเดลภาษาอังกฤษขนาดเล็ก มีเสียงให้เลือกแปดเสียงมีภาษาและรูปแบบเสียงน้อยกว่าฟรี ไม่ต้องมีคีย์ โมเดลที่มาพร้อมปัจจุบันประมาณ 24 MB บวกไฟล์เอนจิน/เสียง ใช้ CPU
eSpeakเบา หลายภาษา เริ่มต้นเร็วตั้งใจให้มีเสียงสังเคราะห์/คล้ายหุ่นยนต์ฟรี ไม่ต้องมีคีย์ โหลดไฟล์เอนจิน/ภาษาที่มาพร้อมแอป ไม่ต้องมีโมเดลนิวรัลหรือ GPU
TTS ของระบบใช้เสียงที่เบราว์เซอร์หรือแอปเดสก์ท็อปเปิดให้ใช้รายการเสียงและการเก็บเสียงใน OBS แตกต่างกัน บางเสียงต้องใช้อินเทอร์เน็ตไม่มีค่าผู้ให้บริการจาก SSN ต้องมีเสียงของระบบ/เบราว์เซอร์ที่ใช้งานได้ ทดสอบบนหน้าที่เล่นจริง
ElevenLabsรหัสเสียง การเลือกโมเดล และตัวควบคุมความคงที่/สไตล์อาจมีข้อจำกัดบัญชี ความล่าช้าเครือข่าย และค่า APIอินเทอร์เน็ต คีย์ API และรหัสเสียงที่เข้าถึงได้ ข้อความแชตส่งไปยังผู้ให้บริการ
Google Cloudเสียงที่มีชื่อ พร้อมตัวควบคุมภาษา อัตราการพูด และระดับเสียงสูงต่ำไม่ใช่ทุกเสียงที่รองรับทุกตัวควบคุมอินเทอร์เน็ต เปิด Cloud TTS API คีย์ API และเสียง/ภาษาที่ตรงกัน มีการคิดเงิน/โควตา
Geminiสไตล์เสียงและคำสั่งลักษณะการพูดแบบข้อความโมเดลพรีวิวและโควตาอาจเปลี่ยน ความล่าช้าแตกต่างกันไปอินเทอร์เน็ต คีย์ Gemini API และสิทธิ์เข้าถึงโมเดล TTS ที่เลือก ตรวจสอบข้อจำกัด/การเรียกเก็บเงินของบัญชี
Speechifyรหัสเสียงพร้อมตัวควบคุมความเร็ว ภาษา และโมเดลต้องมีสิทธิ์ API เสียงที่ใช้ได้ขึ้นอยู่กับบัญชีอินเทอร์เน็ตและคีย์ Speechify API มีเงื่อนไข/ข้อจำกัดการใช้ API
OpenAIเสียงที่มีชื่อ พร้อมตัวควบคุมโมเดลและรูปแบบต้องมีการเรียกเก็บเงิน API และอินเทอร์เน็ต การสมัครสมาชิกบัญชีแยกต่างหากคีย์ API ที่มีสิทธิ์ TTS ข้อความแชตจะส่งไปยังปลายทางที่กำหนด
กำหนดเอง / ภายในเครื่องใช้เซิร์ฟเวอร์เสียงที่เข้ากันได้ของคุณเองต้องตั้งค่ามากที่สุด: ปลายทาง โมเดล เสียง และการเข้าถึงจากเบราว์เซอร์ต้องสอดคล้องกันปลายทางเสียงพูดที่เข้ากันได้กับ OpenAI และเข้าถึงได้ พร้อมคีย์หากจำเป็น ค่าอุปกรณ์ภายในเครื่องหรือโฮสต์แตกต่างกันไป

ขนาดดาวน์โหลดด้านบนเป็นไฟล์โมเดล ไม่ใช่การใช้หน่วยความจำทั้งหมดหรือไฟล์ที่จำเป็นทั้งหมด ผู้ให้บริการภายในเครื่องใช้คอมพิวเตอร์ที่รันแผงด็อก/โอเวอร์เลย์ การใช้ครั้งแรกอาจช้ากว่าและ OBS มีแคชของตัวเอง ผู้ให้บริการคลาวด์ลดการประมวลผลภายในเครื่อง แต่ส่งข้อความออกจากอุปกรณ์

OBS: ผู้ให้บริการภายในเครื่องสี่รายด้านล่างผ่านการทดสอบบันทึกแหล่งข้อมูลเบราว์เซอร์แล้ว ผู้ให้บริการคลาวด์/กำหนดเองส่งเสียงกลับให้หน้าเว็บเล่น แต่ไม่ได้ทดสอบด้วยบัญชีจริงในการตรวจครั้งนี้ TTS ของระบบต้องทดสอบแยกแม้จะแสดงรายชื่อเสียง

การตั้งค่าผู้ให้บริการและชื่อเสียง

การตั้งค่าแอปเดสก์ท็อปจริงที่จับภาพจากโปรไฟล์ใหม่ เปิดผู้ให้บริการที่ต้องการ ช่องคีย์ API ตั้งใจเว้นว่างไว้ ตัวควบคุมเหล่านี้ตั้งค่าแผงด็อกหรือโอเวอร์เลย์ SSN ที่เลือก เลือกภาพหน้าจอเพื่อดูขนาดเต็ม

TTS ของระบบ

รายการภาษาว่างในโปรไฟล์ใหม่นี้ เสียงที่มีขึ้นอยู่กับเบราว์เซอร์/แอปและเสียงที่ติดตั้ง ไม่มีรายการเสียง SSN สากล

การตั้งค่าผู้ให้บริการ System TTS ของ SSN จริง
Kokoro

เลือกเสียงใน SSN โมเดลจะโหลดบนหน้าที่พูด มีเสียงอังกฤษแบบสหรัฐฯ/สหราชอาณาจักร สเปน และโปรตุเกสแบบบราซิล ใช้ตัวกรองภาษาเพื่อหาเสียง Test จะเล่นวลีสั้น ๆ ในภาษาที่เลือก หากต้องการใช้ CPU น้อยลง ให้ลอง Piper

การตั้งค่าผู้ให้บริการ Kokoro ของ SSN จริง
ชื่อเสียงและค่า URL
  • Heart (หญิงอเมริกัน) — af_heart
  • Alloy (หญิงอเมริกัน) — af_alloy
  • Aoede (หญิงอเมริกัน) — af_aoede
  • Bella (หญิงอเมริกัน) — af_bella
  • Jessica (หญิงอเมริกัน) — af_jessica
  • Kore (หญิงอเมริกัน) — af_kore
  • Nicole (หญิงอเมริกัน) — af_nicole
  • Nova (หญิงอเมริกัน) — af_nova
  • River (หญิงอเมริกัน) — af_river
  • Sarah (หญิงอเมริกัน) — af_sarah
  • Sky (หญิงอเมริกัน) — af_sky
  • Adam (ชายอเมริกัน) — am_adam
  • Echo (ชายอเมริกัน) — am_echo
  • Eric (ชายอเมริกัน) — am_eric
  • Fenrir (ชายอเมริกัน) — am_fenrir
  • Liam (ชายอเมริกัน) — am_liam
  • Michael (ชายอเมริกัน) — am_michael
  • Onyx (ชายอเมริกัน) — am_onyx
  • Puck (ชายอเมริกัน) — am_puck
  • Santa (ชายอเมริกัน) — am_santa
  • Emma (หญิงบริติช) — bf_emma
  • Isabella (หญิงบริติช) — bf_isabella
  • George (ชายบริติช) — bm_george
  • Lewis (ชายบริติช) — bm_lewis
  • Alice (หญิงบริติช) — bf_alice
  • Lily (หญิงบริติช) — bf_lily
  • Daniel (ชายบริติช) — bm_daniel
  • Fable (ชายบริติช) — bm_fable
  • Dora (สเปน) - ef_dora
  • Alex (สเปน) - em_alex
  • Santa (สเปน) - em_santa
  • Dora (โปรตุเกสแบบบราซิล) - pf_dora
  • Alex (โปรตุเกสแบบบราซิล) - pm_alex
  • Santa (โปรตุเกสแบบบราซิล) - pm_santa
Kitten

เสียงภาษาอังกฤษแปดเสียง: เสียงชายและหญิงหมายเลข 2, 3, 4 และ 5 ตัวอย่างใช้ Voice 4 (Female)

การตั้งค่าผู้ให้บริการ Kitten ของ SSN จริง
ชื่อเสียงและค่า URL
  • เสียง 2 (ชาย) — expr-voice-2-m
  • เสียง 2 (หญิง) — expr-voice-2-f
  • เสียง 3 (ชาย) — expr-voice-3-m
  • เสียง 3 (หญิง) — expr-voice-3-f
  • เสียง 4 (ชาย) — expr-voice-4-m
  • เสียง 4 (หญิง) — expr-voice-4-f
  • เสียง 5 (ชาย) — expr-voice-5-m
  • เสียง 5 (หญิง) — expr-voice-5-f
Piper

เลือกภาษาและโมเดลที่ตรงกัน ตัวอย่างใช้ HFC medium การตั้งค่าภาษาอย่างเดียวไม่ได้แปลเสียง

การตั้งค่าผู้ให้บริการ Piper ของ SSN จริง
ชื่อเสียงและค่า URL
  • หญิงภาษาอังกฤษสหรัฐฯ (HFC) - คุณภาพปานกลาง — en_US-hfc_female-medium
  • สเปนแบบสเปน (DaveFX) - คุณภาพปานกลาง — es_ES-davefx-medium
  • สเปนแบบเม็กซิโก (Ald) - คุณภาพปานกลาง — es_MX-ald-medium
  • โปรตุเกสแบบบราซิล (Faber) - คุณภาพปานกลาง — pt_BR-faber-medium
  • โปรตุเกสแบบบราซิล (Edresson) - คุณภาพต่ำ — pt_BR-edresson-low
  • โปรตุเกสแบบโปรตุเกส (Tugao) - คุณภาพปานกลาง — pt_PT-tugão-medium
eSpeak

เลือกเสียงตามภาษาและปรับอัตราการพูดได้ตามต้องการ เอนจินนี้ตั้งใจให้เสียงคล้ายหุ่นยนต์

การตั้งค่าผู้ให้บริการ eSpeak ของ SSN จริง
ชื่อเสียงและค่า URL
  • อังกฤษ — en
  • สเปน — es
  • โปรตุเกสแบบบราซิล — pt-br
  • โปรตุเกสแบบโปรตุเกส — pt-pt
ElevenLabs

ป้อนคีย์ API แล้วใช้ List My Available Voices เพื่อหารหัสเสียงที่บัญชีของคุณใช้ได้ เอกสารอ้างอิงผู้ให้บริการ.

การตั้งค่าผู้ให้บริการ ElevenLabs ของ SSN จริง
Google Cloud

ป้อนคีย์ Google Cloud TTS API และชื่อเสียงให้ตรงทุกตัว พร้อมภาษาที่ตรงกัน ชื่อเสียงและตัวควบคุมที่รองรับ.

การตั้งค่าผู้ให้บริการ Google Cloud ของ SSN จริง
Gemini

เลือกโมเดล TTS และเสียงที่รองรับ คำสั่งสไตล์เปลี่ยนลักษณะการพูด นี่คือการตั้งค่า Gemini API ซึ่งแยกจาก Google Cloud TTS ตัวอย่างเสียงและข้อกำหนด.

การตั้งค่าผู้ให้บริการ Gemini ของ SSN จริง
Fish Audio

เลือก Fish Audio ในเมนูผู้ให้บริการ TTS ของแผงด็อกแชต โอเวอร์เลย์ข้อความเด่น หน้า TTS หรือ Flow Actions ป้อน คีย์ Fish Audio API แล้วใช้ปุ่ม Test TTS ที่มีอยู่ ช่อง Voice ID เป็นตัวเลือกเสริมสำหรับเลือกเสียงจาก Fish Audio ให้คัดลอกรหัสโมเดลเสียง ไม่ใช่ชื่อหรือ URL หน้าเสียง ปล่อยว่างเพื่อใช้เสียงเริ่มต้นของบริการ

ตัวเลือกขั้นสูงมีโมเดลและอัตราการพูด (0.5–2) ค่าเริ่มต้นของ SSN คือ s2.1-pro-free ความพร้อมของแพ็กเกจฟรีและเงื่อนไขการใช้งานอย่างเป็นธรรมกำหนดโดย Fish Audio โมเดลเสียเงินต้องมีเครดิตในบัญชี SSN จะไม่ลองคำขอฟรีที่ล้มเหลวซ้ำด้วยโมเดลเสียเงิน ใช้ More TTS options สำหรับระดับเสียงฝั่งผู้ชม ข้อความจะส่งไปยัง Fish Audio และบริการเป็นผู้ตรวจจับภาษา

การตั้งค่า OBS / เบราว์เซอร์: เรียกใช้ บริดจ์ TTS ภายในเครื่องในโหมด Fish บนคอมพิวเตอร์ OBS ตั้งตัวแปร environment SSN_TTS_TARGET_BEARER เป็นคีย์ Fish API ของคุณ แล้วเริ่ม node scripts/local-tts-bridge.cjs --mode fish ในแผง Fish Audio ให้ตั้ง URL บริดจ์สำหรับ OBS / เบราว์เซอร์ เป็น http://127.0.0.1:8124/v1/audio/speech วางโทเค็นบริดจ์ภายในเครื่องที่แสดงในเทอร์มินัลลงในช่องของป๊อปอัป คีย์ API โทเค็นจะเปลี่ยนเมื่อเริ่มใหม่ เว้นแต่จะตั้ง SSN_TTS_BRIDGE_TOKEN เป็นค่าลับสุ่มที่ยาว เก็บลิงก์โอเวอร์เลย์ที่มีโทเค็นเป็นส่วนตัว เปิดบริดจ์ไว้ ทดสอบเสียง และใช้ URL โอเวอร์เลย์ที่สร้างให้ใน OBS เปิด Control audio via OBS ในการตั้งค่าแหล่งข้อมูลเบราว์เซอร์หากต้องการเสียงในมิกเซอร์ OBS คำขอ Fish โดยตรงจากหน้าเบราว์เซอร์ที่โฮสต์ไว้ไม่มีสิทธิ์ CORS บริดจ์เป็นตัวส่งการตอบกลับเสียงที่เบราว์เซอร์เข้าถึงได้

เมื่อใช้บริดจ์ ให้เพิ่ม &fishendpoint=http%3A%2F%2F127.0.0.1%3A8124%2Fv1%2Faudio%2Fspeech ใน URL และไม่ต้องใส่ fishkey เมื่อบริดจ์เก็บคีย์ไว้

พารามิเตอร์ URL: &ttsprovider=fish&fishkey=YOUR_KEY&voicefish=VOICE_ID&fishmodel=s2.1-pro-free&fishspeed=1 เปิด TTS ด้วยตัวควบคุมตามปกติ เก็บ URL ที่สร้างขึ้นซึ่งมีคีย์เป็นส่วนตัว ตัวเลือกเสียงแทนที่ของแอ็กชัน Speak Text ใน Event Flow รับรหัสเสียง Fish ได้เมื่อหน้าที่รับใช้ Fish Audio

เอกสารอ้างอิง Fish Audio API · ประกาศและเงื่อนไขโมเดลฟรี

Speechify

คู่มือ Speechify ทีละขั้นตอน: คีย์ API เสียง ความเร็ว และระดับเสียงฝั่งผู้ชม

ป้อนคีย์ API และรหัสเสียงจากบัญชี Speechify API ของคุณ การตั้งค่าผู้ให้บริการ.

การตั้งค่าผู้ให้บริการ Speechify ของ SSN จริง
OpenAI

เลือกเสียง/โมเดลที่รองรับแล้วป้อนคีย์ API การสมัครสมาชิก ChatGPT ไม่ได้ให้เครดิต API ใช้ปลายทางเริ่มต้นสำหรับ OpenAI

การตั้งค่าผู้ให้บริการ OpenAI ของ SSN จริง
TTS แบบกำหนดเอง / ภายในเครื่อง

ตัวเลือกนี้ใช้ตัวควบคุมที่เข้ากันได้กับ OpenAI ร่วมกัน จึงยังมีหัวข้อ OpenAI ป้อนปลายทางเซิร์ฟเวอร์และเสียง/โมเดลที่รองรับ การยืนยันตัวตนขึ้นอยู่กับเซิร์ฟเวอร์ ดู คู่มือเซิร์ฟเวอร์ภายในเครื่อง.

การตั้งค่าผู้ให้บริการ Custom / Local TTS ของ SSN จริง
ขั้นสูง: แก้ไข URL ของ TTS ด้วยตนเอง

ตัวเลือกที่เหมาะกับการทดสอบครั้งแรก:

dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kokoro
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=piper
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kitten

สำหรับภาษาโปรตุเกสหรือสเปน ให้เริ่มจากหนึ่งในตัวเลือกเหล่านี้แทน:

dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium
dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=espeak&espeakvoice=es

เอกสารอ้างอิง TTS ฉบับเต็ม · คู่มือเซิร์ฟเวอร์ TTS ภายในเครื่อง

ขั้นสูง: เรียกใช้เซิร์ฟเวอร์ TTS ภายในเครื่องเอง

เซิร์ฟเวอร์ TTS ภายในเครื่องมีประโยชน์เมื่อต้องการเสียงส่วนตัว โมเดลเสียงเฉพาะ หรือเซิร์ฟเวอร์ เช่น Kokoro-FastAPI หรือ openedai-speech หน้าที่เล่น TTS ต้องเข้าถึงปลายทางได้

แผนภาพแสดงแหล่งข้อมูลเบราว์เซอร์ใน OBS ส่งคำขอ TTS ผ่านบริดจ์ TTS ภายในเครื่องของ Social Stream Ninja ไปยังเซิร์ฟเวอร์ TTS
สำหรับ OBS บริดจ์ภายในเครื่องมักทำงานดีที่สุดเมื่ออยู่บนคอมพิวเตอร์เครื่องเดียวกับ OBS
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=customtts&openaiendpoint=http://127.0.0.1:8124/v1/audio/speech&voiceopenai=af_bella

localhost หมายถึงคอมพิวเตอร์ที่รันหน้าเว็บ หากเซิร์ฟเวอร์ TTS อยู่อีกเครื่อง ให้ใช้ IP ภายใน LAN ของเครื่องนั้นหรือรันบริดจ์บนคอมพิวเตอร์ OBS