دليل كامل لخيارات أصوات تحويل النص إلى كلام، وتوافق المتصفحات، والتقاط الصوت
يمكن لـ SSN قراءة نص الدردشة الملتقط من أي مصدر مدعوم؛ ولا يلزم أن تتضمن منصة الدردشة ميزة TTS خاصة بها. تنطق لوحة الإرساء أو التراكب المفعّل فيه TTS الرسائل التي يتلقاها، وفقًا لمرشحاته وإعدادات TTS. ابدأ بـ دليل الإعداد المختصر؛ تتناول هذه الصفحة خيارات الأصوات والإعدادات المتقدمة. قارن المزودين واستمع إلى العينات واطلع على الإعدادات.
dock.html?session=YOUR_SESSION&speech=en-US. يستخدم هذا System TTS افتراضيًا. لاستخدام موفّر مجاني في OBS، أضف أيضًا &ttsprovider=kokoro. أبقِ هذه الصفحة مفتوحة ومتصلة؛ يجب أن تنطق نسخة واحدة فقط.
| المزود | التكلفة | الالتقاط في OBS | الميزات |
|---|---|---|---|
| Kokoro TTS | مجاني | مباشر | ذكاء اصطناعي يعمل في المتصفح، بجودة ممتازة وعشرات الأصوات |
| Piper TTS | مجاني | مباشر | تحويل نص إلى كلام عصبي سريع يعمل في المتصفح ومناسب للمعالج المركزي |
| Kitten TTS | مجاني | مباشر | يعمل في المتصفح باستخدام نموذج ONNX خفيف |
| eSpeak-NG | مجاني | مباشر | تقليدي ومفتوح المصدر ويعمل على أي عتاد |
| المزود | التكلفة | الالتقاط في OBS | الميزات |
|---|---|---|---|
| OpenAI TTS | تُطبّق تكاليف API (أو مجانًا محليًا) | مباشر | جودة عالية؛ ويدعم أيضًا الخوادم المحلية عبر نقطة نهاية مخصصة |
| Google Cloud | تُطبّق تكاليف API | مباشر | جودة احترافية بلغات متعددة |
| ElevenLabs | تتوفر خطة مجانية | مباشر | تدريب أصوات مخصصة ونطق طبيعي |
| Speechify | تُطبّق تكاليف API | مباشر | أصوات عالية الجودة بلغات متعددة |
| تحويل النص إلى كلام من Gemini | تُطبّق تكاليف API | مباشر | واجهة API للغة التوليدية من Google |
هذه إمكانات معتادة وليست ضمانات لكل تثبيت. يستخدم OBS متصفحه المضمّن الخاص ولا يرث قائمة أصوات Chrome أو Edge المثبت. نجاح اختبار تطبيق SSN لا يختبر مصدر متصفح منفصلًا في OBS.
✓ تتوفر أصوات النظام في عمليات التثبيت المدعومة
أصوات من Google بالإضافة إلى أصوات النظام
✓ تتوفر أصوات النظام في عمليات التثبيت المدعومة
أصوات Microsoft بالإضافة إلى حزم TTS في Windows
⚠ دعم محدود
لغات النظام المحلية فقط
⚠ دعم محدود
يعتمد على Chromium؛ وتختلف الأصوات المتاحة حسب التثبيت
يشغّل موفّرو SSN المحليون الذين يعملون في المتصفح وموفّرو الصوت السحابيون الصوت المُنشأ عبر الصفحة:
بالنسبة إلى System TTS تحديدًا:
تنزيلات توجيه الصوت: VB-Audio Virtual Cable | Voicemeeter | Audio Router (قديم)
جرّب أولًا التقاط صوت المتصفح الذي ينطق عبر التقاط صوت التطبيق أو سطح المكتب في OBS، حيثما كان ذلك مدعومًا. طرق الكابل الافتراضي أدناه بدائل اختيارية؛ ولا تضيف دعم النطق إلى OBS.
اتبع التعليمات الواردة في دليل Microsoft الرسمي لتثبيت حزم اللغات.
| المعامل | الوصف | مثال |
|---|---|---|
| &speech | تفعيل TTS باستخدام رمز اللغة | &speech=en-US |
| &pitch | طبقة الصوت (من 0.1 إلى 2.0) | &pitch=1.2 |
| &volume | مستوى الصوت (من 0.0 إلى 1.0) | &volume=0.8 |
| &rate | معدل النطق (من 0.1 إلى 10.0) | &rate=1.5 |
| &voice | مطابقة جزئية لاسم الصوت | &voice=google |
| &ttsprovider | اختر الموفّر: kokoro, piper, kitten, espeak, openai, customtts, localtts, elevenlabs, google, speechify, gemini | &ttsprovider=customtts |
| المعامل | الوصف |
|---|---|
| &simpletts | عدم نطق «يقول» أو «يقول أحدهم» |
| &simpletts2 | عدم قراءة أسماء الدردشة إطلاقًا |
| &ttscommand | تفعيل أمر TTS مخصص (الافتراضي: !say) |
| &readevents | تضمين أحداث البث في TTS |
| &skipmessages=3 | قراءة كل رسالة ثالثة فقط |
?ttsprovider=kokoro&voicekokoro=af_bella&kokorospeed=1.2&voicekokoro=ef_dora للإسبانية أو &voicekokoro=pf_dora للبرتغالية البرازيلية. تغيير &speech= وحده لا يغيّر الصوت المحدد. تظل معرّفات الأصوات الإنجليزية الحالية تعمل.?ttsprovider=piper&pipervoice=en_US-hfc_female-medium&pipervoice=pt_BR-faber-medium أو &pipervoice=pt_BR-edresson-low&pipervoice=es_ES-davefx-medium أو &pipervoice=es_MX-ald-medium&piperspeed=1.0?ttsprovider=kitten&kittenvoice=expr-voice-4-f?ttsprovider=espeak&espeakvoice=en&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br&speech=es-ES&ttsprovider=espeak&espeakvoice=es&espeakspeed=175?speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium?speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br?speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium?speech=es-ES&ttsprovider=espeak&espeakvoice=es?ttsprovider=openai?ttsprovider=customtts أو ?ttsprovider=localtts لنقطة نهاية تستضيفها بنفسك&openaiendpoint=http://localhost:8880/v1/audio/speechlocalhost و 127.0.0.1 يعنيان الجهاز نفسه الذي يشغّل صفحة TTS. إذا كان OBS على جهاز مختلف عن خادم TTS، فاستخدم عنوان IP الخاص بجهاز الخادم على الشبكة المحلية بدلًا من ذلك.npm run local-tts-bridge على جهاز OBS ووجّه SSN إلى http://127.0.0.1:8124/v1/audio/speech{ model, input, voice, response_format, speed } ويدعم الصوت الثنائي وروابط الصوت في JSON والصوت بترميز base64 في JSON&voiceopenai=af_bella، السرعة: &openaispeed=1.0. استخدم اسم صوت يدعمه خادمك؛ تبدو أصوات Kokoro مثل af_bella، بينما قد تبدو أصوات openedai-speech أو الأصوات بنمط OpenAI مثل nova أو echo.?ttsprovider=google&ttskey=YOUR_API_KEY&voicegoogle=en-GB-Standard-A&googlelang=en-US?ttsprovider=gemini&geminikey=YOUR_API_KEY&geminimodel=gemini-2.5-flash-preview-tts&voicegemini=Kore، اللغة: &geminilang=th-TH&geministyle=Read aloud in a warm tone.?ttsprovider=elevenlabs&elevenlabskey=YOUR_API_KEY&voice11=YOUR_VOICE_ID&elevenlabsmodel=eleven_multilingual_v2اختر Fish Audio وأدخل مفتاح API، مع معرّف صوت اختياري. النموذج الافتراضي هو s2.1-pro-free. الإعداد وخيارات النماذج وقيود وصول المتصفح.
?ttsprovider=speechify&speechifykey=YOUR_API_KEY&voicespeechify=henry&speechifymodel=simba-3.0 (الافتراضي)، أو &speechifymodel=simba-3.2 للإنجليزية.&speechifyspeed=1.2 (النطاق من 0.5 إلى 3.0؛ والقيمة العادية 1.0).127.0.0.1.ttsquick من رابط OBS إن كانت موجودة.يعرض هذا أصوات System TTS في المتصفح الذي يعرض هذا الدليل فقط. لا يختبر ذلك OBS أو نافذة منفصلة لتطبيق SSN أو موفّرين مثل Kokoro. لا تعني القائمة الفارغة أن موفّري TTS الآخرين في SSN غير متاحين.