Посібник із налаштування TTS

Почуйте свій чат за три кроки. Почніть безкоштовно, без облікового запису чи API-ключа.

1. Увімкніть читання чату

Чат ще не підключено? Почніть тут: установіть SSN, додайте джерело й відкрийте док.

Відкрийте спливне вікно розширення SSN або в настільному застосунку «Джерела й налаштування».

У розділі Основний оверлей чату й док керування (Main chat overlay & control dock), розгорніть Повідомлення — озвучення тексту (Message — Text to Speech). Увімкніть показаний тут перемикач:

Справжнє спливне вікно: Message — Text to Speech з увімкненим Enable TTS in dock
Синій перемикач = читання чату ввімкнено.

2. Виберіть безкоштовний голос

У тому самому розділі прокрутіть до Постачальник служби TTS (TTS Service Provider). Виберіть Piper TTS, а потім голос.

Справжнє спливне вікно: вибрано Piper TTS із голосом English US Female HFC Medium
Piper не потребує облікового запису чи API-ключа. Дайте час на перше завантаження голосу.

Використовуйте скопіювати посилання біля Основний оверлей чату й док керування (Main chat overlay & control dock) , щоб отримати оновлене посилання.

3. Відтворіть його в OBS

  1. Додайте в OBS Джерело браузера (Browser Source) і вставте це посилання.
  2. Увімкнути Керувати звуком через OBS (Control audio via OBS) у його властивостях.
  3. Надішліть повідомлення чату. Перевірте індикатор звуку джерела, а потім зробіть короткий запис.

Хочете чути самі? У Advanced Audio Properties OBS виберіть Моніторинг і виведення (Monitor and Output) для цього джерела. Залишайте лише одну копію для читання чату.

Послухайте безкоштовні голоси

Хочете інше звучання? Ці чотири голоси безкоштовні. Натисніть відтворення для порівняння.

Piper

Англійська США, жіночий (HFC), середня якість.
en_US-hfc_female-medium

Переглянути налаштування й голоси

Kokoro

Bella, американський жіночий. Перевірено на CPU/WASM, q8.
af_bella

Переглянути налаштування й голоси

Kitten

Голос 4, жіночий. Вбудована модель nano v0.1.
expr-voice-4-f

Переглянути налаштування й голоси

eSpeak

Англійська. Синтетичний голос із малим споживанням ресурсів.
en

Переглянути налаштування й голоси

Іспанські й португальські зразки

Виберіть мову над списком голосів у налаштуваннях SSN, а потім використовуйте Перевірка. Piper пропонує Іспанію, Мексику, Бразилію та Португалію; Kokoro додає три іспанські й три бразильські португальські голоси.

Piper — іспанська (Іспанія)

DaveFX

Kokoro — іспанська

Dora

Piper — португальська (Бразилія)

Faber

Kokoro — португальська (Бразилія)

Dora

Безкоштовний локальний синтез із початковим завантаженням. Зразки не включають час завантаження. Piper — легший початковий варіант; Kokoro може бути повільним на CPU. Використовуйте Piper, якщо озвучення відстає від чату.

Текст зразків і подробиці перевірки

Чотири англійські зразки читають: Ласкаво просимо на стрім! Дякуємо, що приєдналися. У яку гру зіграти далі? Читання імен вимкнено.

Перевірено 7 вересня 2026 року в OBS 32.2.2 на Windows 11: повідомлення чату надійшло до справжнього дока, згенерувало мовлення, активувало індикатор браузерного джерела й потрапило в запис. У цьому тесті на CPU Kokoro починав говорити помітно довше. Ці кліпи демонструють голос, а не час очікування.

Системний TTS на цьому комп’ютері надавав п’ять голосів, але не створював звуку в записі браузерного джерела. Цей результат стосується конкретного налаштування; завжди перевіряйте кінцевий URL і запис. Хмарні голоси не включені, оскільки платні облікові дані не використовувалися.

Потрібна допомога?

Чи підтримує моя платформа чату TTS?

Якщо SSN отримує чат як текст, він може читати його вголос. YouTube, Twitch, TikTok та інші джерела використовують ту саму функцію. Вашій платформі чату не потрібна власна підтримка TTS.

Немає мовлення?

Перевірте, що док отримує чат, а потім перемикач TTS, постачальника й фільтри. Використовуйте щойно скопійоване посилання. Дочекайтеся завершення першого завантаження моделі.

Працює в Chrome/Edge, але не в OBS?

OBS має окремий браузер і список голосів. Системний TTS може там не працювати, навіть якщо голоси перелічені. Спробуйте Piper, Kokoro, Kitten або eSpeak. Віртуальний аудіокабель не виправить відсутність мовлення.

Індикатор рухається, але запис беззвучний?

Перевірте вимкнення звуку й призначення доріжок запису в OBS. Використовуйте Monitor and Output, якщо також хочете чути звук; уникайте повторного захоплення цього моніторингового виходу. Посібник зі звуку OBS.

Чи можна натомість використовувати док OBS або Featured Chat?

OBS Custom Browser Dock — це панель керування, а не браузерне джерело сцени, використане вище. Для Featured Chat увімкніть TTS у власних параметрах цього оверлею в спливному вікні й скопіюйте посилання. Залишайте лише одну сторінку для озвучення, щоб уникнути подвійних голосів.

Порівняйте всіх постачальників: вимоги, вартість і компроміси

Почніть із Piper для безкоштовного локального голосу або порівняйте Kokoro, якщо подобається його звучання. Спробуйте eSpeak, коли швидкість відгуку важливіша за реалістичність. Kitten — ще один компактний англійський варіант. Послухайте перед вибором.

ПостачальникПідходить дляКомпромісВимоги / вартість
KokoroАнглійські, іспанські й бразильські португальські голоси.Більше роботи CPU; перше озвучення може бути повільним.Безкоштовно, без ключа. Завантажує ресурси моделі/голосу; CPU або підтримуваний WebGPU.
PiperЛокальні нейронні голоси; англійські, іспанські та португальські варіанти.Якість і вимова залежать від голосу.Безкоштовно, без ключа. Завантажує вибрану модель (HFC medium: приблизно 63 МБ) і файли рушія.
KittenКомпактна англійська модель, вісім голосів.Менше мов і голосових стилів.Безкоштовно, без ключа. Поточна вбудована модель: приблизно 24 МБ плюс файли рушія/голосів; CPU.
eSpeakЛегкий, багато мов, швидкий запуск.Навмисно синтетичне/роботизоване звучання.Безкоштовно, без ключа. Завантажує вбудовані файли рушія/мов; нейронна модель або GPU не потрібні.
Системне озвученняВикористовує голоси, які надає браузер або настільний застосунок.Список голосів і захоплення OBS різняться; деяким голосам потрібен Інтернет.Без плати постачальнику SSN. Потрібен робочий системний/браузерний голос; перевірте на фактичній сторінці відтворення.
ElevenLabsID голосів, вибір моделі та керування стабільністю/стилем.Можуть застосовуватися обмеження облікового запису, мережеві затримки й плата за API.Інтернет, API-ключ і доступний ID голосу. Текст чату надходить постачальнику.
Google CloudІменовані голоси й керування мовою, швидкістю та висотою тону.Не кожен голос підтримує всі елементи керування.Інтернет, увімкнений Cloud TTS API, API-ключ і відповідні голос/мова. Застосовуються оплата/квота.
GeminiГолосові стилі й письмові інструкції манери мовлення.Попередні моделі й квоти можуть змінюватися; затримка різна.Інтернет, API-ключ Gemini та доступ до вибраної моделі TTS. Перевірте ліміти/оплату облікового запису.
SpeechifyID голосу з керуванням швидкістю, мовою й моделлю.Потрібен доступ до API; доступні голоси залежать від облікового запису.Інтернет і API-ключ Speechify. Застосовуються умови/ліміти використання API.
OpenAIІменовані голоси з керуванням моделлю й форматом.Потрібні оплата API й Інтернет; підписка облікового запису окрема.API-ключ із доступом до TTS. Текст чату надсилається на налаштовану кінцеву точку.
Власний / локальнийВикористовуйте власний сумісний голосовий сервер.Найбільше налаштувань: кінцева точка, модель, голос і браузерний доступ мають узгоджуватися.Доступна кінцева точка мовлення, сумісна з OpenAI; ключ за потреби. Вартість локального обладнання або хостингу різна.

Наведені вище розміри завантаження — це файли моделей, а не загальне споживання пам’яті чи всі потрібні ресурси. Локальні постачальники використовують комп’ютер, де працює док/оверлей; перше використання може бути повільнішим, а OBS має власний кеш. Хмарні постачальники заощаджують локальні обчислення, але надсилають текст за межі пристрою.

OBS: чотири локальні постачальники нижче пройшли перевірки запису браузерного джерела. Хмарні/власні постачальники повертають аудіо для відтворення сторінкою, але в цьому огляді не перевірялися з живими обліковими записами. Системний TTS потребує окремої перевірки, навіть якщо показує голоси.

Налаштування постачальників і назви голосів

Справжні налаштування настільного застосунку, зняті в новому профілі. Відкрийте потрібного постачальника; поля API-ключів навмисно порожні. Ці елементи налаштовують вибраний док або оверлей SSN. Натисніть знімок екрана, щоб побачити повний розмір.

Системне озвучення

У цьому новому профілі список мов порожній. Доступні голоси залежать від браузера/застосунку та встановлених голосів; універсального списку голосів SSN немає.

Справжні налаштування постачальника System TTS у SSN
Kokoro

Виберіть голос у SSN; модель завантажується на сторінці, що озвучує. Вибір включає англійську США/Великої Британії, іспанську й бразильську португальську. Шукайте голоси фільтром мови; Test відтворює коротку фразу вибраною мовою. Для меншого навантаження CPU спробуйте Piper.

Справжні налаштування постачальника Kokoro у SSN
Назви голосів і значення URL
  • Heart (американський жіночий) — af_heart
  • Alloy (американський жіночий) — af_alloy
  • Aoede (американський жіночий) — af_aoede
  • Bella (американський жіночий) — af_bella
  • Jessica (американський жіночий) — af_jessica
  • Kore (американський жіночий) — af_kore
  • Nicole (американський жіночий) — af_nicole
  • Nova (американський жіночий) — af_nova
  • River (американський жіночий) — af_river
  • Sarah (американський жіночий) — af_sarah
  • Sky (американський жіночий) — af_sky
  • Adam (американський чоловічий) — am_adam
  • Echo (американський чоловічий) — am_echo
  • Eric (американський чоловічий) — am_eric
  • Fenrir (американський чоловічий) — am_fenrir
  • Liam (американський чоловічий) — am_liam
  • Michael (американський чоловічий) — am_michael
  • Onyx (американський чоловічий) — am_onyx
  • Puck (американський чоловічий) — am_puck
  • Santa (американський чоловічий) — am_santa
  • Emma (британський жіночий) — bf_emma
  • Isabella (британський жіночий) — bf_isabella
  • George (британський чоловічий) — bm_george
  • Lewis (британський чоловічий) — bm_lewis
  • Alice (британський жіночий) — bf_alice
  • Lily (британський жіночий) — bf_lily
  • Daniel (британський чоловічий) — bm_daniel
  • Fable (британський чоловічий) — bm_fable
  • Dora (іспанська) - ef_dora
  • Alex (іспанська) - em_alex
  • Santa (іспанська) - em_santa
  • Dora (бразильська португальська) - pf_dora
  • Alex (бразильська португальська) - pm_alex
  • Santa (бразильська португальська) - pm_santa
Kitten

Вісім англійських голосів: чоловічі й жіночі варіанти з номерами 2, 3, 4 і 5. Зразок використовує Voice 4 (Female).

Справжні налаштування постачальника Kitten у SSN
Назви голосів і значення URL
  • Голос 2 (чоловічий) — expr-voice-2-m
  • Голос 2 (жіночий) — expr-voice-2-f
  • Голос 3 (чоловічий) — expr-voice-3-m
  • Голос 3 (жіночий) — expr-voice-3-f
  • Голос 4 (чоловічий) — expr-voice-4-m
  • Голос 4 (жіночий) — expr-voice-4-f
  • Голос 5 (чоловічий) — expr-voice-5-m
  • Голос 5 (жіночий) — expr-voice-5-f
Piper

Виберіть відповідні мову й модель. Зразок використовує HFC medium. Саме налаштування мови не перекладає голос.

Справжні налаштування постачальника Piper у SSN
Назви голосів і значення URL
  • Англійська США, жіночий (HFC) — середня якість — en_US-hfc_female-medium
  • Іспанська, Іспанія (DaveFX) — середня якість — es_ES-davefx-medium
  • Іспанська, Мексика (Ald) — середня якість — es_MX-ald-medium
  • Бразильська португальська (Faber) — середня якість — pt_BR-faber-medium
  • Бразильська португальська (Edresson) — низька якість — pt_BR-edresson-low
  • Португальська, Португалія (Tugao) — середня якість — pt_PT-tugão-medium
eSpeak

Виберіть голос потрібної мови й за бажанням змініть швидкість мовлення. Цей рушій навмисно звучить роботизовано.

Справжні налаштування постачальника eSpeak у SSN
Назви голосів і значення URL
  • Англійська — en
  • Іспанська — es
  • Португальська, Бразилія — pt-br
  • Португальська, Португалія — pt-pt
ElevenLabs

Введіть API-ключ, а потім використовуйте List My Available Voices, щоб знайти ID голосу, доступного вашому обліковому запису. Довідник постачальників.

Справжні налаштування постачальника ElevenLabs у SSN
Google Cloud

Введіть API-ключ Google Cloud TTS і точну назву голосу з відповідною мовою. Назви голосів і підтримуване керування.

Справжні налаштування постачальника Google Cloud у SSN
Gemini

Виберіть підтримувані модель TTS і голос; інструкції стилю змінюють манеру мовлення. Це налаштування Gemini API, окремі від Google Cloud TTS. Приклади голосів і вимоги.

Справжні налаштування постачальника Gemini у SSN
Fish Audio

Виберіть Fish Audio у меню постачальника TTS для дока чату, оверлею вибраних повідомлень, сторінки TTS або Flow Actions. Введіть власний API-ключ Fish Audio, а потім скористайтеся наявною кнопкою Test TTS. Необов’язковий Voice ID вибирає голос із Fish Audio; скопіюйте ID моделі голосу, а не назву чи URL сторінки. Залиште порожнім, щоб використовувати стандартний голос сервісу.

Розширені параметри включають модель і швидкість мовлення (0,5–2). За замовчуванням SSN використовує s2.1-pro-free; доступність безкоштовного тарифу й умови добросовісного використання визначає Fish Audio. Платні моделі потребують коштів на рахунку. SSN не повторює невдалий безкоштовний запит із платною моделлю. Для гучності глядачів використовуйте More TTS options. Текст надсилається в Fish Audio, а мову визначає сервіс.

Налаштування OBS / браузера: Запустіть наявний у SSN локальний міст TTS у режимі Fish на комп’ютері з OBS. Задайте для змінної середовища SSN_TTS_TARGET_BEARER значення свого API-ключа Fish і запустіть node scripts/local-tts-bridge.cjs --mode fish. У панелі Fish Audio встановіть URL мосту OBS / браузера до http://127.0.0.1:8124/v1/audio/speech; вставте токен локального мосту, надрукований у терміналі, у поле спливного вікна API-ключ . Токен змінюється після перезапуску, якщо ви не задасте SSN_TTS_BRIDGE_TOKEN довгим випадковим секретом; тримайте посилання оверлеїв із токеном у таємниці. Залишайте міст запущеним, перевірте голос і використовуйте згенерований URL оверлею в OBS. Увімкніть Control audio via OBS у налаштуваннях браузерного джерела, якщо хочете звук у мікшері OBS. Прямі запити Fish із розміщених браузерних сторінок не мають дозволу CORS; міст надає аудіовідповідь, доступну браузеру.

Із мостом додайте &fishendpoint=http%3A%2F%2F127.0.0.1%3A8124%2Fv1%2Faudio%2Fspeech до URL і не вказуйте fishkey , коли ключ зберігається в мосту.

Параметри URL: &ttsprovider=fish&fishkey=YOUR_KEY&voicefish=VOICE_ID&fishmodel=s2.1-pro-free&fishspeed=1. Увімкніть TTS звичайними елементами керування. Тримайте згенеровані URL із ключем у таємниці. Наявне перевизначення голосу Speak Text в Event Flow приймає ID голосу Fish, коли сторінка-одержувач використовує Fish Audio.

Довідник API Fish Audio · Оголошення безкоштовної моделі й умови

Speechify

Покроковий посібник Speechify: API-ключ, голоси, швидкість і гучність для глядачів.

Введіть API-ключ і ID голосу з облікового запису Speechify API. Налаштування постачальника.

Справжні налаштування постачальника Speechify у SSN
OpenAI

Виберіть підтримувані голос/модель і введіть API-ключ. Підписка ChatGPT не надає кредитів API. Для OpenAI залишайте стандартну кінцеву точку.

Справжні налаштування постачальника OpenAI у SSN
Власний / локальний TTS

Цей варіант повторно використовує елементи керування, сумісні з OpenAI, тому заголовок досі OpenAI. Введіть кінцеву точку сервера та підтримувані голос/модель; автентифікація залежить від сервера. Див. посібник із локального сервера.

Справжні налаштування постачальника Custom / Local TTS у SSN
Для досвідчених: ручне редагування URL TTS

Хороші перші перевірки:

dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kokoro
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=piper
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kitten

Для португальської або іспанської почніть натомість з одного з цих варіантів:

dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium
dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=espeak&espeakvoice=es

Повний довідник озвучення · Посібник із локального сервера TTS

Для досвідчених: власний локальний сервер TTS

Локальний сервер TTS корисний, коли потрібні приватні голоси, конкретна модель голосу або сервер на кшталт Kokoro-FastAPI чи openedai-speech. Сторінка, що відтворює TTS, повинна мати доступ до кінцевої точки.

Схема браузерного джерела OBS, що надсилає TTS-запити через локальний міст TTS Social Stream Ninja до сервера TTS
Для OBS локальний міст зазвичай найкраще працює на тому самому комп’ютері, що й OBS.
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=customtts&openaiendpoint=http://127.0.0.1:8124/v1/audio/speech&voiceopenai=af_bella

localhost означає комп’ютер, де працює сторінка. Якщо сервер TTS на іншому комп’ютері, використовуйте його LAN IP або запустіть міст на комп’ютері з OBS.