Посібник із TTS Social Stream Ninja

Повний посібник із голосів для озвучення тексту, сумісності браузерів і захоплення звуку

Українська

Огляд

SSN може читати захоплений текст чату з будь-якого підтримуваного джерела; платформа чату не потребує власної функції TTS. Ваш док або оверлей із увімкненим TTS озвучує отримані повідомлення відповідно до своїх фільтрів і налаштувань TTS. Почніть із короткого посібника з налаштування; ця сторінка описує варіанти голосів і розширені налаштування. Порівнюйте постачальників, слухайте зразки та переглядайте налаштування.

Швидкий початок: Використовуйте dock.html?session=YOUR_SESSION&speech=en-US. За замовчуванням використовується системне TTS. Для безкоштовного постачальника в OBS також додайте &ttsprovider=kokoro. Залиште цю сторінку відкритою та підключеною; озвучувати має лише одна копія.

Де використовується TTS?

Системне TTS — лише один із безкоштовних варіантів TTS:
  • Системні голоси залежать від браузера та операційної системи. OBS може не надавати придатних голосів, навіть коли Chrome/Edge працює.
  • Відсутність голосу — це інша проблема, ніж відтворення мовлення поза захопленням звуку OBS. Маршрутизація звуку не виправить відсутність підтримки мовлення.
  • Безкоштовні постачальники, як-от Kokoro, Piper, Kitten та eSpeak, натомість генерують звук сторінки. Для TTS в OBS платити не потрібно.
  • Перевірте доступність голосів, а потім — захоплення звуку.

Варіанти постачальників TTS

Системне TTS (безкоштовне)

Локальні / безкоштовні варіанти TTS (ключ API не потрібен)

Потрібне повністю локальне TTS із ШІ? Кілька високоякісних голосів ШІ вбудовано безпосередньо в Social Stream Ninja. Вони працюють у вашому браузері без ключа API, хмари та додаткового встановлення. Дивіться Посібник із локального озвучення ШІ для інструкцій із налаштування та варіантів власного сервера.
Постачальник Вартість Захоплення в OBS Можливості
Kokoro TTS Безкоштовно Безпосередньо ШІ у браузері, чудова якість, десятки голосів
Piper TTS Безкоштовно Безпосередньо Швидке нейронне TTS у браузері з помірним навантаженням на процесор
Kitten TTS Безкоштовно Безпосередньо У браузері, легка модель ONNX
eSpeak-NG Безкоштовно Безпосередньо Класичне рішення з відкритим кодом, працює на будь-якому обладнанні

Платні / хмарні варіанти TTS (безпосередній звук браузера)

Постачальник Вартість Захоплення в OBS Можливості
OpenAI TTS Використання API платне (або безкоштовно локально) Безпосередньо Висока якість; також підтримує локальні сервери через власну кінцеву точку
Google Cloud Використання API платне Безпосередньо Професійна якість, кілька мов
ElevenLabs Є безкоштовний тариф Безпосередньо Навчання власного голосу, природне звучання
Speechify Використання API платне Безпосередньо Високоякісні голоси, кілька мов
Gemini TTS Використання API платне Безпосередньо API генеративних мовних моделей Google

Доступність системних голосів

Це типові можливості, а не гарантії для кожної інсталяції. OBS використовує власний вбудований браузер і не успадковує список голосів установленого Chrome/Edge. Успішна перевірка в застосунку SSN не перевіряє окреме джерело браузера OBS.

Chrome

✓ Системні голоси доступні в підтримуваних інсталяціях

Голоси Google + системні голоси

Edge

✓ Системні голоси доступні в підтримуваних інсталяціях

Голоси Microsoft + пакети TTS Windows

Firefox

⚠ Обмежена підтримка

Лише локальні системні мови

Opera

⚠ Обмежена підтримка

На основі Chromium; доступні голоси залежать від інсталяції

Обмеження браузерів:

Способи захоплення звуку TTS Windows для OBS

Звук сторінки: безкоштовні локальні та хмарні постачальники

Локальні постачальники SSN, що працюють у браузері, і хмарні постачальники звуку відтворюють згенерований звук через сторінку:

Способи захоплення системного TTS

Важливо: Спершу переконайтеся, що системне TTS генерує мовлення. Вбудований браузер OBS може не надавати придатного системного голосу. Якщо мовлення не генерується, зміна маршрутизації звуку не допоможе. Виберіть іншого постачальника або генеруйте мовлення в підтримуваному браузері й захоплюйте звук цього браузера.

Саме для системного TTS:

Завантаження засобів маршрутизації: VB-Audio Virtual Cable | Voicemeeter | Audio Router (застарілий)

Спочатку спробуйте захопити звук браузера, що озвучує текст, через захоплення звуку застосунку або робочого столу в OBS, якщо це підтримується. Наведені нижче способи з віртуальним кабелем — необов’язкові альтернативи; вони не додають OBS підтримку мовлення.

Спосіб 1: стандартний маршрут звуку через віртуальний кабель

1. Set VB-Audio Virtual Cable as Windows default output - Sound Settings > Output > CABLE Input 2. OBS: - Add Audio Input Capture - Source: CABLE Output - Monitor: Monitor and Output, or Monitor Only if another source handles stream output

Спосіб 2: маршрут для застосунку у Windows 10

1. Sound Settings > App volume and device preferences 2. Find browser in list 3. Output: CABLE Input 4. OBS setup same as Method 1

Спосіб 3: маршрут для застосунку у Windows 11

1. Settings > System > Sound > Volume Mixer 2. Locate browser 3. Output: CABLE Input 4. OBS setup same as Method 1

Спосіб 4: програма Audio Router

1. Install Audio Router 2. Route browser to CABLE Input 3. OBS setup same as Method 1

Спосіб 5: Voicemeeter (розширений)

1. Install Voicemeeter 2. Set as Windows default output 3. Route: - Hardware out > speakers - Virtual out > OBS 4. OBS captures Voicemeeter output

Перевірка налаштування

1. Play TTS 2. Check OBS meter 3. Verify system audio 4. Adjust levels if needed
Альтернативи: Використовуйте безкоштовного вбудованого постачальника, як-от Kokoro, Piper, Kitten або eSpeak, хмарного постачальника чи власний сервер TTS.

Установлення додаткових мовних пакетів

Windows 11

  1. Перейдіть до Пуск > Налаштування > Час і мова > Мовлення
  2. У розділі Керувати голосами, натисніть Додати голоси
  3. Виберіть потрібні мови та натисніть Додайте
  4. Перезапустіть браузери, щоб оновити доступні голоси

Windows 10

Дотримуйтеся інструкцій в офіційному посібнику Microsoft для встановлення мовних пакетів.

Порада: Деякі сторонні голоси можуть не з’являтися у браузерах через проблеми сумісності. Firefox часто показує більше системних голосів, ніж браузери на основі Chromium.

Параметри URL для налаштування TTS

Основні параметри

Параметр Опис Приклад
&speech Увімкнути TTS із кодом мови &speech=en-US
&pitch Висота голосу (від 0,1 до 2,0) &pitch=1.2
&volume Рівень гучності (від 0,0 до 1,0) &volume=0.8
&rate Темп мовлення (від 0,1 до 10,0) &rate=1.5
&voice Частковий збіг назви голосу &voice=google
&ttsprovider Виберіть постачальника: kokoro, piper, kitten, espeak, openai, customtts, localtts, elevenlabs, google, speechify, gemini &ttsprovider=customtts

Розширені параметри

Параметр Опис
&simpletts Не говорити «каже» або «хтось каже»
&simpletts2 Взагалі не читати імена учасників чату
&ttscommand Увімкнути власну команду TTS (за замовчуванням: !say)
&readevents Озвучувати події трансляції
&skipmessages=3 Читати лише кожне третє повідомлення

Налаштування постачальника TTS

Kokoro TTS (безкоштовне, вбудоване)

Piper TTS (безкоштовне, вбудоване)

Kitten TTS (безкоштовне, вбудоване)

eSpeak-NG (безкоштовне, вбудоване)

Приклади TTS португальською та іспанською

OpenAI / TTS на локальному сервері

Google Cloud TTS

Gemini TTS

ElevenLabs TTS

Fish Audio TTS

Виберіть Fish Audio та введіть свій ключ API, за потреби додавши ID голосу. Модель за замовчуванням — s2.1-pro-free. Налаштування, варіанти моделей та обмеження доступу з браузера.

Speechify TTS

Усунення несправностей

Поширені проблеми

Рекомендовані практики

Перевірити системні голоси цього браузера

Тут перелічено Лише голоси системного TTS у браузері, де відкрито цей посібник. Це не перевіряє OBS, окреме вікно застосунку SSN або такі постачальники, як Kokoro. Порожній список не означає, що інші постачальники TTS у SSN недоступні.