Руководство по озвучиванию Social Stream Ninja

Полное руководство по голосам для озвучивания текста, совместимости браузеров и захвату звука

Русский

Обзор

SSN может читать захваченный текст чата из любого поддерживаемого источника; платформе чата не нужна собственная функция TTS. Ваша док-панель или оверлей с включённым TTS озвучивает получаемые сообщения с учётом своих фильтров и настроек озвучивания. Начните с краткого руководства по настройке; эта страница описывает варианты голосов и расширенные настройки. Сравните провайдеров, послушайте образцы и посмотрите настройки.

Быстрый старт: Используйте dock.html?session=YOUR_SESSION&speech=en-US. По умолчанию используется System TTS. Для бесплатного провайдера в OBS добавьте также &ttsprovider=kokoro. Оставьте эту страницу открытой и подключённой; озвучивать должна только одна копия.

Где используется озвучивание текста?

System TTS — лишь один из вариантов бесплатного озвучивания:
  • Системные голоса зависят от браузера и операционной системы. OBS может не предоставлять ни одного пригодного голоса, даже если Chrome/Edge работает.
  • Отсутствие голоса и воспроизведение речи вне захвата звука OBS — разные проблемы. Маршрутизация звука не добавляет отсутствующую поддержку речи.
  • Бесплатные провайдеры вроде Kokoro, Piper, Kitten и eSpeak вместо этого создают звук страницы. Для озвучивания текста в OBS платить не обязательно.
  • Сначала проверьте доступность голосов, затем захват звука.

Варианты провайдеров озвучивания

System TTS (бесплатный)

Локальное / бесплатное озвучивание текста (без ключа API)

Хотите полностью локальное ИИ-озвучивание? В Social Stream Ninja встроено несколько качественных ИИ-голосов, которые работают в вашем браузере — без ключа API, облака или дополнительной установки. См. Руководство по локальному ИИ-озвучиванию с инструкциями по настройке и вариантами собственного сервера.
Провайдер Стоимость Захват OBS Возможности
Kokoro TTS Бесплатно Напрямую ИИ в браузере, отличное качество, десятки голосов
Piper TTS Бесплатно Напрямую Быстрое нейросетевое озвучивание в браузере с низкой нагрузкой на CPU
Kitten TTS Бесплатно Напрямую Работа в браузере, компактная модель ONNX
eSpeak-NG Бесплатно Напрямую Классический движок с открытым исходным кодом, работает на любом оборудовании

Платное / облачное озвучивание (звук непосредственно в браузере)

Провайдер Стоимость Захват OBS Возможности
OpenAI TTS Действует оплата API (или бесплатно локально) Напрямую Высокое качество; также поддерживает локальные серверы через свою конечную точку
Google Cloud Действует оплата API Напрямую Профессиональное качество, несколько языков
ElevenLabs Доступен бесплатный тариф Напрямую Обучение собственных голосов, естественное звучание
Speechify Действует оплата API Напрямую Качественные голоса, несколько языков
Озвучивание Gemini Действует оплата API Напрямую API генеративного языка Google

Доступность системных голосов

Это типичные возможности, а не гарантии для каждой установки. OBS использует собственный встроенный браузер и не наследует список голосов установленного Chrome/Edge. Успешный тест в приложении SSN не проверяет отдельный источник «Браузер» в OBS.

Chrome

✓ Системные голоса доступны в поддерживаемых установках

Голоса Google + системные голоса

Edge

✓ Системные голоса доступны в поддерживаемых установках

Голоса Microsoft + пакеты TTS Windows

Firefox

⚠ Ограниченная поддержка

Только локальные системные языки

Opera

⚠ Ограниченная поддержка

На базе Chromium; доступные голоса зависят от установки

Ограничения браузеров:

Способы захвата звука TTS Windows для OBS

Звук страницы: бесплатные локальные и облачные провайдеры

Локальные браузерные провайдеры SSN и облачные аудиопровайдеры воспроизводят созданный звук через страницу:

Способы захвата System TTS

Важно: Сначала убедитесь, что System TTS создаёт речь. Встроенный браузер OBS может не предоставлять пригодный системный голос. Если речь не создаётся, изменение маршрутизации звука не поможет. Выберите другого провайдера или создавайте речь в поддерживаемом браузере и захватывайте его звук.

Именно для System TTS:

Скачать средства маршрутизации: VB-Audio Virtual Cable | Voicemeeter | Audio Router (устаревший)

Сначала попробуйте захватить говорящий браузер через звук приложения или рабочего стола в OBS, если это поддерживается. Способы с виртуальным кабелем ниже — необязательные альтернативы; они не добавляют поддержку речи в OBS.

Способ 1: стандартная маршрутизация звука с виртуальным кабелем

1. Set VB-Audio Virtual Cable as Windows default output - Sound Settings > Output > CABLE Input 2. OBS: - Add Audio Input Capture - Source: CABLE Output - Monitor: Monitor and Output, or Monitor Only if another source handles stream output

Способ 2: маршрутизация приложения в Windows 10

1. Sound Settings > App volume and device preferences 2. Find browser in list 3. Output: CABLE Input 4. OBS setup same as Method 1

Способ 3: маршрутизация приложения в Windows 11

1. Settings > System > Sound > Volume Mixer 2. Locate browser 3. Output: CABLE Input 4. OBS setup same as Method 1

Способ 4: программа Audio Router

1. Install Audio Router 2. Route browser to CABLE Input 3. OBS setup same as Method 1

Способ 5: Voicemeeter (для опытных пользователей)

1. Install Voicemeeter 2. Set as Windows default output 3. Route: - Hardware out > speakers - Virtual out > OBS 4. OBS captures Voicemeeter output

Проверка настройки

1. Play TTS 2. Check OBS meter 3. Verify system audio 4. Adjust levels if needed
Альтернативы: Используйте бесплатного встроенного провайдера, например Kokoro, Piper, Kitten или eSpeak, облачного провайдера либо собственный сервер TTS.

Установка дополнительных языковых пакетов

Windows 11

  1. Перейдите в Пуск > Параметры > Время и язык > Речь
  2. В разделе Управление голосами (Manage Voices), нажмите Добавить голоса (Add Voices)
  3. Выберите нужные языки и нажмите Добавить
  4. Перезапустите браузеры, чтобы обновить список доступных голосов

Windows 10

Следуйте инструкциям в официальном руководстве Microsoft по установке языковых пакетов.

Совет: Некоторые сторонние голоса могут не появляться в браузерах из-за проблем совместимости. Firefox часто показывает больше системных голосов, чем браузеры на базе Chromium.

Параметры URL для настройки озвучивания

Основные параметры

Параметр Описание Пример
&speech Включить озвучивание с кодом языка &speech=en-US
&pitch Высота голоса (от 0.1 до 2.0) &pitch=1.2
&volume Уровень громкости (от 0.0 до 1.0) &volume=0.8
&rate Скорость речи (от 0.1 до 10.0) &rate=1.5
&voice Частичное совпадение названия голоса &voice=google
&ttsprovider Выберите провайдера: kokoro, piper, kitten, espeak, openai, customtts, localtts, elevenlabs, google, speechify, gemini &ttsprovider=customtts

Расширенные параметры

Параметр Описание
&simpletts Не произносить «говорит» или «кто-то говорит»
&simpletts2 Вообще не читать имена участников чата
&ttscommand Включить собственную команду озвучивания (по умолчанию: !say)
&readevents Включить события стрима в озвучивание
&skipmessages=3 Читать только каждое третье сообщение

Настройка провайдера озвучивания

Kokoro TTS (бесплатный, встроенный)

Piper TTS (бесплатный, встроенный)

Kitten TTS (бесплатный, встроенный)

eSpeak-NG (бесплатный, встроенный)

Примеры озвучивания на португальском и испанском

Озвучивание OpenAI / локальный сервер

Google Cloud TTS

Озвучивание Gemini

Озвучивание ElevenLabs

Озвучивание Fish Audio

Выберите Fish Audio и введите ключ API, при желании указав ID голоса. Модель по умолчанию — s2.1-pro-free. Настройка, варианты моделей и ограничения доступа браузера.

Озвучивание Speechify

Устранение неполадок

Частые проблемы

Рекомендации

Проверить системные голоса этого браузера

Здесь перечислены Только голоса System TTS в браузере, где открыто это руководство. Здесь не проверяются OBS, отдельное окно приложения SSN или провайдеры вроде Kokoro. Пустой список не означает, что другие провайдеры TTS в SSN недоступны.