Руководство по настройке озвучивания

Слушайте свой чат за три шага. Начните бесплатно, без аккаунта или ключа API.

1. Включите чтение чата

Чат ещё не подключён? Начните здесь: установите SSN, добавьте источник и откройте док-панель.

Откройте Всплывающее окно расширения SSN или в приложении для компьютера «Источники и настройки».

В разделе Основной оверлей чата и док-панель управления (Main chat overlay & control dock), разверните Сообщения — озвучивание текста (Message — Text to Speech). Включите показанный здесь переключатель:

Всплывающее окно: Message — Text to Speech, параметр Enable TTS in dock включён
Синий переключатель = чтение чата включено.

2. Выберите бесплатный голос

В том же разделе прокрутите до Провайдер TTS (TTS Service Provider). Выберите Piper TTS, затем голос.

Всплывающее окно: выбран Piper TTS и голос English US Female HFC Medium
Piper не требует аккаунта или ключа API. Дайте ему время на первую загрузку голоса.

Используйте копировать ссылку рядом с Основной оверлей чата и док-панель управления (Main chat overlay & control dock) для получения обновлённой ссылки.

3. Воспроизведите его в OBS

  1. Добавьте в OBS Источник «Браузер» и вставьте эту ссылку.
  2. Включить (Enable) Управлять аудио через OBS в его свойствах.
  3. Отправьте сообщение в чат. Проверьте аудиоиндикатор источника, затем сделайте короткую запись.

Хотите услышать сами? В расширенных свойствах аудио OBS выберите Прослушивание и вывод для этого источника. Оставьте только одну копию, читающую чат.

Послушайте бесплатные голоса

Предпочитаете другое звучание? Эти четыре голоса бесплатны. Нажмите кнопку воспроизведения для сравнения.

Piper

Английский США, женский (HFC), среднее качество.
en_US-hfc_female-medium

Посмотреть настройки и голоса

Kokoro

Bella, американский женский голос. Протестирован с CPU/WASM, q8.
af_bella

Посмотреть настройки и голоса

Kitten

Голос 4, женский. Встроенная модель nano v0.1.
expr-voice-4-f

Посмотреть настройки и голоса

eSpeak

Английский. Синтетический голос с малым потреблением ресурсов.
en

Посмотреть настройки и голоса

Примеры на испанском и португальском

Выберите язык над списком голосов в настройках SSN, затем используйте Проверка. Piper предлагает голоса Испании, Мексики, Бразилии и Португалии; Kokoro добавляет три испанских и три бразильских португальских голоса.

Piper - испанский (Испания)

DaveFX

Kokoro - испанский

Dora

Piper - португальский (Бразилия)

Faber

Kokoro - португальский (Бразилия)

Dora

Бесплатный локальный синтез с первоначальной загрузкой. Примеры не включают время загрузки. Piper — менее требовательный начальный вариант; Kokoro может медленно работать на CPU. Если речь отстаёт от чата, используйте Piper.

Текст примеров и подробности теста

Четыре английских примера читают: Добро пожаловать на стрим! Спасибо, что присоединились. В какую игру нам сыграть дальше? Чтение имён отключено.

Проверено 7 сентября 2026 года в OBS 32.2.2 на Windows 11: сообщение чата поступило в настоящую док-панель, было озвучено, вызвало движение индикатора источника «Браузер» и попало в запись. В этом тесте на CPU Kokoro заметно дольше начинал говорить. Эти записи демонстрируют голос, а не время ожидания.

System TTS предоставил пять голосов на этом компьютере, но не дал звука в записи источника «Браузер». Этот результат относится именно к данной конфигурации; всегда проверяйте окончательную ссылку и запись. Облачные голоса не включены, поскольку платные учётные данные не использовались.

Нужна помощь?

Поддерживает ли моя платформа чата озвучивание текста?

Если SSN получает чат в текстовом виде, он может читать его вслух. YouTube, Twitch, TikTok и другие источники используют одну и ту же функцию. Вашей платформе чата не нужна собственная поддержка TTS.

Нет речи?

Проверьте, получает ли док-панель сообщения чата, затем проверьте переключатель TTS, провайдера и фильтры. Используйте новую скопированную ссылку. Дождитесь первой загрузки модели.

Работает в Chrome/Edge, но не в OBS?

У OBS отдельный браузер и список голосов. System TTS может там не работать, даже если голоса перечислены. Попробуйте Piper, Kokoro, Kitten или eSpeak. Виртуальный аудиокабель не исправит отсутствие речи.

Индикатор движется, но в записи тишина?

Проверьте отключение звука и назначение дорожек записи в OBS. Если хотите слышать речь сами, используйте «Мониторинг и вывод»; избегайте повторного захвата звука мониторинга. Руководство по аудио OBS.

Можно ли вместо этого использовать док-панель OBS или Featured Chat?

Пользовательская док-панель браузера OBS — это панель управления, а не использованный выше источник «Браузер» в сцене. Для Featured Chat включите озвучивание текста в собственных параметрах этого оверлея во всплывающем окне и скопируйте его ссылку. Оставьте озвучивание только на одной странице, чтобы голоса не дублировались.

Сравнение всех провайдеров: требования, стоимость и компромиссы

Начните с Piper для бесплатного локального голоса или сравните с Kokoro, если предпочитаете его звучание. Попробуйте eSpeak, если скорость реакции важнее реалистичности. Kitten — ещё один компактный вариант для английского. Послушайте перед выбором.

ПровайдерПодходит дляКомпромиссТребования / стоимость
KokoroАнглийские, испанские и бразильские португальские голоса.Больше нагрузки на CPU; начало речи может задерживаться.Бесплатно, без ключа. Загружает ресурсы модели/голоса; CPU или поддерживаемый WebGPU.
PiperЛокальные нейросетевые голоса; английские, испанские и португальские варианты.Качество и произношение зависят от голоса.Бесплатно, без ключа. Загружает выбранную модель (HFC medium: около 63 МБ) и файлы движка.
KittenКомпактная английская модель, восемь голосов.Меньше языков и вариантов звучания.Бесплатно, без ключа. Текущая встроенная модель: около 24 МБ, плюс файлы движка/голоса; CPU.
eSpeakНизкие требования к ресурсам, много языков, быстрый запуск.Намеренно синтетическое, роботизированное звучание.Бесплатно, без ключа. Загружает встроенные файлы движка/языка; нейросетевая модель или GPU не требуются.
Системное озвучиваниеИспользует голоса, доступные в вашем браузере или приложении для компьютера.Список голосов и захват OBS различаются; некоторым голосам нужен интернет.SSN не взимает плату за провайдера. Нужен работающий голос системы/браузера; проверяйте на фактической странице воспроизведения.
ElevenLabsID голосов, выбор модели и настройки стабильности/стиля.Возможны ограничения аккаунта, сетевая задержка и плата за API.Интернет, ключ API и доступный ID голоса. Текст чата отправляется провайдеру.
Google CloudИменованные голоса и настройки языка, скорости и высоты тона.Не каждый голос поддерживает все настройки.Интернет, включённый Cloud TTS API, ключ API и соответствующие голос/язык. Действуют оплата и квоты.
GeminiСтили голосов и письменные указания по манере речи.Предварительные версии моделей и квоты могут меняться; задержка различается.Интернет, ключ API Gemini и доступ к выбранной модели TTS. Проверьте ограничения и оплату аккаунта.
SpeechifyID голоса с настройками скорости, языка и модели.Требуется доступ к API; доступные голоса зависят от аккаунта.Интернет и ключ API Speechify. Действуют условия и ограничения использования API.
OpenAIИменованные голоса с настройками модели и формата.Требуются интернет и оплата API; подписка на аккаунт оплачивается отдельно.Ключ API с доступом к озвучиванию текста. Текст чата отправляется на заданную конечную точку.
Свой / локальныйИспользуйте собственный совместимый сервер голосов.Больше всего настроек: конечная точка, модель, голос и доступ из браузера должны быть согласованы.Доступная конечная точка синтеза речи, совместимая с OpenAI; ключ при необходимости. Затраты на локальное оборудование или хостинг различаются.

Указанные выше размеры загрузки относятся к файлам моделей, а не к общему потреблению памяти или всем необходимым ресурсам. Локальные провайдеры используют компьютер, на котором открыта док-панель/оверлей; первый запуск может быть медленнее, а у OBS свой кэш. Облачные провайдеры экономят локальные вычислительные ресурсы, но отправляют текст за пределы устройства.

OBS: четыре локальных провайдера ниже прошли тесты записи источника «Браузер». Облачные/собственные провайдеры возвращают аудио для воспроизведения на странице, но в этом обзоре не тестировались с действующими аккаунтами. System TTS нужно проверять отдельно, даже если он перечисляет голоса.

Настройки провайдеров и названия голосов

Реальные настройки приложения для компьютера, снятые в новом профиле. Откройте нужного провайдера; поля ключей API намеренно пустые. Эти элементы настраивают выбранную док-панель или оверлей SSN. Нажмите на снимок, чтобы увидеть его в полном размере.

Системное озвучивание

В этом новом профиле список языков пуст. Доступные голоса зависят от браузера/приложения и установленных голосов; универсального списка голосов SSN нет.

Настройки провайдера System TTS в SSN
Kokoro

Выберите голос в SSN; модель загружается на странице, которая озвучивает текст. В списке есть английские голоса США и Великобритании, испанские и бразильские португальские. Используйте фильтр языков для поиска; Test воспроизводит короткую фразу на выбранном языке. Для меньшей нагрузки на CPU попробуйте Piper.

Настройки провайдера Kokoro в SSN
Названия голосов и значения URL
  • Heart (американский женский) — af_heart
  • Alloy (американский женский) — af_alloy
  • Aoede (американский женский) — af_aoede
  • Bella (американский женский) — af_bella
  • Jessica (американский женский) — af_jessica
  • Kore (американский женский) — af_kore
  • Nicole (американский женский) — af_nicole
  • Nova (американский женский) — af_nova
  • River (американский женский) — af_river
  • Sarah (американский женский) — af_sarah
  • Sky (американский женский) — af_sky
  • Adam (американский мужской) — am_adam
  • Echo (американский мужской) — am_echo
  • Eric (американский мужской) — am_eric
  • Fenrir (американский мужской) — am_fenrir
  • Liam (американский мужской) — am_liam
  • Michael (американский мужской) — am_michael
  • Onyx (американский мужской) — am_onyx
  • Puck (американский мужской) — am_puck
  • Santa (американский мужской) — am_santa
  • Emma (британский женский) — bf_emma
  • Isabella (британский женский) — bf_isabella
  • George (британский мужской) — bm_george
  • Lewis (британский мужской) — bm_lewis
  • Alice (британский женский) — bf_alice
  • Lily (британский женский) — bf_lily
  • Daniel (британский мужской) — bm_daniel
  • Fable (британский мужской) — bm_fable
  • Dora (испанский) - ef_dora
  • Alex (испанский) - em_alex
  • Santa (испанский) - em_santa
  • Dora (бразильский португальский) - pf_dora
  • Alex (бразильский португальский) - pm_alex
  • Santa (бразильский португальский) - pm_santa
Kitten

Восемь английских голосов: мужские и женские варианты с номерами 2, 3, 4 и 5. В примере используется Voice 4 (Female).

Настройки провайдера Kitten в SSN
Названия голосов и значения URL
  • Голос 2 (мужской) — expr-voice-2-m
  • Голос 2 (женский) — expr-voice-2-f
  • Голос 3 (мужской) — expr-voice-3-m
  • Голос 3 (женский) — expr-voice-3-f
  • Голос 4 (мужской) — expr-voice-4-m
  • Голос 4 (женский) — expr-voice-4-f
  • Голос 5 (мужской) — expr-voice-5-m
  • Голос 5 (женский) — expr-voice-5-f
Piper

Выберите соответствующие язык и модель. В примере используется HFC medium. Один выбор языка не переводит голос.

Настройки провайдера Piper в SSN
Названия голосов и значения URL
  • Английский США, женский (HFC) - среднее качество — en_US-hfc_female-medium
  • Испанский, Испания (DaveFX) - среднее качество — es_ES-davefx-medium
  • Испанский, Мексика (Ald) - среднее качество — es_MX-ald-medium
  • Бразильский португальский (Faber) - среднее качество — pt_BR-faber-medium
  • Бразильский португальский (Edresson) - низкое качество — pt_BR-edresson-low
  • Португальский, Португалия (Tugao) - среднее качество — pt_PT-tugão-medium
eSpeak

Выберите голос нужного языка и при желании измените скорость речи. Этот движок намеренно звучит как робот.

Настройки провайдера eSpeak в SSN
Названия голосов и значения URL
  • Английский — en
  • Испанский — es
  • Португальский, Бразилия — pt-br
  • Португальский, Португалия — pt-pt
ElevenLabs

Введите ключ API, затем используйте List My Available Voices, чтобы найти ID голоса, доступного вашему аккаунту. Справочник провайдеров.

Настройки провайдера ElevenLabs в SSN
Google Cloud

Введите ключ API Google Cloud TTS и точное имя голоса с соответствующим языком. Названия голосов и поддерживаемые настройки.

Настройки провайдера Google Cloud в SSN
Gemini

Выберите поддерживаемую модель TTS и голос; инструкции по стилю меняют манеру речи. Это настройки API Gemini, отдельные от Google Cloud TTS. Примеры голосов и требования.

Настройки провайдера Gemini в SSN
Fish Audio

Выберите Fish Audio в меню провайдера TTS для док-панели чата, оверлея выделенных сообщений, страницы TTS или Flow Actions. Введите свой Ключ API Fish Audio, затем нажмите имеющуюся кнопку Test TTS. Необязательный Voice ID позволяет выбрать голос из Fish Audio; скопируйте ID модели голоса, а не её название или ссылку на страницу. Оставьте поле пустым, чтобы использовать голос сервиса по умолчанию.

Расширенные параметры включают модель и скорость речи (0.5–2). По умолчанию SSN использует s2.1-pro-free; доступность бесплатного тарифа и условия добросовестного использования определяет Fish Audio. Для платных моделей нужны средства на счёте. SSN не повторяет неудачный бесплатный запрос с платной моделью. Громкость для зрителей настраивается в More TTS options. Текст отправляется в Fish Audio, а язык определяет сервис.

Настройка OBS / браузера: Запустите имеющийся в SSN локальный мост TTS в режиме Fish на компьютере с OBS. Задайте для переменной окружения SSN_TTS_TARGET_BEARER значение своего ключа API Fish и запустите node scripts/local-tts-bridge.cjs --mode fish. На панели Fish Audio задайте Ссылка моста для OBS / браузера на http://127.0.0.1:8124/v1/audio/speech; вставьте токен локального моста, выведенный в терминале, в поле всплывающего окна API-ключ . Токен меняется после перезапуска, если не задать SSN_TTS_BRIDGE_TOKEN длинный случайный секрет; не раскрывайте ссылки оверлеев с токеном. Оставьте мост работающим, проверьте голос и используйте созданную ссылку оверлея в OBS. Включите Control audio via OBS в настройках источника «Браузер», если хотите видеть его звук в микшере OBS. Прямым запросам Fish с размещённых в интернете браузерных страниц не хватает разрешения CORS; мост предоставляет аудиоответ, доступный браузеру.

При использовании моста добавьте &fishendpoint=http%3A%2F%2F127.0.0.1%3A8124%2Fv1%2Faudio%2Fspeech к URL и не указывайте fishkey если ключ хранится в мосте.

Параметры URL: &ttsprovider=fish&fishkey=YOUR_KEY&voicefish=VOICE_ID&fishmodel=s2.1-pro-free&fishspeed=1. Включите озвучивание текста обычными элементами управления. Не раскрывайте созданные ссылки, содержащие ваш ключ. Параметр переопределения голоса в действии Speak Text в Event Flow принимает ID голоса Fish, если принимающая страница использует Fish Audio.

Справочник API Fish Audio · Объявление о бесплатной модели и условия

Speechify

Пошаговое руководство Speechify: ключ API, голоса, скорость и громкость для зрителей.

Введите ключ API и ID голоса из своего аккаунта API Speechify. Настройка провайдера.

Настройки провайдера Speechify в SSN
OpenAI

Выберите поддерживаемый голос/модель и введите ключ API. Подписка ChatGPT не предоставляет средства для API. Для OpenAI оставьте конечную точку по умолчанию.

Настройки провайдера OpenAI в SSN
Своё / локальное озвучивание текста

Этот вариант использует те же элементы управления, что и совместимый с OpenAI режим, поэтому заголовок по-прежнему называется OpenAI. Введите конечную точку своего сервера и поддерживаемые им голос/модель; аутентификация зависит от сервера. См. руководство по локальному серверу.

Настройки провайдера Custom / Local TTS в SSN
Для опытных пользователей: ручное редактирование ссылки TTS

Хорошие варианты для первой проверки:

dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kokoro
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=piper
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=kitten

Для португальского или испанского начните с одного из этих вариантов:

dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=piper&pipervoice=pt_BR-faber-medium
dock.html?session=YOUR_SESSION&speech=pt-BR&ttsprovider=espeak&espeakvoice=pt-br
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=piper&pipervoice=es_ES-davefx-medium
dock.html?session=YOUR_SESSION&speech=es-ES&ttsprovider=espeak&espeakvoice=es

Полный справочник по озвучиванию · Руководство по локальному серверу TTS

Для опытных пользователей: запуск собственного локального сервера TTS

Локальный сервер озвучивания полезен, если вам нужны приватные голоса, определённая модель голоса или сервер вроде Kokoro-FastAPI либо openedai-speech. Страница, воспроизводящая речь, должна иметь доступ к конечной точке.

Схема отправки запросов TTS от источника «Браузер» OBS через локальный мост TTS Social Stream Ninja к серверу озвучивания
Для OBS локальный мост обычно лучше запускать на том же компьютере, что и OBS.
dock.html?session=YOUR_SESSION&speech=en-US&ttsprovider=customtts&openaiendpoint=http://127.0.0.1:8124/v1/audio/speech&voiceopenai=af_bella

localhost означает компьютер, на котором открыта страница. Если сервер TTS находится на другом компьютере, используйте его IP-адрес в локальной сети или запустите мост на компьютере с OBS.