Współprowadzący AI

Pomocnik AI, z którym rozmawiasz na transmisji. Może też czytać czat.

Dwa sposoby użycia

Głosowy współprowadzący

Rozmawiaj głosowo z AI na cohost.html. Odpowiada i na prośbę może omówić czat.

Skonfiguruj

Przyciski doku

Kliknij prawym przyciskiem wiadomość w Docku. Awatar AI ją przeczyta albo przygotuje odpowiedź lub lekki roast, który najpierw zatwierdzisz.

Skonfiguruj

Obie opcje pokazują awatar i dymek w OBS za pomocą Nakładka sceniczna AI, cohost-overlay.html.

Głosowy współprowadzący w 8 krokach

Ta funkcja używa OpenAI Realtime, więc potrzebny jest klucz OpenAI API. Inne opcje to poniżej.

  1. W oknie podręcznym Social Stream wybierz ChatGPT API, wklej klucz API projektu OpenAI i kliknij Przetestuj wybranego bota czatu.
  2. Otwórz cohost.html z okna podręcznego. Zachowaj ten link dla siebie.
  3. Wybierz OpenAI Realtime.
  4. Wybierz mikrofon, do którego mówisz. Pozostaw Odpowiedź dźwiękowa zaznaczone.
  5. Naciśnij Uruchom współprowadzącego.
  6. Pozostaw Czat na żywo na Tylko kontekst. W każdej chwili zapytaj „Co mówi czat?”.
  7. W OBS przechwytuj dźwięk ze strony lub aplikacji współprowadzącego. Tylko tam odtwarzany jest głos AI.
  8. Dodaj cohost-overlay.html?session=YOUR_SESSION_ID do OBS jako źródło przeglądarkowe dla awatara i dymka wypowiedzi.
Strona sterowania cohost.html z urządzeniami multimedialnymi, ustawieniami dostawcy AI, instrukcjami systemowymi i stanem czatu na żywo
Strona współprowadzącego: mikrofon, dostawca AI, instrukcje i stan czatu na żywo.
Chcesz osobną ścieżkę audio w OBS? Wybierz wirtualny kabel w polu Wyjście współprowadzącego, jeśli konfiguracja to obsługuje. Zostaw też widoczny dymek, aby osoby niesłyszące dźwięku mogły czytać.
Udostępnić mu ekran lub kamerę? Opcjonalne. Wideo zaczyna w trybie Bez wideo. Jeśli wybierzesz Udostępnianie ekranu lub kamerę, OpenAI otrzymuje jeden obraz za każdym razem, gdy mówisz lub piszesz, a nie wideo na żywo. Może to zwiększyć koszt i opóźnienie.
Prywatność: Twój mikrofon, wybrany ekran lub kamera oraz udostępnione wiadomości czatu trafiają do OpenAI. Widzowie nie mogą przez czat uruchamiać narzędzi współprowadzącego. Link współprowadzącego wygasa po 12 godzinach, działa tylko w Twojej sesji i znika z paska adresu po załadowaniu strony.
Więcej o OpenAI Realtime
  • Opłaty są naliczane na koncie OpenAI API. To usługa oddzielna od chatgpt.com, która nie dołącza do rozmowy w witrynie ani aplikacji ChatGPT.
  • Twój standardowy klucz pozostaje w Social Stream. Strona współprowadzącego otrzymuje tylko krótkotrwałą przepustkę.
  • Nie musisz w tym celu włączać opcji prywatnego chatbota.
  • Odpowiedzi są ograniczone do 512 tokenów wyjściowych. Diagnostyka pokazuje łączne użycie tokenów i szybkość rozpoczynania odpowiedzi.
  • Jeśli mu przerwiesz, zatrzyma się i odrzuci nieodtworzone audio.
  • Przechowuje do 20 ostatnich wiadomości przez maksymalnie 90 sekund, w tym informacje o wpłatach, wspieraniu kanału, moderatorach, zdarzeniach i kanale. Potem je zapomina.
  • Po zerwaniu połączenia łączy się ponownie i rozpoczyna nową sesję przed upływem 60-minutowego limitu OpenAI. Zachowuje instrukcje i ustawienia szybkości, ale zapomina wypowiedziane słowa.

Jak używa Twojego czatu

Otwórz stronę współprowadzącego z tym samym session co w Social Stream, aby widziała Twój czat na żywo. Wybierz sposób w sekcji Czat na żywo.

Ustawienie czatu na żywoCo robi
Tylko kontekst – odpowiadaj na pytanie (domyślnie)Pamięta ostatnie wiadomości i milczy, dopóki nie zapytasz o czat.
Odpowiadaj głosem na pytania i wzmiankiSamodzielnie odpowiada głosem na pytania i wzmianki.
Odpowiadaj głosem na każdą wiadomośćOdpowiada głosem na każdą wiadomość.

Żadna z tych opcji nie publikuje odpowiedzi na czacie YouTube, Twitch ani Kick. Tylko kontekst przekazuje czat do AI tylko przy OpenAI Realtime. Inni dostawcy obserwują czat, ale nie przekazują go do AI.

Głos bez OpenAI

Gdzie je uruchamiaszJak Cię słyszy
Aplikacja komputerowa SSNWhisper na Twoim komputerze. Pierwsze użycie pobiera około 42 MB. Potem działa offline.
Chrome (link rozszerzenia)Rozpoznawanie mowy Chrome. Może wymagać internetu.
Inne przeglądarkiGłos może nie działać. Pisanie, czat na żywo, kamera lub ekran oraz odpowiedzi AI nadal mogą działać.

Aby sprawdzić, czy Cię słyszy, otwórz Diagnostyka. Powinno pokazać Nasłuchiwanie (Desktop Whisper) lub Nasłuchiwanie (OpenAI WebRTC)i Twoje słowa powinny pojawić się pod Usłyszano.

Bezpłatne AI do testów

  1. Otwórz Boty czatu i usługi AI → Skonfiguruj dostawcę LLM.
  2. Wybierz SSN Hosted Trial LLM (eksperymentalne).
  3. Pozostaw puste pola adresu usługi, tokena i modelu.

Jest bezpłatne w okresie próbnym i może zostać wyłączone lub objęte limitem żądań. Do długotrwałego użytku dodaj własny token lub użyj lokalnej AI.

Przyciski doku w 5 krokach

  1. Otwórz Dock: dock.html?session=YOUR_SESSION_ID.
  2. Dodaj nakładkę sceniczną do OBS: cohost-overlay.html?session=YOUR_SESSION_ID. Dodaj &tts jeśli ma mówić.
  3. Skonfiguruj dostawcę AI w oknie podręcznym. Do szybkiego testu użyj SSN Hosted Trial LLM.
  4. Włącz Boty czatu i usługi AI → Bot czatu – Interfejs prywatny → Włącz prywatnego bota czatu.
  5. Kliknij prawym przyciskiem wiadomość w Docku i wybierz Współprowadzący.
Brak menu współprowadzącego? Pojawia się dopiero, gdy Dock wykryje nakładkę sceniczną w tej samej sesji.
PrzyciskCo robiWymaga
Odczytaj przez współprowadzącegoAwatar odczytuje wiadomość.Nakładka sceniczna jest połączona. AI nie jest potrzebna.
Odpowiedz (Answer)Tworzy krótką odpowiedź do zatwierdzenia.Włączony prywatny chatbot oraz dostawca AI.
Lekka docinka (Light Roast)Tworzy krótki, żartobliwy, łagodny roast do zatwierdzenia.Włączony prywatny chatbot oraz dostawca AI.
Mów (Speak)Wysyła zatwierdzony szkic do nakładki.Szkic.
KopiujKopiuje szkic bez wysyłania.Szkic.

Szkice AI nigdy nie są odczytywane, dopóki nie klikniesz Mów (Speak). Zatwierdzasz w doku, poza transmisją.

Menu kontekstowe nie działa jeszcze z klawiatury. Użytkownicy klawiatury mogą pisać lub mówić na cohost.html zamiast tego.

Szybkość, jakość i koszt (OpenAI)

UstawienieSzybciej i taniejInteligentniej, wolniej
ModelMiniPełna jakość (droższa)
Poziom rozumowaniaMinimalny lub NiskiWysokie lub bardzo wysokie (droższe)
Szybkość przejmowania głosuSzybki: czeka około 2 sekund po zakończeniu mowy. Może wejść w pauzę.Zrównoważony: około 4 sekund. Cierpliwy: około 8.

Zmiany poziomu rozumowania działają także podczas połączenia. Diagnostyka pokazuje czas oczekiwania na początek odpowiedzi. Stan sieci i obciążenie OpenAI mogą się zmieniać.

Pozwól mu sterować transmisją

Współprowadzący może odtwarzać Spotify, przełączać sceny OBS lub wyróżniać wiadomość z czatu. Wszystko jest domyślnie wyłączone. OpenAI Realtime obsługuje wszystkie trzy funkcje. SSN Configured LLM obsługuje tylko Spotify. Inni dostawcy jeszcze ich nie obsługują.

  1. W oknie podręcznym Social Stream włącz tylko potrzebne narzędzia.
  2. Dla OBS wpisz dokładne nazwy dozwolonych scen, oddzielone przecinkami. Pozostaw actions.html połączone z OBS lub użyj źródła przeglądarkowego OBS z pełnymi uprawnieniami.
  3. Na cohost.html, otwórz Sterowanie transmisją przez współprowadzącego i włącz te same narzędzia.
  4. Poproś głosem, np. „przełącz na BRB”, „wyróżnij ostatnią wiadomość” lub „wyczyść wyróżniony czat”.
Tylko Ty możesz uruchamiać narzędzia. Widzowie nie mogą tego robić. Uruchamia jedno narzędzie na żądanie i wybiera tylko sceny z Twojej listy. Wyróżnianie wiadomości wymaga otwartego Docka. Odpowiedź „gotowe” oznacza wysłanie żądania, a nie zakończenie działania przez OBS lub nakładkę.

Rozwiązywanie problemów

ProblemSpróbuj tego
Brak menu współprowadzącego w DockuNakładka sceniczna nie jest otwarta w tej samej sesji. Przełącznik głównej nakładki chatbota nie ma na to wpływu.
Odpowiedź lub lekki roast jest nieaktywneWłącz opcję prywatnego chatbota i sprawdź, czy Social Stream działa.
Odpowiedź, lekki roast lub skonfigurowany LLM SSN przekracza czasSprawdź, czy Social Stream działa, sesja jest zgodna, prywatny bot jest włączony, a dostawca AI dostępny.
Strona współprowadzącego nie widzi czatuUżyj tej samej wartości session co w oknie podręcznym. Ustaw czat na żywo na dowolną opcję oprócz Wyłączony.
Zna czat, ale milczyTo normalne w trybie Tylko kontekst. Zapytaj, o czym mówi czat, lub wybierz inny tryb.
Nic nie widać w OBSKliknij Przetestuj nakładkę na stronie współprowadzącego i sprawdź, czy pojawia się wiersz.
Tekst jest widoczny, ale brak głosu (OpenAI)Sprawdź Odpowiedź dźwiękowa, uprawnienie audio przeglądarki i przechwytywanie dźwięku strony współprowadzącego w OBS. Nie używaj &tts w tym celu.
Dwa głosy jednocześnieUsuń &forcetts z linku nakładki.
Usłyszano pozostaje puste (aplikacja komputerowa)Sprawdź, czy mikrofon nie jest wyciszony, i poczekaj na pierwsze pobranie.
Usłyszano pozostaje puste (Chrome)Zezwól na mikrofon, sprawdź domyślny mikrofon komputera, internet i dostępność rozpoznawania mowy Chrome.
Odpowiedzi są powolneWypróbuj Mini, niski poziom rozumowania i szybkie przejmowanie głosu. Porównaj wiersz opóźnienia w Diagnostyce.
OpenAI ciągle się rozłączaPozostaw je uruchomione podczas kolejnych prób. Diagnostyka pokaże, co się nie udało.
Brakuje narzędzia sterowania transmisjąWłącz tę funkcję w oknie podręcznym i w sterowaniu transmisją współprowadzącego. OBS wymaga co najmniej jednej nazwy sceny.
Darmowe próbne AI przestało odpowiadaćUsługa może być wyłączona lub mieć limit żądań. Użyj własnego tokena, Ollama albo Custom API.
Lokalny model Gemma nie chce się pobraćSkieruj adres hosta zasobów na własną kopię plików Gemma.
Otwartych kilka nakładekUpewnij się, że etykieta nakładki odpowiada celowi w Docku. Domyślnie jest to cohost-overlay.
Przyciski wyciszenia i głośności
  • Wycisz mikrofon zatrzymuje przesyłanie Twojego głosu do współprowadzącego.
  • Wycisz głos współprowadzącego, suwak głośności, wybór wyjścia i Przestań mówić sterują tym, co słyszysz.
  • Wycisz udostępniany dźwięk systemowy jest oddzielne i widoczne tylko u dostawców, którzy mogą korzystać z Twojego ekranu.

Dodaj je na końcu cohost-overlay.html łącze.

Chcę…Dodaj do linku
Połącz z moim Social Stream (wymagane)?session=YOUR_SESSION_ID
Włącz mowę nakładki (przepływ doku)&tts lub &speak=1
Wymuś mowę nakładki, gdy strona współprowadzącego mówi (dodaje drugi głos)&forcetts
Ustaw etykietę nakładki&label=cohost-overlay
Zmień wyświetlaną nazwę&name=NinjaBot
Użyj własnego awatara&avatar=https://…
Przesuń&position=bottom-right
Powiększ lub pomniejsz&scale=1.2
Pokaż stan połączenia&status

Gdy strona współprowadzącego odtwarza już głos, nakładka pomija własną mowę, aby dźwięk się nie powtarzał. &forcetts wyłącza tę funkcję.

Jak strony się komunikują (dla programistów)

Format wiadomości i uwagi projektowe

Dock i nakładka korzystają ze standardowego połączenia sesji Social Stream. Wiadomości są wysyłane jako overlayNinja dane kierowane według etykiety.

Read on Co-host: Dock wysyła wybraną wiadomość bezpośrednio do cohost-overlay.html.

Answer / Light Roast: Dock pyta prywatnego chatbota w tle, pokazuje szkic w Docku i wysyła go do nakładki dopiero po kliknięciu Mów.

{
  "action": "cohostOverlay",
  "target": "cohost-overlay",
  "meta": {
    "command": "say",
    "text": "The line the avatar should say",
    "speak": true,
    "emotion": "happy"
  }
}
  • W tekstowych przepływach doku nakładka daje obraz i opcjonalny głos TTS. Dla głosu OpenAI przechwytuj cohost.html przechwytuj oddzielnie jako dźwięk. Nakładka nie odtwarza ponownie tego audio WebRTC.
  • Dodatkowe szczegóły polecenia trafiają do meta, aby dane były przewidywalne dla nakładek i automatyzacji.