KI-Co-Host

Ein KI-Begleiter zum Sprechen im Stream. Er kann auch deinen Chat lesen.

Zwei Nutzungsmöglichkeiten

Sprach-Co-Host

Sprich laut mit der KI auf cohost.html. Es antwortet dir und kann auf Nachfrage deinen Chat besprechen.

Einrichten

Dock-Schaltflächen

Klicke im Dock mit der rechten Maustaste auf eine Chatnachricht. Der KI-Avatar liest sie vor oder entwirft eine Antwort oder leichte Neckerei, die du zuerst freigibst.

Einrichten

Beide zeigen Avatar und Sprechblase in OBS über das KI-Bühnenoverlay, cohost-overlay.html.

Sprach-Co-Host in 8 Schritten

Dies nutzt OpenAI Realtimedu brauchst also einen OpenAI-API-Schlüssel. Weitere Optionen sind weiter unten.

  1. Wähle im Social-Stream-Popup ChatGPT-API, füge deinen OpenAI-Projekt-API-Schlüssel ein und klicke auf Ausgewählten Chatbot testen.
  2. Öffne cohost.html -Link aus dem Popup. Halte diesen Link geheim.
  3. Auswählen OpenAI Realtime.
  4. Wähle das Mikrofon, in das du sprichst. Lass Audioantwort aktiviert.
  5. Drücken Sie Co-Host starten.
  6. Lass Live-Chat auf Nur Kontext. Frage jederzeit „Was sagt der Chat?“
  7. Erfasse in OBS den Ton der Co-Host-Seite oder App. Die KI-Stimme wird nur dort abgespielt.
  8. Hinzufügen cohost-overlay.html?session=YOUR_SESSION_ID in OBS als Browserquelle für Avatar und Sprechblase hinzu.
Steuerungsseite cohost.html mit Mediengeräten, KI-Anbietereinstellungen, Systemanweisungen und Livechat-Status
Die Co-Host-Seite: Mikrofon, KI-Anbieter, Anweisungen und Live-Chat-Status.
Eigene Audiospur in OBS gewünscht? Wähle unter folgender Einstellung ein virtuelles Audiokabel: Co-Host-Ausgabe, sofern dein Setup es unterstützt. Lass auch die Sprechblase sichtbar, damit Zuschauer ohne Ton mitlesen können.
Bildschirm oder Kamera freigeben? Optional. Video startet mit Kein Video. Wenn du Folgendes wählst: Bildschirmfreigabe oder eine Kamera auswählst, erhält OpenAI bei jeder gesprochenen oder getippten Eingabe ein Bild, kein Live-Video. Das kann Kosten und Verzögerungen erhöhen.
Datenschutz: dein Mikrofon, der gewählte Bildschirm oder die Kamera sowie geteilte Chatnachrichten werden an OpenAI gesendet. Zuschauer können den Co-Host nicht per Chat zur Ausführung von Werkzeugen bringen. Der Co-Host-Link läuft nach 12 Stunden ab, gilt nur für deine Sitzung und wird nach dem Laden aus der Adressleiste entfernt.
Mehr über OpenAI Realtime
  • Die Abrechnung erfolgt über dein OpenAI-API-Konto. Es ist von chatgpt.com getrennt und nimmt nicht an Gesprächen auf der ChatGPT-Website oder in der App teil.
  • Dein Standardschlüssel bleibt in Social Stream. Die Co-Host-Seite erhält nur einen kurzlebigen Zugang.
  • Dafür musst du die Option „Privater Chatbot“ nicht aktivieren.
  • Antworten sind auf 512 Ausgabetoken begrenzt. Diagnose zeigt den gesamten Tokenverbrauch und wie schnell Antworten beginnen.
  • Wenn du dazwischenredest, stoppt es und verwirft die noch nicht abgespielte Audiospur.
  • Es speichert bis zu 20 aktuelle Chatnachrichten für höchstens 90 Sekunden, einschließlich Spenden, Mitgliedschaften sowie Moderator-, Ereignis- und Kanalinformationen. Danach vergisst es sie.
  • Bei einem Verbindungsabbruch stellt es die Verbindung selbst wieder her und startet vor dem 60-Minuten-Limit von OpenAI eine neue Sitzung. Deine Anweisungen und Geschwindigkeitseinstellungen bleiben erhalten, aber gesprochene Inhalte werden vergessen.

Wie es deinen Chat verwendet

Öffne die Co-Host-Seite mit derselben session wie Social Stream, damit sie deinen Live-Chat sehen kann. Wähle den Modus unter Live-Chat.

Live-Chat-EinstellungWas es macht
Nur Kontext – auf Nachfrage antworten (Standard)Merkt sich aktuelle Nachrichten und bleibt stumm, bis du nach dem Chat fragst.
Fragen und Erwähnungen laut beantwortenBeantwortet Fragen und Erwähnungen selbstständig laut.
Auf jede Nachricht laut antwortenBeantwortet jede Nachricht laut.

Keine dieser Funktionen sendet Antworten in den YouTube-, Twitch- oder Kick-Chat. Nur Kontext gibt den Chat nur bei OpenAI Realtime an die KI weiter. Andere Anbieter beobachten den Chat, geben ihn aber nicht an die KI weiter.

Sprache ohne OpenAI

Wo es läuftWie es dich hört
SSN-Desktop-AppWhisper auf deinem eigenen Computer. Bei der ersten Nutzung werden etwa 42 MB heruntergeladen. Danach funktioniert es offline.
Chrome (Erweiterungslink)Chromes Spracherkennung. Benötigt möglicherweise Internet.
Andere BrowserSprache funktioniert möglicherweise nicht. Texteingabe, Live-Chat, Kamera oder Bildschirm sowie KI-Antworten können weiterhin funktionieren.

Um zu prüfen, ob es dich hört, öffne Diagnose. Dort sollte stehen: Hört zu (Desktop Whisper) oder Hört zu (OpenAI WebRTC)und deine Worte sollten erscheinen unter Gehört.

Kostenlose KI zum Testen

  1. Öffnen Chatbots und KI-Dienste → LLM-Dienstanbieter konfigurieren.
  2. Auswählen Gehostetes Test-LLM von SSN (experimentell).
  3. Lass Endpunkt, Token und Modell leer.

Während der Testphase ist es kostenlos und kann deaktiviert oder in der Nutzung begrenzt werden. Füge für eine dauerhafte Nutzung deinen eigenen Token hinzu oder verwende eine lokale KI.

Dock-Schaltflächen in 5 Schritten

  1. Öffne das Dock: dock.html?session=YOUR_SESSION_ID.
  2. Bühnenoverlay in OBS hinzufügen: cohost-overlay.html?session=YOUR_SESSION_ID. Füge hinzu &tts wenn es sprechen soll.
  3. Richte im Popup einen KI-Anbieter ein. Für einen schnellen Test nutze Gehostetes Test-LLM von SSN.
  4. Aktiviere Chatbots und KI-Dienste → Chatbot – Private Oberfläche → Privaten Chatbot aktivieren.
  5. Klicke im Dock mit der rechten Maustaste auf eine Nachricht und wähle Co-Host.
Kein Co-Host-Menü? Es erscheint erst, wenn das Dock das Bühnenoverlay in derselben Sitzung erkennt.
SchaltflächeWas es machtBenötigt
Im Co-Host vorlesenDer Avatar liest die Nachricht vor.Bühnenoverlay verbunden. Keine KI nötig.
AntwortEntwirft eine kurze Antwort zur Freigabe.Privater Chatbot aktiviert und ein KI-Anbieter eingerichtet.
Leichter RoastEntwirft eine kurze, spielerische, jugendfreie Neckerei zur Freigabe.Privater Chatbot aktiviert und ein KI-Anbieter eingerichtet.
SprechenSendet deinen freigegebenen Entwurf an das Overlay.Ein Entwurf.
KopierenKopiert den Entwurf, ohne ihn zu senden.Ein Entwurf.

KI-Entwürfe werden erst gesprochen, wenn du auf Folgendes klickst: Sprechen. Die Freigabe erfolgt im Dock außerhalb des Streams.

Das Kontextmenü lässt sich noch nicht per Tastatur bedienen. Tastaturnutzer können tippen oder sprechen auf cohost.html stattdessen.

Geschwindigkeit, Qualität und Kosten (OpenAI)

EinstellungSchneller und günstigerIntelligenter, langsamer
ModellMiniVolle Qualität (teurer)
DenktiefeMinimal oder NiedrigHoch oder sehr hoch (teurer)
Geschwindigkeit des SprecherwechselsSchnell: wartet etwa 2 Sekunden nach deinem Sprechende. Kann bei Pausen unterbrechen.Ausgewogen: etwa 4 Sekunden. Geduldig: etwa 8.

Änderungen der Denktiefe gelten auch bei bestehender Verbindung. Diagnose zeigt, wie lange es bis zum Beginn einer Antwort dauert. Netzwerk und OpenAI-Auslastung können weiterhin schwanken.

Den Stream steuern lassen

Der Co-Host kann Spotify abspielen, OBS-Szenen wechseln oder eine Chatnachricht hervorheben. Alles ist standardmäßig deaktiviert. OpenAI Realtime unterstützt alle drei Funktionen. SSN Configured LLM unterstützt nur Spotify. Andere Anbieter unterstützen diese Funktionen noch nicht.

  1. Aktiviere im Social-Stream-Popup nur die gewünschten Werkzeuge.
  2. Gib für OBS die erlaubten Szenennamen exakt und kommasepariert ein. Lass actions.html mit OBS verbunden oder verwende eine OBS-Browserquelle mit vollen Berechtigungen.
  3. Ein cohost.html, öffne Stream-Steuerung des Co-Hosts und aktiviere dieselben Werkzeuge.
  4. Bitte laut darum, etwa „zur BRB-Szene wechseln“, „letzte Nachricht hervorheben“ oder „hervorgehobenen Chat leeren“.
Nur du kannst Werkzeuge auslösen. Zuschauer können das nicht. Es führt pro Anfrage ein Werkzeug aus und kann nur Szenen aus deiner Liste wählen. Zum Hervorheben einer Nachricht muss das Dock geöffnet sein. Eine „erledigt“-Antwort bedeutet, dass die Anfrage gesendet wurde, nicht dass OBS oder das Overlay sie abgeschlossen hat.

Probleme beheben

ProblemVersuche Folgendes
Kein Co-Host-Menü im DockDas Bühnenoverlay ist nicht in derselben Sitzung geöffnet. Der Schalter für das primäre Chatbot-Overlay hat darauf keinen Einfluss.
Antwort oder leichte Neckerei ist ausgegrautAktiviere die Option „Privater Chatbot“ und prüfe, ob Social Stream läuft.
Antwort, leichte Neckerei oder konfiguriertes SSN-LLM überschreitet das ZeitlimitPrüfe, ob Social Stream läuft, die Sitzung übereinstimmt, der private Chatbot aktiv und dein KI-Anbieter erreichbar ist.
Co-Host-Seite sieht den Chat nichtVerwende denselben session wie im Popup. Wähle bei Live-Chat einen anderen Wert als Aus.
Es kennt den Chat, bleibt aber stummDas ist bei „Nur Kontext“ normal. Frage, was im Chat gesagt wird, oder einen anderen Modus wählen.
In OBS ist nichts zu sehenKlicke auf Overlay testen auf der Co-Host-Seite und prüfe, ob die Zeile erscheint.
Text erscheint, aber keine Stimme (OpenAI)Prüfe Audioantwort, die Audiofreigabe des Browsers und ob OBS das Audio der Co-Host-Seite erfasst. Verwende nicht &tts dafür.
Zwei Stimmen gleichzeitigEntfernen &forcetts aus dem Overlay-Link.
Gehört bleibt leer (Desktop)Prüfe, ob das Mikrofon nicht stummgeschaltet ist, und warte auf den ersten Download.
Gehört bleibt leer (Chrome)Erlaube das Mikrofon und prüfe Standardmikrofon, Internet sowie die Verfügbarkeit der Chrome-Spracherkennung.
Antworten sind langsamVersuche Mini, niedrige Denktiefe und schnelle Sprecherwechsel. Vergleiche die Latenzzeile in der Diagnose.
OpenAI trennt ständig die VerbindungLass es während der erneuten Verbindungsversuche laufen. Die Diagnose zeigt, was fehlgeschlagen ist.
Ein Stream-Steuerwerkzeug fehltAktiviere es sowohl im Popup als auch in der Co-Host-Stream-Steuerung. OBS benötigt mindestens einen Szenennamen.
Die kostenlose Test-KI antwortet nicht mehrEs ist möglicherweise deaktiviert oder in der Nutzung begrenzt. Nutze deinen eigenen Token, Ollama oder Custom API.
Lokales Gemma wird nicht heruntergeladenVerweise den Asset-Host auf deine eigene Kopie der Gemma-Dateien.
Mehrere Overlays geöffnetAchte darauf, dass die Overlay-Bezeichnung mit dem Ziel im Dock übereinstimmt. Der Standard ist cohost-overlay.
Stumm- und Lautstärketasten
  • Mikrofon stummschalten stoppt die Übertragung deiner Stimme an den Co-Host.
  • Co-Host-Stimme stummschalten, der Lautstärkeregler, die Ausgabewahl und Sprechen beenden bestimmen, was du hörst.
  • Geteiltes Systemaudio stummschalten ist separat und erscheint nur bei Anbietern, die deinen Bildschirm nutzen können.

Füge dies am Ende deines cohost-overlay.html Link.

Ich möchte …Zum Link hinzufügen
Mit meinem Social Stream verbinden (erforderlich)?session=YOUR_SESSION_ID
Overlay sprechen lassen (Dock-Ablauf)&tts oder &speak=1
Overlay-Sprache erzwingen, auch wenn die Co-Host-Seite spricht (fügt zweite Stimme hinzu)&forcetts
Overlay-Bezeichnung festlegen&label=cohost-overlay
Angezeigten Namen ändern&name=NinjaBot
Eigenen Avatar verwenden&avatar=https://…
Verschieben&position=bottom-right
Größer oder kleiner machen&scale=1.2
Verbindungsstatus anzeigen&status

Wenn die Co-Host-Seite die Stimme bereits abspielt, lässt das Overlay seine eigene Sprachausgabe aus, damit du sie nicht doppelt hörst. &forcetts schaltet das aus.

Wie die Seiten kommunizieren (für Entwickler)

Nachrichtenformat und Hinweise zum Aufbau

Dock und Overlay verwenden die normale Social-Stream-Sitzungsverbindung. Nachrichten werden gesendet als overlayNinja Daten gesendet und anhand des Labels adressiert.

Im Co-Host vorlesen: das Dock sendet die ausgewählte Nachricht direkt an cohost-overlay.html.

Antwort / Leichter Roast: das Dock fragt im Hintergrund den privaten Chatbot, zeigt den Entwurf im Dock und sendet ihn erst an das Overlay, wenn du auf „Sprechen“ klickst.

{
  "action": "cohostOverlay",
  "target": "cohost-overlay",
  "meta": {
    "command": "say",
    "text": "The line the avatar should say",
    "speak": true,
    "emotion": "happy"
  }
}
  • Bei Dock-Textabläufen liefert das Overlay Bild und optionale TTS-Stimme. Erfasse für die OpenAI-Stimme cohost.html separat als Audio erfassen. Das Overlay spielt dieses WebRTC-Audio nicht erneut ab.
  • Zusätzliche Befehlsdetails kommen in metadamit Daten für Overlays und Automationen vorhersehbar bleiben.