Kitta AI Docs
IntegrationsleitfädenIntegrationen von Drittanbietern

OpenTalking-Setup-Anleitung

Konfigurieren Sie den OpenAI-kompatiblen TTS-Anbieter in OpenTalking für die Verwendung eines Kitta AI-Modells und einer geklonten Stimme.

Kitta AI TTS mit OpenTalking verbinden

OpenTalking umfasst einen openai_compatible TTS-Anbieter für Sprachgespräche und generierte Medien. Sein TTS-Anbieter ist von seinen LLM- und Spracherkennungsanbietern getrennt.

Bereiten Sie den API-Schlüssel und die Sprach-ID vor

  1. Erstellen Sie einen dedizierten Schlüssel in API-Verwaltung.
  2. Kopieren Sie die Sprach-ID von Ihrer geklonten Stimme.
  3. Bestätigen Sie, dass Ihr API-Guthaben ausreichend ist.

Nutzen Sie für den ersten Test diese Systemstimme:

00a1b221-6137-4b73-ad62-b0cbce134167

Konfigurieren Sie OpenTalking

Fügen Sie diese Werte in der Backend-Datei .env von OpenTalking hinzu oder aktualisieren Sie sie:

OPENTALKING_TTS_DEFAULT_PROVIDER=openai_compatible
OPENTALKING_TTS_OPENAI_BASE_URL=https://kittaai.com/v1
OPENTALKING_TTS_OPENAI_API_KEY=YOUR_FISH_AUDIO_API_KEY
OPENTALKING_TTS_OPENAI_MODEL=fishaudio-s21pro-flash
OPENTALKING_TTS_OPENAI_VOICE=00a1b221-6137-4b73-ad62-b0cbce134167
OPENTALKING_TTS_OPENAI_RESPONSE_FORMAT=wav
OPENTALKING_TTS_OPENAI_PROTOCOL=audio_speech

Wenn OPENTALKING_TTS_ENABLED_PROVIDERS bereits festgelegt ist, stellen Sie sicher, dass die durch Kommas getrennte Liste openai_compatible enthält.

Use the Base URL ending at /v1

OpenTalking hängt /audio/speech an OPENTALKING_TTS_OPENAI_BASE_URL an. Geben Sie nicht das Ganze ein /v1/audio/speech-Endpunkt in dieser Variablen.

Starten Sie das OpenTalking-Backend neu, nachdem Sie .env geändert haben. Wählen Sie in den Einstellungen OpenAI-kompatibles TTS aus, geben Sie einen kurzen Vorschausatz ein und spielen Sie die Sprachvorschau ab.

Anbietergrenzen

  • Diese Einstellungen ändern nur TTS. Konfigurieren Sie die LLM- und ASR-Anbieter separat.
  • Behalten Sie audio_speech als Protokoll bei. Kitta AI ist kein Audioanbieter für Chat-Abschlüsse. – Verwenden Sie wav für den ersten Test, da der Adapter von OpenTalking WAV direkt dekodiert, bevor er Audio in die Konversation streamt.
  • Ersetzen Sie die System-Sprach-ID erst durch Ihre geklonte Stimme, wenn die Vorschau funktioniert.

Fehlerbehebung

  • 404: https://kittaai.com/v1 als Basis-URL verwenden; OpenTalking fügt /audio/speech hinzu.
  • 401: Überprüfen Sie OPENTALKING_TTS_OPENAI_API_KEY und starten Sie dann das Backend neu.
  • 402: Fügen Sie API-Credits hinzu, bevor Sie es erneut versuchen.
  • 400 oder ungültige Stimme: Verwenden Sie fishaudio-s21pro-flash und eine gültige Kitta AI-Sprach-ID.
  • OpenAI-kompatibles TTS ist nicht verfügbar: openai_compatible zu OPENTALKING_TTS_ENABLED_PROVIDERS hinzufügen und neu starten.
  • Einstellungen geändert, Audio jedoch nicht: OpenTalking behält die Laufzeitkonfiguration in der Backend-Umgebung bei; Bestätigen Sie das angezeigte Modell und die angezeigte Stimme und starten Sie dann den betroffenen Dienst neu.

Verwandte Dokumentation