統合ガイドサードパーティの統合
OpenTalking セットアップガイド
OpenTalking で OpenAI 互換の TTS プロバイダーを構成して、Kitta AI モデルとクローン音声を使用します。
Kitta AI TTS を OpenTalking に接続する
OpenTalking には、音声会話と生成されたメディア用の openai_compatible TTS プロバイダーが含まれています。その TTS プロバイダーは、LLM および音声認識プロバイダーとは別のものです。
API キーと Voice ID を準備します
- API管理に専用キーを作成します。
- クローンした音声から音声 ID をコピーします。
- API クレジット残高 が十分であることを確認します。
最初のテストにはこのシステム音声を使用します。
00a1b221-6137-4b73-ad62-b0cbce134167OpenTalking を設定する
OpenTalking のバックエンド .env ファイルに次の値を追加または更新します。
OPENTALKING_TTS_DEFAULT_PROVIDER=openai_compatible
OPENTALKING_TTS_OPENAI_BASE_URL=https://kittaai.com/v1
OPENTALKING_TTS_OPENAI_API_KEY=YOUR_FISH_AUDIO_API_KEY
OPENTALKING_TTS_OPENAI_MODEL=fishaudio-s21pro-flash
OPENTALKING_TTS_OPENAI_VOICE=00a1b221-6137-4b73-ad62-b0cbce134167
OPENTALKING_TTS_OPENAI_RESPONSE_FORMAT=wav
OPENTALKING_TTS_OPENAI_PROTOCOL=audio_speechOPENTALKING_TTS_ENABLED_PROVIDERS がすでに設定されている場合は、カンマ区切りのリストに openai_compatible が含まれていることを確認してください。
Use the Base URL ending at /v1
OpenTalking は、/audio/speech を OPENTALKING_TTS_OPENAI_BASE_URL
に追加します。完全なものは入れないでください この変数の /v1/audio/speech エンドポイント。
.env を変更した後、OpenTalking バックエンドを再起動します。 [設定] で、OpenAI 互換の TTS を選択し、短いプレビュー文を入力して、音声プレビューを再生します。
プロバイダーの境界
- これらの設定は、TTS のみを変更します。 LLM プロバイダーと ASR プロバイダーを個別に構成します。
- プロトコルとして
audio_speechを維持します。 Kitta AI はチャット補完オーディオ プロバイダーではありません。 - OpenTalking のアダプターは音声を会話にストリーミングする前に WAV を直接デコードするため、最初のテストには
wavを使用します。 - プレビューが機能した後でのみ、システムの音声 ID をクローンした音声に置き換えます。
トラブルシューティング
- 404:
https://kittaai.com/v1をベース URL として使用します。 OpenTalking には/audio/speechが追加されます。 - 401:
OPENTALKING_TTS_OPENAI_API_KEYを確認し、バックエンドを再起動します。 - 402: 再試行する前に、API クレジットを追加してください。
- 400 または無効な音声:
fishaudio-s21pro-flashと有効な Kitta AI 音声 ID を使用します。 - OpenAI 互換の TTS は使用できません:
openai_compatibleをOPENTALKING_TTS_ENABLED_PROVIDERSに追加して再起動します。 - 設定は変更されましたが、音声は変更されませんでした: OpenTalking はランタイム設定をバックエンド環境に保持します。表示されている機種と音声を確認し、該当サービスを再起動してください。