Kitta AI 文档
集成指南第三方软件接入

OpenTalking 接入教程

在 OpenTalking 中配置 OpenAI 兼容 TTS Provider,使用 Kitta AI 模型和克隆音色进行语音对话。

OpenTalking 接入 Kitta AI TTS

OpenTalking 内置 openai_compatible TTS Provider,可用于语音对话和媒体内容生成。它的 TTS、LLM 和语音识别 Provider 相互独立。

准备 API Key 和 Voice ID

  1. API 管理页面创建该软件专用的 API Key。
  2. 打开自己的克隆音色并复制 Voice ID。
  3. 确认 API 积分余额充足。

首次测试使用以下系统测试音色:

00a1b221-6137-4b73-ad62-b0cbce134167

配置 OpenTalking

在 OpenTalking 后端的 .env 中添加或修改:

OPENTALKING_TTS_DEFAULT_PROVIDER=openai_compatible
OPENTALKING_TTS_OPENAI_BASE_URL=https://kittaai.com/v1
OPENTALKING_TTS_OPENAI_API_KEY=YOUR_FISH_AUDIO_API_KEY
OPENTALKING_TTS_OPENAI_MODEL=fishaudio-s21pro-flash
OPENTALKING_TTS_OPENAI_VOICE=00a1b221-6137-4b73-ad62-b0cbce134167
OPENTALKING_TTS_OPENAI_RESPONSE_FORMAT=wav
OPENTALKING_TTS_OPENAI_PROTOCOL=audio_speech

如果已经设置 OPENTALKING_TTS_ENABLED_PROVIDERS,确认逗号分隔的列表中包含 openai_compatible

Base URL 只填写到 /v1

OpenTalking 会在 OPENTALKING_TTS_OPENAI_BASE_URL 后自动追加 /audio/speech,不要在变量中填写完整的 /v1/audio/speech 端点。

修改 .env 后重启 OpenTalking 后端。在设置页面选择 OpenAI-compatible TTS,输入一句短文本并播放音色试听。

Provider 边界

  • 上述变量只修改 TTS,LLM 和 ASR 需要单独配置。
  • Protocol 保持为 audio_speech;Kitta AI 不是 Chat Completions 音频 Provider。
  • 第一次测试使用 wav,OpenTalking 的 Adapter 可以直接解码 WAV,再把音频流送入对话。
  • 系统测试音色成功后,再替换为自己的克隆音色 Voice ID。

常见问题

  • 404:Base URL 使用 https://kittaai.com/v1/audio/speech 由 OpenTalking 自动追加。
  • 401:检查 OPENTALKING_TTS_OPENAI_API_KEY,修改后重启后端。
  • 402:API 积分不足,需要补充积分后重试。
  • 400 或音色无效:模型使用 fishaudio-s21pro-flash,音色使用有效的 Kitta AI Voice ID。
  • 没有 OpenAI-compatible TTS 选项:把 openai_compatible 加入 OPENTALKING_TTS_ENABLED_PROVIDERS 后重启。
  • 修改设置后声音没变化:确认界面显示的模型和音色已经更新,并重启对应的后端服务。

相关文档