集成指南第三方软件接入
OpenTalking 接入教程
在 OpenTalking 中配置 OpenAI 兼容 TTS Provider,使用 Kitta AI 模型和克隆音色进行语音对话。
OpenTalking 接入 Kitta AI TTS
OpenTalking 内置 openai_compatible TTS Provider,可用于语音对话和媒体内容生成。它的 TTS、LLM 和语音识别 Provider 相互独立。
准备 API Key 和 Voice ID
首次测试使用以下系统测试音色:
00a1b221-6137-4b73-ad62-b0cbce134167配置 OpenTalking
在 OpenTalking 后端的 .env 中添加或修改:
OPENTALKING_TTS_DEFAULT_PROVIDER=openai_compatible
OPENTALKING_TTS_OPENAI_BASE_URL=https://kittaai.com/v1
OPENTALKING_TTS_OPENAI_API_KEY=YOUR_FISH_AUDIO_API_KEY
OPENTALKING_TTS_OPENAI_MODEL=fishaudio-s21pro-flash
OPENTALKING_TTS_OPENAI_VOICE=00a1b221-6137-4b73-ad62-b0cbce134167
OPENTALKING_TTS_OPENAI_RESPONSE_FORMAT=wav
OPENTALKING_TTS_OPENAI_PROTOCOL=audio_speech如果已经设置 OPENTALKING_TTS_ENABLED_PROVIDERS,确认逗号分隔的列表中包含 openai_compatible。
Base URL 只填写到 /v1
OpenTalking 会在 OPENTALKING_TTS_OPENAI_BASE_URL 后自动追加
/audio/speech,不要在变量中填写完整的 /v1/audio/speech 端点。
修改 .env 后重启 OpenTalking 后端。在设置页面选择 OpenAI-compatible TTS,输入一句短文本并播放音色试听。
Provider 边界
- 上述变量只修改 TTS,LLM 和 ASR 需要单独配置。
- Protocol 保持为
audio_speech;Kitta AI 不是 Chat Completions 音频 Provider。 - 第一次测试使用
wav,OpenTalking 的 Adapter 可以直接解码 WAV,再把音频流送入对话。 - 系统测试音色成功后,再替换为自己的克隆音色 Voice ID。
常见问题
- 404:Base URL 使用
https://kittaai.com/v1,/audio/speech由 OpenTalking 自动追加。 - 401:检查
OPENTALKING_TTS_OPENAI_API_KEY,修改后重启后端。 - 402:API 积分不足,需要补充积分后重试。
- 400 或音色无效:模型使用
fishaudio-s21pro-flash,音色使用有效的 Kitta AI Voice ID。 - 没有 OpenAI-compatible TTS 选项:把
openai_compatible加入OPENTALKING_TTS_ENABLED_PROVIDERS后重启。 - 修改设置后声音没变化:确认界面显示的模型和音色已经更新,并重启对应的后端服务。