Kitta AI Docs
통합 가이드타사 통합
Back to site

오픈토킹 설정 가이드

Kitta AI 모델과 복제된 음성을 사용하도록 OpenTalking에서 OpenAI 호환 TTS 공급자를 구성합니다.

Kitta AI TTS를 오픈토킹에 연결

OpenTalking에는 음성 대화 및 생성된 미디어를 위한 openai_compatible TTS 공급자가 포함되어 있습니다. TTS 공급자는 LLM 및 음성 인식 공급자와 별개입니다.

API 키와 음성 ID를 준비하세요

  1. API 관리에서 전용키를 생성합니다.
  2. 복제된 음성에서 음성 ID를 복사합니다.
  3. API 크레딧 잔액이 충분한지 확인하세요.

첫 번째 테스트에는 다음 시스템 음성을 사용하세요.

00a1b221-6137-4b73-ad62-b0cbce134167

오픈토킹 구성

OpenTalking의 백엔드 .env 파일에 다음 값을 추가하거나 업데이트하세요.

OPENTALKING_TTS_DEFAULT_PROVIDER=openai_compatible
OPENTALKING_TTS_OPENAI_BASE_URL=https://kittaai.com/v1
OPENTALKING_TTS_OPENAI_API_KEY=YOUR_FISH_AUDIO_API_KEY
OPENTALKING_TTS_OPENAI_MODEL=fishaudio-s21pro-flash
OPENTALKING_TTS_OPENAI_VOICE=00a1b221-6137-4b73-ad62-b0cbce134167
OPENTALKING_TTS_OPENAI_RESPONSE_FORMAT=wav
OPENTALKING_TTS_OPENAI_PROTOCOL=audio_speech

OPENTALKING_TTS_ENABLED_PROVIDERS가 이미 설정된 경우 쉼표로 구분된 목록에 openai_compatible가 포함되어 있는지 확인하세요.

Use the Base URL ending at /v1

OpenTalking은 /audio/speechOPENTALKING_TTS_OPENAI_BASE_URL에 추가합니다. 완전하게 넣지 마세요 이 변수의 /v1/audio/speech 엔드포인트입니다.

.env를 변경한 후 OpenTalking 백엔드를 다시 시작합니다. 설정에서 OpenAI 호환 TTS를 선택하고 짧은 미리보기 문장을 입력한 후 음성 미리보기를 재생하세요.

제공자 경계

  • 이 설정은 TTS만 변경합니다. LLM 및 ASR 공급자를 별도로 구성합니다.
  • 프로토콜은 audio_speech로 유지하세요. Kitta AI는 채팅 완료 오디오 제공업체가 아닙니다.
  • OpenTalking의 어댑터는 대화에 오디오를 스트리밍하기 전에 WAV를 직접 디코딩하므로 첫 번째 테스트에는 wav를 사용하십시오.
  • 미리보기가 작동한 후에만 시스템 음성 ID를 복제된 음성으로 교체하세요.

문제 해결

  • 404: https://kittaai.com/v1를 기본 URL로 사용합니다. OpenTalking에 /audio/speech가 추가되었습니다.
  • 401: OPENTALKING_TTS_OPENAI_API_KEY를 확인한 후 백엔드를 다시 시작합니다.
  • 402: 다시 시도하기 전에 API 크레딧을 추가하세요.
  • 400 또는 잘못된 음성: fishaudio-s21pro-flash 및 유효한 Kitta AI 음성 ID를 사용합니다.
  • OpenAI 호환 TTS를 사용할 수 없습니다: openai_compatibleOPENTALKING_TTS_ENABLED_PROVIDERS에 추가하고 다시 시작하세요.
  • 설정은 변경되었지만 오디오는 변경되지 않았습니다: OpenTalking은 백엔드 환경에 대한 런타임 구성을 유지합니다. 표시된 모델과 음성을 확인한 다음 해당 서비스를 다시 시작하십시오.

관련 문서