Kitta Audio CLI
声音克隆与设计
使用授权素材克隆声音,试听设计候选并保存结果。
开始前
完成认证并确认额度足够。只克隆自己拥有权利或已获得授权的音频, 保留同意与来源记录,不要冒用他人身份欺骗听众。
克隆授权样本
kitta audio voices clone --schema
kitta audio voices clone --name Narrator --audio-file sample.wav --visibility private将 sample.wav 替换为获授权的本地录音。该命令以 multipart audioFiles 上传文件。 从返回的 JSON 中找到声音 ID,然后查询确认:
kitta audio voices get --voice VOICE_ID设计、试听与保存
kitta audio voices design --prompt "A calm warm narrator" --preview-text "Hello from Kitta"保留结果中的设计 ID 和候选 ID。候选是临时的;生成设计不等于保存可复用声音。
kitta audio voices preview --design DESIGN_ID --candidate CANDIDATE_ID --output preview.wav
kitta audio voices save --design DESIGN_ID --candidate CANDIDATE_ID --name Narrator用同一次设计结果中的 ID 替换占位符。保存前先试听 preview.wav。 保存后取得的声音 ID 可用于 TTS。
部分结果与未知结果
2026-09-22 实测限制:部分列表返回的声音可以合成,但 voices get 会返回
ERR_MODEL_NOT_FOUND。详情 404 本身不代表声音无法使用。请保留声音 ID 和
requestId 供支持排查,不要为了绕过查询不一致而付费创建新克隆。
自动化依赖详情查询前,请重新确认当前服务行为。
设计部分成功时,stdout 仍返回结果,退出码为 5。保留结果并检查可用候选, 不要假定什么都没有生成。克隆和设计等付费请求不会自动重试。 结果未知时,重新提交前先核对账号。 使用账号页面管理不需要的声音,不要编造尚未支持的 CLI 删除命令。
下一步:任务恢复与计费。