Kitta AI 文档
Kitta Audio CLI

生成语音

从文本、UTF-8 文件或标准输入生成配音。

开始前

先完成快速开始。使用账号可访问的声音, 在付费请求前检查模型及其控制参数。

kitta audio models list --json
kitta audio voices list --all --language zh --json
kitta audio tts --schema

文本或文件

kitta audio tts --voice VOICE_ID --text "Hello from Kitta" --output hello.mp3
kitta audio tts --voice VOICE_ID --text-file script.txt --format wav --output narration.wav

将 script.txt 保存为 UTF-8。用查询到的声音 ID 替换 VOICE_ID。 每个完成的文件使用不同路径;CLI 不会覆盖已有文件。 --output 会等待任务完成。如果只等待不保存,使用 --wait。

标准输入

Bash:

printf '%s' 'Hello from Kitta' | kitta audio tts --voice VOICE_ID --text - --output stdin.mp3

PowerShell:

$OutputEncoding = [System.Text.UTF8Encoding]::new()
"Hello from Kitta" | kitta audio tts --voice VOICE_ID --text - --output stdin.mp3

PowerShell 可能追加换行。恢复提交时需要保持输入完全一致。

控制参数与结果

通过 --model 指定 models list 返回的模型 ID,声音与模型是否兼容由服务端判断。 使用 --schema 查看格式和控制参数限制。--no-text-normalization 可明确关闭文本规范化。 成功结果是完整下载的音频文件,诊断信息与任务 ID 输出到 stderr。

等待超时后,不要为了下载文件再创建任务。 继续阅读任务恢复与计费