Kitta Audio CLI
生成语音
从文本、UTF-8 文件或标准输入生成配音。
开始前
先完成快速开始。使用账号可访问的声音, 在付费请求前检查模型及其控制参数。
kitta audio models list --json
kitta audio voices list --all --language zh --json
kitta audio tts --schema文本或文件
kitta audio tts --voice VOICE_ID --text "Hello from Kitta" --output hello.mp3
kitta audio tts --voice VOICE_ID --text-file script.txt --format wav --output narration.wav将 script.txt 保存为 UTF-8。用查询到的声音 ID 替换 VOICE_ID。 每个完成的文件使用不同路径;CLI 不会覆盖已有文件。 --output 会等待任务完成。如果只等待不保存,使用 --wait。
标准输入
Bash:
printf '%s' 'Hello from Kitta' | kitta audio tts --voice VOICE_ID --text - --output stdin.mp3PowerShell:
$OutputEncoding = [System.Text.UTF8Encoding]::new()
"Hello from Kitta" | kitta audio tts --voice VOICE_ID --text - --output stdin.mp3PowerShell 可能追加换行。恢复提交时需要保持输入完全一致。
控制参数与结果
通过 --model 指定 models list 返回的模型 ID,声音与模型是否兼容由服务端判断。 使用 --schema 查看格式和控制参数限制。--no-text-normalization 可明确关闭文本规范化。 成功结果是完整下载的音频文件,诊断信息与任务 ID 输出到 stderr。
等待超时后,不要为了下载文件再创建任务。 继续阅读任务恢复与计费。