OpenAI Audio Speech
当你要把文本合成为音频时,使用:
POST /v1/audio/speech最小示例
curl -sS "https://api.4tk.ai/v1/audio/speech" \
-H "Authorization: Bearer YOUR_SUB_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"model": "tts-1-hd",
"voice": "alloy",
"input": "你好,欢迎使用 4tk.ai。",
"response_format": "mp3"
}' \
--output speech.mp3返回行为
成功时返回的是音频二进制,不是 JSON。命令行建议直接使用 curl --output,应用端则应把响应流或二进制内容写入文件、对象存储或播放器缓存。
response_format、speed 等附加字段会按原样透传到上游;具体是否支持,取决于你选择的 TTS 模型与线路。
计费说明
- 如果该模型按 token 计费,当前会按 prompt floor 与输出音频时长进行估算结算。
- 如果该模型按次计费,则直接按模型单次价格扣费。
- 最终价格与可用模型请以 模型价格 和你的 tokenGroup 权限为准。
适用场景
- 文本播报、提示音、语音回复、TTS 落盘
- 需要 OpenAI 兼容的文生语音接口
- 想直接拿到可播放的音频响应,而不是二次封装 JSON
注意事项
voice与input为必填字段,且当前input必须是非空字符串。- 常见
response_format如mp3、wav可直接使用;更具体的支持范围以所选上游为准。 - 如果你只是验证路由是否可用,不要用
GET /v1/audio/speech,该端点只接受POST。