协议接入
OpenAI Audio Speech

OpenAI Audio Speech

当你要把文本合成为音频时,使用:

POST /v1/audio/speech

最小示例

curl -sS "https://api.4tk.ai/v1/audio/speech" \
  -H "Authorization: Bearer YOUR_SUB_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts-1-hd",
    "voice": "alloy",
    "input": "你好,欢迎使用 4tk.ai。",
    "response_format": "mp3"
  }' \
  --output speech.mp3

返回行为

成功时返回的是音频二进制,不是 JSON。命令行建议直接使用 curl --output,应用端则应把响应流或二进制内容写入文件、对象存储或播放器缓存。

response_format、speed 等附加字段会按原样透传到上游;具体是否支持,取决于你选择的 TTS 模型与线路。

计费说明

  • 如果该模型按 token 计费,当前会按 prompt floor 与输出音频时长进行估算结算。
  • 如果该模型按次计费,则直接按模型单次价格扣费。
  • 最终价格与可用模型请以 模型价格 和你的 tokenGroup 权限为准。

适用场景

  • 文本播报、提示音、语音回复、TTS 落盘
  • 需要 OpenAI 兼容的文生语音接口
  • 想直接拿到可播放的音频响应,而不是二次封装 JSON

注意事项

  • voice 与 input 为必填字段,且当前 input 必须是非空字符串。
  • 常见 response_format 如 mp3、wav 可直接使用;更具体的支持范围以所选上游为准。
  • 如果你只是验证路由是否可用,不要用 GET /v1/audio/speech,该端点只接受 POST。