Api referenceAudios
文字转语音(OpenAI 兼容)
通过 OpenAI 兼容请求异步生成语音。
当前文字转语音能力由可灵渠道提供。你可以使用 OpenAI Speech 请求字段提交任务,也可以直接使用可灵原生兼容接口。
警告
可灵 TTS 是异步任务。POST /v1/audio/speech 在模型路由到可灵渠道时返回任务 JSON,不会像 OpenAI TTS 一样直接返回二进制音频流。
支持模型
kling-v3
模型与音色的实际可用性取决于当前渠道,请以 模型广场 和上游可用音色为准。
OpenAI 兼容请求
string required
填写路由到可灵渠道的模型 ID。
string required
需要合成的文本。内部映射为可灵的 text。
string
可灵已有音色 ID。内部映射为 voice_id。
number
语速,范围 0.25 到 4.0。内部映射为 voice_speed。
string
可选的语音风格或表达要求。内部映射为可灵提示字段。
string
TokenFlash 扩展字段,例如 zh 或 en。内部映射为 voice_language。
object
可灵扩展字段,例如 callback_url 和 external_task_id。
说明
response_format 和 stream_format 当前不会改变可灵异步任务的输出格式。最终音频格式由可灵上游结果决定。
curl --request POST \
--url https://tokenflash.cn/v1/audio/speech \
--header 'Authorization: Bearer YOUR_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "kling-v3",
"input": "欢迎使用 TokenFlash 可灵语音合成接口。",
"voice": "YOUR_VOICE_ID",
"speed": 1.0,
"language": "zh"
}'import requests
response = requests.post(
"https://tokenflash.cn/v1/audio/speech",
headers={"Authorization": "Bearer YOUR_API_KEY"},
json={
"model": "kling-v3",
"input": "欢迎使用 TokenFlash 可灵语音合成接口。",
"voice": "YOUR_VOICE_ID",
"speed": 1.0,
"language": "zh",
},
)
print(response.json()){
"id": "task_01KXXXXXXXXXXXXXXXXXXXX",
"task_id": "task_01KXXXXXXXXXXXXXXXXXXXX",
"object": "video",
"model": "kling-v3",
"status": "queued",
"progress": 0,
"created_at": 1784080000
}注意
object 当前沿用统一异步多媒体任务结构,可能显示为 video。这不影响最终返回音频 URL。
可灵原生接口
原生接口使用可灵字段,返回与 OpenAI 兼容入口相同的异步任务结构。
curl --request POST \
--url https://tokenflash.cn/kling/v1/audio/tts \
--header 'Authorization: Bearer YOUR_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model_name": "kling-v3",
"text": "欢迎使用 TokenFlash 可灵语音合成接口。",
"voice_id": "YOUR_VOICE_ID",
"voice_language": "zh",
"voice_speed": 1.0
}'| 原生字段 | OpenAI 兼容字段 | 说明 |
|---|---|---|
model_name | model | 可灵模型 ID |
text | input | 需要合成的文本 |
voice_id | voice | 已有音色 ID |
voice_speed | speed | 语速 |
voice_language | language | 语音语言 |
警告
voice 或 voice_id 用于选择已有音色。当前没有独立的音色克隆接口。
多模态通用任务接口
需要统一管理图片、视频和音频任务时,也可以使用多模态接口:
curl --request POST \
--url https://tokenflash.cn/v1/multimodal/audio/generations \
--header 'Authorization: Bearer YOUR_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "kling-v3",
"task_type": "tts",
"metadata": {
"text": "欢迎使用 TokenFlash 可灵语音合成接口。",
"voice_id": "YOUR_VOICE_ID",
"voice_language": "zh",
"voice_speed": 1.0
}
}'查询任务
统一任务查询
curl --request GET \
--url https://tokenflash.cn/v1/tasks/task_01KXXXXXXXXXXXXXXXXXXXX \
--header 'Authorization: Bearer YOUR_API_KEY'可灵原生查询
curl --request GET \
--url https://tokenflash.cn/kling/v1/audio/tts/task_01KXXXXXXXXXXXXXXXXXXXX \
--header 'Authorization: Bearer YOUR_API_KEY'| 状态 | 说明 |
|---|---|
queued | 已进入队列 |
in_progress | 正在生成语音 |
completed | 生成完成 |
failed | 生成失败 |
任务完成后,响应中的 metadata.url 为音频结果地址:
{
"id": "task_01KXXXXXXXXXXXXXXXXXXXX",
"object": "video",
"model": "kling-v3",
"status": "completed",
"progress": 100,
"metadata": {
"url": "https://example.com/generated-audio.mp3"
}
}refresh-cw
统一任务查询
查看异步任务状态与结果字段。