TokenFlashTokenFlash
Api referenceAudios

文字转语音(OpenAI 兼容)

通过 OpenAI 兼容请求异步生成语音。

当前文字转语音能力由可灵渠道提供。你可以使用 OpenAI Speech 请求字段提交任务,也可以直接使用可灵原生兼容接口。

警告

可灵 TTS 是异步任务。POST /v1/audio/speech 在模型路由到可灵渠道时返回任务 JSON,不会像 OpenAI TTS 一样直接返回二进制音频流。

支持模型

  • kling-v3

模型与音色的实际可用性取决于当前渠道,请以 模型广场 和上游可用音色为准。

OpenAI 兼容请求

string required

填写路由到可灵渠道的模型 ID。

string required

需要合成的文本。内部映射为可灵的 text

string

可灵已有音色 ID。内部映射为 voice_id

number

语速,范围 0.254.0。内部映射为 voice_speed

string

可选的语音风格或表达要求。内部映射为可灵提示字段。

string

TokenFlash 扩展字段,例如 zhen。内部映射为 voice_language

object

可灵扩展字段,例如 callback_urlexternal_task_id

说明

response_formatstream_format 当前不会改变可灵异步任务的输出格式。最终音频格式由可灵上游结果决定。

curl --request POST \
  --url https://tokenflash.cn/v1/audio/speech \
  --header 'Authorization: Bearer YOUR_API_KEY' \
  --header 'Content-Type: application/json' \
  --data '{
    "model": "kling-v3",
    "input": "欢迎使用 TokenFlash 可灵语音合成接口。",
    "voice": "YOUR_VOICE_ID",
    "speed": 1.0,
    "language": "zh"
  }'
import requests

response = requests.post(
    "https://tokenflash.cn/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "kling-v3",
        "input": "欢迎使用 TokenFlash 可灵语音合成接口。",
        "voice": "YOUR_VOICE_ID",
        "speed": 1.0,
        "language": "zh",
    },
)

print(response.json())
{
  "id": "task_01KXXXXXXXXXXXXXXXXXXXX",
  "task_id": "task_01KXXXXXXXXXXXXXXXXXXXX",
  "object": "video",
  "model": "kling-v3",
  "status": "queued",
  "progress": 0,
  "created_at": 1784080000
}

注意

object 当前沿用统一异步多媒体任务结构,可能显示为 video。这不影响最终返回音频 URL。

可灵原生接口

原生接口使用可灵字段,返回与 OpenAI 兼容入口相同的异步任务结构。

curl --request POST \
  --url https://tokenflash.cn/kling/v1/audio/tts \
  --header 'Authorization: Bearer YOUR_API_KEY' \
  --header 'Content-Type: application/json' \
  --data '{
    "model_name": "kling-v3",
    "text": "欢迎使用 TokenFlash 可灵语音合成接口。",
    "voice_id": "YOUR_VOICE_ID",
    "voice_language": "zh",
    "voice_speed": 1.0
  }'
原生字段OpenAI 兼容字段说明
model_namemodel可灵模型 ID
textinput需要合成的文本
voice_idvoice已有音色 ID
voice_speedspeed语速
voice_languagelanguage语音语言

警告

voicevoice_id 用于选择已有音色。当前没有独立的音色克隆接口。

多模态通用任务接口

需要统一管理图片、视频和音频任务时,也可以使用多模态接口:

curl --request POST \
  --url https://tokenflash.cn/v1/multimodal/audio/generations \
  --header 'Authorization: Bearer YOUR_API_KEY' \
  --header 'Content-Type: application/json' \
  --data '{
    "model": "kling-v3",
    "task_type": "tts",
    "metadata": {
      "text": "欢迎使用 TokenFlash 可灵语音合成接口。",
      "voice_id": "YOUR_VOICE_ID",
      "voice_language": "zh",
      "voice_speed": 1.0
    }
  }'

查询任务

统一任务查询

curl --request GET \
  --url https://tokenflash.cn/v1/tasks/task_01KXXXXXXXXXXXXXXXXXXXX \
  --header 'Authorization: Bearer YOUR_API_KEY'

可灵原生查询

curl --request GET \
  --url https://tokenflash.cn/kling/v1/audio/tts/task_01KXXXXXXXXXXXXXXXXXXXX \
  --header 'Authorization: Bearer YOUR_API_KEY'
状态说明
queued已进入队列
in_progress正在生成语音
completed生成完成
failed生成失败

任务完成后,响应中的 metadata.url 为音频结果地址:

{
  "id": "task_01KXXXXXXXXXXXXXXXXXXXX",
  "object": "video",
  "model": "kling-v3",
  "status": "completed",
  "progress": 100,
  "metadata": {
    "url": "https://example.com/generated-audio.mp3"
  }
}
refresh-cw

统一任务查询

查看异步任务状态与结果字段。

On this page