Skip to main content
POST
文字转语音

Authorizations

Authorization
string
header
required

每个请求都通过 API Key 认证:Authorization: Bearer {API_KEY}。应用接口使用应用 API Key,知识库接口使用知识库 API Key(快速开始)。

API Key 应保存在服务端,切勿嵌入客户端代码。缺失或无效的 Key 会返回 HTTP 401unauthorized)。

Body

application/json

文字转语音的请求体。提供 message_idtext 其中之一。

message_id
string<uuid>

要转为语音的消息答案的 ID。同时提供 text 时,优先使用 message_id。消息 ID 从 获取会话历史消息 获取。

text
string

要合成为语音的文本。

user
string

终端用户标识,由你的应用定义,需在应用内唯一。参见 终端用户身份

voice
string

文字转语音使用的声音。可用声音取决于为此应用配置的 TTS 提供商。使用获取应用参数text_to_speech.voice 中的 voice 值作为默认值。

streaming
boolean

为向后兼容而保留,但不产生任何效果。音频是否以流式返回由配置的 TTS 供应商的输出决定,而非此字段。

Response

返回生成的音频。Content-Type 响应头反映供应商实际返回的音频容器格式,可识别时会根据响应字节校验。

响应体可能是 AAC、FLAC、MP4、MP3、Ogg、WAV 或 WebM。无法识别的输出按供应商声明的类型标注;未声明时标注为 audio/mpeg

供应商流式返回时按分块传输编码交付;请求中的 streaming 字段不控制此行为。

The response is of type file.

Last modified on August 24, 2026