null、空数组等 JSON 形状,并 best-effort 透传。
请求体
string | array
当请求改用可复用
prompt,或通过 previous_response_id 继续已存储响应时,可以省略 input。由对话组成的输入项列表。每个项可以是:message: 带有角色和内容的对话消息function_call: 一个函数调用请求function_call_output: 来自函数调用的输出
message.content 可以是普通字符串,也可以是内容块数组。对于支持图像的模型(例如 GPT-5.4 变体),请将图像作为 input_image 块传递,而不是将 URL 或 Base64 字符串直接嵌入普通文本中。示例内容块:{ "type": "input_text", "text": "Describe this image" }{ "type": "input_image", "image_url": "https://example.com/image.jpg" }{ "type": "input_image", "image_url": "data:image/png;base64,..." }
string
提供给模型的系统指令(等同于 system 消息)。
integer
生成的最大 token 数量。
number
默认值:"1"
采样温度,范围在 0 到 2 之间。
array
模型可以调用的工具列表。AI Sonar 不维护本地 allowlist,而是原样转发原生工具定义;支持的类型和组合由选中的 service 决定。
boolean
默认值:"false"
如果为 true,则返回事件流。
string
用于从某个先前响应继续对话的响应 ID。
boolean
默认值:"true"
是否存储响应以便后续检索。
object
附加到响应以用于跟踪的元数据。
object
文本生成的配置选项。
text.format 的行为取决于所选模型和路由路径;并不保证在每个模型上都一致。boolean
默认值:"true"
是否允许并行进行多个工具调用。
number
Nucleus 采样参数(0-1)。
object
针对具备推理能力的模型(例如 GPT-5 系列变体)的推理配置。
effort(string): 推理努力级别(low,medium,high)
响应
string
响应的唯一标识符。
string
始终为
response。integer
响应创建时的 Unix 时间戳。
array
模型生成的输出项列表。
object
token 使用统计。