Skip to main content
Responses 是 OpenAI 原生的有状态响应协议。只有模型详情公开 Responses 格式且存在同协议 service 路径时,AI Sonar 才提供该入口;不会根据模型名或厂商名推断,也绝不回落 Chat Completions。AI Sonar 会保留未知字段、显式 null、空数组等 JSON 形状,并 best-effort 透传。

请求体

string
必填
要使用的模型 ID。可用选项请参见 Models
string | array
当请求改用可复用 prompt,或通过 previous_response_id 继续已存储响应时,可以省略 input。由对话组成的输入项列表。每个项可以是:
  • message: 带有角色和内容的对话消息
  • function_call: 一个函数调用请求
  • function_call_output: 来自函数调用的输出
对于多模态输入,message.content 可以是普通字符串,也可以是内容块数组。对于支持图像的模型(例如 GPT-5.4 变体),请将图像作为 input_image 块传递,而不是将 URL 或 Base64 字符串直接嵌入普通文本中。示例内容块:
  • { "type": "input_text", "text": "Describe this image" }
  • { "type": "input_image", "image_url": "https://example.com/image.jpg" }
  • { "type": "input_image", "image_url": "data:image/png;base64,..." }
string
提供给模型的系统指令(等同于 system 消息)。
integer
生成的最大 token 数量。
number
默认值:"1"
采样温度,范围在 0 到 2 之间。
array
模型可以调用的工具列表。AI Sonar 不维护本地 allowlist,而是原样转发原生工具定义;支持的类型和组合由选中的 service 决定。
boolean
默认值:"false"
如果为 true,则返回事件流。
string
用于从某个先前响应继续对话的响应 ID。
boolean
默认值:"true"
是否存储响应以便后续检索。
object
附加到响应以用于跟踪的元数据。
object
文本生成的配置选项。text.format 的行为取决于所选模型和路由路径;并不保证在每个模型上都一致。
boolean
默认值:"true"
是否允许并行进行多个工具调用。
number
Nucleus 采样参数(0-1)。
object
针对具备推理能力的模型(例如 GPT-5 系列变体)的推理配置。
  • effort (string): 推理努力级别(low, medium, high

响应

string
响应的唯一标识符。
string
始终为 response
integer
响应创建时的 Unix 时间戳。
array
模型生成的输出项列表。
object
token 使用统计。