Skip to main content
POST
Responses API 是 OpenAI 推出的新一代 Agentic 接口,相比 Chat Completions 提供更强大的能力:
  • 函数调用(Function Calling):模型可调用自定义函数
  • 内置工具web_search_preview(联网搜索)等开箱即用
  • 服务端多轮上下文:通过 previous_response_id 自动维护对话历史,无需客户端传完整消息
  • 推理力度控制:通过 reasoning.effort 精确调节思考深度
标注为 Responses Only 的模型(如 gpt-5-pro-officialgpt-5.3-codex-official)仅支持此 API,不支持 Chat Completions。完整模型列表请参阅 模型一览

Authorizations

string
必填
使用 Bearer Token 认证
获取 API Key:访问 API Key 管理页面

Body

string
必填
模型名称示例:"gpt-5-pro-official""gpt-5.3-codex-official""gpt-5.2-official"
string | object[]
必填
用户输入,支持两种格式:
  • 字符串:简单文本输入
  • 消息数组:多轮对话格式
string
系统指令,指导模型行为(等同于 Chat Completions 中的 system message)
boolean
默认值:false
是否启用流式输出
integer
生成内容的最大 token 数量
number
默认值:1
采样温度,范围 0 ~ 2
number
默认值:1
核采样概率阈值,范围 0 ~ 1
string
上一次响应的 ID,用于服务端自动拼接多轮上下文,无需客户端传完整历史消息
object
推理配置
object[]
可用工具列表
string
默认值:"auto"
工具选择策略:autononerequired

Response

string
响应的唯一标识符(可用作 previous_response_id
string
固定为 response
string
响应状态:completedfailedin_progress
object[]
输出项列表,可能包含多种类型:
  • message:文本回复,包含 content[].text
  • function_call:函数调用请求,包含 namearguments
  • reasoning:推理过程(当 reasoning.effortnone 时出现)
  • web_search_call:联网搜索调用记录
object
token 消耗统计
  • usage.input_tokens:输入 token 数
  • usage.output_tokens:输出 token 数
  • usage.output_tokens_details.reasoning_tokens:推理 token 数
  • usage.total_tokens:总 token 数