POST https://geekapis.com/v1/responses 是 OpenAI 推出的新一代 Agentic 接口,相比传统 Chat Completions 提供了更强大的能力:内置工具(联网搜索)、自定义函数调用、服务端自动维护多轮上下文(previous_response_id)以及精细化推理力度控制(reasoning.effort)。
鉴权
string
required
请求参数
string
required
模型名称。示例:
"gpt-5-pro-official"、"gpt-5.3-codex-official"、"gpt-5.2-official"string | object[]
required
用户输入,支持两种格式:
- 字符串:简单的单轮文本输入
- 消息数组:多轮对话格式
string
系统指令,指导模型行为,等同于 Chat Completions 中的
system 消息。boolean
default:"false"
是否启用流式输出(Server-Sent Events)。
integer
生成内容的最大 token 数量。
number
default:"1"
采样温度,控制输出随机性。范围:
0 ~ 2。number
default:"1"
核采样概率阈值。范围:
0 ~ 1。建议不要同时修改 temperature 和 top_p。string
上一次响应的
id,用于服务端自动拼接多轮对话上下文。使用此字段后无需客户端自行传递完整历史消息。object
推理配置,控制模型的思考深度。
object[]
可用工具列表,模型可在响应中调用这些工具。
string
default:"auto"
工具选择策略:
auto:由模型自行决定是否调用工具none:禁止调用任何工具required:强制调用至少一个工具
响应字段
string
响应的唯一标识符,可直接用作下次请求的
previous_response_id 以延续对话。string
固定为
response。string
响应状态:
completed(已完成)/ failed(失败)/ in_progress(处理中)。string
实际使用的模型名称。
object[]
输出项列表,可能包含以下一种或多种类型:
object
token 消耗统计。
代码示例
响应示例
200 - 文本响应
200 - 函数调用响应
