Skip to main content
POST

授权

Authorization
string
header
必填

Bearer authentication header of the form Bearer <token>, where <token> is your auth token.

请求体

application/json
model
string

用于生成响应的模型 ID,例如 gpt-5.6-sol。

input

提供给模型的文本、图片、音频或文件输入。可直接为字符串,或为输入消息数组。

instructions
string

插入模型上下文的系统或开发者指令。使用 previous_response_id 时,前一响应的 instructions 不会自动继承。

previous_response_id
string

上一条 Response 的唯一 ID,用于多轮对话;不能与 conversation 同时使用。

conversation

本次响应所属的会话。会话项会自动加入本次上下文,输入和输出项也会写入该会话。

background
boolean

是否在后台运行模型响应。

include
enum<string>[]

指定需要额外包含在响应中的数据。

可用选项:
web_search_call.action.sources,
code_interpreter_call.outputs,
computer_call_output.output.image_url,
file_search_call.results,
message.input_image.image_url,
message.output_text.logprobs,
reasoning.encrypted_content
max_output_tokens
integer

生成响应允许使用的最大词元数,包含可见输出和推理词元。

必填范围: x >= 1
max_tool_calls
integer

响应中可处理的内置工具调用总次数上限。

必填范围: x >= 0
metadata
object

最多 16 个键值对元数据;键最长 64 个字符,值最长 512 个字符。

moderation
object

对输入和输出执行内容审核的配置。

parallel_tool_calls
boolean

是否允许模型并行调用工具。

prompt
object

提示词模板及其变量。

prompt_cache_key
string

用于提高相似请求缓存命中率的稳定键;取代 user 字段。

prompt_cache_options
object

提示词缓存选项。

prompt_cache_retention
enum<string>

已弃用,请使用 prompt_cache_options.ttl。

可用选项:
in_memory,
24h
reasoning
object

推理模型配置。

safety_identifier
string

稳定的终端用户标识符,用于协助检测滥用;建议使用用户名或邮箱的哈希值。

Maximum string length: 64
service_tier
enum<string>

请求的服务层级。

可用选项:
auto,
default,
flex,
scale,
priority,
fast,
ultrafast
store
boolean

是否存储生成的 Response 以供后续通过 API 获取。

stream
boolean

是否以 SSE 流式返回事件。

stream_options
object

流式选项,仅在 stream 为 true 时设置。

temperature
number

采样温度;通常与 top_p 二选一调整。

必填范围: 0 <= x <= 2
top_p
number

核采样阈值;通常与 temperature 二选一调整。

必填范围: 0 <= x <= 1
text
object

文本或结构化 JSON 输出配置。

tools
object[]

模型在生成响应时可调用的工具,包括 function、web_search、file_search、code_interpreter、computer、MCP 等。

tool_choice

控制模型如何选择工具。

可用选项:
none,
auto,
required
top_logprobs
integer

每个输出位置最多返回的高概率词元数量。

必填范围: 0 <= x <= 20
truncation
enum<string>

已弃用。输入超出上下文窗口时的截断策略。

可用选项:
auto,
disabled
user
string

已弃用,请使用 safety_identifier 和 prompt_cache_key。

context_management
object[]

上下文管理配置。

响应

200 - application/json
id
string
必填

Response 的唯一 ID。

object
enum<string>
必填

对象类型,固定为 response。

可用选项:
response
created_at
integer
必填

Response 创建时间的 Unix 时间戳,单位为秒。

model
string
必填

实际使用的模型 ID。

output
object[]
必填

模型生成的输出项列表,顺序和数量取决于模型响应。

completed_at
integer

Response 完成时间的 Unix 时间戳;仅 status 为 completed 时出现。

status
enum<string>

响应生成状态。

可用选项:
completed,
failed,
in_progress,
cancelled,
queued,
incomplete
output_text
string

SDK 便捷字段:输出中所有文本内容的拼接结果。

error
object

生成失败时的错误对象。

incomplete_details
object

响应不完整的原因。

instructions

应用于该响应的系统或开发者指令。

conversation
object

该响应所属的会话。

previous_response_id
string

上一条 Response 的 ID。

metadata
object

关联元数据。

usage
object

词元使用统计。

parallel_tool_calls
boolean

是否允许并行工具调用。

temperature
number

本响应使用的采样温度。

top_p
number

本响应使用的核采样阈值。

max_output_tokens
integer

请求设置的最大输出词元数。

max_tool_calls
integer

请求设置的最大工具调用次数。

service_tier
string

实际使用的服务层级。

background
boolean

是否后台运行。

store
boolean

是否存储该响应。

safety_identifier
string

请求使用的安全标识符。