什么是后台模式
后台模式是指在对话过程中,用户可以选择不立即等待模型的回复,而是让模型在后台处理请求,稍后再获取结果。这种模式适用于需要较长时间处理的任务,如画图、复杂推理、深度研究或多轮对话等。典型的耗时任务模型如下:
o1o1-proo3o3-progpt-5复杂推理gpt-5-progpt-5-codexgemini-2.5-flash复杂推理gemini-2.5-flash-imagegemini-2.5-pro- 所有模型ID中带
sonar前缀的对话模型(需要联网搜索) - 所有模型ID中带
thinking后缀的推理模型(注意不是no-thinking),如 Claude、DeepSeek 等 - 所有模型ID中带
search字样的联网搜索对话模型 - 所有模型ID中带
research字样的深度研究推理模型 - OpenAI 系列使用了搜索(
web_search)、画图(image_generation)工具的对话模型 - 所有其他内置联网搜索并开启以及使用了外部搜索工具的对话模型
- 所有其他在对话中支持画图、语音的对话模型
启用后台模式对话
要使用后台模式,您需要在对话请求中设置background 参数为 true。以下是一个示例请求:
stream 和 background 为 true,否则会导致请求失败:
获取后台模式结果
一旦发起了一个后台模式的请求,将收到一个响应,其中包含一个唯一的id 用于标识本次对话任务:
id 通过对话结果查询接口查询任务的状态和结果:
{id} 替换为你收到的任务 id 发起查询请求即可,在本例中,就是 4ec88c8a-9ef9-496d-bec8-711521a1c693。查询结果可能有以下几种状态:
pending:任务仍在排队中running:任务正在处理中succeed:任务处理成功
任务结果默认会保留 7 天,7 天后任务结果将被自动删除,请及时查询和保存结果。
