跳到主内容
快讯直播
AI智模界
AI编程

OpenAI 在 Responses API 中引入 WebSocket 加速智能体工作流

OpenAI 发布文章《Speeding up agentic workflows with WebSockets in the Responses API》,介绍在 Responses API 中通过 WebSocket 加速智能体(agentic)工作流。

Responses API 是 OpenAI 面向智能体场景提供的接口,应用可以在一次任务中串联模型推理、工具调用与结果回传。这类流程通常不是一次请求就能结束,而要在客户端与模型之间来回多轮:模型先决定调用哪个工具,客户端执行后再把结果送回模型,如此反复直至任务完成。

在传统的 HTTP 请求—响应模式下,每一轮交互都需要重新发起请求并建立连接,连接建立与协议开销会在多轮往返中累积,成为端到端延迟的一部分。WebSocket 提供的是持久化双向连接,一次握手后通道保持打开,双方可在任意时刻发送数据。把这一机制引入 Responses API,意味着多轮交互有望复用同一条连接,而不必为每一轮重新建连。

对智能体应用而言,延迟直接影响体验与可行性:一个需要多次工具调用的任务,任何一轮的固定开销都会被放大。因此,“加速 agentic workflows”这一表述指向的正是多轮往返场景下的效率问题。

具体的实现细节、支持范围与性能数据,仍需以官方文档为准。对正在构建智能体应用的开发者来说,这一变化值得关注:若底层连接模型从一次性请求转向长连接,客户端在连接复用、并发管理与错误重连上的处理方式,也可能需要相应调整。

AI 生成本文由 AI 基于公开信息自动生成,仅供参考。