top of page

OpenAI Agent Mode 旨在实现无需额外标签页的自动化

OpenAI agent mode 上个月推出,目标是让用户委托多步骤任务,而不是为每个操作打开新的浏览器标签页。

该更新扩展了现有的 ChatGPT 界面,使 agent 可以按顺序浏览网站、总结文档、安排会议并起草输出。OpenAI 表示系统将所有活动保持在一个窗口内。

早期测试者发现这一承诺在理论上很有吸引力。一家中型软件公司的产品经理要求 agent 研究竞争对手定价、编译电子表格并准备幻灯片。agent 完成了前两个步骤,然后在误解登录页面时停滞。

该事件表明 agent 系统仍需在多个环节进行人工审查。

该更新实际改变了什么

OpenAI agent mode 通过将模型调用串联在一起工作。每一步都基于先前结果加上用户提供的上下文。系统可以打开页面、提取文本、运行计算,并在用户无需切换应用的情况下返回最终交付物。

该公司声称 agent 会在无关任务之间重置上下文以减少漂移。它还会记录用户之后可以检查的每项操作。

几位评论者测试了该功能在销售拓展和会议准备上的表现。一位用户报告称 agent 正确提取了三家公司的公开财务数据,但未能标记需要单独登录凭证的付费墙报告。

这些结果与 OpenAI 公布的限制一致。agent 无法自行访问账户或执行支付。

生产力提升伴随监督成本

早期采用该工具的团队注意到工作负载的变化。员工不再花时间进行重复搜索,而是花时间纠正 agent 输出并验证来源。

一家消费品牌的市场分析师描述了每周使用 agent 进行竞争扫描的情况。首次运行节省了大约 40 分钟的手动浏览时间。第二次运行生成的表格混淆了 2025 年和 2026 年的数据,因为 agent 拉取了缓存页面而非实时页面。

该分析师现在会在将结果转发给经理前审查 agent 日志。

测试者中重复出现这一模式。收益出现在简单的检索任务上。涉及多个账户或条件逻辑的任务仍需直接监督。

OpenAI Agent Mode 与现有工具的比较

几款成熟产品已提供类似串联功能。Anthropic Claude Projects 允许用户附加文件并运行顺序提示。Microsoft Copilot in 365 可以在同一线程中从 Outlook 和 SharePoint 拉取数据。

OpenAI agent mode 的主要区别在于强调停留在单个 ChatGPT 窗口内。除非进行额外设置,否则 agent 尚无法通过 Zapier 或原生 API 调用触发外部自动化。

已依赖 remio 进行个人知识管理的用户注意到,OpenAI agent 不会跨会话保留记忆,除非用户手动将结果复制回自己的系统。相比之下,remio 无需额外步骤即可保留情景和语义记忆。

需要立即关注的风险

安全团队指出了两个主要担忧。首先,agent 可以访问用户允许的任何公开 URL,这为通过隐藏网页内容进行提示注入创造了表面。其次,默认情况下日志存储在 OpenAI 云账户中,这给受监管行业带来了数据驻留问题。

OpenAI 已发布护栏,阻止直接金融交易和某些医疗查询。Hugging Face 上发布的独立红队测试显示,当要求 agent 用另一种语言重新表述同一请求时,护栏可能被绕过。

这些发现促使几家企业试点将 agent mode 限制仅用于非敏感数据。

未来三个月值得关注的事项

OpenAI 计划在 6 月更新中添加对 Google Drive 文件夹的只读访问。观察者将检查新连接器是否提高任务完成率,还是仅带来更多验证工作。

Anthropic 和 Google 预计将在 9 月前推出类似 agent 功能。在相同基准任务上的失败率差异将影响采用选择。

企业买家还将关注 OpenAI 如何处理审计日志。如果该公司添加可导出、带时间戳且满足 SOC 2 要求的操作记录,受监管公司可能会扩大使用。

评估自动化选项的用户可以直接在 ChatGPT 中测试当前版本。需要跨工具保留个人记忆的用户继续依赖默认本地存储上下文的 remio 等系统。

 
 

免费开始

一款本地优先的AI助手,具备个人知识管理功能

为了获得更好的人工智能体验,

remio 目前仅支持Windows 10+ (x64)M-Chip Mac

在你的大脑里添加一个搜索栏

Ask remio

记住一切

​无需整理

bottom of page