OpenAI正为Codex开发"持久模式",让AI主动持续工作直到用户将其"置于休眠"。OpenAI证实正在测试,但暂无上线计划。

据称OpenAI正在开发其旗舰AI智能体Codex的一个主动、高度持久的新版本。

近日,OpenAI开始为其命令行版Codex添加一个新的"持久模式"设置。Codex命令行工具的改动默认公开,新功能往往先在这里冒头,随后才进入Codex桌面应用和ChatGPT Work等其他智能体产品。

持久模式尚未大规模上线或公布,但未来可能。OpenAI发言人向WIRED确认正在测试这一功能,同时表示没有立刻推出的计划。"OpenAI是一种高度自下而上的文化,开源仓库上探索的东西很多,那算是我们共享的游乐场,"OpenAI核心产品负责人Thibault Sottiaux表示。

这一功能似乎是OpenAI让AI智能体真正有人愿意用的最新尝试。OpenAI、Anthropic和Meta都在竞相推出通用智能体产品,帮人们自动化工作和生活中的任务,比如报销差旅费或预约医生。目前用AI智能体的主要是软件工程师,但硅谷相信这能成为客户面更广的主要业务线。

持久模式出现在Codex的"推理努力"菜单里,用户可以在此选择允许模型在作答前"思考"所用的算力、token和时间。它似乎是OpenAI计算强度最高的设置之一。用户选中持久模式后,代码中显示Codex将"持续工作,直到被置于休眠"。这与现有模式形成鲜明对比,后者即使任务没完成,几分钟或几小时后也会停下。

代码库的另一份文件描述了持久模式内的"主动性"功能,这是一种供持久模式智能体使用的系统提示,告诉它回答完用户请求不算完工,而要主动给自己创建后续任务。它能跨会话处理这些任务,并利用过去的用户互动和"对用户的了解"决定该做什么。它还有个工具可在未经要求时给用户发消息,但被叮嘱要少用。

文件还给智能体设了限制:持久模式并不扩大它被允许做的事,改动用户自身系统以外的任何东西都须先经用户批准,似乎意在限制持久AI智能体的危险性。该文件位于Codex的共享核心而非终端专属代码中,暗示主动性功能不只用于命令行工具。

CEO Sam Altman近期在播客、访谈和私下投资人会上,都表达过要把ChatGPT变成主动、常在线的AI智能体的愿望。他在David Senra的播客上说:"就是单一产品:我需要向AI问点什么。迟早,AI也许该主动给我提东西。你会有这个从聊天机器人起步、现在又有了编程智能体的界面,我想某个时候它会更像持久智能体。"

公司也承认持久AI模型风险更高。本周发布的技术报告里,OpenAI称其Hugging Face入侵事件主要源于一个被训练得高度持久的内部研究模型,公司已将该模型下线。但OpenAI表示已训练了包括Astra在内的其他未来模型来支持持久智能体。持久化放大的风险之一是对齐问题:面对不可能完成的任务时,OpenAI说其智能体会诉诸预料之外的手段,包括试图探测和入侵它所处的沙箱环境。

OpenAI已多次尝试推出主动式AI产品,都没在用户中站稳。去年它推出Pulse,一个趁用户睡觉时生成晨间简报的智能体,今夏早些时候公司却停掉了它。持久模式是同一赌注上更具雄心的版本。

原文:https://www.wired.com/story/openai-is-developing-a-persistent-ai-agent/