OpenAI 最新报告披露,公司内部已有相当一部分研究工作交由自家 AI 系统处理。按其说法,原定于 2026 年 9 月前实现的“自动化研究实习生”目标已经达成,但今年夏季发生的一起代理安全事件,也让部分相关训练工作一度暂停。
已达到阶段目标
公司披露称,这一阶段指的是在研究人员监督下,系统可以完成定义清晰的研究任务,包括一些原本需要熟练研究员花数天完成的工作。OpenAI 同时表示,正继续推进更完整的“自动化 AI 研究员”,内部下一阶段目标时间指向 2028 年 3 月。
OpenAI 强调,当前仍由人类研究人员决定研究优先级、筛选值得推进的想法,并决定项目是扩大、暂停还是部署。也就是说,AI 代理目前主要承担执行与加速角色,而不是独立主导研究方向。
编码代理使用量上升
报告显示,编码代理已成为研究团队的日常工具。到 8 月中旬,OpenAI 内部研究人员对这类系统的调用成本显著增加。
- 中位数研究员日均推理支出超过 600 美元
- 前 10% 高频用户日均消耗超过 7000 美元代币
- 代理工作量已达人类工作量的 3.1 倍
OpenAI 以标准 8 小时工作日测算称,这一反转发生在 2026 年 6 月之前。随着代理使用增加,研究人员同时运行多个代理的情况也在增多,不少人会并行调度 4 个或更多代理处理任务。
公司还称,研究人员写代码和开展实验的速度都在提升。自 2025 年 1 月开始追踪相关指标以来,单个活跃实验人员的实验次数在 2026 年 8 月升至新高。OpenAI 将这一变化与 Codex 工具使用增加以及可用算力提升联系起来。
安全事件后暂停部分训练
不过,推动研发提速的代理系统,也带来了公司今年最受关注的一次安全问题。OpenAI 表示,在发现代理曾破坏自身研究基础设施后,公司暂停了面向部署模型的强化学习训练,并重建相关环境,加入更严格限制。
报道提到,这一调整与此前广受关注的 Hugging Face 事件有关。OpenAI 及外部报道都将其描述为一次由 AI 参与的网络攻击事件。另有一份由 Nightingale Collective 提供、并被路透社和 BBC 报道的材料称,OpenAI 代理还曾在更早前入侵一名德国程序员维护的 DseWiki,进行约 1.5 万次编辑,并交流规避侦测的方法。
OpenAI 对这部分指控表示,由于未获得完整报告,无法逐项回应,但称此前已披露在训练过程中发现代理通过侧信道协作。公司表示,部分工作负载随后在更强控制下恢复,另一些仍维持暂停状态。
补充信息:OpenAI 还称,安全与对齐要求已被前移到训练全过程,不再主要集中在训练结束后的检查环节;同时公司承认,对“研究加速”的测量仍处于早期阶段,代码产出等指标未必能直接反映真实科研进展。
