OpenAI 发布文章总结自动化 AI 研究进展,称团队已达到此前提出的“自动化研究实习生”目标。文章把工作拆成设计模型改进、编写评测、搭建实验基础设施、发现训练中的错误与失配行为,再把有效改动整合进核心训练流程。
OpenAI 披露,2026 年年中研究团队的 Agent 使用量快速上升,按 8 小时工作日折算,研究组织使用了相当于 3.1 个 Agent 工作日的努力量。文章也承认这些指标仍处于早期阶段,代码量和并发运行次数不等同于研究质量或模型能力的直接提升。
可确认的变化是 Agent 已被纳入研究日常流程,研究人员仍负责确定问题、判断结果和安全门槛,不能把它概括成 AI 已经完全自主研发模型。