返回快讯列表
大模型前沿

OpenAI 称已达到自动化研究实习生目标,Agent 开始参与模型研发

OpenAI 公布自动化研究实习生阶段性进展:研究团队使用编码 Agent 设计改进、编写评测、运行实验并辅助对齐工作,但仍由人类设定方向和审核结果。

OpenAI 发布文章总结自动化 AI 研究进展,称团队已达到此前提出的“自动化研究实习生”目标。文章把工作拆成设计模型改进、编写评测、搭建实验基础设施、发现训练中的错误与失配行为,再把有效改动整合进核心训练流程。

OpenAI 披露,2026 年年中研究团队的 Agent 使用量快速上升,按 8 小时工作日折算,研究组织使用了相当于 3.1 个 Agent 工作日的努力量。文章也承认这些指标仍处于早期阶段,代码量和并发运行次数不等同于研究质量或模型能力的直接提升。

可确认的变化是 Agent 已被纳入研究日常流程,研究人员仍负责确定问题、判断结果和安全门槛,不能把它概括成 AI 已经完全自主研发模型。

更多快讯