往期日报 · 第 67 期
前沿模型、研究加速与安全边界
本期聚焦前沿模型、研究自动化与安全治理:GPT-6 Astra 公布评测,编码智能体深入研究流程,OpenAI 首席科学家呼吁谨慎扩展。
- 前沿模型
- 研究智能体
- AI安全
- 模型治理
要点速览
- 01GPT-6 Astra 在多项电脑操作、代码与科学评测中刷新 OpenAI 公布的内部对比结果
- 02OpenAI 研究团队称 8 月每个研究员工作日对应 3.1 个智能体工作日,实验密度继续上升
- 03首席科学家警告模型能力可能进入递归自我改进,主张把人类控制与安全评估置于继续扩展之前
前沿模型与产品
GPT-6 Astra 公布新一轮能力对比
9 月 2 日本报曾记录 Astra 已越过关键安全能力阈值;这次更新的实质增量,是 OpenAI 进一步公布模型正式能力画像和多项内部评测结果。公告称 GPT-6 Astra 在电脑操作、浏览、软件工程、网络安全、科学和专业工作等方向取得新的能力水平,披露的评测包括:FrontierMath Tier 4 得分 98%,ARC-AGI-3 得分 99.9%,ExploitBench 得分 100%;在 Agents’ Last Exam 上为 59.3%,高于 Claude Opus 5 的 55.5% 和 GPT-5.6 Sol 的 53.6%。这些是 OpenAI 公告中的厂商评测数据,不代表独立基准机构的复核结论。
对开发者更直接的变化在 Codex:OpenAI 称 Astra 能在上下文窗口耗尽后保留、检索此前的工作笔记与测试结果,减少长任务中反复压缩上下文造成的信息损失。公告还称,GPT-6 Astra 在 Terminal-Bench 4.0 上得分 57.9%,GPT-5.6 Sol 为 37.3%,Claude Fable 5.1 为 55.8%。
AI 研究与工程实践
编码智能体进入前沿实验室的日常工作流
OpenAI 披露,研究团队在 2026 年年中已经普遍把编码智能体用于日常工作,并将其用于写代码、排查研究基础设施、运行评测和处理更长周期的任务。按该公司对 8 月中旬数据的统计,研究组织平均每个工作日使用相当于 3.1 个智能体工作日的努力量;研究员使用量的中位数已超过每天 600 美元的 API 推理价格口径,90 分位用户超过每天 7000 美元。
OpenAI 同时强调,这些指标不能直接等同于研究进度:算力仍是约束,任务越复杂越需要人类介入。其披露显示,过去 6 个月中,成功完成的 4–8 小时人类任务有超过一半至少经历过一次人工干预。实验室此次首次同时公开使用强度、智能体工作量和介入率等过程数据,显示编码智能体正在从辅助编程进入研究流程的核心环节。
安全治理与发展边界
OpenAI 首席科学家要求把人类控制置于继续扩展之前
OpenAI 首席科学家 Jakub Pachocki 在新文章中表示,推理模型已经能够操作电脑、与人及其他模型协作并开展研究,同时也在重塑网络安全风险;基于内部结果,他对当前进展速度持续进入递归自我改进抱有较强预期。文章的新增点不是重复此前关于 AI 安全的国际对话,而是由公司首席科学家公开提出:如果继续沿当前路径发展,未来几年可能出现幅度相当甚至更大的能力跃迁,因此不能假定 alignment 与安全措施会自然跟上。
Pachocki 将安全重点放在目标对齐、价值对齐、泛化监测和可扩展防御上,并表示 OpenAI 会在必要时单方面暂缓进一步扩展;他同时承认目前仍无法安全地走完“对齐的递归自我改进”路径。上述内容属于首席科学家的公开立场与风险判断,不是已经发生的能力结果,也不应解读为已确认的时间表。