往期日报 · 第 72 期
受控科研、工程智能体与能力鸿沟
生命科学模型开始以资格审查方式交付,工程智能体进入代码审查和大规模基础设施改造;安全与全球治理同时强调可验证控制。
- 生命科学
- 工程智能体
- AI安全
- 全球治理
- AI基建
要点速览
- 01生命科学专用模型开始以资格审查方式走向研究机构
- 02代码审查引入 Shell 验证与多智能体集成,减少人工收尾
- 03超大规模存储迁至 Rust,AI 编程进入生产基础设施改造
- 04千万级邮件诈骗披露提醒:AI 线索不能替代攻击归因
- 05联合国拟以全球基金补足发展中国家的 AI 能力缺口
生命科学模型转入受控交付
OpenAI 将 GPT-Rosalind 结束研究预览
OpenAI 9 月 11 日更新称,面向生物学、药物发现和转化医学的 GPT-Rosalind 已从研究预览转为向合资格组织提供的 trusted-access 服务。模型可在 ChatGPT、Codex 和 API 中使用;同日上线的 Codex Life Sciences research plugin 可连接 50 多个公共多组学数据库、文献源和生物学工具。
这一变化的关键不只是新增模型入口,而是把部署边界写进产品:官方称,生命科学模型的初期访问须经过资格和安全审查,参与机构需要具备研究治理、合规及滥用防范控制,并把使用限制在获批用户和受管理环境中。性能方面,OpenAI 称该模型在 LABBench2 的 11 项任务中有 6 项优于 GPT-5.4;这些均为开发方公开评测,不能视为临床或独立实验验证。
可连接的公共科研工具与数据源
50+
官方说明
LABBench2 中优于 GPT-5.4 的任务
6/11
官方评测
工程智能体走进审查与底层服务
GitHub 扩展 Copilot 代码审查的验证能力
GitHub 更新 Copilot code review:当后续提交已经解决某条 Copilot 评论时,重新审查会自动关闭该评论;应用自动修复建议时,系统还会按实际改动生成提交信息建议。更重要的改动在审查链路后端:代理可在 Copilot agent firewall 之后使用 Copilot SDK 的完整 Shell 工具集,运行构建、测试或定向脚本来验证代码。
Lite 级审查也从单代理改为多代理集成,再合并成一份评审。GitHub 的实验称,高、中、低严重度评论被解决的平均数量分别增加 47%、31% 和 11%,审查成本约降 8%。这些数字属于 GitHub 的实验结果;对团队而言,可观察的变化是代码审查开始兼顾执行验证、审查证据与待办清理,而非只生成文字意见。
OpenAI 披露 Habitat 存储平台的 Rust 迁移
OpenAI 在工程文章中披露,其在线存储平台 Habitat 现横跨近 40 个地区,每秒处理超过 7,000 万次请求,支持每周逾 10 亿用户并服务超过 500 PB 数据。该平台先以 Python 服务承接增长,但在 2026 年第二季度由两名工程师借助 Codex 与 GPT-5.5 完成全量 Rust 重写;新服务目前承载 95% 的生产请求。
按 OpenAI 的数据,新 Rust 服务的 CPU 效率为原 Python 版本的 6 倍、内存效率为 15 倍,并降低平均与尾部延迟。这是厂商自身的生产度量,外部无法独立复核;但它把生成式编程的可用边界从局部代码辅助推进到有明确上线比例、性能对照和回滚要求的核心基础设施改造。
安全:AI 辅助迹象不等于确定归因
微软披露高管冒充与虚假发票邮件活动
微软 9 月 11 日公布的一份威胁分析称,其在 8 月 3 日至 5 日观察到一项通过第三方邮件投递基础设施发送逾 100 万封金融诈骗邮件的活动,其中 87.7% 投向美国用户。攻击者冒充多家企业的 CEO、CFO 或总裁,配合伪造的 ServiceNow 年度订阅发票和虚构往来邮件,诱导财务人员处理约 5 万美元的 ACH 转账。
微软在邮件 HTML 中发现大量详细注释、统一分区和一致模板等与生成式 AI 辅助制作相符的迹象,但明确表示,单个迹象不足以判断 AI 在多大程度上生成了攻击内容。报告也没有发现 ServiceNow 或其他被冒充企业的系统遭入侵或参与活动的证据。这个限定很重要:防御团队可以把 AI 辅助视为内容规模化和定制化的风险信号,却不应把它当作脱离证据链的攻击归因。
防御侧的直接启示
对付款请求同时核验发件域名、发件人与回信地址的一致性、邮件线程结构及独立的付款审批链路;不要仅因文本更自然或模板更工整而作出归因判断。
全球治理聚焦能力缺口
联合国秘书长建议推进全球 AI 能力建设基金
联合国秘书长 9 月 11 日提交给联大的报告 A/80/817 建议,联大在第八十一届会议推进建立“全球 AI 能力建设基金”,并完善其战略目标、治理与行政安排。报告将缺口界定为算力及配套能源和连接、高质量数据、数字公共基础设施、技能,以及采购、部署和治理 AI 的制度能力。
报告援引世界银行数据称,2025 年 6 月高收入国家占全球共置数据中心容量的 77%,低收入国家不足 0.1%;约半数会员国已有国家 AI 战略,最不发达国家中这一比例不足 20%。它提出两至四年约 30 亿美元的初始承诺只是指示性起点,不是已获批准的基金设计。相较于单纯讨论模型规则,这份文件将 AI 治理的执行条件明确延伸到基础设施、资金与公共能力。
信息来源
- Introducing GPT-Rosalind for life sciences research官方
- Auto-resolution and analysis updates in Copilot code review官方
- Rapidly scaling online storage to serve over 1 billion ChatGPT users官方
- AI-assisted executive impersonation and invoice fraud官方
- Secretary-General Calls for Global Fund to Address AI Capacity-Building Gaps in Developing Countries联合国