往期日报 · 第 46 期
新模型受控开放与AI阵营边界
谷歌发布 Gemini 3.7 Flash,Z.ai 延后公开 GLM-5.3 权重;美国草案拟将 AI 合作与阵营选择挂钩。
- 模型发布
- 开发工具
- 网络安全
- 全球治理
要点速览
- 01Flash 新模型以半价切入编程与智能体工作流
- 02GLM-5.3 先做安全评估,最敏感功能限核验用户
- 03美国草案拟要求合作国避免加入冲突的 AI 框架
模型与开发工具
Google 发布 Gemini 3.7 Flash
Google 8 月 13 日推出 Gemini 3.7 Flash,定位为面向编程和智能体工作流的 Flash 系列升级。公司称,该模型在 FrontierCode 1.1 Main 的得分为 43.6%,高于 Gemini 3.6 Flash 的 34.4%;在 DeepSWE v1.1 为 65.3%,高于 49.0%。这些均为 Google 公布的评测结果,反映的是厂商测试口径。
FrontierCode 1.1 Main
43.6%
+9.2 个百分点
DeepSWE v1.1
65.3%
+16.3 个百分点
开发者可通过 Google AI Studio、Android Studio 和 Antigravity 使用该模型,企业端则接入 Gemini Enterprise。Google 给出的导入价为每百万输入 token 0.75 美元、每百万输出 token 3.75 美元,持续至今年年底;其博客称这一输入价相当于 3.6 Flash 原价的一半。与此前关于 Gemini 3.5 Pro 延期的报道不同,这是一款已经公布并开放入口的 Flash 系列新模型。
网络安全与开放模型
Z.ai 将 GLM-5.3 权重公开延后约两周
Z.ai 8 月 14 日披露 GLM-5.3 的网络安全能力,并称将先完成约两周安全评估后再公开发布模型权重;在此之前,初始访问只向少数合作伙伴开放,最敏感的网络安全功能将通过“可信访问”计划面向已核验用户提供。
据 Z.ai 向路透社提供的数据,GLM-5.3 在 CyberGym 漏洞识别测试中得分 84.5%,其列示的 Mythos 5 为 83.8%;在将漏洞转化为可运行攻击的 ExploitBench 中,GLM-5.3 为 54.4%,低于 Mythos 5 的 78.0%。这些对比尚未获独立验证,不能据此视为通用能力排名。
这使“开放权重”不再等同于即时、无差别分发:Z.ai 选择把公开权重与高风险能力分层处理。对于开源软件维护者和安全团队,后续关键观察点将是两周评估结束后实际开放范围,以及核验机制能否在模型外流前发挥作用。
全球治理与技术联盟
美国草案拟要求 AI 合作伙伴避免加入冲突框架
路透社 8 月 14 日报道称,其看到的一份美国国务院未署日期草案拟致信 35 个《AI Opportunity Statement》签署方,要求各国审慎选择 AI 合作框架;草案称,Pax Silica 的参与不能与“预期相冲突”的重复倡议并存。美国国务院未就所谓泄露文件置评,寄发时间、文本和最终政策都尚未确定。
草案涉及模型、芯片和关键矿产的供应链合作。路透社称,约 24 国已加入 Pax Silica,哈萨克斯坦是已知同时加入美国与中国相关框架的国家。若草案按现有方向落地,AI 国际合作的条件将从项目协同进一步延伸到联盟排他性。
第 27 期曾报道 29 国于 7 月签署世界人工智能合作组织成立协定;今天的新增信息不是该组织再度成立,而是美国拟以成员身份为条件回应并行框架。由于这仍是一份内部草案,不应写作已生效的外交或出口管制政策。