往期日报 · 第 80 期
模型开放、治理与推理调度
模型、企业控制面、州级合规、跨区域推理与医学实验基础设施同步更新,AI部署正在向可验证的生产环节延伸。
- 前沿模型
- 企业智能体
- AI治理
- 推理基建
- 科学智能
要点速览
- 01Grok 4.7以相同价格更新模型能力,并扩大至 API 与编码工具。
- 02企业开始把模型成本、提示攻击和智能体 API 越权纳入同一控制面。
- 03纽约为大型前沿模型设定注册、72小时事故报告和季度评估节点。
- 04跨三地推理调度把17,000节点容量转化为统一资源池。
- 05NIH 将类器官、机器人和 AI 连接成可循环设计的研究平台。
前沿模型与分发
SpaceXAI 发布 Grok 4.7
SpaceXAI 于 9 月 21 日发布 Grok 4.7。公司称,新版本采用比 Grok 4.6 更大的基础模型,并在更难、偏向多小时完成的混合任务上进行了更长的强化学习训练,以改善长任务中的自检与上下文管理。
Grok 4.7 已在 Cursor、Grok Build、Grok API、第三方编码执行框架、模型路由器和云平台提供。定价为每百万输入 token 2 美元、每百万输出 token 6 美元。官方公布的 CursorBench 4.0 成绩为 46.3%,对照表中 Grok 4.6 为 40.4%;该比较属于厂商披露的基准结果。
生产控制面
Fastly 推出 AI Runtime Control、AI Firewall 与 API Security
Fastly 宣布三项能力现已可用。AI Runtime Control 通过单一端点路由公有及自托管模型调用,提供 virtual keys、token 支出可视化、限速、预算控制和故障转移;企业可在不固定于单一模型供应商的情况下集中执行访问与成本策略。
AI Firewall 在请求路径中直接评估 prompts,以识别并阻断包括 prompt injection 在内的 LLM 攻击。新的 API Security 则对智能体、智能体辅助及传统流量执行 API 合约,可按服务观察或阻断不符合约定的请求,限制智能体调用未获支持的操作或发送格式错误的请求。
州级治理进入实施
纽约公布 RAISE Act 合规时间表
纽约州表示,将自 11 月起要求大型前沿 AI 开发者向州政府注册,为《负责任 AI 安全与教育法案》合规做准备。自 2027 年 1 月起,相关企业须向纽约州金融服务部内的新设数字创新、治理、诚信与信任办公室定期报告,并遵守透明度、安全与事故报告要求。
法案要求开发者在网站公开安全与透明度框架;发生关键安全事故后,须在 72 小时内向该办公室报告,并按季度提交灾难性风险评估。该办公室还将发布年度公开报告,汇总事故报告、安全观察与修法建议。
跨区域推理调度
Google Cloud 披露多集群 GKE Inference Gateway 实测
Google Cloud 公布了一项跨美国和欧洲三座 GKE 集群、共 17,000 个计算节点的推理路由测试。该部署服务采用 SGLang 的混合专家基础模型,由多集群网关承担全球流量分配,并以推理引擎暴露的 KV-cache token 利用率作为路由信号。
从一个集群扩展到三个集群后,请求吞吐量从 0.72 req/s 升至 2.10 req/s,token 吞吐量从 2,898 tok/s 升至 8,457 tok/s,三种拓扑的成功率均约为 99.9%。Google Cloud 称,经网关路由的吞吐量达到本地直连集群调用的 99.5%,额外开销低于 1%;当主区域 KV-cache 利用率越过 40% 阈值时,溢出请求会切往下一个健康区域。
计算节点
17,000
美国与欧洲三集群
请求吞吐
0.72→2.10 req/s
从一集群扩至三集群
路由额外开销
小于1%
官方基准
人源研究基础设施
NIH 建设 Bio Genesis 自主人体生物学实验室
美国国立卫生研究院宣布,将在其临床中心设立 Bio Genesis Autonomous Human Biology Laboratory,并与标准化类器官建模中心协同。该平台计划把标准化人源类器官、机器人、AI 与先进数据能力组成闭环实验系统,让连续生成的数据指导下一次实验,在可重复的人体生物系统中检验临床驱动问题。
配套投入包括 10 个建设项目、合计超过 8,800 万美元的人源研究基础设施资金,以及奖金总额超过 700 万美元的 Qu-SAFE 挑战赛。后者征集以量子技术改进实验室新方法学中生物信号检测和测量的方案,服务于药物安全与毒性评价。