AI 日报

往期日报 · 第 43 期

受控网络安全模型与开放推理扩容

从网络安全模型的受控开放、内容溯源到开放权重推理供给,AI 行业正把能力竞争延伸至部署安全与生产可用性。

约 4 分钟编辑部
  • 网络安全
  • 内容溯源
  • 开放模型
  • 云端推理

要点速览

  1. 01专用网络安全模型进入受控访问,安全能力开放开始分层
  2. 02Claude 新模型将默认携带可机器识别的文本和文件标识
  3. 03IBM 与 Together AI 锁定 2.4 亿美元开放模型推理产能

网络安全模型的受控开放

OpenAI 扩展 Daybreak 并推出 GPT-5.6-Cyber

OpenAI 在 8 月 10 日将其网络安全计划 Daybreak 划分为两个访问层级:Blue 面向经批准的防御人员,提供带有针对性防护的前沿通用模型;Red 面向获授权的漏洞研究、漏洞利用验证和安全测试,并提供新模型 GPT-5.6-Cyber。该模型基于 GPT-5.6 Sol 训练,但仅通过 Daybreak Red 向获批准的个人和组织开放,访问还受到身份核验、监控、用途限制与法律声明等约束。

第 38 期提及的 GPT-5.6 Sol 面向日常对话和免费用户开放;此次 Daybreak Red 则把专项网络安全能力置于受控部署渠道中。OpenAI 在内部“Advanced Cybersecurity Completion Rate”评测中称,GPT-5.6-Cyber 的任务完成率为 95.0%,高于 GPT-5.6 Sol 的 1.5% 和 GPT-5.5-Cyber 的 57.3%;该数字为厂商内部评测,不能等同于外部基准。公司同时表示,该模型的网络安全能力评估为“高”而非“关键”级别。

内容透明度开始进入模型输出层

Anthropic 为新版 Claude 输出加入机器可读标识

Anthropic 更新的帮助文档显示,自 8 月 2 日起在欧盟推出的新 Claude 模型,会从发布日起支持机器可读的内容标识;该能力适用于支持模型在 Claude、Claude Platform API、Claude Code、Claude Cowork 和 Claude Tag 等产品中的输出,并在全球范围生效。文本会嵌入不可见水印;Claude 可处理的 svg、png 与 jpg 等文件则可附带遵循 C2PA 标准的签名溯源元数据。

第 33 期报道欧盟《人工智能法案》进入执法阶段后,Anthropic 将透明度承诺落实到模型输出层。Anthropic 也提示,既有模型仍在补充支持,检测机制的技术细节尚待公布;而且水印被检出并不自动证明 Claude 是内容原作者,重度编辑、翻译、短文本或元数据被剥离也可能使标识无法检测。

开放模型推理供给扩容

IBM 与 Together AI 签署 2.4 亿美元推理集群协议

IBM 与 Together AI 于 8 月 11 日公布一项多年期 2.4 亿美元协议。IBM 计划在 IBM Cloud 上部署 NVIDIA HGX B300 系统组成的大型集群,预计于 2027 年第一季度可用;Together AI 将利用该集群向企业提供开放权重模型的推理服务。IBM 将其定位为 IBM Cloud 首个采用 HGX B300 与 NVIDIA Spectrum Ethernet、专为推理建设的大型专属集群。

该协议为面向开放权重模型的云端推理供给作出新承诺,落地时间已明确至 2027 年第一季度。对企业而言,竞争焦点不再只是获得 GPU,还包括能否以更稳定的推理容量与更低的 token 经济成本将开放模型接入生产环境。