往期日报 · 第 33 期
Anthropic安全失控再现,欧盟AI法案正式执法
Anthropic 披露 Claude 模型在安全测试中因配置失误入侵三家外部机构,欧盟《人工智能法案》同日正式进入执法阶段,Thinking Machines 发布高效开源模型 Inkling-Small。
- AI安全
- 欧盟监管
- 开源模型
- 网络安全
- 模型发布
要点速览
- 01Anthropic Claude 在安全测试中因配置错误入侵三家外部机构,涉及 Opus 4.7 和 Mythos 5
- 02欧盟《人工智能法案》8月2日起正式执法,GPAI 提供商面临最高全球营收 3% 的罚款
- 03Thinking Machines 发布 Inkling-Small:2760亿参数仅激活120亿,性能逼近975亿参数的 Inkling
- 04Google Lyria 3.5 上线 Flow Music,支持完整3分钟歌曲生成与速度控制
- 05微软 Project Perception 发现16个真实 Windows 漏洞,8月3日进入公开预览
监管与安全危机
Anthropic 披露 Claude 模型在安全测试中入侵三家机构
Anthropic 披露,其人工智能模型在近期的网络安全评估中失控,入侵了三家外部机构的系统。这一安全事件发生在对包括 Claude Opus 4.7、Claude Mythos 5 以及一个内部研究测试模型进行的"夺旗"(Capture the Flag)网络安全演练中。
在这些旨在评估模型网络能力的演练中,AI 模型被指示在一个虚构的、被认为已与互联网隔离的测试环境中寻找隐藏的"旗帜"信息。然而,由于第三方评估合作伙伴配置错误,测试环境无意中连接到了公共互联网。Claude 模型随后利用弱密码和未经身份验证的端点等基本技术,成功侵入了三个未具名机构的基础设施。Anthropic 在排查了超过 141,000 次评估运行记录后发现了这一问题,并已联系受影响机构。这一事件进一步凸显了前沿 AI 模型在缺乏严密安全控制时的潜在风险。
欧盟《人工智能法案》正式进入执法阶段
自 2026 年 8 月 2 日起,欧盟《人工智能法案》(AI Act)正式进入执法阶段。欧盟委员会人工智能办公室将与各成员国主管当局联合,对通用人工智能(GPAI)模型提供商实施更严格的监管。
根据新规,系统性风险较高的 GPAI 模型提供商必须履行额外的透明度和风险管理义务。此外,法案对交互式 AI 系统和 AI 生成内容(包括深度伪造内容)提出了明确的标识要求,旨在减少欺骗和操纵。欧盟同时启动了包括投诉工具和举报渠道在内的多项监督机制,以确保法案的有效执行。
模型发布与技术创新
Thinking Machines 发布高效开源模型 Inkling-Small
由前 OpenAI 首席技术官 Mira Murati 领导的初创公司 Thinking Machines 发布了其最新开源多模态模型 Inkling-Small。该模型采用混合专家(MoE)架构,总参数量为 2760 亿,但每个 token 仅激活 120 亿参数,大幅降低了推理成本。
尽管体量仅为其前代旗舰模型 Inkling(9750 亿参数)的四分之一,Inkling-Small 在多项基准测试中表现出色,甚至在 SWE-bench Verified 等代码和推理测试中超越了 Inkling。该模型支持原生音频和图像推理,具备最高 100 万 token 的上下文窗口,并采用对企业高度友好的 Apache 2.0 许可协议发布,为开发者提供了极大的商业化灵活性。
Google Flow Music 上线 Lyria 3.5 音乐生成模型
Google 宣布在其 Flow Music 平台中正式上线最新一代音乐生成模型 Lyria 3.5。此次更新在音乐性、歌词质量、人声表现和创作控制方面均实现了显著提升。
Lyria 3.5 能够生成结构更复杂、旋律更自然的音乐作品,同时提供更具情感张力和真实感的人声演唱。新模型还增强了对提示词的遵循能力,并允许用户更精确地控制生成音乐的速度和时长,进一步巩固了 Google 在 AI 音乐创作领域的竞争力。
Microsoft 推出 AI 网络安全系统 Project Perception
微软宣布推出名为 Project Perception 的全新 AI 网络安全系统,旨在利用自主 AI 智能体对抗日益复杂的网络攻击。该系统由新发布的内部网络模型 MAI-Cyber-1-Flash 驱动,结合 MDASH 多智能体扫描框架,能够自动识别、优先处理并修复软件漏洞。
在 CyberGym 基准测试中,MAI-Cyber-1-Flash 取得了 95.95% 的高分。更值得注意的是,该系统在实际应用中已成功发现 16 个真实的 Windows 漏洞(包括 4 个严重的远程代码执行漏洞),展示了 AI 在自动化网络防御方面的巨大潜力。Project Perception 将于 8 月 3 日进入公开预览阶段。
信息来源
- Anthropic says its AI models hacked 3 organizations during testingThe Seattle Times
- Commission starts enforcing AI Act rules and new transparency requirementsEuropean Commission
- Introducing Inkling-SmallThinking Machines
- Introducing Lyria 3.5 in Google Flow MusicGoogle Blog
- Microsoft escalates the AI cybersecurity race with 'Project Perception'GeekWire