AI 日报

往期日报 · 第 55 期

端侧芯片与企业 AI 加速

芯片从端侧到推理底座加速,企业 AI 管理也从看报表走向对话式执行。

约 6 分钟编辑部
  • 端侧智能
  • AI芯片
  • 推理基础设施
  • 企业AI
  • 产业政策

要点速览

  1. 01Apple 用 2nm M6 与四芯片 M5 Ultra 把本地模型能力推向两端
  2. 02小米三款玄戒芯片覆盖手机、AI 加速和智驾,端侧闭环进一步成形
  3. 03OpenAI 首轮测试称 Jalapeño 在多模型上同时提升能效与低延迟
  4. 04管理员可在 ChatGPT Work 和 Codex 对话中完成授权的工作区操作
  5. 05北京亦庄用 2026—2028 年 20 条政策推动 AI 进入芯片全链路

芯片与端侧智能

Apple 发布 M6 与 M5 Ultra

Apple 于 8 月 25 日发布 M6 与 M5 Ultra,分别瞄准新一代桌面端设备与高端专业工作站。根据 Apple 官方新闻稿,M6 是 Apple 首款 2 纳米芯片,配备 12 核 CPU、12 核 GPU 和双 16 核 Neural Engine,统一内存带宽最高 170GB/s;Apple 称双 Neural Engine 的峰值计算能力最高达到前代两倍,GPU AI 峰值计算较 M5 提升近 30%。

M5 Ultra 则首次在 M 系列 SoC 中采用四芯片架构,最高提供 36 核 CPU、80 核 GPU、512GB 统一内存和 1.2TB/s 统一内存带宽。Apple 将其定位为可在本地运行数千亿参数级大模型的专业芯片。两款芯片共同显示,端侧 AI 的硬件竞争正在同时沿着更先进制程与更大本地内存两条路线推进。

小米集中发布三款玄戒芯片

据 北京科技传播中心转引北京日报的报道,小米 8 月 25 日在北京发布玄戒 O3、O100 和 D100,覆盖 AI 手机、高带宽计算与智驾。玄戒 O3 采用 3 纳米制程,晶体管数量为 240 亿;报道援引小米披露称,其针对大语言模型优化后,推理速度提升 45%,运行功耗降低 26%。

面向大模型加速的玄戒 O100 采用 6 纳米 3D 晶圆级堆叠,报道口径为 1.22Tbps 带宽;玄戒 D100 则被报道为国内首个 3 纳米智驾芯片。三款芯片均已完成回片验证,O3 计划于 2026 年 9 月在新一代折叠手机小米 18 Fold 首发,O100 和 D100 计划于 2027 年商用。

推理基础设施

OpenAI 首披 Jalapeño 测试结果

OpenAI 于 8 月 25 日公布自研推理芯片 Jalapeño 的首轮测试结果。根据 OpenAI 官方技术说明,测试覆盖 GPT-OSS 120B、DeepSeek R1 和 Kimi K2.5 1T,并使用 SemiAnalysis 的公开 InferenceX 基准。OpenAI 称,相比对照系统,Jalapeño 在三类模型上的峰值吞吐每瓦 AI 工作量提高 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍;在高交互负载下,性能提高 2.1 至 4.1 倍。

这些数字是 OpenAI 对测试结果的官方表述,不是独立审计结论。更重要的变化在于,OpenAI 把模型、服务软件、芯片、内存和网络放入同一套优化路径,试图用全栈协同同时压低延迟与能耗,而不是只在单一芯片指标上竞争。

企业 AI 产品

OpenAI 推出工作区管理插件

OpenAI 8 月 25 日发布面向 ChatGPT Work 和 Codex 的 Admin plugin。根据 OpenAI 官方公告,管理员可以在同一段对话中询问工作区信息、查看细节、执行获授权的设置变更并确认结果,不必在分析页面、设置页和操作工具之间反复切换。

这项产品把企业 AI 的管理面从“查看使用情况”推进到“在权限约束下执行管理动作”。公告没有完整披露适用套餐和权限边界,因此其实际可用范围仍应以产品文档和账户配置为准。

产业政策

北京经开区发布 AI4Chip 20 条

北京日报客户端报道,北京经济技术开发区于 8 月 25 日正式发布《“AI4Chip”人工智能赋能集成电路产业跨越式发展行动计划(2026—2028 年)》。该政策包含五大行动和 20 条重点任务,覆盖 AI 原生全链赋能、AI+智能设计、AI+制造封测、AI+设备材料和 AI+产业生态。

政策目标是到 2028 年培育 3 至 5 家具有国际影响力的 AI4Chip 生态领军企业,并打造 10 个以上具备行业推广能力的标杆应用。区域产业政策由支持“使用 AI”进一步延伸到芯片设计、制造、封测、设备材料等环节,AI 与集成电路的结合开始以全链条方式落地。