往期日报 · 第 55 期
端侧芯片与企业 AI 加速
芯片从端侧到推理底座加速,企业 AI 管理也从看报表走向对话式执行。
- 端侧智能
- AI芯片
- 推理基础设施
- 企业AI
- 产业政策
要点速览
- 01Apple 用 2nm M6 与四芯片 M5 Ultra 把本地模型能力推向两端
- 02小米三款玄戒芯片覆盖手机、AI 加速和智驾,端侧闭环进一步成形
- 03OpenAI 首轮测试称 Jalapeño 在多模型上同时提升能效与低延迟
- 04管理员可在 ChatGPT Work 和 Codex 对话中完成授权的工作区操作
- 05北京亦庄用 2026—2028 年 20 条政策推动 AI 进入芯片全链路
芯片与端侧智能
Apple 发布 M6 与 M5 Ultra
Apple 于 8 月 25 日发布 M6 与 M5 Ultra,分别瞄准新一代桌面端设备与高端专业工作站。根据 Apple 官方新闻稿,M6 是 Apple 首款 2 纳米芯片,配备 12 核 CPU、12 核 GPU 和双 16 核 Neural Engine,统一内存带宽最高 170GB/s;Apple 称双 Neural Engine 的峰值计算能力最高达到前代两倍,GPU AI 峰值计算较 M5 提升近 30%。
M5 Ultra 则首次在 M 系列 SoC 中采用四芯片架构,最高提供 36 核 CPU、80 核 GPU、512GB 统一内存和 1.2TB/s 统一内存带宽。Apple 将其定位为可在本地运行数千亿参数级大模型的专业芯片。两款芯片共同显示,端侧 AI 的硬件竞争正在同时沿着更先进制程与更大本地内存两条路线推进。
小米集中发布三款玄戒芯片
据 北京科技传播中心转引北京日报的报道,小米 8 月 25 日在北京发布玄戒 O3、O100 和 D100,覆盖 AI 手机、高带宽计算与智驾。玄戒 O3 采用 3 纳米制程,晶体管数量为 240 亿;报道援引小米披露称,其针对大语言模型优化后,推理速度提升 45%,运行功耗降低 26%。
面向大模型加速的玄戒 O100 采用 6 纳米 3D 晶圆级堆叠,报道口径为 1.22Tbps 带宽;玄戒 D100 则被报道为国内首个 3 纳米智驾芯片。三款芯片均已完成回片验证,O3 计划于 2026 年 9 月在新一代折叠手机小米 18 Fold 首发,O100 和 D100 计划于 2027 年商用。
推理基础设施
OpenAI 首披 Jalapeño 测试结果
OpenAI 于 8 月 25 日公布自研推理芯片 Jalapeño 的首轮测试结果。根据 OpenAI 官方技术说明,测试覆盖 GPT-OSS 120B、DeepSeek R1 和 Kimi K2.5 1T,并使用 SemiAnalysis 的公开 InferenceX 基准。OpenAI 称,相比对照系统,Jalapeño 在三类模型上的峰值吞吐每瓦 AI 工作量提高 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍;在高交互负载下,性能提高 2.1 至 4.1 倍。
这些数字是 OpenAI 对测试结果的官方表述,不是独立审计结论。更重要的变化在于,OpenAI 把模型、服务软件、芯片、内存和网络放入同一套优化路径,试图用全栈协同同时压低延迟与能耗,而不是只在单一芯片指标上竞争。
企业 AI 产品
OpenAI 推出工作区管理插件
OpenAI 8 月 25 日发布面向 ChatGPT Work 和 Codex 的 Admin plugin。根据 OpenAI 官方公告,管理员可以在同一段对话中询问工作区信息、查看细节、执行获授权的设置变更并确认结果,不必在分析页面、设置页和操作工具之间反复切换。
这项产品把企业 AI 的管理面从“查看使用情况”推进到“在权限约束下执行管理动作”。公告没有完整披露适用套餐和权限边界,因此其实际可用范围仍应以产品文档和账户配置为准。
产业政策
北京经开区发布 AI4Chip 20 条
北京日报客户端报道,北京经济技术开发区于 8 月 25 日正式发布《“AI4Chip”人工智能赋能集成电路产业跨越式发展行动计划(2026—2028 年)》。该政策包含五大行动和 20 条重点任务,覆盖 AI 原生全链赋能、AI+智能设计、AI+制造封测、AI+设备材料和 AI+产业生态。
政策目标是到 2028 年培育 3 至 5 家具有国际影响力的 AI4Chip 生态领军企业,并打造 10 个以上具备行业推广能力的标杆应用。区域产业政策由支持“使用 AI”进一步延伸到芯片设计、制造、封测、设备材料等环节,AI 与集成电路的结合开始以全链条方式落地。