6 月 8 日 WWDC 2026 keynote,Apple 正式把「下一代 Apple Intelligence」端上桌——核心是全新的 Siri AI,背后是一套以 Gemini 为底、重新写过的 Apple Foundation Models。官方 Newsroom 罕见地用「bold new architecture, uniquely designed to protect privacy」来描述这次重写。
架构上最值得说的三件事:
端侧多模态。 新模型在设备本地同时理解语音和图像,硬件门槛是 iPhone 17 Pro / iPhone Air 起步、12GB 统一内存(A17 Pro / M1 及之后)。这是 Apple 首次把 on-device 模型从「文本」推进到「文本+图像+语音」多模态,而不是把多模态留在云端。
Gemini 进入 Private Cloud Compute。 请求超出设备能力时,Apple 把推理交给 PCC 里的 Apple Foundation Models——这一层由 Apple 与 Google 合作、用 Gemini 作为基础模型蒸馏适配而来。Apple 一再强调 PCC 的「无状态、可验证、不留存数据」特性,本质是借 Gemini 的能力,端到端不丢隐私叙事。
系统级应用层。 新 App Intents 框架允许任意 App 暴露可被 Siri 调用的动作——Siri AI 不再只是聊天框,而是跨 App 编排层。配合 onscreen awareness 和 personal context(Messages、Mail、Photos),能力边界从问答扩展到「代用户执行多步任务」。Siri AI 还有独立 App,会话历史在 iPhone、iPad、Mac 之间同步,Vision Pro 上用 3D 视图调起。
我的判断:这次发布最值得玩味的不是 Siri「终于聪明了」,而是 Apple 第一次在白皮书上承认自己最强的端侧模型背后站着 Gemini。端侧用自家数据 + RLHF 把 Gemini 蒸馏成可高效在 3B 量级跑的多模态模型;云端把 Gemini 当推理引擎,在 PCC 里跑更大版本。这是「自研 + Google 算力」的混合架构,和纯自研路线(Anthropic、xAI)、纯 API 转售(iOS 18 早期接入 ChatGPT)都不一样。
对 Apple 来说,最大风险是叙事——把 Gemini 写进白皮书,意味着 Apple Intelligence 永远绕不开「用谁的模型」这个拷问;对 Google 来说,这是 Gemini 在 C 端最大的一次规模化分发——WWDC 之后,每一个升级到 iOS 27 的 iPhone 用户都是 Gemini 的潜在推理消费者,比任何 Google I/O 都要炸裂。
开发者 Beta 今天上线,公共 Beta 下个月开跑,正式版要等今年秋季。