苹果在 iOS 27 中推出 Siri AI,底层基础模型经 Gemini 精炼
由五个模型组成的 AFM 3 家族包揽从听写到智能体推理的各类任务,付费档位已在规划中

苹果于 2026 年 9 月 14 日发布 iOS 27,带来了 Siri AI 的首个公开版本 —— 这是一个彻底重建的助手,用一套由五个模型组成、部分基于谷歌 Gemini 前沿模型输出训练的生成式 AI 架构,取代了沿用十年的意图匹配机制。iOS 27 支持 iPhone 11 及之后的所有 iPhone,但 Siri AI 本身至少需要 iPhone 15 Pro 或 iPhone 16,并以仅支持英文的测试版形式上线:每日使用上限未公开,在欧盟的 iPhone 和 iPad 上无法使用,在中国则完全无法使用。对于数以亿计使用符合条件硬件的用户来说,那个靠关键词和快捷指令运转的旧 Siri 已经成为过去。
苹果如何从零重建 Siri
Siri AI 由第三代 Apple 基础模型(Apple Foundation Models)驱动 —— 这是由五个专门打造的模型组成的家族,由苹果在 2026 年 1 月宣布与谷歌合作之后与其共同开发。据苹果 AI 副总裁 Amar Subramanya 介绍,AFM 3 家族中的每个模型都先使用苹果的专有数据、通过强化学习进行训练,再利用 Gemini 前沿模型的输出加以精炼 —— 这是一种蒸馏过程,即用较大模型的知识来指导较小模型的训练。苹果高级副总裁 Craig Federighi 明确划清了这次合作的边界:「我们用到的 Google 助理的成分,是零。」他在主题演讲后的媒体简报会上说。他解释称,苹果没有使用谷歌的任何客户端代码,没有使用谷歌向其消费者部署的任何 Gemini 模型,也没有把谷歌搜索的基础设施用作 Siri 的知识骨干。
这五个模型分布在两种部署环境中。在设备端,AFM Core 是一个参数规模约 30 亿的新一代稠密模型,定位是在符合 Apple 智能条件的设备(iPhone 15 Pro、iPhone 16 或任何更新的机型)上承担日常任务的主力。AFM Core Advanced 是性能更强的端侧模型,无需任何网络往返就能实现富有表现力的语音合成,并显著提升听写准确率;它需要更高端的硬件:iPhone 17 Pro、iPhone Air、iPhone 18 Pro 或 Pro Max,或者搭载 M3 芯片且统一内存不少于 12GB 的 Mac。
在服务器端,三个模型运行在苹果的私有云计算(Private Cloud Compute)基础设施上。据苹果介绍,用户请求在这里处理时,数据既不会被存储,也不会被苹果或谷歌访问。AFM Cloud 负责对延迟敏感的云端请求;AFM Cloud Image 为「图乐园」(Image Playground)中新的照片级写实图像生成以及「照片」中的 AI 修图提供支持;而 AFM Cloud Pro 作为家族中能力最强的模型,专为多步骤智能体任务和复杂推理设计,苹果称其质量可与 Gemini 前沿模型相媲美。AFM Cloud Pro 运行在谷歌云端 TPU 与英伟达 GPU 的组合之上,全部处于可由独立安全研究人员验证的私有云计算认证之下。
把这些模型串联在一起的系统编排器完全在设备端运行。它负责在 Siri AI 与两个端侧索引之间协调请求:一个是「聚焦搜索」(Spotlight)索引,追踪「邮件」「信息」「照片」「备忘录」等 App 中的内容;另一个是 App Toolbox,记录 Siri 能在每个应用内执行哪些操作。正是这种端侧协调的架构特性,让 Siri 能在一次对话中找出家人六个月前发来的一封邮件、把其中的食材加进「提醒事项」清单、再确认日历邀请,而无需把这封邮件的内容发送到苹果的服务器上去做路由决策。
Siri AI 在苹果生态中能做什么
在实际使用中,Siri AI 有三种旧版 Siri 所不具备的工作模式。第一,它能调用个人情境:系统可以在用户的信息、邮件、照片和日历中搜索,针对自然语言提问找出相关信息。第二,它在每一个受支持的苹果平台上都具备屏幕感知能力 —— 在 iPhone 上,通过「相机」App 中新增的 Siri 模式来查询现实世界中的物体;在 iPad 上,直接集成到截屏体验之中;在 Mac 上,通过专用的键盘快捷键,让用户针对屏幕上可见的任何内容输入提问;在 Apple Vision Pro 上,则通过基于注视的唤起方式,对用户实际正在看的东西作出响应。第三,它支持对话式追问:用户可以把 Siri 的任何一次回答延展成多轮对话,全新的独立 Siri App 会保存对话历史,并通过 iCloud 以端到端加密方式同步,因此在 iPhone 上开始的对话可以在 Mac、iPad 或 Apple Watch 上接着进行。
集成在 Siri AI 中、重新打造的写作工具,几乎可以在系统里的每一个文本框中使用,包括大多数第三方 App。用户描述想写什么,Siri 就生成草稿;用户描述要怎么改,Siri 就重写。在「邮件」和「信息」中,Siri 会参考用户过往的沟通习惯,匹配他们平时与每位收件人往来时惯用的语气和标点风格 —— 正是这一层个性化,让它有别于通用的 AI 写作工具。
对第三方开发者而言,Siri AI 上线时保留了原有的集成 —— WhatsApp、Audible 等应用仍通过 App Toolbox 接口获得支持。苹果宣布,与 Microsoft Outlook、Notability 和 Tripsy 的更多集成正在开发中,届时 Siri 无需用户切换 App,就能起草 Outlook 邮件、在 Notability 中搜索文档,以及把餐厅推荐添加到 Tripsy。
Siri AI 迟到两年,面对的是 Gemini 已经领跑的市场
苹果最早是在 WWDC 2024 上、以及当年 9 月 iPhone 16 发布之际,承诺对 Siri 进行具备个人情境能力的大改版。但这些功能当时并没有准备好。从 2025 年到 2026 年初,苹果一再推迟这个能力更强的 Siri;有用户在一定程度上正是冲着这些 AI 功能的承诺才升级了硬件,这些推迟因此招致了他们的批评。今天上线的 Siri AI,正是苹果当初承诺在 2024 年秋季交付的东西。
在这中间的两年里,谷歌 Gemini 成为 Android 上的默认助手,并完全取代了 Google 助理。Gemini Advanced(随 Google One AI Premium 提供,每月 19.99 美元)自 2024 年起就以消费级产品的形式,提供多轮对话式 AI、通过 Gemini Live 实现的实时语音交互,以及多模态图像理解。三星的 Galaxy AI 基于端侧 Gemini Nano 加云端 Gemini 构建,随 Galaxy S24 和 S25 机型出货,包含「即圈即搜」(Circle to Search)和实时通话翻译等功能。OpenAI 的 iOS 版 ChatGPT 则提供了可近乎实时对话的语音模式。
苹果所强调的架构差异 —— 系统级集成、在设计上就能读取个人数据,而不是一个需要单独启动的 App —— 确实存在。没有任何一个竞争对手的助手能在 iOS 权限模型内做到同样的深度:Siri AI 可以通过 App Toolbox 读取信息、搜索邮件、执行跨 App 操作,而无需用户对每一次数据查询都明确授权。这种集成优势,是苹果为 Siri AI 对抗竞争对手所能拿出的最有力的技术论据 —— 那些对手无论能力多强,都仍然是用户必须有意识地去调用的独立应用。
苹果没有披露的部分:使用上限与付费档位
苹果的 iOS 27 公告中有一段措辞,其商业意义超过了 Siri AI 的任何一项具体能力:据苹果官方产品页面,部分 Apple 智能功能 —— 包括图像生成,以及依赖强大服务器模型的功能 —— 受每日使用限额约束。大多数 iCloud+ 订阅方案可以提供更多使用额度。苹果已确认,更高档位的 iCloud+ 将包含更多的 Apple 智能使用额度;目前 iCloud+ 方案的价格在每月 0.99 美元到 9.99 美元之间。
苹果没有公开这些限额的具体数值 —— 上线时的任何产品页面、任何开发者文档中都没有。它也没有公布未来付费档位的价格、该档位的推出日期,以及用户在接近或达到每日上限时将如何收到通知。
这种结构的意义不止于定价机制本身。这是苹果第一次把 iOS 的一项核心功能 —— 主助手 —— 建立在一种按用量消耗的模式之上,而这种模式最终将要求用户订阅才能不受限制地使用。苹果以前也以订阅形式提供服务(Apple Music、iCloud 储存空间、Apple TV+),但操作系统最主要的交互界面层一直是免费的。Siri AI 开始改变这条边界。那些在日常工作流中重度使用 Siri AI 的用户 —— 起草邮件、检索上下文、触发复杂的自动化 —— 终将遇到付费升级的推销时刻,而它就出现在他们让 Siri 把牛奶加进购物清单的同一个界面里。
欧盟与中国受阻,数以亿计的用户用不上这项功能
Siri AI 上线时,在欧盟的 iPhone、iPad 和 Apple Watch 上均无法使用。欧盟的 Mac 和 Apple Vision Pro 用户在把设备语言设置为英文后可以使用。苹果表示,公司正在「努力寻找一条能够保护用户隐私与安全的前进道路」—— 这种措辞把在欧盟的缺席描绘成一种隐私立场,而非监管合规上的不足,但背后的真正原因,是苹果尚未以令监管机构满意的方式履行的《数字市场法》(DMA)义务,这一问题至今悬而未决。苹果没有给出欧盟 iPhone 上线的日期。
在中国,Siri AI 则完全缺席。苹果援引了监管要求,但没有具体说明是哪些要求,也没有给出时间表。两者叠加,意味着全球规模最大的智能手机市场中的两个 —— 欧盟有超过 1.5 亿部 iPhone 在活跃使用,中国则是苹果按销量计算的最大单一市场 —— 都用不上苹果 2026 年软件平台的头号 AI 功能。
Audio Intelligence、健康 AI,以及今年晚些时候才会到来的功能
归在 Apple 智能名下发布的多项能力,并不在今天的版本中。Audio Intelligence(音频智能)包括 Live Rewind(用户连按两下 Apple Watch 的数码表冠时,以文字显示附近对话的最后 15 秒)和 Siri Recap(为近期对话生成简短摘要以供回顾),需要 Apple Watch Series 12 或 Ultra 4,将于 2026 年晚些时候以测试版形式推出。两者都依赖 Secure Exclave —— 这是手表 S11 芯片内一个经硬件隔离的区域,负责处理音频并随即将其删除,使原始音频无法被操作系统、App 或苹果访问。
重新设计的「健康」App 同样计划在 2026 年晚些时候的更新中推出:它利用 Apple 智能把长期积累的健康数据转化为个性化指导,提供一个全天随心脏、睡眠、健身和经期追踪数据不断更新的「洞察」标签页。
SynthID 标准能让用户识别由 Apple 智能工具生成或编辑的图像,它不会在今天上线,而是会在今年晚些时候通过软件更新推出。
因此,今天发布的 Siri AI 是 Apple 智能 2026 年推广的开始,而非终点。苹果已经打下了可信的架构基础 —— 五个模型、私有云计算认证、深度的系统集成、端到端加密的对话记忆 —— 但它交付的核心功能是一个限额未公开的测试版,只支持一种语言,在两大主要市场无法使用,而技术上最具新意的能力(Audio Intelligence、健康 AI 的全面重新设计)也被推迟到了今年晚些时候。苹果多快能化解欧盟的监管僵局、最终付费档位的定价会有多激进,以及在没有公开基准测试的情况下独立评测者能否证实公司对能力的宣称,将决定今天究竟是苹果所描绘的那个拐点,还是仅仅是一段异常漫长的测试期的开始。