7月22日,苹果正式向开发者推送iOS 27第四个开发者Beta版本(Build 23G71)。这次更新最值得关注的不是界面微调或Bug修复,而是一个从底层改变iOS开发生态的变化——苹果首次在系统中向第三方开发者开放了完整的端侧AI能力。通过全新推出的Foundation Models框架,任何Swift开发者都能在自己的App中调用系统级AI模型,无需API密钥、无需网络、不产生任何费用。
Foundation Models:苹果给开发者发的”免费AI引擎”
在此之前,想在iOS应用里加入AI功能,开发者必须接入OpenAI、Google或Anthropic的云端API。每调用一次就要付费,用户数据还要上传到远程服务器。Foundation Models框架彻底改变了这个局面。
这个框架直接调用设备端Neural Engine上运行的苹果自研基础模型,所有计算在本地完成。开发者可以调用的核心能力包括:文本生成(支持温度、top-p等参数控制)、结构化输出(直接生成Codable类型对象,无需手动解析JSON)、语义嵌入向量(用于语义搜索和RAG检索)、以及逐token流式输出。

上下文窗口方面,A17 Pro芯片支持16K tokens,A18 Pro及以上设备可达32K tokens。对于大多数移动应用场景,这个长度已经足够覆盖一次完整的对话或文档分析任务。
独立开发者的成本革命
这个变化对独立开发者和小团队的意义远大于大公司。一个日记应用可以在本地完成所有摘要和关联分析,一个健康追踪助手可以在不联网的情况下分析用户的运动数据,一个文档扫描工具可以处理敏感商业文件而不必担心数据泄露——这些场景以前要么做不了,要么需要承担高昂的云端API费用。
更关键的是离线能力。飞机上、地铁里、偏远地区,只要设备有电,AI功能就能正常工作。这对于主打隐私保护的应用来说,简直是量身定做的技术底座。
Siri AI的底层换血:Gemini重构与三选一格局
Foundation Models是面向开发者的开放接口,而在用户端,苹果同期推进的Siri AI重构同样激进。根据WWDC 2026披露的信息,全新Siri AI的云端推理引擎AFM Cloud Pro,是基于Google Gemini约1.2万亿参数模型蒸馏而来,年授权费用约10亿美元。

更具突破性的是,苹果允许用户在ChatGPT、Gemini和Claude之间自由选择默认AI提供商。一键切换,不需要额外注册账号或付费。这意味着苹果不再试图自己做好所有AI能力,而是把自己定位为AI模型的分发平台——就像App Store分发应用一样,现在它开始分发AI模型。
首批适配SiriKit Contextual Extensions的应用已经确认包括Spotify、Notion、Airbnb、Uber、Duolingo等主流应用。Siri可以直接跨这些App执行多步任务,比如从Notion提取会议记录、生成待办事项、再通过Uber叫车前往会议地点。
对AI行业格局的连锁反应
苹果这步棋的杀伤力在于它的分发规模。全球超过22亿台活跃iOS设备,一旦AI能力成为操作系统级基础设施,模型提供商之间的竞争将从”谁的API更好”变成”谁能成为苹果设备的默认选项”。短期来看,Gemini作为默认选项有望在年底前拿下35%以上的消费级AI市场份额,Claude则可能凭借在开发者群体中的口碑实现用户量级跃升。
与此同时,AI API定价战已经开始。当苹果设备端自带免费的AI推理能力,云端API的定价策略必须重新调整。对于主要依赖iOS生态的AI应用来说,如何在本地能力和云端优势之间找到差异化定位,成为接下来必须回答的问题。
国行版的进展

国内用户也在等一个消息。今年7月中旬,国行版Apple Intelligence已完成备案审核,合作方为阿里通义千问。端侧AI计算在本地完成,涉及云端的复杂任务由通义千问处理,数据存储于国内服务器。预计2026年秋季随iOS 27正式版同步推送,覆盖iPhone 15 Pro及以上机型。
苹果用一次Beta推送,把AI从”一个App的功能”变成了”整个操作系统的能力”。对于开发者来说,这意味着AI不再是产品里的加分项,而是标配。问题只剩一个:你打算怎么用它。








