01意外上线数小时,端侧模型首次亮相
2026年3月,苹果AI国行版端侧模型在正式发布前意外上线数小时,让全球用户率先体验到“ 零延迟”的本地AI。短暂开放期间,文本改写、AI消除等核心功能在设备端秒级完成,刷新了人们对本地计算的想象。
02速度:所有计算“留在”iPhone里
过去,用户输入一段文字、等待云端返回结果,再刷新页面,动作被切成三段;如今, 核心算法在芯片内部闭环,整个流程被压缩到两秒以内。实测显示,文本改写从触发到呈现新文本不到2秒,AI消除一张照片也不超过3秒。没有云端往返,延迟几乎为零。
03隐私:数据不出设备,法规与理念双赢
速度之外,苹果把“ 隐私优先”写进了底层架构:所有训练数据、推理输入均不离开本地网络。这既满足国内“数据本地化”法规要求,也让用户无需担心云端泄露。代价是精度折让——复杂场景下AI消除可能出现阴影残留或填充瑕疵,与云端大模型仍有差距。
04智能蒸馏:让小模型“偷学”大模型
为了在有限算力下逼近云端智能,苹果引入“模型蒸馏”技术:把Google Gemini完整版接入训练集,让大模型当“老师”, 蒸馏出更小、更高效的本地模型。新模型不仅输出结果类似,还继承了内部推理逻辑,在手机芯片上就能完成高阶任务。
05生态整合:从备忘录到“图乐园”的全链路覆盖
蒸馏出的端侧模型被深度植入iOS生态:Siri获得柔光界面并支持文字输入;备忘录、邮件等原生应用接入写作工具;全新App“图乐园”可一键生成个性化图片。系统级整合让AI能力像Wi-Fi一样“即开即用”,却也暴露天花板—— 长文本摘要、深度对话等复杂场景仍需云端补足精度。