都说天下没有免费午餐,大模型第一个不服。
今天带大家免费用的是——把大模型装进 iPhone,地铁里、飞机上、没信号的地方,照样能用。

大家好,我是程序员晚枫。

今晚苹果发布会刚开完,iPhone 18 Pro、Pro Max 和首款折叠屏亮相。热搜都在聊芯片、摄像头、新配色。

但我盯着的是一个更实用的参数:全系 12GB 内存

这个数字什么概念?它是端侧大模型的分水岭——意味着你可以在 iPhone 里完整装下一个 AI 大模型,断网也能用,一分钱不花。

今天这篇文章,就手把手带你把免费大模型装进 iPhone。不用新买的 18 也行,你的旧手机大概率也能跑。


为什么 12GB 内存是个分水岭?

先说人话:内存就是 AI 的工位面积

大模型跑在手机上,模型本身要占内存,对话内容(上下文)也要占内存。工位太小,要么模型塞不进去,要么干着干着就被系统赶出去。

手机内存和能跑的模型,对应关系大概是这样:

你的 iPhone 内存能跑的模型体感
6GB(iPhone 14 Pro 及以前)1.7B 小模型够用,飞快
8GB(iPhone 15/16/17 系列)3B 模型从容,主流水平
12GB(今晚的 iPhone 18 系列)4B 模型无压力,7B 也能塞甜点配置

今晚的 iPhone 18 Pro 用的是 2 纳米 A20 Pro 芯片,功耗比上一代低 25-30%。跑大模型是持续满负荷运算,最怕发热降频——新芯片等于给 AI 配了个不发烧的大脑

A20 Pro 芯片

所以结论很直接:iPhone 18 是目前最适合跑端侧大模型的 iPhone,没有之一。

iPhone 18 Pro 与 iPhone 18 Pro Max


5 分钟装好:一个免费 App + 一个免费模型

不需要越狱,不需要任何折腾,全程 App Store 搞定。

第一步:装 App

打开 App Store,搜 PocketPal AI,免费下载。它是开源软件,模型下载完之后所有对话都发生在你手机里,不联网、不注册、不要钱

第二步:挑模型

打开 App,点 Models 标签,里面直接列出了为手机优化过的模型清单。选一个点 Download 就行。

怎么挑?我直接给结论:

模型体积适合谁
Qwen3 1.7B(通义千问)约 1GB中文用户首选,写作、翻译、问答
Llama 3.2 3B约 2GB综合能力强,8GB 内存机型
Phi-4 Mini 3.8B约 2.7GB推理和写代码最强,12GB 机型
Gemma 3 1B(谷歌)约 0.7GB旧机型救星,6GB 内存也能跑

第三步:开聊

下载完点进 Chat,等 5 秒钟模型加载进内存,直接打字。就这,装完了。

参考速度:上一代 iPhone 16 Pro 跑 Qwen3 1.7B,每秒能输出 18-24 个字;今晚的 18 Pro 按芯片升级幅度估算,还会再快 20-30%。日常对话完全跟手,比很多人打字速度快。


什么时候你会感谢它?

端侧模型不是拿来跟云端旗舰比聪明的,它赢在三个字:靠得住

  • 地铁里:信号时断时续,云端 AI 转圈,你的本地模型秒回
  • 飞机上:全程断网,照样写文案、改邮件、翻译文档
  • 说私密的话:日记、草稿、没想好要不要发的消息,一个字节都不出你的手机
  • 不花一分钱:没有次数限制、没有会员费、没有"今日额度已用完"

有个读者之前问我:公司内网隔离,啥云端 AI 都用不了,怎么办?这类朋友今晚可以下单 iPhone 18,然后按这篇文章装个模型——你的手机,就是你的 AI

我自己把主力机装上 Qwen3 1.7B 之后,最常干的三件事:

  • 地铁上回工作消息:让它先把语气改得体面一点,再发出去,避免"收到"两个字暴露情绪
  • 开会时快速总结:语音转成文字丢给它,让它提炼要点,比我自己边听边记靠谱
  • 给娃讲作业:十万个为什么连环轰炸,扔给本地模型,它比我有耐心,还不费我的流量

还有一个意外的好处:没有次数焦虑。云端 AI 每次提问都在心里默数"这个月额度还剩多少",本地模型随便问,问一千条也不心疼。用 AI 的心态,会从"省着用"变成"放开了用"——这两种状态下,你用它干的事完全不一样。

丑话说在前面:小模型的能力有天花板。日常问答、写作辅助、翻译总结,它绰绰有余;让它做特别烧脑的深度推理,它会用实力告诉你什么叫知足常乐。


苹果自己也在往这个方向走

今晚发布会还有个细节值得注意:苹果反复强调 iPhone 会优先用端侧模型处理 AI,需要时才连云端

为什么?隐私。数据在手机里处理,就不用出门。

你可能会说:那我用系统自带的 Apple Intelligence 不就行了?

自带的确实够用,但它藏在系统里,只能在邮件、备忘录这些固定场景帮你,你没法直接跟它聊天,也没法换模型。PocketPal 这类 App 的价值就在这:想用什么模型自己挑,今天 Qwen,明天 Llama,全免费。

苹果修好了路(12GB 内存 + 不降频的芯片),第三方 App 把车开进来了。


说到底,云端 AI 是租的,端侧 AI 是你的。租的聪明,你的踏实。

今晚看完发布会,别光顾着纠结新配色——花 5 分钟给手机装个大模型,这才是新手机最快的正确用法。旧手机也别闲着,先查查内存,大概率也能跑。

你的 iPhone 是哪一款、多大内存?评论区报个到,我告诉你能跑哪个模型。

科技不高冷,AI很好用。
我是晚枫,关注我,带你一起玩AI!


参考链接

相关阅读

AI 实战课