三亩地 三亩地SAN MU DI · CODE DIARY
ARTICLE DETAIL

日记详情

真实记录编程学习的某一天,欢迎挑你感兴趣的翻一翻。

手机离线跑AI这个事,是不是智商税?

手机离线跑AI这个事,是不是智商税?

讲真,2026年这个AI圈真的太魔幻了。前两年大家还在卷千亿参数的大模型,今年突然就开始在手机上跑AI了。

我一直以为小语言模型(SLM)就是个智商税——参数那么少,能干啥?直到前两天在地铁上信号不好,手机又收不到网,原来能用的AI助手突然就歇了,我才意识到一个很现实的问题:离了云端,我们真的啥也干不了。

端侧AI到底行不行?

现在主流的SLM都是3B-7B参数这个量级。Phi-3 Mini、Gemma 2、Qwen 2.5这些,说白了就是"浓缩版"的大模型。浓缩是真的浓缩了,但能力也打折。

但有个东西确实让我蚌埠住——Apple的CoreML和Google的MediaPipe现在可以直接在手机上跑模型推理了。不需要网络,完全离线。延迟还低得离谱——20ms以内就能出第一个Token。这比云端往返的300ms快了不止一点。

高通和联发科的旗舰芯片也都支持本地AI推理了。80 TOPS的算力,足以跑一个量化后的3B模型。所以硬件基础是有了。

但我还是不太懂

有个问题我一直没想明白:为什么厂商都在推端侧?是隐私?但大多数用户的隐私需求真的那么强吗?更多人还不是一样把数据上传云端。

我觉得更可能是成本。云端API调用是要钱的,每个Token都在烧钱。端侧推理 once买了硬件就不需要额外付费了。这才是厂商真正想推的原因吧。

你们呢?

你们会更倾向于用端侧SLM还是继续用云端大模型?

← 返回列表