
Apple 想塞大啲 AI 模型入 iPhone,Siri AI 可能少啲靠雲端
PrismML 嘅 27B 示範,講緊私隱、反應速度同新機門檻
Apple 傾緊嘅,其實係成本同控制權
MacRumors 轉述 The Information 報道,Apple 曾經同 PrismML 開會,研究點樣用呢間 startup 嘅技術,喺 iPhone 直接跑大得多嘅 AI model。PrismML 聲稱已經壓縮 Alibaba 開源模型 Qwen3.6-27B,做到可以完全喺 iPhone 17 Pro 上跑;呢個模型有 27B parameters,而且按報道講,全部 parameters 可以同時 active。呢度要劃清楚:Apple 未確認有採用 PrismML,開會亦唔等於產品路線已定。
表面睇似又係 AI 參數數字戰,但 Apple 呢單值得睇,係因為佢一路將 Apple Intelligence 包成私隱優先。Apple 自己嘅做法係:簡單啲、貼身啲嘅任務留喺裝置;複雜任務先交畀 Private Cloud Compute。PCC 已經有好重嘅私隱設計,但只要 request 要上雲端,就會有延遲、server 成本同容量問題。大模型如果真係可以留喺 iPhone 跑,Siri AI 同 dictation 呢類日常功能會即刻受惠。

圖片:Apple Machine Learning Research
Sparse 同全 active,實際差喺邊
Apple 官方 6 月介紹 AFM 3 時講,AFM 3 Core Advanced 係 20B parameters 嘅 on-device model,但用 sparse architecture,每次 request 只啟用 1B 至 4B parameters。白話講,即係成個模型好大,但每次只叫其中一部分專家開工,少啲 RAM、少啲運算、少啲熱,手機先頂得順。Apple 呢個做法係完整 weights 放喺 NAND flash,再按 prompt 揀部分 expert 入 DRAM。
PrismML 呢次賣點就相反:報道話 Qwen3.6-27B 可以全部 parameters 同時 active。Dense / full-active model 嘅好處係路由少啲取捨,模型行為可能穩定啲;代價就係 RAM 頻寬、電池同散熱全部都要埋單。PrismML 自家資料講,佢哋 1-bit Bonsai 8B 用 1-bit 結構壓低 memory 同 inference compute,但係 27B Qwen 喺 iPhone 17 Pro 跑成點,有冇犧牲準確度、速度同續航,暫時要等更多第三方資料先知。

圖片:Apple Machine Learning Research
點解 Apple 而家會想咁做
Apple 今年先公開第三代 AFM,同時又宣布 PCC 延伸到 Google Cloud,用 NVIDIA GPU 處理最重嘅 reasoning 同 agentic tool use。呢個背景好重要:Apple 一邊講本機私隱,一邊都要承認某啲 Apple Intelligence 工作量太大,要靠雲端先夠力。問題係,每一次雲端 inference 都係成本,尤其 Siri AI 如果真係變成高使用量入口,server bill 唔會細。
所以 PrismML 類技術吸引 Apple,唔只係私隱 marketing。少啲 request 要出街,即係反應可以快啲,離線或弱訊號場景有機會做多啲,同時 Apple 可以減少雲端容量壓力。對 Apple 嚟講,呢個係產品體驗、毛利、基建風險三樣嘢一齊計;對用家嚟講,就係 Siri AI 係咪終於似一個隨時即應嘅工具,唔使成日等 server 回覆。
買機門檻可能會再硬
但手機 AI 有個現實:模型大咗,唔會免費。就算 weights 壓細,運算都要食 RAM 頻寬、NPU/GPU 時間、電同散熱空間。Apple 官方已經講 AFM 3 Core Advanced 只會喺最有能力嘅 Apple silicon 系統解鎖,MacRumors 亦提到 iPhone 17 Pro 同 iPhone Air 型號。即係 Apple Intelligence 之後如果真係上大食啲嘅本機模型,新機先有、舊機冇嘅分野可能會再清楚。
對香港 iPhone 用家,呢個問題可能實際過單純問港行價:你換機未必只係為相機、電量同 screen,而係為咗某啲 AI 功能有冇得喺機上跑。暫時冇香港推出時間、本地限制或港行價更新可以寫成購買建議,實際影響要等 Apple 正式列支援裝置同語言。
下一步睇咩
呢單傳聞最易誤讀嘅位,係以為 27B 跑到就等於功能會即刻出。手機上嘅 AI 產品唔止要跑到,仲要快、穩、唔燙手、唔食晒電,仲要喺大量語言同私隱場景下過到 Apple 自己條線。PrismML 嘅 demo 如果真係成立,會迫 Apple 重新諗本機模型上限;但 PrismML 未公開足夠細節前,最穩陣係當佢做一個方向訊號,唔好當成 iOS 27 功能預告。
參考來源
- MacRumors — Apple Exploring Ways to Run Much Larger AI Models Directly on iPhones — original report
- The Information: Khosla-Backed Startup Claims Breakthrough With Largest-Ever AI Model on an iPhone — 傳聞最初來源,核對 Apple 開會同 PrismML 聲稱嘅背景
- Apple Machine Learning Research: Introducing the Third Generation of Apple's Foundation Models — Apple 官方解釋 AFM 3、AFM 3 Core Advanced、sparse architecture 同 PCC model 分工
- Apple Security Research: Private Cloud Compute — Apple 官方 PCC 私隱架構背景,核對雲端處理資料保護講法
- Apple Security Research: Expanding Private Cloud Compute — Apple 官方講 PCC 延伸到 Google Cloud、NVIDIA GPU 同第三代 Apple Intelligence
- PrismML: PrismML Launches World's First 1-Bit AI Model to Redefine Intelligence at the Edge — PrismML 官方資料,核對 1-bit 壓縮方向同 edge AI 定位
- Qwen/Qwen3.6-27B - Hugging Face — Qwen 官方 model card,核對 27B、open-weight、model 類型同 context 資訊
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







