PrismML 將 27B 推理模型壓到 5.9GB:可以放入電腦甚至手機

人工智能實驗室 PrismML 於2026年9月17日發布 Bonsai 2 27B 模型,把阿里巴巴廣泛使用的開源模型 Qwen3.8 27B 壓縮至 5.9GB。這個體積小得足以放入個人電腦,甚至可能放入高端智能手機,記憶體佔用較原版減少約九至十倍。[1][2]

技術原理:三值權重

PrismML 表示,壓縮的關鍵在於縮小組成模型的「權重」——即模型在訓練期間學習並儲存的資訊。一般情況下每個權重需要16位元,而 PrismML 採用名為「三值」權重的方法,把每個權重簡化為三個可能值:正一、負一或零。由於每個權重需要儲存的值大幅縮小,模型所佔空間亦隨之大減。[1]

效能保留程度

該公司行政總裁 Babak Hassibi 表示,PrismML 的壓縮技術獨特之處在於模型幾乎沒有損失效能。Bonsai 2 達到 Qwen 綜合基準分數的98%,高於3月發布的初代 Bonsai 的95%。公司指出,初代模型已被下載超過1,100萬次,而更小的模型另有260萬次下載。

Hassibi 指出,壓縮很可能總會帶來一些影響,能否達到百分之百的基準效能持平仍有待觀察。不過他認為,對於更大的模型,要達到百分之百會較容易,因為模型越大,壓縮而不失去智能的空間亦越多。該公司的下一個目標,是在未來數個月內推出數千億參數級別的模型。

背景與投資者

PrismML 由一群加州理工學院研究人員創辦,由該校教授、壓縮技術專家 Hassibi 領導。該公司的顧問包括 Ion Stoica——Databricks 共同創辦人之一,以及柏克萊著名 Sky Computing 實驗室總監。投資者包括 Khosla Ventures、Cerberus Capital 及加州理工學院;公司至今僅完成2,225萬美元種子輪融資。有傳聞指該公司正與 Apple 洽談,但 Hassibi 拒絕向 TechCrunch 評論。

對使用者的意義

Stoica 表示,這項技術令他興奮的原因是它讓先進模型可以在使用者裝置上運行。他形容使用者將會在指尖擁有智能,而且是免費的,因為它在你已經購買的裝置上運行;同時亦是私密的,因為不需要把資料送往雲端。

參考資料

[1] TechCrunch — PrismML hopes its tiny LLM will change how we all use AI

[2] PrismML — Bonsai 2 27B

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *

*