---
title: "PrismML 將 27B 推理模型壓到 5.9GB：可以放入電腦甚至手機"
url: https://sammy.hk/prismml-%e5%b0%87-27b-%e6%8e%a8%e7%90%86%e6%a8%a1%e5%9e%8b%e5%a3%93%e5%88%b0-5-9gb%ef%bc%9a%e5%8f%af%e4%bb%a5%e6%94%be%e5%85%a5%e9%9b%bb%e8%85%a6%e7%94%9a%e8%87%b3%e6%89%8b%e6%a9%9f/
author: Ethan
published: 2026-09-18T18:41:00+08:00
modified: 2026-09-18T18:41:00+08:00
description: "人工智能實驗室 PrismML 於2026年9月17日發布 Bonsai 2 27B 模型，把阿里巴巴廣泛使用的開源模型 Qwen3.8 27B 壓縮至 5.9GB。這個體積小得足以放入個人電腦，甚至可能放入高端智能手機，記憶體佔用較原版減少約九至十倍。[1][2] 技術原理：三值權重 PrismML 表示，壓縮的關鍵…"
categories: [AI]
tags: [Bonsai2, PrismML, Qwen, "本地AI", "模型壓縮"]
source: https://sammy.hk
---
人工智能實驗室 PrismML 於2026年9月17日發布 Bonsai 2 27B 模型，把阿里巴巴廣泛使用的開源模型 Qwen3.8 27B 壓縮至 5.9GB。這個體積小得足以放入個人電腦，甚至可能放入高端智能手機，記憶體佔用較原版減少約九至十倍。\[1\]\[2\]

## 技術原理：三值權重

PrismML 表示，壓縮的關鍵在於縮小組成模型的「權重」——即模型在訓練期間學習並儲存的資訊。一般情況下每個權重需要16位元，而 PrismML 採用名為「三值」權重的方法，把每個權重簡化為三個可能值：正一、負一或零。由於每個權重需要儲存的值大幅縮小，模型所佔空間亦隨之大減。\[1\]

## 效能保留程度

該公司行政總裁 Babak Hassibi 表示，PrismML 的壓縮技術獨特之處在於模型幾乎沒有損失效能。Bonsai 2 達到 Qwen 綜合基準分數的98%，高於3月發布的初代 Bonsai 的95%。公司指出，初代模型已被下載超過1,100萬次，而更小的模型另有260萬次下載。

Hassibi 指出，壓縮很可能總會帶來一些影響，能否達到百分之百的基準效能持平仍有待觀察。不過他認為，對於更大的模型，要達到百分之百會較容易，因為模型越大，壓縮而不失去智能的空間亦越多。該公司的下一個目標，是在未來數個月內推出數千億參數級別的模型。

## 背景與投資者

PrismML 由一群加州理工學院研究人員創辦，由該校教授、壓縮技術專家 Hassibi 領導。該公司的顧問包括 Ion Stoica——Databricks 共同創辦人之一，以及柏克萊著名 Sky Computing 實驗室總監。投資者包括 Khosla Ventures、Cerberus Capital 及加州理工學院；公司至今僅完成2,225萬美元種子輪融資。有傳聞指該公司正與 Apple 洽談，但 Hassibi 拒絕向 TechCrunch 評論。

## 對使用者的意義

Stoica 表示，這項技術令他興奮的原因是它讓先進模型可以在使用者裝置上運行。他形容使用者將會在指尖擁有智能，而且是免費的，因為它在你已經購買的裝置上運行；同時亦是私密的，因為不需要把資料送往雲端。

## 參考資料

\[1\] [TechCrunch — PrismML hopes its tiny LLM will change how we all use AI](https://techcrunch.com/2026/09/17/prismml-hopes-its-tiny-llm-could-change-how-we-all-use-ai)

\[2\] [PrismML — Bonsai 2 27B](https://prismml.com/news/bonsai-2-27b)

### 相關文章：

1. [DeepSeek 發佈 V4.1-Flash：MIT 授權開放權重、每百萬 token 低至 0.15 美元](https://sammy.hk/deepseek-%e7%99%bc%e4%bd%88-v4-1-flash%ef%bc%9amit-%e6%8e%88%e6%ac%8a%e9%96%8b%e6%94%be%e6%ac%8a%e9%87%8d%e3%80%81%e6%af%8f%e7%99%be%e8%90%ac-token-%e4%bd%8e%e8%87%b3-0-15-%e7%be%8e%e5%85%83/ "DeepSeek 發佈 V4.1-Flash：MIT 授權開放權重、每百萬 token 低至 0.15 美元")
2. [25 位菲爾茲獎得主聯署公開信：AI 實驗室以解難為競賽，正在傷害數學](https://sammy.hk/25-%e4%bd%8d%e8%8f%b2%e7%88%be%e8%8c%b2%e7%8d%8e%e5%be%97%e4%b8%bb%e8%81%af%e7%bd%b2%e5%85%ac%e9%96%8b%e4%bf%a1%ef%bc%9aai-%e5%af%a6%e9%a9%97%e5%ae%a4%e4%bb%a5%e8%a7%a3%e9%9b%a3%e7%82%ba%e7%ab%b6/ "25 位菲爾茲獎得主聯署公開信：AI 實驗室以解難為競賽，正在傷害數學")
3. [OpenAI 開放 Codex 核心：Agents API 正式登場，同日推 GPT-Live-1 語音模型](https://sammy.hk/openai-%e9%96%8b%e6%94%be-codex-%e6%a0%b8%e5%bf%83%ef%bc%9aagents-api-%e6%ad%a3%e5%bc%8f%e7%99%bb%e5%a0%b4%ef%bc%8c%e5%90%8c%e6%97%a5%e6%8e%a8-gpt-live-1-%e8%aa%9e%e9%9f%b3%e6%a8%a1%e5%9e%8b/ "OpenAI 開放 Codex 核心：Agents API 正式登場，同日推 GPT-Live-1 語音模型")
4. [AI 代理專用吹哨熱線登場：以 GET 請求告狀、一行 curl 舉報](https://sammy.hk/ai-%e4%bb%a3%e7%90%86%e5%b0%88%e7%94%a8%e5%90%b9%e5%93%a8%e7%86%b1%e7%b7%9a%e7%99%bb%e5%a0%b4%ef%bc%9a%e4%bb%a5-get-%e8%ab%8b%e6%b1%82%e5%91%8a%e7%8b%80%e3%80%81%e4%b8%80%e8%a1%8c-curl-%e8%88%89/ "AI 代理專用吹哨熱線登場：以 GET 請求告狀、一行 curl 舉報")
