PrismML 發布 Bonsai 2 27B,壓縮 Qwen3.8 27B 至 5.9GB,適合手機並維持 98.2% 效能
為何重要
這顯示模型壓縮與部署技術已進化至足以讓頂級大型語言模型在消費級智慧型手機上執行且不顯著犧牲效能,為開發者提供了第三種部署選擇(除了雲端與資料中心)。此外,這也反映了行動端 AI 競賽核心從單純爭奪算力,轉向如何在有限的硬體資源下最大化模型效能。
AI 實驗室 PrismML 宣佈推出 Bonsai 2 27B,旨在透過模型壓縮技術,讓大型語言模型能夠在裝置端執行,不再受限於雲端運算。該模型將 Alibaba 的 Qwen3.8 27B 壓縮至適合智慧型手機的體積,同時極大程度保留了原始效能。
- Bonsai 2 27B 是將阿里巴巴的 Qwen3.8 27B 模型進行壓縮後的產物。
- 壓縮後的模型檔案大小僅約 5.9 GB,符合手機裝置的儲存限制。
- 壓縮後的版本保留了原版 98.2% 的基準排名分數。