阿里正式發布 Qwen3.8 系列模型,定位高階市場並推出低成本 API
為何重要
Qwen3.8 不僅在權威榜單上達到全球第一梯隊的水準,更重要的是透過 M890 超節點最佳化與具競爭力的定價策略,大幅降低了企業部署 AI Agent 的門檻與成本,直接衝擊了國際模型在中國市場的定價權與算力供應鏈主導地位。 - 對開發者而言,2.4T 引數量級與長上下文能力搭配 27B 開源版本,提供了更靈活的技術路徑選擇,有利於垂直領域模型的微調與整合。 - 產業觀察重點在於「真武 M890」與 Qwen3.8 的聯動最佳化,這顯示了從硬體到底層模型的全鏈路閉環最佳化將成為未來競爭的關鍵。
阿里巴巴於 8 月 3 日發布新一代基礎大模型 Qwen3.8,包含旗艦版 Qwen3.8-Max 與即將開源的 27B 版本,透過稀疏 MoE 架構最佳化推理效率,並主打程式設計與專業辦公場景的自主規劃能力。
- 技術架構與規格:採用稀疏 MoE 與混合注意力最佳化,總引數達 2.4T、啟用 95B,上下文長度 1M Tokens,支援視覺理解,並已針對阿里真武 M890 超節點進行全鏈路最佳化。
- 效能基準表現:在 PaperBench 科研智慧體評估中以 93.0 分(較前代提升 28.2 分)錄得新高,GPQA Diamond 科學推理達 92.6 分,Vision Arena 排名全球第二。
- 價格與競爭力:Qwen3.8 的國際 API 價格僅為 Opus5 的輸入 40% 與輸出 24%,在 M890 最佳化加持下,Agentic 推理場景最高可提升 1.5 倍效能。
- 實際應用範例:展現系統級自主規劃能力,包括自主開源 oh-my-cli 框架、1 小時完成法律文書處理,以及數小時內完成 ETF 輪動量化研究。