中國掀起開源模型熱潮:Qwen 與 DeepSeek 挑戰美國專有模型壟斷
為何重要
中國廠商透過「技術透明化」與「硬體成本最佳化」,成功將競爭模式轉變為「開源搶先跑」與「API 價格殺手」,迫使 Anthropic 等美國廠商必須重新正視開源權重的不可逆壓力;對投資人而言,DeepSeek 所展現的高效率推理意味著「算力堆疊」不再是獲利護城河,開源生態的激烈競爭將重塑美國科技巨頭的軟體服務營收邏輯與估值。
美國模型公司遭遇競爭壓力,Alibaba 發布 2.4 兆引數的 Qwen 3.8-Max 並首度提供權重量下載,DeepSeek 則推出體積僅 284B 引數的 V4 Flash-0731,以效率與低成本策略打破專有模型壟斷。
- Qwen 3.8-Max 採用 MoE 架構,部署於 48-64 顆 Nvidia B200 或 8-16 顆 AMD MI355X 即可執行,其 API 價格為輸入 $2/M tokens、輸出 $6/M tokens,預計下週在 Hugging Face 上線。
- DeepSeek V4 Flash-0731 在規模上大幅精簡,僅需約 142GB FP4 記憶體即可執行,其每解決問題的成本比 OpenAI 的 GPT 5.6 Luna 便宜 40%(3 美分 vs 5 美分)。
- 雖然 Qwen 3.8-Max 引數量巨大,但 Artificial Analysis 測試顯示其效能僅與 Anthropic 的 Claude Sonnet 5 相當,且 DeepSeek V4 Flash 超越了同公司 1.6T 引數的 Pro 版本。