實測訊飛星火X2.5:手搓粒子月亮、拆完61頁財報……還順手揪出了我的Bug
為何重要
這篇文章實質上驗證了星火大模型在「與 Agent 協作」與「國產算力全鏈路部署」兩條主線上的落地能力。對開發者而言,提升的 API 相容性與工具鏈整合意味著這是一個可以直接投入生產環境而非玩具的模型;對產業而言,93% 的訓練效率獨佔鰲頭,配合政府層面對智慧體應用的推動,標誌著訊飛正構築抵禦國際晶片制裁並符合國家戰略的新生態。
訊飛最新發布 293B-A30B MoE 架構的星火大模型,並繼續擴張端側模型生態;在國產算力平臺上,模型訓練效率較 A800 叢集提升至 93%。實測顯示,模型具備良強的 Agent 與程式碼能力,雖然面對的是複雜任務,但仍能實現 9 份圖表及投研簡報的零耗時交付,並覆蓋 200 餘種語言。
- 規格與能力:大模型覆蓋 200 餘種語言,原生支援 Anthropic 協定與 Claude Code、Codex 等第三方框架
- 端側表現:4B 和 1.7B 模型支援 100 萬 Token 上下文,並登上 Hugging Face 熱門榜第一
- 國產算力最佳化:在落地於國產算力的情況下,訓練效率從開箱狀態的 30% 提升至 93%