LG AI Research 發布 MoE 多語言基礎模型 K-EXAONE 2.0
為何重要
K-EXAONE 2.0 的推出標誌著韓國 AI 生態系在開放權重前線模型領域的正式佈局,透過 Apache 2.0 授權釋出,它為全球開發者提供了一個具體的、能在編碼與長續 掌握上與閉源競爭的對手。對於重視資料隱私與在地化(特別是亞洲語境)的開發者或企業而言,這展示了除了美國大廠外,還有本地化開源基礎模型可供選擇;此舉也進一步加劇了前線模型的爭奪戰。
韓國 LG AI Research 推出了升級版開放權重多語言基礎模型 K-EXAONE 2.0,此版本透過架構擴充將模型規模提升至前代的約三倍。
- 採用 Mixture-of-Experts(MoE)架構,總引數量達 750B,每次運算約有 37B 個引數被啟用。
- 支援最長 256K token 的上下文視窗,並將多語言支援範圍擴充套件至 10 種語言。
- 在 Apache 2.0 授權下發布,並透過持續預訓練與針對代理編碼、長上下文理解及韓國社會文化安全的微調來強化實力。