掘金 AI 測評標準:Vals 籌得 $4,000 萬 A 輪,切入市場信任關鍵位
為何重要
隨著 Anthropic 與 OpenAI 等模型廠商逼近上市或公開募資,缺乏標準化的驗證機制恐將成為發展障礙。Vals 的崛起代表著 AI 產業正從單純的技術燒錢轉向「信任基礎建設」的競爭,開發者與企業將逐漸依賴專業的評測服務作為選擇模型的關鍵依據。對投資人而言,這類驗證服務的訂閱收入模式與政府合約潛力,將是評估 AI 生態系經濟可持續性的一個新指標。
為了彌補傳統學術基準測試已難以衡量現代語言模型的複雜能力,新創公司 Vals 致力於建立一套更可行、更具產業實務影響力的評估系統。
- 該公司透過不公開具體測試內容,並專注評估法律、財務、程式碼編寫及戰爭法等領域的模型表現,來確保測評結果的客觀性與難度。
- Vals 陸續獲得 8VC、Bloomberg Beta 前序種子輪,以及 Andreessen Horowitz 領投的 $4,000 萬 Series A,營收達去年同期 8 倍且員工數增長三倍至 25 人。