ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

掘金 AI 測評標準:Vals 籌得 $4,000 萬 A 輪,切入市場信任關鍵位

模型 1 個來源 · 4 天前
為何重要

隨著 Anthropic 與 OpenAI 等模型廠商逼近上市或公開募資,缺乏標準化的驗證機制恐將成為發展障礙。Vals 的崛起代表著 AI 產業正從單純的技術燒錢轉向「信任基礎建設」的競爭,開發者與企業將逐漸依賴專業的評測服務作為選擇模型的關鍵依據。對投資人而言,這類驗證服務的訂閱收入模式與政府合約潛力,將是評估 AI 生態系經濟可持續性的一個新指標。

為了彌補傳統學術基準測試已難以衡量現代語言模型的複雜能力,新創公司 Vals 致力於建立一套更可行、更具產業實務影響力的評估系統。

  • 該公司透過不公開具體測試內容,並專注評估法律、財務、程式碼編寫及戰爭法等領域的模型表現,來確保測評結果的客觀性與難度。
  • Vals 陸續獲得 8VC、Bloomberg Beta 前序種子輪,以及 Andreessen Horowitz 領投的 $4,000 萬 Series A,營收達去年同期 8 倍且員工數增長三倍至 25 人。
ValsAndreessen HorowitzAI BenchmarkingModel EvaluationSeries A

來源 · 1 篇報導

首發 TechCrunch — AI techcrunch.com 21:00