Shieldstral:3 引數多模態安全性分類器
為何重要
對於開發者與企業而言,Shieldstral 展示了小型模型在安全性分類上的潛力,能有效降低內容審查對高算力資源的依賴,使成本效益高的模型部署成為可能。其採用的二元問答框架為解決多重安全分類標準不一匯整難的痛點提供了新的結構性解決方案。這項技術驗證了在推理成本與模型效能之間取得更佳平衡的可行性。
Shieldstral 是一種新型的 3 引數多模態安全性分類器,將內容審查簡化為二元是/否問答任務,以統一異質性的安全資料集。該模型在文字安全基準測試中表現優異,足以匹敵接近 7 倍規模的競品。研究團隊公開了約 5410 萬個樣本的資料建構食譜,包含策劃與生成結果,以及具備細粒度的評估資料集。