OpenAI 發布 MentalHealthBench:由 80+ 名心理健康專家打造的對話評估基準
為何重要
這顯示 OpenAI 正試圖在醫療等高敏感且合規性要求高的領域建立資料標準與信任背書。對於利用 AI 從事輔助諮詢或相關服務的開發者而言,這提供了評估模型專業度與安全性的實具體工具;在市場上,這能吸引需要高信任度應用的企業客戶。
- OpenAI 公佈 MentalHealthBench,這是一個開放基準,專門用來評估 AI 在現實心理健康諮詢對話中的回應。
- 該基準由 80+ 名持照心理健康專家共同開發。
- 其設計場景涵蓋真實的對話情境,目的是提供具體的評估標準。