ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

Anthropic 修正 Fable 5 生物學安全分類器,誤判後退現象降低 85%

模型 1 個來源 · 2 小時前
為何重要

此舉凸顯尖端 AI 模型在『安全性』與『可用性』間的拉扯。Anthropic 選擇放寬部分分類器限制以釋放臨床與教育價值,但仍刻意保留部分高危領域的後備機制,反映出針對生化武器研發等『雙重用途』風險的防範仍是普及高階語言模型的關鍵門檻。

Anthropic 正在最佳化 Claude Fable 5 模型的生物學防護措施,透過更新分類器減少使用者遇到強制切換至較低階機型的次數。

AnthropicFable 5Opus 5Biological SafeguardsSafety Classifiers

來源 · 1 篇報導

首發 Anthropic News anthropic.com 12:00