ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

OpenAI 承諾加強 Astra 安全控制,Anthropic 因競爭壓力放寬 Fable 防禦機制

模型 1 個來源 · 1 小時前
為何重要

這兩家 AI 領頭羊的動作深刻反映了微妙的競爭生態:OpenAI 趨向將「開發階段的安全」實物化,而 Anthropic 則為了保住使用者而在商業應用上犧牲部分拒絕攔截機制。對投資人與產業觀察者而言,這意味著低成本、速度快的開源競品正迫使西方巨頭在「訓練時的嚴謹」與「商業時的便利」之間尋求新的平衡點,安全策略將成為新的競爭護城河。

面對未發布模型潛在的致命攻擊風險,OpenAI 與 Anthropic 近期對其特殊模型的安全政策呈現出截然不同的發展方向。OpenAI 承諾對其未發布的模型 Astra 採取更嚴格的隔離測試與 Chain of Thought 監控等防範措施,以應對其內部評估中顯示的網路安全能力進步;相對地,Anthropic 為了應對來自中國開源模型公司的市場競爭壓力,選擇放寬 Fable model 對於生物與化學攻擊相關提示詞的防禦性拒絕。

OpenAIAstraAnthropicFablePreparedness FrameworkChain of Thought

來源 · 1 篇報導

首發 The Register theregister.com 07:41