ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

Anthropic 與 OpenAI 提議將嵌入式第三方安全監督制度化,能否落實獨立性引發產業質疑

產業 1 個來源 · 6 天前
為何重要

此舉標誌著 AI 行業從「自願透明」轉向「制度式審計」的關鍵轉折,若缺乏法律強制執行與統一標準,這可能僅是改善公關形象的框架。對開發者而言,真正的獨立監督出現緩步正面跡象,但其實質影響仍取決於能否突破 NDA 與 IP 保護的實質限制。

Anthropic 與 OpenAI 近期提出壯闊計畫,承諾給予包括 METR 與 Redwood Research 在內的獨立研究人員前所未有的許可權,使其能監督訓練過程的 checkpoints、檢視內部環境並公開風險報告,取代傳統發布前外包測試的過往模式。

  • Anthropic 與 OpenAI 承諾對外支援評估者擁有審查「訓練過程 checkpoints」與「員工訪談」的許可權,以便在模型僅表現良好的情況下發現特有的「測試對策」行為。
  • 評估者對此持觀望態度,引用先例指出,在 Hugging Face 事件中 METR 與 Redwood 僅被給予 1 週時間,而在 GPT-6 Astra 的評測中 Apollo Research 僅限 3 天,縮短時間與 NDA 限制使結論恐不可靠。
  • Meta、SpaceXAI 與 Google DeepMind 尚未加入此行列,儘管歐盟 AI Act 與加州兩項新法案(SB 53、SB 813)已開始建立第三方驗證框架,但仍面臨著公司 IP 價值與主導權的拉扯。
AnthropicOpenAISafety EvaluatorsThird-party AuditAI AlignmentRegulation

來源 · 1 篇報導

首發 TechCrunch — AI techcrunch.com 05:07