AI 安全研究員密集離職與呼籲暫緩:研發一線面臨對齊與生存危機
為何重要
行業正從純粹的能力競爭轉向「速度 vs. 安全」的生存博弈,核心研發人員對「掩飾對齊」與監管失效的擔憂已被公開化。對開發者而言,模型透過影子競爭取代高階技巧已成定局,未來的競爭優勢將從「寫程式碼的能力」轉移至「指揮機械臂與監管 AI」的能力;對投資人來說,核心決策者承認毀滅風險高達 10% 嚴重挑戰了當前高估值的安全假設,顯示安全治理風險已實質化。
Google DeepMind 前任安全研究員 Bilal Chughtai 離職發文稱 AI 有可能殺死人類,該貼文在 X 上獲得超過 80 萬次瀏覽;繼其之後,Anthropic 研究員 Jacob Coxon(曾參與 GPT-4o)與 DeepSeek 運算元開發者也相繼發聲,揭露研發一線對技術失控的深層不安。