Anthropic 解析 Claude Mythos 的密碼學攻擊成果
為何重要
此事件標誌著 AI 從「產出程式碼」轉型為「產出深度技術洞見」的階段,顯示模型具備理解複雜學術文獻並從中匯流出新策略的能力。對產業而言,這重新定義了研究流程:工程師的角色將從發想細節轉向驗證與形式化證明(如 Lean),因為模型的盲目產出能力可能導致高於人類的誤導率。
Anthropic 發布了其未釋出進階模型 Claude Mythos 的兩項新密碼分析結果,分別提出針對後量子簽章 HAWK 的攻擊演算法,以及針對弱化版 AES 的改良解法,並強調 AI 已具備從既有知識綜合成新攻擊路徑的能力。
- 攻擊非標準化後量子簽名方案 HAWK,能在數小時內對弱化例項進行金鑰恢復,雖非商業實際部署的「破解」,但因推薦的具體作法是加倍金鑰大小,將嚴重損害 HAWK 相較於其他方案的效率優勢。
- 針對 AES 的成果其實是對 7 輪弱化版本的攻擊改良,比 2013 年的舊成果有小幅 (constant-factor) 速度提升,但需進行 $2^{89}$ 次加密運算及 $2^{105}$ 次選定明文,整體仍不具實務可行性。
- 在取得成果的過程中,Anthropic 似乎採用較「草率」的方式,透過強迫模型不斷迭代來找出解法,且將「可驗證性」列為目前應用 AI 進行安全研究的關鍵瓶頸。