ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

Anthropic 公告阿里巴巴與 Moonshot AI 的知識萃取攻擊報告

中國 1 個來源 · 12 天前
為何重要

此報告揭示了 AI 領域競爭已從單純的模型能力訓練,升級為高規模的「萃取競賽」與防禦戰。開發者與企業需正規視國際標準下的竊密手段,並重新評估 API 端的安全防護機制,市場所預期的單純 API 成本下降可能因此受阻。

Anthropic 公佈一份報告,指控中國 AI 公司利用越獄技術非法萃取 Claude 等美國前沿模型的內部推理過程,以便訓練自家小模型。報告指出,攻擊者手法日益精進,部分甚至成功繞過 Anthropic 的防禦機制直接獲取模型思考軌跡。

  • 2 億次互動被歸類為知識萃取攻擊,主要集中在代理能力、程式碼與邏輯推理上。
  • 阿里巴巴 (Qwen) 被視為最大的攻擊者,在 2026 年 5 月至 7 月間利用 1.51 億次互動建立訓練資料庫,涉及超過 3,500 個共用固定提示詞的帳戶。
  • Moonshot AI (Kimi) 的活動被發現路由自中國軍方,要求 Claude Opus 針對監視畫面分析約 30 萬次請求,偵測異常行為。
AnthropicAlibabaQwenMoonshot AIKimiClaude

來源 · 1 篇報導

首發 TechCrunch — AI techcrunch.com 04:57