Agensh:將組織智慧擴充套件至 1,024 個代理
為何重要
這項研究提出將「代理數量」作為擴充套件通用智慧的關鍵維度,挑戰了傳統以中心化指揮官為主的擴充套件模式。對涉足 Agent 生態的開發者與企業而言,這提供瞭解決高延遲與時間預算限制下的複雜任務新解法;從投資角度看,這意味著非中心化的 AI 協作架構日益成熟,未來企業搭建分散式 AI 團隊的基礎設施可能性提高,儘管目前仍傾向於技術研究階段。
Agensh 是一種可擴充套件的「去中心化」多代理 harness,旨在突破現有框架依賴中央協調器的擴充套件性瓶頸。透過沒有中心管控員的機制,Agent 能夠在共享空間內自主分配子任務、驗證結果並協作。
- 在 ProgramBench 最難的 5 個任務上使用 GPT-5.6-sol (high) 進行評估。
- 代理數從 1 增至 128,平均最終測試通過率從 19.31% 上升至 28.78%,相對改善約 49%。
- 在 pandoc 上,代理數增至 1,024 時,測試通過率達到 55.06%。
- 系統包含共用工作區、訊息介面與共享上下文等基礎設施,支援代理在非同步模式下執行迴圈。