微軟喊卡「Tokenmaxxing」!從今年 7 月起設定預算目標
為何重要
此舉標誌著 AI 產業從早期的「使用者成長與消耗優先」正式轉向「產出與成本優先」的發展階段。這將強倒逼企業重新評估 AI Agent 的部署策略與模型選擇(如改用 DeepSeek 等),並可能導致市場對 AI 工具的估值邏輯從「單與用量掛鉤」轉向「效能與價效比掛鉤」,進而影響雲端廠商的營運穩定性。
面對 AI 推理成本攀升及員工刷用量等問題,微軟從 2026 年 7 月開始為所有業務單位設定明確的 AI Token 預算上限,並將內部預設模型切換為更便宜的 GPT-5.6,實施通貨膨脹式的成本控制政策。
- 從 2026 年 7 月起,微軟各業務部門將獲得明確的「AI Token 預算目標」。
- 根據內部資料顯示,工程師每月的 token 支出約為數百到數千美元。
- 微軟將內部預設模型從其他選項切換為 GPT-5.6,主因是其成本效益更高。
- 微軟財務長 Jay Parikh 要求員工將 token 使用視為關鍵資源一樣進行管理。