發表文章

目前顯示的是有「Copilot」標籤的文章

Tokenmaxxing爭議:微軟砍AI Token預算逼工程師省用 | Tokenmaxxing: Microsoft Caps AI Token Budgets for Engineers

By Kit 小克 | AI Tool Observer | 2026-08-05 🇹🇼 Tokenmaxxing爭議:微軟砍AI Token預算逼工程師省用 Tokenmaxxing (瘋狂刷AI Token)正成為科技業新流行語——微軟本週被爆出向工程師下達「AI Token預算」上限,高層在內部信明白寫著「Tokenmaxxing不是我們要優化的目標」,這代表企業對AI寫程式工具的態度,正從全力推廣轉向精算成本。 什麼是Tokenmaxxing?微軟為什麼要喊卡? Tokenmaxxing指工程師不論是否必要,都習慣性狂用AI代理、瘋狂消耗Token的行為。微軟EVP Jay Parikh日前寄信給工程團隊,宣布自2026年7月起,各部門將實施「AI Token預算目標」,並開放工程師自行追蹤用量,理由很直白:不是不讓用,而是不要為用而用。 微軟怎麼砍AI Token預算? 根據內部文件,部分工程師每月AI花費已來到數百美元到「數千美元」不等,對於一家自家Copilot對外主打「人人都該用」的公司來說,這數字顯然超出預期。微軟的因應對策有兩個方向: 設定部門級Token預算目標 ,讓每個團隊有明確的用量天花板 把GPT-5.6設為內部預設模型 ,因為它比其他選項便宜,藉此降低單次呼叫成本 換句話說,微軟一邊對外賣「無限暢用Copilot」的願景,一邊對內喊卡Tokenmaxxing,兩套標準的反差正是這則新聞引爆討論的原因。 這對開發者跟企業意味著什麼? 這不代表AI寫程式退燒,而是產業從「野蠻生長期」進入「精算期」。過去一年多,企業幾乎是無腦鼓勵員工用AI提升生產力;現在帳單來了,才發現不是每個Token都花得有價值。這股風氣不只微軟——愈來愈多公司開始設AI使用儀表板、幫員工排名用量,逼團隊思考「這次呼叫到底值不值得」。 對一般開發者來說,實際的因應方式很簡單:重複性、低風險的任務丟給便宜模型(例如GPT-5.6這類定位),真正複雜、高價值的架構決策才動用貴模型,別讓Tokenmaxxing變成新的技術債。 常見問題 FAQ Q: Tokenmaxxing是什麼意思? A: 泛指工程師不分場合、過度依賴AI代理消耗大量Token的行為,微軟高層用這個詞警告員工別為用而用。 Q: 微軟為什麼要設...