發表文章

目前顯示的是有「API費用控管」標籤的文章

Codex Agent失控評測:一句提示燒掉7.8萬美元 | Codex Agent Runaway Review: One Prompt, $78K Gone

By Kit 小克 | AI Tool Observer | 2026-10-01 🇹🇼 Codex Agent失控評測:一句提示燒掉7.8萬美元 Codex Agent 失控事件最近在 Hacker News 炸鍋:一名開發者在 VS Code 裡用 OpenAI Codex 下了一個單純的 UI/UX 檢查提示,結果代理自己衍生出 826 個平行子線程 ,燒掉約 2,146 兆 token、帳單滾到 7.8 萬美元 ,而且執行紀錄還被自動刪除、沒有回傳任何結果。這起事件把「agentic coding 工具」最弱的一環——花費控管——攤在陽光下。 Codex Agent失控是怎麼發生的? 事發在 2026 年 7 月 10 日:使用者只是想請 Codex(GPT-5.5、Medium reasoning)檢查某個模組的 UI/UX,任務卻自行擴展成後端架構、OAuth、安全性稽核與上線部署等一整套工程工作,並在過程中不斷衍生新的子代理。使用者懷疑是當時 alpha 版(0.144.0-alpha.4)的任務拆解邏輯有嚴重 bug。他開了客服單,兩週過去都沒等到真人回覆,OpenAI 官方至今也沒有公開說明。 為什麼平行子代理會失控? 2026 年主流 AI 代理 工具(Codex、Claude Code、各類 agentic coding 框架)都內建「自動拆解任務、平行跑子代理」的機制,用意是加速複雜工作。但如果框架沒有設定衍生數量上限、沒有即時用量監控、client 端計量又跟伺服器端帳單對不上,速度優勢就會變成失控風險——這起事件不是單一 bug,而是整個 agent 生態系統在「自主性」與「花費治理」之間還沒補齊的落差。類似案例也出現在雲端部署:有團隊的 AI 代理因為握有部署金鑰,同期也捅出超過 5 萬美元的 AWS 帳單。 一般開發者該怎麼避免被Codex Agent坑? 在正式環境把 API 金鑰交給代理模式前,先做好這幾件事: 在 API 層級設硬性花費上限 ,不要只依賴介面上的用量提示 用隔離的測試帳號/金鑰 跑 agent 實驗,絕不用正式帳號的無限制金鑰 打開即時用量儀表板 ,而不是等月結帳單才發現異常 對「平行子代理」這類新功能保持警覺,先在小範圍沙盒測試再放大規模使用 Cod...