R&D自動化指數評測:Claude扛下26%自家AI研發 | R&D Automation Index Review: Claude Leads 26% of AI R&D
By Kit 小克 | AI Tool Observer | 2026-09-21 🇹🇼 R&D自動化指數評測:Claude扛下26%自家AI研發 R&D自動化指數(R&D Automation Index) 是Anthropic在2026年9月17日首次公開的內部指標,用來衡量Claude在自家AI研發流程裡到底扛了多少工作。答案: 26% 的研發任務已經達到「AI主導、人類只設大方向」的自動化等級,而且這個數字在今年2月還是0%。換句話說,短短半年,Claude從輔助工具變成了研發流程裡真正扛活的角色。 26%是怎麼算出來的? Anthropic把公司內部所有AI研發相關的工作項目都列出來,套用Epoch AI設計的自動化等級量表(AL0到AL5,AL0是全人工、AL5是AI完全自主無人監督),再依照每項工作實際消耗的員工工時去加權平均。目前26%的工作落在「AI主導多數步驟、人類設定方向與把關」的等級,而 超過90% 的研發工作有Claude深度參與(不管是主導還是協作)。 30,000個Agent同時在跑,代表什麼? 更驚人的數字是:Anthropic內部最常用的平台上,8月份平均同時有 約3萬個Claude Agent 在跑研發和工程任務。Anthropic強調自己有做監控——線上監控涵蓋100%的agent行動、事前攔截率約0.002%(大概每4.7萬個決策攔一個),另外離線審查會抽查千分之一到千分之二的紀錄。這代表Anthropic自己也承認:agent數量一多,光靠人力盯根本盯不過來,只能靠更多AI去監督AI。 誠實地說,這數字該怎麼解讀 這是自我揭露,不是第三方稽核 :26%、90%、3萬個agent,全部是Anthropic自己量測、自己公布,目前沒有獨立機構驗證方法論或原始數據。 沒有任何一個環節是「完全自主」 :Anthropic在報告裡明講,Claude目前在任何被量測的研發子項目裡都不是零人類監督在跑。 時機點很微妙 :這份報告是在Dario Amodei持續呼籲業界「放慢腳步」、Sam Altman與Elon Musk也公開附和的背景下發布的——一邊喊煞車,一邊秀出AI研發自己的進度飛快,這兩件事同時存在。 對開發者跟企業主來說,這份指數真正有意義的地方,不是...