人工智慧(AI)模型 Claude 母公司 Anthropic 週四(9月17日)公布最新內部數據,截至今年 8 月,旗下 Claude AI 已能「主導」公司約 26% 的 AI 研究與開發工作,較 2 月不到 1% 的占比明顯增加,另有 90% 的研發工作進入 AI 與人類協作階段。
綜合媒體報導,為了統計 AI 在內部研發工作的實際應用情況,Anthropic 建立了「研發自動化指數」(R&D Automation Index),並於今年 7 月開始,每週隨機抽取相關部門 20% 員工,從內部通訊軟體 Slack、文件分析他們的工作內容。
Anthropic 目前已累計整理出 1.5 萬項細分的模型研發工作任務,並依照工作性質建立包含 542 個節點的分類架構,涵蓋 AI 模型訓練、產品開發、預訓練(pre-training)、強化學習、模型評估,以及工程問題診斷等研發工作。
在評估 AI 參與程度方面,Anthropic 採用 AI 研究機構「Epoch AI」提出的自動化程度架構,將 AI 介入工作的程度分成 6 個等級。依序分別是「完全沒有介入」、「最低程度介入」「AI協助」、「AI與人協作」、「AI主導工作」,最高則為「完全自主」。
其中,「AI與人協作」代表 AI 需要在人的指導下完成大部分工作;「AI主導工作」則指 AI 只要接獲高階指令後,在人類監督下完成一項工作的多數流程。截至目前的受測 AI 研發工作中,仍沒有任何項目達到最高的「完全自主」等級。
此外,Anthropic 也透露,截至上月底,公司內部主要平台約有 3 萬個 AI 代理人同時協助處理研究、工程工作。為了確保運作安全,公司也設置相關監控及攔截機制。這些 AI 代理人在這段期間共執行超過 10 億次任務,其中約有 0.002% 遭到系統攔截,換算下來平均每 4.7 萬次,就有一次會被攔下。

