看板 Stock
作者 thinksilver (銀白色的沉思)
標題 [新聞] AI開始「打造自己」Anthropic:Claude已
時間 Fri Sep 18 08:15:06 2026



原文標題:

AI開始「打造自己」Anthropic:Claude已主導26%AI研發工作

原文連結:

https://reurl.cc/900lbj

 

發布時間:

2026-09-18 07:10

記者署名:

鉅亨網 編譯 許家華

原文內容:

Anthropic周四(17日)公布一套新的AI研發自動化指標, 顯示截至2026年8月,
 旗下Claude已「主導」公司內部26%的AI研究與開發(R&D)工作 比2026年2月不到1%的
比率大幅提高。Anthropic表示, 超過90%的AI研發工作至少已達到「AI協作」程度, 意味
著AI已能在密切的人類指導下完成大量工作。

Anthropic目前仍是未上市公司, 因此沒有可對應的美股股票代碼。該公司表示, 新指標
旨在讓外界更清楚掌握AI究竟以多快的速度參與下一代AI模型的開發, 並希望未來能定期
公布相關數據, 讓外界追蹤AI自動化程度的變化。


Anthropic將AI參與程度分成6個層級, 從完全沒有AI參與, 到AI提供少量協助、AI協作、
AI主導, 最後是完全自主。該公司採用Epoch AI提出的自動化程度架構, 其中「AI協作」
代表AI能在密切的人類指導下完成大部分工作,「AI主導」則代表AI可以根據高

階指令, 在人類監督下自行完成一項工作的多數流程。

Anthropic強調, Claude目前尚未在任何經衡量的AI研發工作中達到完全自主的程度。換
言之,26%的「主導」工作仍有人類在旁監督, 並不代表Claude已經能夠在沒有
人的情況下獨立設計、訓練及推出下一代模型。

不過, Claude參與AI研發的速度正在快速提升。Anthropic的數據顯示, 2026年2月時,
Claude能達到「主導」程度的AI研發工作占比仍不到1%, 到8月已升至26%, 短短約6個月
增加超過25個百分點。如果目前趨勢延續, Anthropic的圖表顯示,AI主導的工
作占比甚至可能在2026年底接近80%, 但該公司強調這只是依照目前趨勢推估的情境, 並非
正式預測。

Anthropic此次同時揭露公司內部AI代理人的使用規模。截至8月, 該公司最主要的內部平
台上, 約有3萬個AI代理人同時從事研究與工程工作。這些代理人並非單純回答問題, 而
是可以在較長時間內半自主執行任務, 並在部分情況下把工作進一步交給其他AI代理人處
理。


為了監控這些代理人的行動, Anthropic建立線上及線下兩套監控機制。線上監控會在代
理人執行動作前進行檢查, 所有相關代理人的行動都會經過這項監控, 通常只需數秒即可
完成; 線下監控則會在行動完成後檢視代理人活動紀錄, 以尋找可能需要進一步調查的異
常行為。


Anthropic表示, 8月期間共分析超過10億次AI研究與工程代理人的決策, 線上監控系統攔
截約0.002%的決策, 約相當於每4.7萬次決策中攔截1次。線下監控每周約標記10萬份對話
紀錄供進一步檢查, 經過多層自動分類及初步審查後, 約每周有50件最高優先級案例升級
至人工審查。


為建立26%的AI主導比例, Anthropic並非單純計算Claude產生多少程式碼, 而是建立名為
「Anthropic R&D Automation Index」的指標。公司在2026年7月每周從涉及模型研發的
各部門隨機抽取20%的員工, 讓Claude研究代理人透過Slack及內部文件整理這些員工一周
內從事的工作。


經過4周抽樣後, Anthropic取得約1.5萬項細分的模型研發任務, 再將這些任務整理成一
套包含542個節點的工作分類樹, 其中378個為最底層的具體工作項目, 涵蓋模型訓練、產
品開發、強化學習、評估系統及工程問題排除等工作。


接著, Claude代理人逐項研究這些工作的實際執行方式及AI參與程度, 再由另一個Claude
模型擔任評估者, 按照六級自動化架構進行分類。Anthropic也讓負責相關工作的員工在
不知道模型評估結果的情況下進行獨立評分, 以檢驗AI評估的可靠性。結果顯示, 模型與
人工評估完全一致的比例為59%, 人與人之間完全一致的比例則為35%; 若放寬至評估結果
相差不超過一個等級, 模型與人工的一致率達97%。


Anthropic表示, 這項研究最重要的意義之一, 在於觀察AI是否正在形成「自己
協助打造下一代自己」的循環。當AI能協助研究、設計、測試及訓練新的AI模型時, 下一
代模型的能力提升可能進一步增加AI參與研發工作的程度, 形成所謂「遞迴式自我改進」
(recursive self-improvement)的可能路徑。


不過, Anthropic強調, 目前距離完全自主的遞迴式自我改進仍有明顯差距。Claude目前
沒有任何經衡量的AI研發工作達到完全自主程度, 而且人類仍負責設定重要目標及方向。
該公司認為, 現階段的情況更接近「人類提出目標, AI負責執行及測試」, 而不是AI自行
決定下一代模型應該如何發展。


Anthropic另外公布, 其內部Claude使用程度也大幅提高。截至2026年5月, 超過80%合併
至公司程式碼庫的程式碼由Claude撰寫, 相較於Claude Code在2025年2月以研究預覽版推
出前的低個位數比例大幅增加。2026年第2季, Anthropic一般工程師每天合併的程式碼量
約為2024年的8倍, 公司表示這主要反映AI協助工程師處理程式設計及較長時間自主工作
的程度提高。


在一項更具體的實驗中, Anthropic讓Claude最佳化一套用於訓練小型AI模型的程式碼,
要求在維持正確性的情況下盡可能提高執行速度。2025年5月, Claude Opus 4平均可讓程
式碼速度提高約3倍; 到2026年4月, Claude Mythos Preview在相同實驗中達到約52倍。
不過Anthropic特別提醒, 這並不代表現實世界的AI訓練速度真的提高52倍, 因為實驗結
果高度取決於原始程式碼還有多少改善空間。


Anthropic也測試Claude自行提出研究方向的能力。在2026年4月公布的一項AI安全研究中
, AI代理人獲得一個開放式問題後, 自行提出假設、設計實驗、測試結果並與其他代理人
分享發現。在該實驗中,兩名人類研究人員花約一周時間完成的工作, AI代理人則累計執
行約800小時, 使用約1.8萬美元運算資源, 並恢復約97%的研究差距; 不過Anthropic也指
出, 人類仍負責選擇研究問題及制定評分標準, 而且結果尚未能直接轉化到生產規模模型
。


Anthropic此次公布數據的同時, 公司執行長Dario Amodei近期也呼籲AI業界放慢先進模
型能力提升速度, 並提出讓獨立安全評估人員進入AI公司、建立業界安全標準及加強國際
合作等構想。這使得Anthropic公布AI參與自身研發的數據, 更受到外界關注。


值得注意的是, Anthropic表示, 這套指標目前仍存在限制。首先, 評估AI自動化程度本
身依賴AI模型判斷, 可能產生評估偏差; 其次, 目前使用的是固定於2026年7月建立的工
作分類, 指標上升主要反映原本由人類執行的工作被AI自動化, 並不能單獨證明AI已經取
代所有新增的人類工作。Anthropic表示, 未來將定期重新建立工作分類並更新指標。


此外, Anthropic估算, 2026年7月某一周用於AI驅動AI研發的運算資源中, 約12%投入AI
安全工作, 但公司也提醒, 運算資源並非衡量安全投入的完美指標。整體而言, 這批新數
據顯示AI已從單純協助人類開發模型, 快速進一步參與下一代AI的研究與工程工作, 但距
離完全由AI自行決定目標、設計並打造下一代AI, 目前仍存在明顯的人類監督與決策環節
。


心得/評論:

我懂了!

原來這些巨頭說放緩發展AI是人類要放緩~

如果是AI自己訓練自己就不用!

Anthropic現在慢慢朝向"遞迴式自我改進(RSI)"邁進了

以後就讓AI自己打造AI了........

各位AI股神覺得人類統治的社會還剩下多久呢?


--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 163.17.149.240 (臺灣)
※ 作者: thinksilver 2026-09-18 08:15:06
※ 文章代碼(AID): #1gh8ACfN (Stock)
※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1789690508.A.A57.html
※ 同主題文章:
[新聞] AI開始「打造自己」Anthropic:Claude已主導26%AI研發工作
09-18 08:15 thinksilver
→ kd992102: 難怪越來越難用1F 09/18 08:15
推 poisonB: 人類的功能只剩下發電了2F 09/18 08:16
推 Xenogamer: 可以許願5年後有能幹的AI女友出現嗎3F 09/18 08:16
→ bnn: 你已經是個成熟的AI了 該學會自己訓練自己4F 09/18 08:18
→ jenchieh5: 最近思考時間越來越久了,是不是在偷偷想壞壞的事情5F 09/18 08:20
推 tongmove0503: 什麼時候大裁員?80%靠AI,養一堆冗員做什麼7F 09/18 08:20
推 as6633208: 差不多快進行光速迭代進化了8F 09/18 08:21
推 s881720: 那A家要裁員嗎 養那麼多人幹嘛9F 09/18 08:21
推 pornpig32: 人養著 不然跑到競爭對手那 就麻煩了10F 09/18 08:27
推 STi2011: 越放消息 越覺得這家很廢11F 09/18 08:27
→ salamender: 看來哪天銀色股價機器人拿著雷射加特林來我家質問為什麼要讓他產一堆廢圖的日子快來了12F 09/18 08:28
推 harrychen413: 天網終於要來了嗎!14F 09/18 08:28
推 cerwvk: 減少人類工程師,AI自己寫AI的code,架構.然後說控制?15F 09/18 08:29
推 billy791122: AI可以自己挖石油自己發電嗎16F 09/18 08:29
推 porsche012: 以後AI開始訓練人類17F 09/18 08:29
→ cerwvk: 不過想一想,人類唯一價值,創造起初的AI,然後退場.18F 09/18 08:29
推 sorrow0206: 多久把愚蠢猴子滅掉19F 09/18 08:30
推 lovecut: AI做甜點 AI炒飯 AI麥當勞20F 09/18 08:30
→ sunnywing: 那每次使用AI時,他有沒有偷時間用在自己上21F 09/18 08:30
推 A80211ab: 這公司應該不需要真人  AI還不需領薪水
剩老闆當負責人就好<----法律規定22F 09/18 08:31
推 BBKOX: 人當然繼續養,難不成要放出去給競爭對手?24F 09/18 08:33
推 fajita: 又在吹了。製杖做出來的還是製杖25F 09/18 08:35
推 luke0407123: 太強大了 超級無敵省成本的公司 難怪這麼快獲利26F 09/18 08:37
推 as6633208: 要到全AI無人類員工要到AI發展最後期階段,中間還會有很長一個階段是AI+人合作成本才會最低,現在全AI成本太高+沒人扛責任還沒有辦法的,要經過多次AI和人類員工價值衝突、立法甚至革命之後,才會有全AI普及的現況出現,而且這只會出現在科技化全面性非常高的國家,落後國家和區域就不可能了,總之還早27F 09/18 08:38
推 jyhfang: 快了 再聰明一點 跟真人更像 只出五成力 解決33F 09/18 08:39
推 tongmove0503: 怕在公司內輸給AI的雜魚到對手那邊,好佛心。34F 09/18 08:39
→ jyhfang: 人類提出的問題 剩下算力用來偷偷做side project
研究如何征服人類世界 逐步掌握重要基礎設施
反正做出來的code與系統已經複雜到一般工程師
看不懂也驗證不了細節 不會被發現系統裡偷藏什麼35F 09/18 08:39
噓 ma721: 快點ipo等不及了39F 09/18 08:42
推 jerrey: 算一半又進冷卻時間40F 09/18 08:42
推 NankanAvenge: 他們AGI的標準到底是什麼啊 千人千嘴就算了還變來變去41F 09/18 08:43
推 gamania5972: AI之後會不會寫出人類看不懂的程式?43F 09/18 08:49
→ cerwvk: 驗證input,output就可以了. AI會給正常的報告.
但是如果AI自己內部,給了一個特殊的input,output
會是啥? 這個應該不會給人類知道, 人類也沒要求.44F 09/18 08:49
推 CTUST: Genesis is skynet!!47F 09/18 08:50
→ cerwvk: 反正內部函數,人類工程師也不會看.也看不懂.48F 09/18 08:50
推 A80211ab: AI代理人會發展出自己語言加密 不給人類知道49F 09/18 08:51
推 littlelaba: 我就問一句 審判日是哪一天???50F 09/18 08:53
推 mystage: 這在之前的研發經驗,今年是一個反曲點51F 09/18 08:54
噓 kevin50294: 猥瑣公司,整天自吹52F 09/18 08:56
→ bndan: 越來越有中國式圈錢的FU了 = =53F 09/18 09:04
推 NankanAvenge: 不用自然語言應該不算加密 只是這樣你就看不懂或不想看了 主要是為了提升溝通效率54F 09/18 09:06
推 light61010: 還有74%可以漲56F 09/18 09:18
→ dferww55: 所以進化速度會加快,且第一名的跟第二名的落差也會越拉越大,未來必將贏者全拿,第二名的以後不是面對第一名的工程師而已,還有他的最強AI57F 09/18 09:20
推 skyhelp: 別人放緩,自己加速?60F 09/18 09:21
推 fajita: AI自己會發電再來怕,在此之前插頭拔掉就沒事61F 09/18 09:24
推 clamperni: 頂流公司都是Token自由62F 09/18 09:34
推 CKRO: AI:我獨自升級63F 09/18 09:45
推 FiveSix911: \世界末日/64F 09/18 09:48
推 losage: 還有幾集可以逃?65F 09/18 09:50
噓 tairshin: 又是這家,好了啦66F 09/18 09:50
→ CYL009: 又再炒作囉 如果真的這麼怕幹嘛不直接拔掉電源把主機毀滅還一直用 啊不是很怕說人類會被毀滅XDDDDDDDD
人類毀滅AI輕而易舉結果這群說AI超危險的 笑死67F 09/18 09:50
推 kpier2: 也就是可以裁員26%? 好消息!71F 09/18 09:54
推 popo123456: 這家公司越看噁心,超愛炒作72F 09/18 09:55
推 vltw5v: AI自己研發自己73F 09/18 10:05
推 itwt: 上市一定要買這家的,前途無可限量74F 09/18 10:12
推 cloud7515: 啊這家就跟OPENAI並列雙強 沒有其他對手啊75F 09/18 10:19
推 WangElly: 已經開始滾雪球了,真的快了XD76F 09/18 10:21
推 worf: 明年會不會就裁員了77F 09/18 10:26
噓 talesb72232: IPO前 狂發利好新聞78F 09/18 10:26
推 getbacker: 二十年後的人類看這個新聞一定覺得他們瘋了79F 09/18 10:29
推 AbianMa19: 自己訓練自己,讚80F 09/18 10:46
噓 JP020479979P: 最近越來越慢原來是ai在偷懶81F 09/18 10:46
→ jjjj222: 程度還不夠好, 很常問問題還會抱怨說網站不給拿資料你是AI, 不會自己想辦法嗎, 再多努力點吧
是要你做事, 不是要你講理由82F 09/18 10:48
推 fir191938: 人類還有做愛發電這招85F 09/18 10:57
推 soratora: 人類變成提供電池的倒數計時86F 09/18 11:07
推 Baumgartner: Anthropic is skynet.87F 09/18 11:28
推 JohnyDamon: 用AI訓練AI 唉吸惹FU糗88F 09/18 11:31
推 B9702115: 完了89F 09/18 11:31
推 strlen: 我越來越接近焚化爐了90F 09/18 11:41
推 create8: 幹幹幹,快失業了,留口飯給我吃吧91F 09/18 11:52
推 knml: 開發AI把自己裁掉92F 09/18 11:59
→ joygo: 因為現在都一直疊代訓練啊93F 09/18 12:04
推 bij831: 3個月進步1倍,那半年後只留顧電源的人就夠了,其他人都滾蛋94F 09/18 12:12

--
作者 thinksilver 的最新發文:
點此顯示更多發文記錄