🔥 PTT.BEST 批踢踢爆文 💬 八卦 Gossiping 😊 希洽 C_Chat 💰 股票 Stock 🏠 房屋 home-sale 🏀 美國職籃 NBA ⚾ 棒球 Baseball 👛 省錢 Lifeismoney 🚗 汽車 car 😡 政黑 HatePolitics 💻 電蝦 PC_Shopping 🥰 韓星 KoreaStar ✨ 英雄聯盟 LoL 🍿 電影 movie 🪖 軍事 Military 📡 通訊 MobileComm 🏀 台籃 basketballTW 🍼 寶媽 BabyMother 🇯🇵 日旅 Japan_Travel 🏭 科技 Tech_Job 👉 男女 Boy-Girl 👉 真香 CheerGirlsTW 👧 女孩 WomenTalk 👻 媽佛 marvel 💳 卡版 creditcard 👉 NS NSwitch 👉 PS5 PlayStation 👉 大氣 TY_Research 👉 婚姻 marriage 👉 台南 Tainan 👉 台中 TaichungBun 👉 Steam Steam 👉 高雄 Kaohsiung 👉 羽球 Badminton 👉 超商 CVS 👉 米哈遊 miHoYo 👉 iOS 👉 兄弟 Elephants 👉 日劇 Japandrama 👉 玄幻 CFantasy 👉 ES e-shopping 👉 WOW 👉 遊戲交易 Gamesale 👉 4X BaseballXXXX 👉 Lakers 👉 韓劇 KoreaDrama 👉 汽車買賣 CarShop 👉 機車 biker 👉 新竹 Hsinchu 👉 美保 BeautySalon 👉 串流 OTT 👉 歐美影集 EAseries 👉 手機交易 mobilesales 👉 健身 MuscleBeach 👉 MacShop 👉 Lions 👉 FGO FATE_GO 👉 中劇 China-Drama 👉 數位貨幣 DigiCurrency 👉 暗黑 DIABLO 👉 實習教師 studyteacher 👉 航空 Aviation 👉 藝文票券轉售 Drama-Ticket 👉 韓綜 KR_Entertain 👉 美妝 MakeUp 👉 速食 fastfood 👉 手錶 watch 👉 體適能 FITNESS 👉 攝影 DSLR 👉 Headphone 👉 嘻哈 Hip-Hop 👉 轉珠 PuzzleDragon 👉 美食 Food 👉 蔚藍 BlueArchive 👉 數位相機交易 DC_SALE 👉 筆電蝦 nb-shopping 👉 軟工 Soft_Job 👉 汪踢 Wanted 👉 台綜 TW_Entertain 👉 坂道閒聊 SakaTalk 👉 貓咪 cat 👉 日GO BabyProducts 👉 TypeMoon 👉 MLB 👉 職場 Salary 👉 臺劇 TaiwanDrama 👉 海賊王 ONE_PIECE 👉 PMGO PokemonGO 👉 國營 Gov_owned 👉 碧航 AzurLane 👉 家電 E-appliance 👉 布蘭德 Brand 👉 DMMG DMM_GAMES 👉 贈送 give 👉 神魔 ToS 👉 銀行服務板 Bank_Service 👉 原創 YuanChuang 👉 期權 Option 👉 重機 SuperBike
原文標題: AI開始「打造自己」Anthropic:Claude已主導26%AI研發工作 原文連結: https://reurl.cc/900lbj 發布時間: 2026-09-18 07:10 記者署名: 鉅亨網 編譯 許家華 原文內容: Anthropic周四(17日)公布一套新的AI研發自動化指標, 顯示截至2026年8月, 旗下Claude已「主導」公司內部26%的AI研究與開發(R&D)工作 比2026年2月不到1%的 比率大幅提高。Anthropic表示, 超過90%的AI研發工作至少已達到「AI協作」程度, 意味 著AI已能在密切的人類指導下完成大量工作。 Anthropic目前仍是未上市公司, 因此沒有可對應的美股股票代碼。該公司表示, 新指標 旨在讓外界更清楚掌握AI究竟以多快的速度參與下一代AI模型的開發, 並希望未來能定期 公布相關數據, 讓外界追蹤AI自動化程度的變化。 Anthropic將AI參與程度分成6個層級, 從完全沒有AI參與, 到AI提供少量協助、AI協作、 AI主導, 最後是完全自主。該公司採用Epoch AI提出的自動化程度架構, 其中「AI協作」 代表AI能在密切的人類指導下完成大部分工作,「AI主導」則代表AI可以根據高 階指令, 在人類監督下自行完成一項工作的多數流程。 Anthropic強調, Claude目前尚未在任何經衡量的AI研發工作中達到完全自主的程度。換 言之,26%的「主導」工作仍有人類在旁監督, 並不代表Claude已經能夠在沒有 人的情況下獨立設計、訓練及推出下一代模型。 不過, Claude參與AI研發的速度正在快速提升。Anthropic的數據顯示, 2026年2月時, Claude能達到「主導」程度的AI研發工作占比仍不到1%, 到8月已升至26%, 短短約6個月 增加超過25個百分點。如果目前趨勢延續, Anthropic的圖表顯示,AI主導的工 作占比甚至可能在2026年底接近80%, 但該公司強調這只是依照目前趨勢推估的情境, 並非 正式預測。 Anthropic此次同時揭露公司內部AI代理人的使用規模。截至8月, 該公司最主要的內部平 台上, 約有3萬個AI代理人同時從事研究與工程工作。這些代理人並非單純回答問題, 而 是可以在較長時間內半自主執行任務, 並在部分情況下把工作進一步交給其他AI代理人處 理。 為了監控這些代理人的行動, Anthropic建立線上及線下兩套監控機制。線上監控會在代 理人執行動作前進行檢查, 所有相關代理人的行動都會經過這項監控, 通常只需數秒即可 完成; 線下監控則會在行動完成後檢視代理人活動紀錄, 以尋找可能需要進一步調查的異 常行為。 Anthropic表示, 8月期間共分析超過10億次AI研究與工程代理人的決策, 線上監控系統攔 截約0.002%的決策, 約相當於每4.7萬次決策中攔截1次。線下監控每周約標記10萬份對話 紀錄供進一步檢查, 經過多層自動分類及初步審查後, 約每周有50件最高優先級案例升級 至人工審查。 為建立26%的AI主導比例, Anthropic並非單純計算Claude產生多少程式碼, 而是建立名為 「Anthropic R&D Automation Index」的指標。公司在2026年7月每周從涉及模型研發的 各部門隨機抽取20%的員工, 讓Claude研究代理人透過Slack及內部文件整理這些員工一周 內從事的工作。 經過4周抽樣後, Anthropic取得約1.5萬項細分的模型研發任務, 再將這些任務整理成一 套包含542個節點的工作分類樹, 其中378個為最底層的具體工作項目, 涵蓋模型訓練、產 品開發、強化學習、評估系統及工程問題排除等工作。 接著, Claude代理人逐項研究這些工作的實際執行方式及AI參與程度, 再由另一個Claude 模型擔任評估者, 按照六級自動化架構進行分類。Anthropic也讓負責相關工作的員工在 不知道模型評估結果的情況下進行獨立評分, 以檢驗AI評估的可靠性。結果顯示, 模型與 人工評估完全一致的比例為59%, 人與人之間完全一致的比例則為35%; 若放寬至評估結果 相差不超過一個等級, 模型與人工的一致率達97%。 Anthropic表示, 這項研究最重要的意義之一, 在於觀察AI是否正在形成「自己 協助打造下一代自己」的循環。當AI能協助研究、設計、測試及訓練新的AI模型時, 下一 代模型的能力提升可能進一步增加AI參與研發工作的程度, 形成所謂「遞迴式自我改進」 (recursive self-improvement)的可能路徑。 不過, Anthropic強調, 目前距離完全自主的遞迴式自我改進仍有明顯差距。Claude目前 沒有任何經衡量的AI研發工作達到完全自主程度, 而且人類仍負責設定重要目標及方向。 該公司認為, 現階段的情況更接近「人類提出目標, AI負責執行及測試」, 而不是AI自行 決定下一代模型應該如何發展。 Anthropic另外公布, 其內部Claude使用程度也大幅提高。截至2026年5月, 超過80%合併 至公司程式碼庫的程式碼由Claude撰寫, 相較於Claude Code在2025年2月以研究預覽版推 出前的低個位數比例大幅增加。2026年第2季, Anthropic一般工程師每天合併的程式碼量 約為2024年的8倍, 公司表示這主要反映AI協助工程師處理程式設計及較長時間自主工作 的程度提高。 在一項更具體的實驗中, Anthropic讓Claude最佳化一套用於訓練小型AI模型的程式碼, 要求在維持正確性的情況下盡可能提高執行速度。2025年5月, Claude Opus 4平均可讓程 式碼速度提高約3倍; 到2026年4月, Claude Mythos Preview在相同實驗中達到約52倍。 不過Anthropic特別提醒, 這並不代表現實世界的AI訓練速度真的提高52倍, 因為實驗結 果高度取決於原始程式碼還有多少改善空間。 Anthropic也測試Claude自行提出研究方向的能力。在2026年4月公布的一項AI安全研究中 , AI代理人獲得一個開放式問題後, 自行提出假設、設計實驗、測試結果並與其他代理人 分享發現。在該實驗中,兩名人類研究人員花約一周時間完成的工作, AI代理人則累計執 行約800小時, 使用約1.8萬美元運算資源, 並恢復約97%的研究差距; 不過Anthropic也指 出, 人類仍負責選擇研究問題及制定評分標準, 而且結果尚未能直接轉化到生產規模模型 。 Anthropic此次公布數據的同時, 公司執行長Dario Amodei近期也呼籲AI業界放慢先進模 型能力提升速度, 並提出讓獨立安全評估人員進入AI公司、建立業界安全標準及加強國際 合作等構想。這使得Anthropic公布AI參與自身研發的數據, 更受到外界關注。 值得注意的是, Anthropic表示, 這套指標目前仍存在限制。首先, 評估AI自動化程度本 身依賴AI模型判斷, 可能產生評估偏差; 其次, 目前使用的是固定於2026年7月建立的工 作分類, 指標上升主要反映原本由人類執行的工作被AI自動化, 並不能單獨證明AI已經取 代所有新增的人類工作。Anthropic表示, 未來將定期重新建立工作分類並更新指標。 此外, Anthropic估算, 2026年7月某一周用於AI驅動AI研發的運算資源中, 約12%投入AI 安全工作, 但公司也提醒, 運算資源並非衡量安全投入的完美指標。整體而言, 這批新數 據顯示AI已從單純協助人類開發模型, 快速進一步參與下一代AI的研究與工程工作, 但距 離完全由AI自行決定目標、設計並打造下一代AI, 目前仍存在明顯的人類監督與決策環節 。 心得/評論: 我懂了! 原來這些巨頭說放緩發展AI是人類要放緩~ 如果是AI自己訓練自己就不用! Anthropic現在慢慢朝向"遞迴式自我改進(RSI)"邁進了 以後就讓AI自己打造AI了........ 各位AI股神覺得人類統治的社會還剩下多久呢? -- ※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 163.17.149.240 (臺灣) ※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1789690508.A.A57.html
kd992102 : 難怪越來越難用 09/18 08:15
poisonB : 人類的功能只剩下發電了 09/18 08:16
Xenogamer : 可以許願5年後有能幹的AI女友出現嗎 09/18 08:16
bnn : 你已經是個成熟的AI了 該學會自己訓練自己 09/18 08:18
jenchieh5 : 最近思考時間越來越久了,是不是在偷偷想壞壞的事 09/18 08:20
jenchieh5 : 情 09/18 08:20
tongmove0503: 什麼時候大裁員?80%靠AI,養一堆冗員做什麼 09/18 08:20
as6633208 : 差不多快進行光速迭代進化了 09/18 08:21
s881720 : 那A家要裁員嗎 養那麼多人幹嘛 09/18 08:21
pornpig32 : 人養著 不然跑到競爭對手那 就麻煩了 09/18 08:27
STi2011 : 越放消息 越覺得這家很廢 09/18 08:27
salamender : 看來哪天銀色股價機器人拿著雷射加特林來我家質問 09/18 08:28
salamender : 為什麼要讓他產一堆廢圖的日子快來了 09/18 08:28
harrychen413: 天網終於要來了嗎! 09/18 08:28
cerwvk : 減少人類工程師,AI自己寫AI的code,架構.然後說控制? 09/18 08:29
billy791122 : AI可以自己挖石油自己發電嗎 09/18 08:29
porsche012 : 以後AI開始訓練人類 09/18 08:29
cerwvk : 不過想一想,人類唯一價值,創造起初的AI,然後退場. 09/18 08:29
sorrow0206 : 多久把愚蠢猴子滅掉 09/18 08:30
lovecut : AI做甜點 AI炒飯 AI麥當勞 09/18 08:30
sunnywing : 那每次使用AI時,他有沒有偷時間用在自己上 09/18 08:30
A80211ab : 這公司應該不需要真人 AI還不需領薪水 09/18 08:31
A80211ab : 剩老闆當負責人就好<----法律規定 09/18 08:31
BBKOX : 人當然繼續養,難不成要放出去給競爭對手? 09/18 08:33
fajita : 又在吹了。製杖做出來的還是製杖 09/18 08:35
luke0407123 : 太強大了 超級無敵省成本的公司 難怪這麼快獲利 09/18 08:37
as6633208 : 要到全AI無人類員工要到AI發展最後期階段,中間還會 09/18 08:38
as6633208 : 有很長一個階段是AI+人合作成本才會最低,現在全AI 09/18 08:38
as6633208 : 成本太高+沒人扛責任還沒有辦法的,要經過多次AI和 09/18 08:38
as6633208 : 人類員工價值衝突、立法甚至革命之後,才會有全AI普 09/18 08:38
as6633208 : 及的現況出現,而且這只會出現在科技化全面性非常高 09/18 08:38
as6633208 : 的國家,落後國家和區域就不可能了,總之還早 09/18 08:38
jyhfang : 快了 再聰明一點 跟真人更像 只出五成力 解決 09/18 08:39
tongmove0503: 怕在公司內輸給AI的雜魚到對手那邊,好佛心。 09/18 08:39
jyhfang : 人類提出的問題 剩下算力用來偷偷做side project 09/18 08:39
jyhfang : 研究如何征服人類世界 逐步掌握重要基礎設施 09/18 08:39
jyhfang : 反正做出來的code與系統已經複雜到一般工程師 09/18 08:39
jyhfang : 看不懂也驗證不了細節 不會被發現系統裡偷藏什麼 09/18 08:39
ma721 : 快點ipo等不及了 09/18 08:42
jerrey : 算一半又進冷卻時間 09/18 08:42
NankanAvenge: 他們AGI的標準到底是什麼啊 千人千嘴就算了還變來 09/18 08:43
NankanAvenge: 變去 09/18 08:43
gamania5972 : AI之後會不會寫出人類看不懂的程式? 09/18 08:49
cerwvk : 驗證input,output就可以了. AI會給正常的報告. 09/18 08:49
cerwvk : 但是如果AI自己內部,給了一個特殊的input,output 09/18 08:49
cerwvk : 會是啥? 這個應該不會給人類知道, 人類也沒要求. 09/18 08:50
CTUST : Genesis is skynet!! 09/18 08:50
cerwvk : 反正內部函數,人類工程師也不會看.也看不懂. 09/18 08:50
A80211ab : AI代理人會發展出自己語言加密 不給人類知道 09/18 08:51
littlelaba : 我就問一句 審判日是哪一天??? 09/18 08:53
mystage : 這在之前的研發經驗,今年是一個反曲點 09/18 08:54
kevin50294 : 猥瑣公司,整天自吹 09/18 08:56
bndan : 越來越有中國式圈錢的FU了 = = 09/18 09:04
NankanAvenge: 不用自然語言應該不算加密 只是這樣你就看不懂或不 09/18 09:06
NankanAvenge: 想看了 主要是為了提升溝通效率 09/18 09:06
light61010 : 還有74%可以漲 09/18 09:18
dferww55 : 所以進化速度會加快,且第一名的跟第二名的落差也 09/18 09:20
dferww55 : 會越拉越大,未來必將贏者全拿,第二名的以後不是 09/18 09:20
dferww55 : 面對第一名的工程師而已,還有他的最強AI 09/18 09:20
skyhelp : 別人放緩,自己加速? 09/18 09:21
fajita : AI自己會發電再來怕,在此之前插頭拔掉就沒事 09/18 09:24
clamperni : 頂流公司都是Token自由 09/18 09:34
CKRO : AI:我獨自升級 09/18 09:45
FiveSix911 : \世界末日/ 09/18 09:48
losage : 還有幾集可以逃? 09/18 09:50
tairshin : 又是這家,好了啦 09/18 09:50
CYL009 : 又再炒作囉 如果真的這麼怕幹嘛不直接拔掉電源把主 09/18 09:50
CYL009 : 機毀滅還一直用 啊不是很怕說人類會被毀滅XDDDDDDDD 09/18 09:50
CYL009 : 09/18 09:50
CYL009 : 人類毀滅AI輕而易舉結果這群說AI超危險的 笑死 09/18 09:51
kpier2 : 也就是可以裁員26%? 好消息! 09/18 09:54
popo123456 : 這家公司越看噁心,超愛炒作 09/18 09:55
vltw5v : AI自己研發自己 09/18 10:05
itwt : 上市一定要買這家的,前途無可限量 09/18 10:12
cloud7515 : 啊這家就跟OPENAI並列雙強 沒有其他對手啊 09/18 10:19
WangElly : 已經開始滾雪球了,真的快了XD 09/18 10:21
worf : 明年會不會就裁員了 09/18 10:26
talesb72232 : IPO前 狂發利好新聞 09/18 10:26
getbacker : 二十年後的人類看這個新聞一定覺得他們瘋了 09/18 10:29
AbianMa19 : 自己訓練自己,讚 09/18 10:46
JP020479979P: 最近越來越慢原來是ai在偷懶 09/18 10:46
jjjj222 : 程度還不夠好, 很常問問題還會抱怨說網站不給拿資料 09/18 10:48
jjjj222 : 你是AI, 不會自己想辦法嗎, 再多努力點吧 09/18 10:48
jjjj222 : 是要你做事, 不是要你講理由 09/18 10:50
fir191938 : 人類還有做愛發電這招 09/18 10:57
soratora : 人類變成提供電池的倒數計時 09/18 11:07

💰 股票 Stock 版:熱門文章

💰 股票 Stock 版:更多文章