AI 研發自動化恐引發「智慧爆炸」!OpenAI、Anthropic 高層與諾貝爾獎得主 Hinton 聯名論文建議政府要求申報、讓稽核進駐
站內可閱讀至 (台北時間)

OpenAI 首席科學家 Jakub Pachocki、Anthropic 共同創辦人 Jack Clark、微軟首席科學家 Eric Horvitz,與諾貝爾物理學獎得主 Geoffrey Hinton、圖靈獎得主 Yoshua Bengio 等 22 位作者,9 月 28 日透過劍橋大學 AI 科學與政策計畫(CASP)發表工作論文〈What if automating AI R&D triggers an intelligence explosion?〉(Frontier AI Working Paper Series No. 2/2026),警告 AI 研發流程一旦大幅自動化,可能引發「智慧爆炸」(intelligence explosion),並呼籲各國政策制定者盡快掌握 AI 研發自動化的實況,發展引導與約束的手段。論文由 AI 治理研究機構 GovAI 研究員 Alan Chan 主筆,CASP 的 Christoph Winter 與 Sören Mindermann 也列名作者。
論文把智慧爆炸定義為「由 AI 驅動的 AI 進展劇烈加速,把原本需要數年的進展壓縮到數月甚至更短」。作者群認為,AI 系統可望在幾年內自動化大部分 AI 研發工作,甚至可能全部自動化,若因此觸發智慧爆炸,AI 的效益會大幅提前到來,但能力成長也可能遠超社會跟上的速度,人類可能失去對超人類 AI 系統的控制,國家、企業與政府各部門之間的權力制衡也可能遭到嚴重侵蝕。論文結論寫道:「一旦智慧爆炸開始,採取行動的窗口可能就此關閉。」作者在文中註明,論文觀點僅代表作者本人,不必然代表所屬機構立場。
論文引用 Anthropic 的數據指出,2025 年 1 月到 2026 年 5 月,AI 系統在該公司核准程式碼中的占比,從個位數低段升至 80% 以上;2026 年 3 月至 8 月,只需人類高層次監督、由 AI 自主完成的研發工作比例,從 1% 升至 26%。論文開頭寫道:「和 1 年前相比,AI 系統如今已寫出打造它們的公司內部大部分的程式碼。」
Anthropic 在官方網站發布的量測報告中,把這項指標稱為「Anthropic 研發自動化指數」(Anthropic R&D Automation Index)。截至 2026 年 8 月,Claude「主導」(leads)了 Anthropic 26% 的 AI 研發工作,AI 參與程度達「協作」以上的工作占比超過 90%,在所有量測的研發工作中,Claude 都還沒有完全自主運作。同一份報告揭露,Anthropic 最常用的內部平台上,同一時間約有 3 萬個 AI Agent 在執行研究與工程工作。
論文另指出,AI 系統在 2023 年只能完成人類幾秒鐘就能做完的任務,如今已能處理人類專家需要數小時到數天的工作。部分初步的趨勢外推顯示,需要數月的 AI 研發專案,可能在 2028 年中被自動化。
論文描述的機制分成 2 步:AI 愈擅長做 AI 研發,等於擴大了研發人力;這批人力再做出更好的 AI,又進一步擴大人力,形成遞迴的回饋循環。作者估算,單一頂尖 AI 開發商目前握有的算力,足以支撐「至少相當於數百萬名頂尖人類研究員」的 AI 人力。
作者同時列出 4 項可能抑制加速的阻力:各科學領域普遍存在的報酬遞減、算力或資料成長的上限、難以自動化的瓶頸任務,以及耗時的流程,例如可能長達 3 個月以上的頂尖模型訓練。論文引用 Ho 與 Whitfill 對 3 個 AI 子領域的研究,研究投入的報酬率(r)中心估計值落在 1.2 到 1.9 之間。若報酬率維持在這個水準、且沒有其他瓶頸,AI 進展速度約 1.5 年內會增為 10 倍,屆時以今日速度需要 1 年的進展,大約 5 週就能完成。作者也強調,這些可能性仍有許多不確定之處。
政策建議分為 3 塊:取得 AI 研發自動化的能見度、引導與約束智慧爆炸,以及讓社會做好調適準備。論文建議政府考慮要求 AI 公司以標準化格式,向政府與第三方稽核單位申報關鍵研發指標,例如 AI 產出的研究貢獻占比、演算法效率的提升速度,以及涉及內部 AI 系統的事故通報。更進一步的做法,是由經認證的民間稽核或政府評估機構,在 AI 系統內部部署前先行評估,或直接進駐特定 AI 公司稽核、監督研發活動。論文舉美國核能管理委員會(NRC)與美國貨幣監理署(OCC)為其他產業的類比。
論文列出的約束選項,包括設定一定期間內能力提升幅度的上限、加強監督執行自動化 AI 研發的資料中心、與資料中心業者及 AI 公司建立事故應變程序(含暫停特定 AI 研發工作負載的選項),以及要求在實體隔離網路(air-gapped)等環境中評估或部署自動化研發系統,防止模型權重外洩。國際層面,論文建議各國建立事故資訊分享等互信措施、談判國際協議並資助驗證方法研究,也建議進行兵棋推演,模擬智慧爆炸的情境。
Anthropic 在前述量測報告中寫道,公司計畫讓來自多個組織的獨立第三方評估人員進駐 Anthropic,並給予與內部風險評估團隊相當的流程、系統與資料存取權限。論文列為政策選項的進駐稽核,已先出現在其中一位作者任職公司的自家計畫裡。報告也揭露,7 月 13 日至 20 日這一週,Anthropic 流向 AI 研發的算力中,約 6% 用於安全相關工作。
論文同時提醒,政策制定者應權衡「智慧爆炸不受控制的風險」,與「特定權力遭濫用的可能及進展延後的成本」。
核稿編輯:Mia