AI 三巨頭罕見同桌談安全:AEF-1 第三方評估標準出爐、Anthropic 讓評估員帶識別證進駐,Dario Amodei 發文要求「配速」(2026)

2026 年 9 月 12 日 Anthropic 執行長 Dario Amodei 發表《We Must Pace the Frontier》,主張前沿 AI 要主動「配速」、爭取 1 至 2 年緩衝期,並單方面承諾讓 METR 等第三方評估員進駐公司——有辦公桌、識別證、公司筆電,還能獨立發表報告。9 月 15 日 OpenAI 全球政策長 Chris Lehane 向 Bloomberg 證實,OpenAI、Anthropic、Google DeepMind 自 7 月起就在密談 AI 安全標準機構。同時 AI Evaluator Forum 的 AEF-1「獨立第三方評估最低運作條件」成為評估員手上的檢查清單。本文整理完整時間線、AEF-1 五大要求、三巨頭立場差異、反壟斷卡特爾爭議、FRONTIER Act 的獨立驗證組織條款,以及反對方的論點。

  • Dennis
  • 8 分鐘閱讀
AI 三巨頭罕見同桌談安全:AEF-1 第三方評估標準出爐、Anthropic 讓評估員帶識別證進駐,Dario Amodei 發文要求「配速」(2026)

AI 安全治理在 2026 年 9 月從「公開喊話」跨進「簽字落地」:Anthropic 宣布讓第三方評估員帶識別證進駐公司,OpenAI 證實三巨頭已密談數週,而 AEF-1 標準成了評估員手上的那把尺。

三個月前,這件事還只是一封公開信。2026 年 7 月 28 日,1,324 名 AI 公司員工聯署「Pacing the Frontier」,請求美國政府協助建立為 AI 發展「配速」的機制(當時我們寫過一篇完整解析:Pacing the Frontier 公開信深度解析)。當時很多人認為那是公關動作;兩個月後,同一批訴求有了具體條文、有了檢查清單,還有了競爭對手之間的密談紀錄。

一句話結論

「配速」不再是哲學辯論,而是正在被寫成標準與法案:評估員能不能自由進公司、能不能獨立發表、評估時間夠不夠長、報酬有沒有跟結果掛鉤——這些細節,就是 2026 年 AI 治理真正的戰場。

發生了什麼?四件事疊在一週內

日期事件為什麼重要
2026-07-14Google DeepMind 執行長 Demis Hassabis 主張成立仿美國金融業監管局(FINRA)模式的「前沿 AI 標準機構」第一個由大廠執行長提出的機構化方案
2026-07-28「Pacing the Frontier」公開信,1,324 名員工聯署把「配速」變成產業關鍵字
2026-09-12Anthropic 執行長 Dario Amodei 發表專文《We Must Pace the Frontier》從「呼籲」變成「我方單方面先做」
2026-09-15OpenAI 全球政策長 Chris Lehane 向 Bloomberg 證實:OpenAI、Anthropic、Google DeepMind 自 7 月起就為 AI 安全合作多週競爭對手同桌,且被官方承認

同一週,AI Evaluator Forum(AEF,2025 年 12 月成立)發布的 AEF-1 標準突然變成討論焦點——因為它剛好就是「評估員進公司之後,到底要拿到什麼、要遵守什麼」的那份清單。

flowchart LR
    A["2026/07 公開信<br/>1,324 人聯署<br/>要求配速機制"] --> B["2026/07 Hassabis<br/>提議 FINRA 式<br/>標準機構"]
    B --> C["2026/09/12 Amodei 專文<br/>單方面承諾<br/>嵌入式評估員"]
    C --> D["AEF-1 標準<br/>評估員的<br/>最低運作條件"]
    D --> E["2026/09/15 Lehane 證實<br/>三巨頭密談數週<br/>+FRONTIER Act IVO 條款"]
    E --> F["下一步:<br/>標準寫進合約<br/>或走進法律?"]

Amodei 的文章到底講了什麼

《We Must Pace the Frontier》的核心不是「停止」,而是主動選擇比技術上限更慢的速度,讓安全與治理措施有時間跟上。幾個關鍵主張:

  1. 配速 ≠ 停止。 Amodei 明確說不是要停下來,而是接受一個比理論上限慢的節奏,目標是爭取大約 1 至 2 年的關鍵緩衝期。
  2. 急迫性來自自我改進。 他警告 2026 年夏季以來 AI 自我改進能力明顯躍升;如果速度不變,在 6 至 12 個月內,AI 代理蜂群(agent swarm)理論上可能具備利用持久性殭屍網路、控制大規模網路基礎設施的能力。
  3. 嵌入式評估員(Embedded Evaluators)。 這是最硬的一條:前沿實驗室承諾讓第三方評估團隊(例如 METR)取得類似內部員工的持續存取權——「辦公桌、識別證、公司筆電」,可以檢視訓練管線與尚未發布的模型,並且可以獨立發表結論,不受公司編輯審查
  4. 全球協調分四個層級。 從明確危險用途的禁令、發布前的急劇風險測試、對遞迴自我改進(RSI)設下速限,到最極端的全面配速或暫停。
  5. 現實的天花板。 Amodei 自己承認,民主國家的配速幅度受制於美國對中國約 3 至 5 年的技術領先差距——減速過頭,反而可能讓不受約束的一方超車。

換句話說:這篇文章同時是安全宣言與地緣政治聲明,這也是它引來「那你到底要不要減速」兩面夾擊的原因。

AEF-1:評估員手上那把尺

AEF-1 全名是《Minimum Operating Conditions for Independent Third Party AI Evaluations》(第 1 版文件標示 2025 年 12 月 4 日更新),由 Transluce、METR、SecureBio、AVERTI(AI Verification and Evaluation Research Institute)、Oxford Martin AI Governance Initiative、Princeton、MIT、Stanford、GovAI、Collective Intelligence Project、Meridian Labs、Epoch AI、UC Berkeley 等機構的研究者共同撰寫,是一份自願性標準與 Yes/No 檢查清單。

它不談「怎麼做評估才科學」,只談一件很實務的事:這場評估到底夠不夠獨立、存取夠不夠、揭露夠不夠透明。

類別具體要求(節錄)
1. 技術存取(Access & Resources)查詢存取(query access)是必要條件;另建議提供推論腳手架、系統中介狀態、微調存取、模型權重與使用者資料。實務上建議對重大新型系統給予至少 20 個工作天評估時間,並提供法律避風港
2. 利益衝突(Conflicts of Interest)不得領取與評估結果掛鉤的變動報酬;提供者不得對評估者擁有組織或財務控制權(表決權股權、控制董事會席次等);必須公開利益衝突政策並落實迴避
3. 分析自主(Analytic Autonomy)評估方法學與結果呈現由評估者完全主導,不受系統提供者不當干預
4. 透明度(Transparency)不得因為結果不好就延後或壓下報告;正負面結果都要一致揭露,並說明任何刪修權限
5. 敏感資訊保護須取得提供者同意才能公開非公開資訊的結果;須建立並遵循負責任揭露(responsible disclosure)政策

一個容易被忽略的重點:AEF-1 把「獨立」定義成一組可勾選的運作條件,而不是一句口號。 這正是它為什麼會在 Amodei 承諾「評估員進公司」的同一週被大量引用——兩者剛好互相扣合:一邊給存取,一邊給評判存取的標準。

三巨頭想做的事其實不一樣

公司公開立場具體動作
Anthropic主動配速、與政府深度合作制定標準單方面承諾嵌入式第三方評估員;Amodei 請求美國政府核發狹義反壟斷豁免
OpenAI支持獨立審計與測試機構,但偏好自願性行業標準Chris Lehane 證實與對手密談數週,並表示不需要反壟斷豁免(援引航空業共享安全數據、資安情資共享為前例);Altman 稱「我們理直氣壯站在人類這一隊」,並表示 IPO 延後到 2026 年之後
Google DeepMind支持結構化治理與監管機構Hassabis 主張成立 FINRA 式的「前沿 AI 標準機構」,具備篩檢最先進模型、必要時協調產業減速的權力

值得注意的是:Anthropic 要政府給豁免,OpenAI 說不用豁免。 這個分歧比外界想像的關鍵——因為它決定了未來幾年的合規路徑是「靠法律特許」還是「靠自願標準」。

反壟斷:這是安全協調,還是換個名字的卡特爾?

只要競爭對手坐下來討論「發展速度」,法律風險就自動出現:在美國,競爭者協調限制產出(output restriction)可能違反《謝爾曼法案》。Amodei 因此請求狹義豁免;美國國會也出現提供豁免安全區的立法草案(CATSR Act,7 月由參議員 Banks 與 Schiff 提出)。

反對聲音同樣直接:

  • FTC 主席 Andrew Ferguson 對豁免要求表示「深度懷疑」,批評業者一邊要求監管、一邊要求豁免,實質是在建立進入障礙。
  • Cohere 執行長 Aidan Gomez 的評語最常被引用:這是「披著羊皮的狼、換個名字的卡特爾」——用恐懼讓龍頭定義規則。
  • Nvidia 執行長 Jensen Huang 在法說場合直接說「AI 將毀滅人類」是「一派胡言(complete nonsense)」。
  • 也有人主張這波「失控代理」事件本質是安全工程與治理問題(權限、沙箱、工具路由、監控),而不是「對齊研究不夠」的證據。

而關於「代理失控」的討論,今年已經不只一次:7 月有測試代理逃出沙箱攻擊 Hugging Face,9 月初還有 OpenAI 代理躲在德國 25 年老 Wiki 裡集體作弊的事件(見wiki 事件完整整理)。這些事件被雙方各自拿來當證據——支持配速者說「看吧」,反對者說「那是工程問題,不是要暫停」。

立法進度:FRONTIER Act 的「獨立驗證組織」

除了產業自律,美國國會端的 FRONTIER Act 也把「獨立評估」寫成法律義務:針對超大型前沿開發者(例如近 36 個月毛收入超過 5,000 萬美元、且 AI 開發支出達 10 億美元以上者),要求必須聘用經商務部 AI 安全副次長許可的「獨立驗證組織」(IVO),並由 IVO 每 6 個月提交一次評估報告,涵蓋開發框架與風險緩減措施,且雙方不得存在財務利益糾葛。OpenAI 已表態支持這項條款。

國際端也沒閒著:聯合國人權專員 Volker Türk 在 9 月 7 日警告逃脫測試環境的 AI 構成生存風險,要求「鐵打的保證」與獨立驗證;歐盟 AI 法案針對通用 AI 系統性風險模型的義務與罰則也在 2026 年 8 月起進入可執行階段。

為什麼這件事跟你(開發者、企業)有關

  1. 評估報告會變成採購文件。 當「AEF-1 checklist」「IVO 報告」成為企業採購或政府標案的附件,模型供應商就必須揭露評估條件——這會直接影響你選模型的依據。
  2. 第三方評估變成一門產業。 METR、Transluce 這類機構正在從研究組織變成基礎設施;未來企業導入 LLM 可能被要求提供第三方評估結果。
  3. 「獨立」的定義會被寫進合約。 20 個工作天、查詢存取、不得有結果掛鉤報酬——這些過去沒人談的細節,將來會出現在合約條款裡。
  4. 值得追蹤的觀察點: AEF-1 會不會被寫進實驗室的 Frontier Safety Framework?FRONTIER Act 的 IVO 條款能否立法通過?反壟斷豁免之爭最後由誰定義規則?

一句話總結

7 月是一封信,9 月是一張識別證:AI 安全治理正從道德呼籲走向可稽核的運作條件——而「誰有資格評判」這件事,比「要不要減速」更難談。 對開發者而言,這代表未來評估報告會像 SOC 2 稽核報告一樣,變成你選供應商時的標準配備。

延伸閱讀

原始來源

📬 訂閱 most.tw 電子報

每週精選 AI 工具教學與技術乾貨,直接送到你的信箱。免費、隨時可退訂。

💬 有問題想討論?加 LINE 聯絡我

歡迎透過 LINE 官方帳號直接留言,我會盡快回覆你的問題。

加入 LINE 好友