五間 AI 實驗室,一個政府單位,零法律約束力:美國 AI 監管的最新防線
Google、Microsoft、xAI 加入 OpenAI 與 Anthropic,五間前沿 AI 實驗室全數同意在模型公開發布前提交美國政府測試。這是 Mythos 危機催生的自願性框架——沒有法律基礎,沒有否決權,但已經是美國最接近 AI 監管的機制。
目錄+
三個月前,Anthropic 的 Mythos 模型讓美國政府意識到一件事:當一個 AI 模型能自主發現並利用所有主流作業系統的零日漏洞時,華盛頓沒有正式機制能在它上市前看一眼。週二,答案出現了——但答案的脆弱程度,可能比問題本身更值得討論。
美國商務部下屬的 AI 標準與創新中心(CAISI)於 2026 年 5 月 5 日正式宣布,Google DeepMind、Microsoft 與 Elon Musk 的 xAI 已同意在 AI 模型公開發布前,提交模型供政府進行安全測試。這三家加入後,美國五大前沿 AI 實驗室——Google、Microsoft、xAI、OpenAI、Anthropic——全數參與這個自願性評估計畫。
從兩間到五間,只因為一次恐慌
2024 年,當時還叫「AI 安全研究所」的 CAISI 僅與 OpenAI 和 Anthropic 簽有合作。Google 的 Gemini、Microsoft 的 Copilot 背後的模型、xAI 的 Grok——這些系統在發布前政府完全無法觸及。轉折點是 Mythos。
Anthropic 在 2026 年 4 月公布的 Mythos 模型,能自主發現數千個高嚴重性漏洞,包括存在數十年未被察覺的系統級缺陷。此事震動華盛頓:白宮考慮以行政命令設立強制審查機制,五角大廈一邊將 Anthropic 列入供應鏈風險黑名單,NSA 卻仍然在使用 Mythos。歐盟則公開要求取得 Mythos 存取權,理由是「當代最具影響力的網路安全工具不能由一家被自家政府部分封殺的美國公司獨佔」。
這個戲劇性的局面,迫使 Google、Microsoft 和 xAI 必須決定:是等待立法強制介入,還是搶先一步自願簽約。
顯然它們選了後者。
全職責、零權力的政府機構
CAISI 目前擁有不到 200 名員工,無傳票權、無禁制權、無法律機制可以阻止一個模型的發布。整個系統的運作基礎,是五家公司出於各自策略考量,判斷「給政府先看」比「等政府強制來看」更划算。
CAISI 主任 Chris Fall——他在前任 Collin Burns 上任四天即因與 Anthropic 的關聯被白宮逼退後接手——在聲明中強調了這個計畫的核心邏輯:「獨立、嚴謹的測量科學,是理解前沿 AI 及其國安意涵的必要條件。」
至今 CAISI 已完成超過 40 次模型評估,其中包括尚未發布的尖端系統。開發者經常提交移除了安全防護的模型版本,以便政府測試人員探測網路攻擊自動化、生物武器合成路徑、自主代理的失控行為等國安風險。
重點是:這一切,全是自願的。
真正的問題在於下一步
五間實驗室都坐在這張桌子上,是自 2023 年生成式 AI 爆發以來最接近「產業共識」的時刻。但自願框架的結構性缺陷顯而易見:法律上,任何一家公司都可以隨時退出,直接發布模型,不需要任何人同意。
Mythos 證明了一件事——AI 的安全邊界,正在從「能不能防止模型說出有害內容」轉移到「一個模型本身是不是攻擊性武器」。這個轉變太快,立法永遠追不上開發。CAISI 的存在,本質上是五家公司和一個政府單位之間的默契:在強制性法規出現之前,先用自願合作填補真空。
但這道防線能擋多久?那個會逼出立法的那個模型,可能已經在不遠的某處訓練中。
「五間公司的自願協議,是一道沒有鋼筋的防火牆——它擋得住日常小火,但有沒有一場大火會燒穿它,沒人知道答案。」