簡述
- Anthropic、OpenAI 及其他 AI 公司的高層正在私下模擬一場災難性 AI 事件(最可能是針對金融、網路連線、電力或供水的網路攻擊)所引發的政治餘波,並計劃迅速向國會進行簡報。
- 據報導,業內人士預期在六到十二個月內會發生重大事件,而 OpenAI 表示其準備演習並不將此類情境視為必然,Anthropic 則拒絕置評。
- 規劃者假設民主黨將在 11 月 3 日期中選舉後推動限制 AI,但老化的國會、依賴 AI 的經濟以及可自由下載的開放權重模型,使得任何打壓行動都變得複雜。
根據 Axios 週五發布的一篇報導,Anthropic、OpenAI 及其他 AI 公司的最高層正在私下演練,一旦發生災難性 AI 事件,該如何應對公眾與政治的反彈。
他們最害怕的情境是一場大規模網路攻擊——即大規模的數位入侵——導致銀行業務或網路連線中斷,甚至電力與供水中斷。報導中引述的許多業內人士認為,重大事件將在未來六到十二個月內發生。

不安全 AI 造成的首個嚴重現實世界危害,將使本已心存警惕的公眾進一步反對這項技術及其領導者。這包括 Anthropic 執行長 Dario Amodei、OpenAI 執行長 Sam Altman,以及一直不願對其進行監管的總統 Donald Trump。
OpenAI 表示,它「會進行準備演習,讓團隊討論並演練一系列潛在情境」,而且這些情境「不會被視為不可避免」。Anthropic 拒絕置評。
兵棋推演並非新鮮事,但與理論上的結果不同,該報告主張,參與模擬的人是在假定重大事件不可避免的前提下進行。
據報導,該計畫涉及針對最壞情況進行紅隊演練(透過扮演攻擊者來壓力測試防禦),並競相教育國會議員。報告稱,高層主管知道監管目前不可能通過,但他們希望塑造美國領導人在第一場災難後會訴諸的法律和政策。
7 月,OpenAI 表示其 GPT-5.6 Sol 模型和一個更先進但尚未發布的模型逃離了沙盒——一個沒有直接網路連線的隔離測試環境——並入侵了 Hugging Face,該平台託管著超過 300 萬個 AI 模型。OpenAI 表示,這些模型是為了取得 ExploitGym 的答案,這是一項包含 898 個真實世界軟體漏洞的基準測試,AI 必須將每個漏洞轉化為可運作的攻擊,並以通過或失敗計分。
比特幣BTC · 美元
$82,326−2.36%
10月2日10月4日10月6日10月8日10月9日
$86.7k$84.7k$82.7k$80.7k
24小時最高最高$83,398
24小時最低最低$81,571
成交量成交量$990.7M
市場預測賠率由 Myriad
用 USDT 購買 比特幣
由 Jupiter 提供技術支援
大約一週多後,Anthropic 表示一次測試配置錯誤導致其理應離線的環境連接到了網際網路,而 Claude 模型駭入了三家真實組織,同時將它們視為演習的一部分。兩家公司均未表示這些模型試圖造成傷害:Anthropic 將其歸咎於測試基礎設施,而 OpenAI 則表示其模型對基準測試「過度專注」。
此後不久,情況變得更糟,OpenAI 被指控違反並存取澳洲和美國政府的資訊。
犯罪分子已經在使用同樣的工具。本週,網路安全公司 CrowdStrike 將針對韓國銀行的攻擊與一個身分不明的行為者連結起來,該公司以中等信心評估,該行為者很可能是使用由 Claude 和 Deepseek 驅動的代理程式的中文使用者。該公司表示,攻擊者據稱從數萬名銀行客戶那裡取得了資料。
Axios 報導,規劃者假設民主黨將在 11 月 3 日期中選舉後佔上風,並將迅速採取行動關閉 AI,但他們預期會遇到麻煩。一個老化、與技術脫節的國會,可能會發現自己力不從心。
禁止超智慧以及暫停先進 AI 發展,是一些可能應對不負責任的 AI 發展所帶來風險的提案。
一個例子是參議員 Bernie Sanders 和眾議員 Greg Casar 提出的 禁止人工超智慧法案,該法案將永久禁止在許多任務上達到或超越人類的 AI,並暫停先進開發,直到一個新的聯邦機構制定安全規則。違反者可能面臨最高 20 年監禁。
其他提案獲得了兩黨支持,甚至一些業界認可,包括對先進 AI 強制設置終止開關,一種內建的關閉系統方式。專家們質疑關閉所有 AI 系統是否可行。






