簡述
- Google 於週三發布 Gemini 4 Argon,在 DeepSWE v1.1 上獲得 77.9% 的成績,並在其自家的比較表中於 18 項基準測試中領先 12 項。
- 它在 Gray Swan 的提示注入測試中取得了 0.7% 的攻擊成功率,領先 Claude Opus 5.5 和 Claude Fable 5.1,這兩者均為 1.0%。
- Argon 首先透過 Fairwind 計畫提供給經過審核的網路防禦人員,不設網路護欄,之後才會提供給付費 API 客戶和 Google AI Ultra 訂閱者。
Gemini 4 終於來了,就在 Claude Opus 5.5 發布一週後,以及 GPT 6.1 Sol 發布一天後,證明美國實驗室非常致力於減緩 AI 發展。請原諒我們的諷刺。
Google 於週三發布 Gemini 4 Argon,稱其為其前沿模型,意味著其在編碼、辦公工作和網路防禦方面最為強大。

在 DeepSWE v1.1 上,這是一項測試 AI 能否完成冗長、混亂、真實世界軟體工程工作的基準,以百分比計分,Argon 達到 77.9%。Claude Opus 5.5 得到 74.2%,GPT-6 Astra 74.1%,Claude Fable 5.1 則是 67.4%。
作為規模參考,Gemini 3.6 Flash 在七月同一項測試中拿下 49%。Argon 還能在一次回覆中寫出多達 100 萬個 token,高於先前的 64,000 個。一個 token 是一段文字,大約是四分之三個單詞,所以那大約是 75 萬個單詞,對比約 48,000 個。
不過,對這些數字還是要打點折扣。Google 自行計算了它的 DeepSWE 分數,而競爭對手的數字則來自公開排行榜和公司報告。它的表格也承認有所不足。Argon 在 18 項基準中領先 12 項,平手一項,落後五項,涵蓋程式設計、科學與電腦控制測試的混合項目。
但這款模型最搶眼的特色是網路能力。把一則秘密指令藏在電子郵件裡,等 AI 助理讀取它,然後看看 AI 是否會聽從陌生人而不是你。那就是間接提示注入,對任何想把收件匣或購物車交給 AI 的人來說,這都是噩夢。
在 Gray Swan 的間接提示注入基準中,該基準會把惡意指令藏在代理讀取的內容裡,並計算攻擊在 15 次嘗試內成功的頻率,Argon 的成績為 0.7%。越低越好。Claude Opus 5.5 和 Claude Fable 5.1 都得到 1.0%。
GPT-6 Astra 的表現為 8.5%。Grok 4.6 和 Kimi K3 被騙成功的機率略超過一半,分別為 51.8% 和 52.7%。
Argon 透過 Fairwind 計畫提供給經過審核的安全團隊,這是 Google 的有限存取網路防禦計畫,於 9 月 2 日啟動,擁有超過 650 個合作夥伴,包括政府和關鍵基礎設施營運商。而且它出貨時「沒有網路護欄」,也就是通常會阻止模型協助駭客行為的內建拒絕機制。
比特幣BTC · 美元
$83,662−0.87%
9月24日9月25日9月27日9月29日9月30日
$85.3k$84.4k$83.5k$82.7k
24小時高點高點$85,518
24小時低點低點$82,951
成交量成交量$1.5B
市場預測賠率由 Myriad
今天$82,000 至 $84,000$82k–$84k55% 機率本週低於 $84,000低於 $84k56% 機率本月$82,000 至 $84,000$82k–$84k55% 機率
用 USDT 購買 比特幣
由 Jupiter 提供技術支援
此類舉措背後的邏輯是,防禦者需要一個能像攻擊者一樣思考的模型,以便在犯罪分子發現漏洞之前修補它們。問題在於,同樣的技能是雙面刃,因此 Google 表示分階段推出是唯一安全的路徑。該公司也參與了美國政府針對發布前模型存取的自願性流程。
Google 並非第一個把網路模型藏在天鵝絨繩後的公司。Anthropic 的 Claude Mythos 早期版本協助找出了 Firefox 中的 271 個漏洞,意味著 Mozilla 隨後修補了 271 個安全漏洞。OpenAI 也採取了類似的路線,推出了網路信任存取計畫。
Argon 的網路評分超越了 Gemini 3.8 Flash Cyber,這是 Google 隨 Fairwind 一同推出的受限模型。在 Wiz 滲透測試基準中,這是一項 Google 內部測試,要求 AI 在未看到程式碼的情況下,針對真實的網頁應用程式漏洞撰寫可用的攻擊程式,並以首次嘗試即解決的比例計分,Argon 達到了 70.9%,而對手為 58.2%。
Google 也表示,Argon 協助安全公司 Wiz 找出了全球各地醫院所使用的醫療保健軟體中的一個重大漏洞,而這是先前的尖端模型所漏掉的。
此次發布正值 Google 經歷了一個艱難的夏天之後。七月時,該公司推出了較小的 Flash 模型,但跳過了原先承諾的 Gemini 3.5 Pro,Alphabet 股價下跌了約 4.4%。Argon 也在川普總統公布一項自願性、無罰則的 AI 協議的同一天問世,該協議由 Google 領導層簽署。
Google 表示,將盡快擴大發布範圍,首先從付費 API 客戶和 Google AI Ultra 訂閱者開始。
introductory 定價為每百萬輸入 token 2 美元,每百萬輸出 token 10 美元。Google 尚未說明該期間何時結束,僅表示標準費率為 4 美元和 20 美元。






