Google 今日(10/1)宣布推出最新前沿模型 Gemini 4 Argon,它是 Google 目前防禦力最強的模型,能自主尋找、驗證並修補關鍵的軟體漏洞,於多項複雜工作流程中展現先進表現,涵蓋真實世界的軟體工程、法律與金融等企業知識工作,以及網路安全防禦。Argon 將以優惠價推出:每百萬輸入詞元(Token)為2美元,每百萬輸出詞元為10美元;快取輸入詞元的價格則比一般輸入詞元便宜95%。

Google DeepMind 資深副總裁暨首席AI架構師 Koray Kavukcuoglu 表示,全新的前沿模型 Gemini 4 Argon 透過 Fairwind 計畫,率先開放給一批受信任的網路安全防禦專家。Argon 是專門為複雜、長期的工作流程中維持深度的推理而打造,已經徹底改變在 Google 工作與開發的方式。它在實際軟體工程、如法律與金融等企業知識,以及網路安全防禦等複雜的工作流程中,都展現了先進且出色的效能。

Koray Kavukcuoglu 指出,要安全地釋出此等級的先進能力,必須採取分階段的策略。在逐步擴大使用範圍的同時,Google 也主動配合美國政府的自願性計畫,在模型正式發布前,先開放權限供相關單位評估。Argon 在提供給開發者、企業與消費者之前,Google將持續收集早期測試者的回饋,並不斷迭代,同時改善安全防護機制。

Gemini 4 Argon 已經開始支援 Google 內部工作流程,數千名員工表示 Argon 在專業程式編寫任務、執行深度研究以及寫作品質上都具有優勢。它已經協助各團隊加快開發速度、突破工程生產力的極限,並加速量子演算法最佳化、記憶體效率、大規模程式碼遷移與最佳化等領域的突破。

在複雜的量子運算中,某些特定程序往往會拖慢整體的執行速度。Argon 正協助 Google 研究團隊突破這些「效能瓶頸」,大幅優化運算所需的時空資源。在一個實際案例中,Argon 僅花了短短幾分鐘,就交出了比現有公開文獻還要好上40%的成績。

為了讓 Gemini 4 Argon 能勝任更長、更複雜的使用情境,Google 將模型的輸出詞元上限,從先前的6.4萬個詞元大幅擴增至業界領先的100萬個詞元。當模型有足夠的餘裕進行深度思考,並能在單次推演中生成數十萬個詞元時,就賦予了它全新層次的深度推理能力,使其能一次到位地解決各種棘手的難題。

為了此次發布,Google 進一步提升防護機制的韌性,包含改良監控模型內部運作狀態的技術,以便更精準地揪出濫用行為。這些防禦機制都已交由內部與外部的紅隊,透過結合手動與自動化的攻擊手法,完成了嚴格的壓力測試。

在一次早期的影響力示範當中,Argon 發現了一個關鍵漏洞,會洩露全球醫院使用的醫療保健軟體中的敏感個人資訊,成功識別出先前其他先進模型未能發現的嚴重風險。

Argon 是 Google 目前防禦力最強的模型,它能自主尋找、驗證並修補關鍵的軟體漏洞;針對利用惡意指令或上下文來挾持模型行為的「間接提示注入攻擊」,這類攻擊非常複雜,需要時刻保持警戒並部署多層防禦。透過自動化的紅隊測試與對抗性訓練,Gemini 4 Argon 在 Gray Swan 的間接提示注入基準測試中,展現了領先業界的強大防禦力。

為了防止 Argon 在執行任務時越界或偏離使用者的原本意圖,Google 部署了專屬的緩解機制,隨時監控 Argon 的思維鏈與行動,並在必要時直接中止其執行。Google 也運用類似的系統來監控訓練過程,一旦發生異狀就會向專屬的事件應變團隊發出警報,謹慎地避免將這些監控結果直接回饋到訓練中,以免 Argon 學會改變推理方式來「規避」監控。

隨著模型能力大幅躍進,業界也面臨著對齊風險的關鍵挑戰。Google 強烈呼籲整個業界應保持模型推理的透明度,讓模型的「思考過程」能持續幫助找出並修正未對齊的行為。

Google 強調,配合 AI 代理控制藍圖,正進一步強化沙盒環境的安全性。在展開高風險的訓練或評估前,會先將沙盒環境隔離並徹底封鎖,共同提升整個生態系的安全防護標準。

Gemini 4 Argon 將率先開放給付費 API 客戶與 Google AI Ultra 訂閱者使用。

更多太報報導
AI代理頻失控! 數發部:積極與4大國際業者合作、盡快取得先進模型
網爆料Google台灣將裁員30%以上? 公司回應:相關調整工作持續進行
迎戰AI算力爆發! Google技術長:追求產能瞬間拉滿 須與台灣供應鏈合作變革