Google終於宣布推出具備深度邏輯推理能力的全新AI模型Gemini 4 Argon,在第三方評比的綜合智慧指數已經追平OpenAI最先進的模型Astra、不懂裝懂的發生率也最低,Google更挟龐大現金流的優勢,以破壞性的價格搶市,Argon原價只要Anthropic現有最先進並供商業使用的Fable 5.1的4成,同時也只要Astra的40%,早鳥價更只需上述兩個先進模型的兩成。

Google原先計劃在今年中就推出新一代模型Gemini 3.5,雖然Gemini 3.5被定位在過渡性產品,仍面臨程式能力趕不上競爭對手、團隊重組、開發延誤等狀況,最後Google決定放棄Gemini 3.5、直攻Gemini 4,同時也加緊訓練速度,趕在9月最後一天亮相。

Google表示,這項技術已在Google內部展現具體的商業價值,在基礎設施端,Argon能自主分析資料中心整體系統,預估最高可為營運省下上千TB的記憶體空間,而面對企業極度耗時的大規模程式碼翻新工程(例如將數十萬行的老舊程式語言轉換為更安全的架構),Argon能接手自動改寫並完成效能測試,不僅維持系統穩定,執行速度更比原本快上2.7倍,而在專門評估「真實世界長期軟體工程任務」的 DeepSWE v1.1 基準測試中,Argon 以 77.9%創下了業界紀錄。

由於Argon單次運算能產出高達100萬字的優勢,Google也瞄準高含金量的知識型產業推銷Argon,Google表示,在針對金融多步驟研究、法律合約草擬與稅務分析的專業指標測試中均拿下高分,其跨圖文影音的解析能力,更能直接讀取專業財報圖表,或抓取長篇影片中的關鍵細節,取代過去仰賴人工的資料判讀。

「主動資安防禦」則是Argon本次發布的另一大亮點。知名雲端資安新創Wiz日前已將未設安全限制的Argon導入防護計畫,並在早期測試中,成功抓出一個會導致全球醫院醫療系統個資外洩的關鍵漏洞,識別出過去其他先進模型從未發現的系統盲點。

Google不僅跳代推出新模型以重新趕上OpenAI、Anthropic等AI第一梯隊,Google的生態系與產生現金流的優勢,更讓Google在Argon的定價上有能力大殺四方,訂出每百萬輸入詞元(Token)為 2 美元、每百萬輸出詞元為 10 美元的早鳥價,就算回到原價,也才分別為4美元與20美元,而且,如果企業是「重複讀取同一批龐大資料」,輸入的費用還能再狂砍95%,這比Google瞄準的同級對手如OpenAI Astra、Anthropic Fable每百萬輸入詞元費用為10美元、每百萬輸出詞元為50美元,明顯便宜許多。

雖然Argon寫程式能力超越對手、也比較不會不懂裝懂,但是它在其他地方還是有不如對手之處,比如說,純事實準確度(Accuracy)的評比中,Argon為50%,低於Astra的63%,Google內部員工也抱怨寫程式有時也不像評比那樣的高分。

Google表示,為了確保安全與不被濫用,Gemini 4 Argon分階段開放,目前正屬於第一階段,僅提供給特定的網路安全合作夥伴與美國政府自願審查程序進行試用,預計隨後才會陸續開放給付費API客戶與Google AI Ultra的訂閱用戶。

更多鏡報報導
「一切都始於台灣!」Google大咖首登SEMICON真情告白:沒有台灣就沒有世界最強算力平台
AI推論價格戰開打!中國開源模型3美元殺入市場 OpenAI、Meta降價應戰
最有台灣味卻最考驗鐵粉信仰?Google Pixel 11系列8月20日登台
跟AI講話不用太客氣!英國政府籲「別跟ChatGPT說謝謝」 背後原因太現實