買幣
行情
🔥
預測市場

Gemini 4 Argon 以較低推出成本在指標上與 GPT-6 Astra 持平

Google 的 Gemini 4 Argon 在 Artificial Analysis Intelligence Index 上與 OpenAI 的 GPT-6 Astra 以 53 分打成平手,且推出時每項任務成本較低。

2026-10-01 05:16約 6 分鐘閱讀

在 Artificial Analysis Intelligence Index 上,Google 的 Gemini 4 Argon 與 OpenAI 的 GPT-6 Astra 打成平手,兩者均獲得 53 分。根據目前的推出定價,每項測試任務的費用也較低。

Google DeepMind 於 9 月 30 日發表該模型。初期僅限於一組受信任的網路安全專家使用。

隆重介紹 Gemini 4 Argon——我們的新一代前沿模型。

它專為跨編碼、企業知識工作及網路安全防禦的複雜工作流程而打造——即日起透過我們的 Fairwind 計畫向一組受信任的測試者推出。pic.twitter.com/X8acOWJOSF

— Google DeepMind (@GoogleDeepMind) 2026 年 9 月 30 日

Argon 使 Google 重返頂尖 AI 實驗室前三名

獨立基準測試機構 Artificial Analysis 表示,該結果使 Google 再次躋身 AI 實驗室前三名。Argon 也以一分之差擊敗 GPT-6.1 Sol;Sol 得分為 52。

Argon 的表現比早期的非 Flash 模型 Gemini 3.1 Pro Preview 高出 23 分。9 月初,Google 推出了 Gemini 3.8 Flash 以及一款網路安全變體。相比之下,SpaceXAI 的 Grok 4.7 在9 月的同一指標中獲得 46 分。

Artificial Analysis 將這些改進歸功於較低的幻覺率和更好的代理能力。在 AA-Omniscience 測試中,Argon 的幻覺率為 15%,而 Astra 的幻覺率為 51%。不過,Argon 答對了 50% 的問題,比 Astra 低 13 個百分點。

Argon 在 AutomationBench-AA 基準測試中以 77.5% 的成績位居榜首,超越Anthropic 的 Claude Sonnet 5.5(後者為 71.3%)。然而,在 Terminal Bench 4 上,它落後於 Sonnet 5.5、Claude Opus 5.5 和 Astra。

上市定價降低費用

Google 設定的上市價格為每百萬輸入令牌 2 美元,每百萬輸出令牌 10 美元。推廣期結束後,這些數字將翻倍至 4 美元和 20 美元。

在折扣條件下,Artificial Analysis 計算出 Argon 每項任務成本為 1.99 美元,而 Astra 為 3.26 美元。在正常價格下,成本升至 3.98 美元,約為 Astra 的 1.2 倍。

節省的成本來自於較低的每令牌價格,儘管 Argon 消耗更多令牌。平均而言,Argon 每項任務使用 62,000 個輸出令牌,而 Astra 為 27,000 個。該模型還支援 100 萬個令牌的輸出限制。

「為了支援 Gemini 4 Argon 在更長、更複雜用例中的能力,我們正在將模型的輸出令牌限制大幅擴展至業界領先的 100 萬個令牌,高於先前的 64,000 個令牌,」團隊表示。

網路防禦者率先一睹 Gemini 4 Argon

Google 執行長 Sundar Pichai 指出,該模型已被 Google 團隊大量用於從編碼到量子運算的各種任務。

「重要的是,Argon 具備前沿安全措施,我們負責任地推出它——它已提供給美國政府,並透過我們的 Fairwind 計畫提供給一組受信任的網路防禦者,」他提到。

根據 Google 的推出公告,Argon 可以獨立尋找、驗證和修補嚴重的軟體漏洞。因此,受信任的防禦者和內部 Google 團隊將獲得它,而無需網路防護措施。

當推廣範圍擴大時,付費 API 使用者和 Google AI Ultra 訂閱者將率先獲得存取權限。Google 尚未透露該上市定價屆時是否仍然有效。

Google 也表示,它正在參與美國政府的自願預發布存取流程。

分享至

免責聲明:本文內容來源於第三方媒體,僅供參考,不構成任何投資建議。加密貨幣及其他金融產品存在較大價格波動風險,請謹慎決策。

相關文章