- Google發表旗艦AI模型Gemini 4 Argon
- 主打長上下文能力,單次輸出上限100萬Token
- DeepSWE測試77.9%,領先Claude Opus與GPT-6 Astra
- 不再計劃推出Gemini 3.5 Pro
- 部分員工反映實際使用效果不如測試表現[2]
- Argon採分階段推出,無公開發布時間表
- API初期定價每百萬輸入Token 2美元、輸出10美元
Google發表旗艦AI模型Argon 擱置Gemini 3.5 Pro
發展中展開完整內容
(綜合中央社、聯合報、ETtoday新聞雲等3家媒體報導)
Google於9月30日正式發表新一代旗艦級AI模型「Gemini 4 Argon」,作為Gemini 4世代的核心,實體規模超越先前的Pro系列,目標在AI競賽中追趕Anthropic與OpenAI。Google發言人表示,Argon是迄今性能最強的模型,專為處理複雜工作負載設計,在關鍵程式編碼與網路安全測試中,表現足以媲美OpenAI的Astra和Anthropic的Opus等前沿模型。
Argon主打長上下文能力,單次輸出上限約100萬Token(約75萬字),遠高於先前的64,000 Token,可處理大型程式碼庫與長篇文件。Google公布的測試結果顯示,Argon在DeepSWE v1.1長周期軟體工程測試取得77.9%,高於Claude Opus 5.5的74.2%與GPT-6 Astra的74.1%;在Vals Index得分68.9%,同樣領先競爭對手。不過,在其他部分指標上,Argon仍落後,包括4項程式編碼相關基準測試中的2項。
聯合報引述彭博報導,知情人士透露Argon在標準測試中表現出色,但Google員工實際使用時效果沒那麼好,尤其不太擅長前端設計。Google對此否認,稱Gemini 4在程式編寫方面表現不佳的說法並不準確,熟悉模型開發的員工則表示內部普遍認為已達業界領先水準[2]。
Google表示,Argon在軟體工程、法律、金融及網路防禦等複雜任務表現出色,尤其擅長找出並修補關鍵軟體漏洞。模型會拒絕可能協助發動網路攻擊或研發化學、生物及核武的要求,與Anthropic和OpenAI的先進模型類似。Google已向部分網路安全合作夥伴提供Argon,並參與川普政府推動的自願性審查機制。
Google同時宣布不再計劃推出Gemini 3.5 Pro,該模型原定6月發布,因訓練時間比預期長、成果不如預期而擱置。Argon今年夏天開發進展比預期快,Google因此決定轉向。
Argon採分階段推出,第一階段透過「Fairwind」計畫提供給受信任的網路安全人員;後續開放給付費API客戶與Google AI Ultra使用者,再逐步擴大至企業與一般消費者。Google未透露公開發布時間表。API初期定價為每百萬輸入Token 2美元、輸出Token 10美元;優惠期後分別調至4美元和20美元。Evercore ISI分析師馬哈尼認為,初期價格具競爭力,但短期內未必能為Google帶來可觀收入[2]。
Alphabet股價週三正常交易時段上漲1%,盤後再漲1.5%。
新進文章(尚未整合)
- 10/1
- Gemini 4問世 和碩鄭光志:AI要像空氣與水無所不在中央社 · 11:59
- Google 將推出目前最強大的 Gemini 4 Argon 也搭配最強監控防止失控聯合報 · 14:09
系統持續蒐集本事件新進文章,資訊充足時將整合至下一份追蹤報導