登入後,會解鎖更多功能喔,快來享受個人化服務吧!
Google的新一代旗艦模型Gemini 4 Argon正式發布!該模型能扛起需要長時間、一連串步驟才能完成的複雜工作,包含寫程式、金融與法律研究、資安防禦等都是主打場景,本文帶各位快速看懂官方公布的升級重點。
文/《104職場力》
本文目錄
先說明一下,這段升級內容會出現很多測試名稱跟分數,是Google官方為了展示Gemini 4 Argon功能領先其他模型所做的測試數據,有興趣的人可以同步參考看看。
AI處理文字時,是用token來計算份量,你可以先把它想成「AI的字數單位」。
Argon「一次回答最多能寫多長」的上限,原本是6.4萬token,這次拉高到100萬token,大約是以前的15倍多,官方說這是業界領先的數字。
為什麼這很重要?官方的說法是,當AI有足夠的篇幅可以「一直想下去」或「一次寫出大量內容」,不只能一次把困難問題的整個思考過程做完,也能更深入解題。
要特別注意這裡有個容易搞混的地方:這個上限是指「寫出來」的長度,不是「讀進去」的資料量,就像寫報告,它代表的是AI一次最多能交出幾頁,不是一次能讀幾本參考書。
DeepSWE v1.1是一份專門考「寫程式」的考卷,不是那種簡單的小練習,是真實軟體開發裡那種要花很長時間才做得完的工作,Argon寫這份考卷拿到77.9%,官方說這是目前最好的成績。
Google表示自家內部的工程師也已經每天在用Gemini 4 Argon,從平常「找出並修正程式錯誤(除錯)」到「把一大批舊程式碼改寫成新版本(程式碼遷移)」,還有設計演算法等都有用到。
金融、法律、稅務等這類白領工作是這次模型的主打場景,Argon在這些領域的測試上都有不錯的表現:
官方形容,Argon在處理需要「看」的工作時特別強!例如:分析專業圖表、從很長的影片裡找出細節,或是看完一疊文件之後接著動手處理。
在長影片理解的LVBench測試中,Argon拿到91.7%,官方表示這是目前最好的成績。
資安方面,Google特別把Gemini 4 Argon訓練成擅長防守的工具,它可以自己找出軟體裡的重大漏洞(可以想成程式的破口,可能被駭客利用)、確認漏洞真的存在,再把它修補起來;在專門考「AI會不會修補漏洞」的CWE-bench v1測試中,Argon拿到68%的好成績。
官方也說它找漏洞的能力比先前的資安版模型Gemini 3.8 Flash Cyber進步很多,在早期示範中,Argon還找出全球醫院使用的醫療軟體裡一個可能讓個人敏感資料暴露的重大漏洞,這是先前的頂尖模型沒發現的風險。
目前Argon只透過Google的Fairwind Program提供給受信任的資安防禦人員,還沒開放給用戶使用,官方僅提到若未來開放,會先從付費的API客戶和Google AI Ultra訂閱者開始,但具體時間也還沒公布。
官方預計在廣泛釋出前先強化以下4項防護,確保其足夠安全:
價格方面,官方公布的是給開發者用的API價格,暫定如下:
- 優惠期間每100萬token,輸入2美元、輸出10美元,重複使用的輸入內容再便宜95%
- 優惠期結束後,調整為輸入4美元、輸出20美元
以上是Gemini 4 Argon目前公布的升級重點,更多Gemini與AI工具的應用,歡迎看我們更多延伸閱讀文章: