![]()
新智元報道
![]()
一口氣三連,谷歌這波是真的不裝了。
今天,谷歌DeepMind連放大招,一次性擺出三張王牌:
Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Gemini 3.5 Flash Cyber
![]()
一個更強(qiáng)的主力、一個更快的輕量款、一個專修漏洞的安全特種兵。
三款Gemini指向的是同一件事:讓跑在生產(chǎn)環(huán)境里的AI Agent,更快、更聰明、更便宜。
![]()
而就在發(fā)布的同一天,谷歌還順手扔下了一枚更大的雷——
谷歌DeepMind「史上最激進(jìn)的一次預(yù)訓(xùn)練已經(jīng)開始」,目標(biāo)是下一代模型Gemini 4。
![]()
一邊是Gemini三連發(fā),一邊是Gemini 4開跑。
谷歌傳遞的信號再清晰不過,AI這場終極牌局,好戲才剛剛開始。
谷歌深夜放大招
三款Gemini齊發(fā)
三款Gemini,接下來一一拆解。
Gemini 3.6 Flash,暴省65% Token
先來看這次真正的「C位」——Gemini 3.6 Flash。
它這次主打一個亮點(diǎn),巨省Token。
按Artificial Analysis Index的測算,相比上一代3.5 Flash,它的輸出Token少用17%。
在DeepSWE這類編碼基準(zhǔn)上,最高能省下65%。
![]()
不光少吐字,它完成一個多步任務(wù)需要的推理步驟和工具調(diào)用也更少,繞的彎路更短,等于又快又省。
不僅如此,Gemini 3.6 Flash在省Token的同時,價格還更低了:
輸入1.5美元、輸出7.5美元每百萬 Token,比3.5 Flash更便宜。
更省、更便宜,還得更能打,這才叫誠意。3.6 Flash在幾條關(guān)鍵測試上,都甩開了前代——
DeepSWE:編程測試 37% ? 49%
MLE Bench:機(jī)器學(xué)習(xí)研究測試49.7% ? 63.9%
OSWorld-Verified:讓模型直接操作電腦測試78.4% ? 83%
GDPVal-AA v2:知識型工作任務(wù)拿下了1421份,比上一代高出70多分
![]()
如下demo中,3.6 Flash大秀多智能體編排絕活,不僅輕松拿下復(fù)雜的代碼遷移任務(wù),更在響應(yīng)速度、代碼質(zhì)量上對3.5 Flash完成了降維打擊。
靠著Gemini Canvas,3.6 Flash打通了3D工作流,分分鐘「手搓」出一個專業(yè)的攝影級紋理提取神器。
它還能化身「AI交互設(shè)計師」,輕松搞定沉浸感爆棚的主題工作室。
![]()
![]()
3.5 Flash-Lite,擊敗了老大哥
第二款Gemini 3.5 Flash-Lite,走的是另一條路:主打一個快,還要夠便宜。
3.5 Flash-Lite的輸出速度達(dá)到每秒350個Token,是整個3.5系列里最快的。
價格也低到離譜,每百萬Token輸入$0.3美元、輸出$2.5美元。
又快又便宜,天生就是為「海量處理文檔」「Agent搜索」這種高頻、走量的場景準(zhǔn)備的。
最厲害的是,它居然反手把自家的「大哥」給踩在了腳下。
在多項(xiàng)編程和Agent測試上,這個輕量小模型居然跑贏了體量更大的Gemini 3 Flash——
SWE-Bench Pro:54.2% vs 49.6%
OSWorld-Verified:74.0% vs 65.1%
![]()
3.6 Flash作「主腦」拆解任務(wù),F(xiàn)lash-Lite作「分身」批量干活。
一個負(fù)責(zé)想,一堆負(fù)責(zé)跑,輕松抹平高并發(fā)壓力。
官方演示里兩相結(jié)合,F(xiàn)lash-Lite一口氣直出25套高可用網(wǎng)頁設(shè)計方案,速度快到幾乎是「想一下就出一批」。
Flash-Lite現(xiàn)在已經(jīng)在Gemini App里上線,還將陸續(xù)進(jìn)入谷歌搜索。
Flash Cyber:能修漏洞,但不是誰都能用
Gemini 3.5 Flash Cyber,一款專攻網(wǎng)絡(luò)安全的硬核模型。
它的任務(wù)只有一個,找漏洞、補(bǔ)漏洞。
眼下一個尷尬的現(xiàn)實(shí)是,AI找漏洞的速度,已經(jīng)快過了現(xiàn)有系統(tǒng)修漏洞的速度。
![]()
谷歌把這款模型塞進(jìn)代碼安全智能體CodeMender里,靠多個Cyber智能體協(xié)同作戰(zhàn),在安全基準(zhǔn)CyberGym上刷新SOTA,成本卻比更大的模型低——
用一個更輕的模型,干最需要精度的活。
不過,這款模型,普通人暫時碰不到。
Gemini 4開跑
史上最激進(jìn)預(yù)訓(xùn)練
雖然Gemini 3.5 Pro還沒到手,Gemini 4也開始訓(xùn)了。
這次三連彈只是前菜,但壓軸的那句官宣,才是真正的重頭戲。
谷歌已確認(rèn),內(nèi)部已啟動了史上最激進(jìn)的一次預(yù)訓(xùn)練,目標(biāo)直指Gemini 4。
![]()
大佬表示,按谷歌常規(guī)的6個月訓(xùn)練節(jié)奏,說不定年底,就能看到Gemini 4了。
![]()
對我們這些真金白銀掏錢買Token、搭A(yù)gent的人來說,今天這場發(fā)布其實(shí)只有一個字最實(shí)在——降。
價格降了,Token耗量降了,跑一次Agent的成本降了。
至于那個遲遲不來的旗艦、和剛剛開跑的Gemini 4,都還是「期貨」。
能用上、還便宜的,才是今天就能裝進(jìn)你錢包的東西。旗艦再強(qiáng),也得先落地。
參考資料:
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/?utm_source=tw&utm_medium=social&utm_campaign=og
編輯:桃子
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.