快科技7月23日消息,當?shù)貢r間7月21日,谷歌旗下DeepMind對外推出三款全新Gemini輕量化模型,包含Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及行業(yè)專用模型Gemini 3.5 Flash Cyber。
與此同時,旗艦?zāi)P虶emini 3.5 Pro依然沒有露面成為此次焦點。
而據(jù)第三方評測榜單數(shù)據(jù)顯示,谷歌當前主力Gemini系列綜合實力已經(jīng)跌至全球榜單十名以外,在頭部大模型競速賽道中顯現(xiàn)壓力。
據(jù)官方披露信息,三款新模型定位清晰,主要面向規(guī)模化商用場景。
其中Gemini 3.6 Flash是主力模型,與上一代相比能使用更少的token,在相同成本下提供更高質(zhì)量的工作;而Gemini 3.5 Flash-Lite則是快速、成本效益高的選項,適用于日常任務(wù),如處理文檔和搜索;Gemini 3.5 Flash Cyber是一種網(wǎng)絡(luò)安全模型,專為發(fā)現(xiàn)和修補關(guān)鍵軟件漏洞而構(gòu)建。
但根據(jù)評測來看,此次谷歌的新模型在智能上并不出色,AI模型評測平臺Arena.ai的研究顯示,Gemini 3.6 Flash在前端代碼競技場中以1537分排名第12位。
![]()
而國內(nèi)月之暗面最新發(fā)布的Kimi K3以1677分位列榜首,智譜GLM-5.2位列第四,Anthropic的Claude和OpenAI的GPT的多款系列產(chǎn)品位居前列。
![]()
第三方評測機構(gòu)Artificial Analysis給出的結(jié)論是,Gemini 3.6 Flash在智能方面較3.5 Flash沒有提升,智能指數(shù)得分50,但任務(wù)效率有所提高,Gemini 3.6 Flash的平均每任務(wù)時間為 1.3 分鐘,較上一代減少超過50%,同時每任務(wù)成本略有降低。
這意味著,谷歌優(yōu)化的更多是速度和成本,而不是模型能力本身。
而除了排行榜,開發(fā)者社區(qū)的反饋同樣出現(xiàn)明顯分化,不少開發(fā)者用谷歌新模型做任務(wù)時未看到很好的表現(xiàn):"前端能力糟糕、空間推理也很差,我安慰自己這其實不是在高思考水平上運行的,但我不確定。"
有開發(fā)者評論道:"谷歌就像龜兔賽跑里的兔子,領(lǐng)先一段時間后就開始睡覺。"也有人直言,Gemini團隊需要引入真正關(guān)心交付前沿模型的人。
![]()
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.