当前位置:首页 > 科技

谷歌Gemini跌出全球排名前十:上新旗舰3.5 Pro再度缺席

2026-07-24 00:00:00科技12482
摘要:快科技7月23日消息,当地时间7月21日,谷歌旗下DeepMind对外推出三款全新Gemini轻量化模型,包含Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及行业专用模…

快科技7月23日消息,当地时间7月21日,谷歌旗下DeepMind对外推出三款全新Gemini轻量化模型,包含Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及行业专用模型Gemini 3.5 Flash Cyber。

与此同时,旗舰模型Gemini 3.5 Pro依然没有露面成为此次焦点。

而据第三方评测榜单数据显示,谷歌当前主力Gemini系列综合实力已经跌至全球榜单十名以外,在头部大模型竞速赛道中显现压力。

据官方披露信息,三款新模型定位清晰,主要面向规模化商用场景。

其中Gemini 3.6 Flash是主力模型,与上一代相比能使用更少的token,在相同成本下提供更高质量的工作;而Gemini 3.5 Flash-Lite则是快速、成本效益高的选项,适用于日常任务,如处理文档和搜索;Gemini 3.5 Flash Cyber是一种网络安全模型,专为发现和修补关键软件漏洞而构建。

但根据评测来看,此次谷歌的新模型在智能上并不出色,AI模型评测平台Arena.ai的研究显示,Gemini 3.6 Flash在前端代码竞技场中以1537分排名第12位。

而国内月之暗面最新发布的Kimi K3以1677分位列榜首,智谱GLM-5.2位列第四,Anthropic的Claude和OpenAI的GPT的多款系列产品位居前列。

第三方评测机构Artificial Analysis给出的结论是,Gemini 3.6 Flash在智能方面较3.5 Flash没有提升,智能指数得分50,但任务效率有所提高,Gemini 3.6 Flash的平均每任务时间为 1.3 分钟,较上一代减少超过50%,同时每任务成本略有降低。

这意味着,谷歌优化的更多是速度和成本,而不是模型能力本身。

而除了排行榜,开发者社区的反馈同样出现明显分化,不少开发者用谷歌新模型做任务时未看到很好的表现:“前端能力糟糕、空间推理也很差,我安慰自己这其实不是在高思考水平上运行的,但我不确定。”

有开发者评论道:“谷歌就像龟兔赛跑里的兔子,领先一段时间后就开始睡觉。”也有人直言,Gemini团队需要引入真正关心交付前沿模型的人。

扫描二维码推送至手机访问。

版权声明:本文由禾间日常发布,如需转载请注明出处。

本文链接:http://hjrc.hefbh.com/?id=59

分享给朋友:

“谷歌Gemini跌出全球排名前十:上新旗舰3.5 Pro再度缺席” 的相关文章

微软要彻底改变存储!巴掌大小能存2百万本书 数据保存超1万年

微软要彻底改变存储!巴掌大小能存2百万本书 数据保存超1万年

快科技7月20日消息,据《Nature》期刊发表的研究,微软研究院展示了名为Silica的玻璃存储系统,能够在普通玻璃中写入和读取数字信息。测试表明,一块掌心大小的玻璃可以存储相当于约200万本书的内…

以人为本 AI向善:腾讯发布2025年度可持续社会价值报告

以人为本 AI向善:腾讯发布2025年度可持续社会价值报告

在沈阳,试点学校将微信全国地震预警系统接入学校现有的教学一体机等教学硬件,使“秒级预警”直达校园每个角落,帮助师生在地震发生时及时避险与紧急疏散;在深圳,腾讯健康与深圳市医疗保障局联合推出智能客服,在…