
A |

B | Gemini 3.6 Flash是主力模型,与上一代相比能使用更少的token,在相同成本下提供更高质量的工作;而Gemini 3.5 Flash-Lite则是快速、成本效益高的选项,适用于日常任务,如处理文档和搜索;Gemini 3.5 Flash Cyber是一种网络安全模型,专为发现和修补关键软件漏洞而构建。

C | 但根据评测来看,此次谷歌的新模型在智能上并不出色。

D | 早年的一项教育调研显示,只有14%的招生部门负责人认同高校排名能够对学生报考高校起到积极作用,超过半数受访者认为这类排名在“误人子弟”。AI模型评测平台Arena.ai的研究显示,Gemini 3.6 Flash 在前端代码竞技场中以1537分排名第12位。尽管《美国新闻与世界报道》的排名机制争议不断,但其在这一领域拥有近乎垄断的话语权。

E | 第三方评测机构Artificial Analysis的结论则是,Gemini 3.6 Flash 在智能方面较3.5 Flash没有提升,智能指数得分50,但任务效率有所提高,Gemini 3.6 Flash的平均每任务时间为 1.3 分钟,较上一代减少超过50%,同时每任务成本略有降低。有业内人士表示,该杂志的高校评级标准虽然多达16条,但最为直观的几条无非是招生人数、经费数额以及银行信用等,这些都是可以“人为操控”的。于是,一些高校积极利用规则进行“内卷”,有的学校会引入一些“肤浅且适得其反”的制度来强行提升排名,而这些举措往往与教育质量毫无关联。 这意味着,谷歌优化的更多是速度和成本,而不是模型能力本身。 更值得关注的是,在Artificial Analysis最新智能指数排行榜中,谷歌目前已经没有任何一款模型进入前十。

F | 在这场排名博弈中,确实有一些名不见经传的高校实现了“逆袭”。排名靠前的是Anthropic、OpenAI等海外厂商,也包括国内月之暗面的Kimi K3、智谱GLM-5.2等模型。这与去年Gemini一度站上全球第一梯队形成了鲜明反差。

G | 但另一方面,也有多所高校因造假“翻车”:2012年,美国名校埃默里大学公开承认谎报学生“高考”成绩、平均绩点及其他学业表现,并承认这一操作已持续多年;同年,克莱蒙特·麦肯纳学院一名副校长承认多年谎报录取数据;2021年,美国天普大学福克斯商学院前院长波拉特更是因为电信诈骗、屡次造假而被定罪。不过也有不同意见认为,尽管高校排名体制硬伤很多,但其也为高校竞争力的数据标准化作出了贡献。

H | 除了排行榜,开发者社区的反馈同样出现明显分化。不少开发者用谷歌新模型做任务时未看到很好的表现,“前端能力糟糕、空间推理也很差,我安慰自己这其实不是在高思考水平上运行的,但我不确定。” 有开发者评论道,“谷歌就像龟兔赛跑里的兔子,领先一段时间后就开始睡觉。”也有人直言,Gemini 团队需要引入真正关心交付前沿模型的人。 在关于谷歌新模型发布的评论中,相比Flash模型,大家更关注的是,旗舰模型Gemini 3.5 Pro什么时候发布? 在5月的谷歌I/O 大会上,谷歌发布了Gemini 3.5 Flash,当时曾预告Pro版本已在内部使用,预期一个月内推出。然而两个月过去了,Gemini 3.5 Pro依然没有公开亮相。

I | 据外媒报道,由于模型始终未达到内部预期性能,谷歌推迟了发布计划。 面对外界质疑,谷歌DeepMind技术负责人洛根·基尔帕特里克(Logan Kilpatrick)也在社交媒体上回应称,Gemini 3.5 Pro正在与合作伙伴进行测试,计划在准备就绪后立即广泛提供。但他未给出具体的时间节点。

J | 与此同时,谷歌在这次博客中提到,团队已经开始着手构建下一代模型,“启动了迄今为止规模最大的 Gemini 4 预训练工作,并对目前的进展感到振奋”。这一表态,也让不少业内人士猜测,谷歌是否正在把更多资源转向下一代模型,而非继续打磨3.5 Pro。 针对现阶段谷歌模型的表现,很多人认为,并不是谷歌的能力不行,而是内部的策略方向问题,优先级放在产品上,而不是像Anthropic、OpenAI等厂商专注将AI做好。

K | 从谷歌这次的更新来看,团队在大模型上的策略似乎是“速度胜过智慧”。有开发者认为,让任务时间缩短是很好,但停滞的智能意味着他们优先考虑了错误的指标。“创新也需要深度,而不仅仅是秒表”。

L | 不过,也有开发者认为,如果模型是为了赚钱,从这个商业角度看,谷歌是聪明的,毕竟现在新兴公司都是在烧钱运营,一旦钱烧完直接就倒闭,而谷歌是将模型降智节省成本。 相比Anthropic和OpenAI持续围绕模型能力竞争,谷歌拥有Android、Chrome、Workspace、搜索、云服务等庞大的产品生态,因此这一年其AI战略一直更偏向产品落地,而不是单纯追逐模型能力和榜单。 但另一方面,开发者更倾向于将智能作为评价AI公司的第一标准。如果模型能力长期停滞,即便商业化领先,也难免影响开发者生态和市场预期。 遥想去年11月,谷歌发布Gemini 3模型时曾引发业界震动,反超OpenAI、坐稳第一梯队,股价一路飙升。而进入2026年以来,AI竞争的风向再次发生变化。OpenAI依靠持续推出新模型重新夺回行业关注度,Anthropic依旧保持着模型能力领先的位置,而谷歌更多展示的是成本优化和产品整合能力。 截至7月21日收盘,谷歌(GOOGL.US)跌超1%,股价收于347.15美元/股,较5月中旬高点累计回落近15%,当前谷歌总市值约4.2万亿美元,也从全球市值榜第二退居第三,被苹果赶超。

M | (本文来自第一财经)。
Current article:http://fwyh.shuazhepenxingshuaisenqienai.buzz/list_y8r14/2lf.html
Published on:17:14:50
相关阅读 珀莱雅:上半年净利润11.68亿元,同比增长46.26%雨量超越“利奇马”“巴威”,“白海豚”预计今天中午前后移出浙江!杭深铁路、杭台高铁、杭温高铁、沪昆高铁等多条线路列车恢复开行下周XBOX新游戏预告:8月24日至8月28日全新别克GL8陆上公务舱上市 22.99万 双层声学玻璃/二排贵宾座椅晶丰明源:上半年净利润8654.71万元,同比增长449.09%容联云全栈产品Agent化破解“Token黑洞” 为智能体效果付费教育部推进基础学科系列“101计划” 筑基拔尖创新人才培养奥克兰南区连日来发生多起火灾,居民被督促安装并检查火灾警报器
热门文章
中国建设银行河南省分行原行长石永拴被开除党籍
关于印发第五批全国社会信用体系建设示范区名单的通知(发改办财金〔2026〕589号)
RAKsmart站群服务器对海外贸易网站的核心优势
限时21.49万元起!长城H9力魂版上市:标配2.5吨牵引资质 可合法拖拽房车摩托艇
最新文章
【成交量异动】国际铜成交量较上一交易日增加5907手增幅50.63%
政声直达丨河北新能源货运发展规模稳居全国前列
哥伦比亚大学因造假“翻车”,美高校排名评级体系引质疑泰山豪取两连胜!克雷桑压哨绝杀,主场8战津门虎全胜,连刷6纪录三星预告与巴黎奢侈时尚品牌Maison Margiela的合作杭州如何下好服务业发展的“先手棋”?
人气排行 八位堂推出“凝焰”XBOX 手柄 25 周年特别纪念款无线充电底座套装,国行定价 199 元曝 OPPO Find X6 系列将采用单孔曲屏,屏幕分辨率为 1.5K / 2K_Pro_方面1至7月,2.06亿人次涌进武林商圈 老商圈解锁AI新玩法哈里梅根英国“偷摸”会合后,开始西非皇家之旅,梅根穿了露背装【联结家庭】冬日暖阳,亲子相伴——记杭州市文澜幼儿园社区亲子活动预约领满额成长福利!《魔域口袋版》8.21新服重磅开启किसान कृषि अनुदान पाने के लिए 30 सितंबर तक करें फटाफट आवेदन, पर यहां पर रजिस्ट्रेशन होना जरूरीKansas Voters Reject Amendment to Strip Abortion Rights From State Constitution By Nearly 2-1 Margin
查看所有0条评论>>