七侠五义 Gemini掉出全球前十,谷歌新模型为何没能赢得掌声?_我的网站
A |
真当中国是软柿子不敢出手?为逼美国下场,马科斯政府心生一计,菲律宾百艘渔船强闯黄岩岛。而就在此时,为了应对这轮挑衅动作,中国海警的打法也变了!
据央视公布的消息,中国海警在黄岩岛海域专门进行了海上救生训练,并强调今后还会定期开展救生训练。
B | 当地时间7月21日,谷歌DeepMind发布三款轻量的新模型,主打“更快、更智能、更具成本效益”,但因智能程度没有满足外界的期待,评价两极分化。
显而易见,在这个敏感时刻,我国海警专程赶赴黄岩岛启动海上救生训练,充斥着一股不同寻常的味道,证明我们做好了应对任何突发状况的准备。
与此同时,旗舰模型Gemini 3.5 Pro依然没有露面成为此次焦点,从排行榜来看,谷歌的模型已经排在十名开外。
根据谷歌官方博客,此次发布的三款模型定位不同。
要知道,由于菲媒早早的就放出了风声,炫耀来自该国“民间组织”的200人将赶往黄岩岛临近海域,并且为了更好的宣示所谓的“主权”,抵达目的地后他们还会投放标志性的浮标。
C |
据环球网16日援引多家外媒消息,菲“民间组织”召集所谓的“当地渔民”出发冲向黄岩岛,为首的5艘船里还搭载着记者、外国观察员等等,另有100余艘渔船跟在后面。更重要的是,这些参与者返国后,还将在马尼拉专门召开一场发布会大肆炒作。
结合这些能看出,百艘渔船计划强闯黄岩岛是有备而来,他们准备在南海玩一把大的,制造混乱局面,然后再指责中国“欺凌弱小”。
Gemini 3.6 Flash是主力模型,与上一代相比能使用更少的token,在相同成本下提供更高质量的工作;而Gemini 3.5 Flash-Lite则是快速、成本效益高的选项,适用于日常任务,如处理文档和搜索;Gemini 3.5 Flash Cyber是一种网络安全模型,专为发现和修补关键软件漏洞而构建。只能说,这种戏码菲律宾不知道上演了多少遍,尽管他们对此乐此不疲,可我们也早就看腻了。
但接下来我要说的是,除了想利用这项“伟大计划”进一步塑造“被霸凌”的形象,马科斯政府更是试图趁机挑动南海局势升级,逼美军亲自下场。之所以这样说,一是因为菲律宾该“民间组织”的计划显然得到了马科斯政府的授意,否则菲律宾海岸警卫队也用不着为了他们“勇闯”黄岩岛的行动提供护航了。
马科斯此前放出话来,称若有人在南海遭到攻击丧命,将恳求美军出手。
D | 基于这两点,再加上菲律宾独自在南海“冲锋陷阵”,且美国长期扮演着幕后推手的角色没展露半点要军事介入的意思,完全可以大胆猜想,马科斯政府授意“民间组织”在黄岩岛闹这么一出,就是企图制造伤亡,从而将美军正式引入到中菲海上争端当中来。
E | 而也正是识破了马科斯政府的“毒计”,中国海警才会提早模拟有人落水展开海上救生的场景。
此外,透过近来在黄岩岛海域我们的常态化训练,想必不少网友注意到了中国海警这次的打法也完全变了。
但根据评测来看,此次谷歌的新模型在智能上并不出色。AI模型评测平台Arena.ai的研究显示,Gemini 3.6 Flash 在前端代码竞技场中以1537分排名第12位。
F |
第三方评测机构Artificial Analysis的结论则是,Gemini 3.6 Flash 在智能方面较3.5 Flash没有提升,智能指数得分50,但任务效率有所提高,Gemini 3.6 Flash的平均每任务时间为 1.3 分钟,较上一代减少超过50%,同时每任务成本略有降低。
这意味着,谷歌优化的更多是速度和成本,而不是模型能力本身。
更值得关注的是,在Artificial Analysis最新智能指数排行榜中,谷歌目前已经没有任何一款模型进入前十。
G |
早在此前,出于想怂恿日本在钓鱼岛问题上与中国对抗,美方便借助《美日安保条例》给日本撑腰,而为了防止日本升级挑衅,中国海警针对钓鱼岛实施了常态化的巡航,并且直到去年,我们几乎实现了对钓鱼岛的全天候巡航,对此日本只能干着急。
而如今中国海警在黄岩岛也俨然启动了“钓鱼岛模式”,通过在此地展开定期训练,进而实现常态化巡航。
也就是说,菲律宾若还是认不清自己几斤几两,决心在黄岩岛与中国硬刚到底,那就尽管放马过来,中国海警必将依法维权,势必粉碎美菲一切的阴谋诡计!
。
H | 排名靠前的是Anthropic、OpenAI等海外厂商,也包括国内月之暗面的Kimi K3、智谱GLM-5.2等模型。这与去年Gemini一度站上全球第一梯队形成了鲜明反差。
除了排行榜,开发者社区的反馈同样出现明显分化。不少开发者用谷歌新模型做任务时未看到很好的表现,“前端能力糟糕、空间推理也很差,我安慰自己这其实不是在高思考水平上运行的,但我不确定。”
有开发者评论道,“谷歌就像龟兔赛跑里的兔子,领先一段时间后就开始睡觉。
I | ”也有人直言,Gemini 团队需要引入真正关心交付前沿模型的人。
在关于谷歌新模型发布的评论中,相比Flash模型,大家更关注的是,旗舰模型Gemini 3.5 Pro什么时候发布?
在5月的谷歌I/O 大会上,谷歌发布了Gemini 3.5 Flash,当时曾预告Pro版本已在内部使用,预期一个月内推出。然而两个月过去了,Gemini 3.5 Pro依然没有公开亮相。据外媒报道,由于模型始终未达到内部预期性能,谷歌推迟了发布计划。
面对外界质疑,谷歌DeepMind技术负责人洛根·基尔帕特里克(Logan Kilpatrick)也在社交媒体上回应称,Gemini 3.5 Pro正在与合作伙伴进行测试,计划在准备就绪后立即广泛提供。但他未给出具体的时间节点。
与此同时,谷歌在这次博客中提到,团队已经开始着手构建下一代模型,“启动了迄今为止规模最大的 Gemini 4 预训练工作,并对目前的进展感到振奋”。
J | 这一表态,也让不少业内人士猜测,谷歌是否正在把更多资源转向下一代模型,而非继续打磨3.5 Pro。
针对现阶段谷歌模型的表现,很多人认为,并不是谷歌的能力不行,而是内部的策略方向问题,优先级放在产品上,而不是像Anthropic、OpenAI等厂商专注将AI做好。
K |
从谷歌这次的更新来看,团队在大模型上的策略似乎是“速度胜过智慧”。有开发者认为,让任务时间缩短是很好,但停滞的智能意味着他们优先考虑了错误的指标。“创新也需要深度,而不仅仅是秒表”。
不过,也有开发者认为,如果模型是为了赚钱,从这个商业角度看,谷歌是聪明的,毕竟现在新兴公司都是在烧钱运营,一旦钱烧完直接就倒闭,而谷歌是将模型降智节省成本。
相比Anthropic和OpenAI持续围绕模型能力竞争,谷歌拥有Android、Chrome、Workspace、搜索、云服务等庞大的产品生态,因此这一年其AI战略一直更偏向产品落地,而不是单纯追逐模型能力和榜单。
L |
但另一方面,开发者更倾向于将智能作为评价AI公司的第一标准。如果模型能力长期停滞,即便商业化领先,也难免影响开发者生态和市场预期。
遥想去年11月,谷歌发布Gemini 3模型时曾引发业界震动,反超OpenAI、坐稳第一梯队,股价一路飙升。而进入2026年以来,AI竞争的风向再次发生变化。OpenAI依靠持续推出新模型重新夺回行业关注度,Anthropic依旧保持着模型能力领先的位置,而谷歌更多展示的是成本优化和产品整合能力。
截至7月21日收盘,谷歌(GOOGL.US)跌超1%,股价收于347.15美元/股,较5月中旬高点累计回落近15%,当前谷歌总市值约4.2万亿美元,也从全球市值榜第二退居第三,被苹果赶超。
(本文来自第一财经)。
Current article:http://jwfyunm.zhuaicaisaanzhenshunnaiwei.bond/wi8fi/d6m16bs.html
Published on:11:49:57