笑傲江湖
Gemini掉出全球前十,谷歌新模型为何没能赢得掌声?_我的网站

A | 当地时间7月21日,谷歌DeepMind发布三款轻量的新模型,主打“更快、更智能、更具成本效益”,但因智能程度没有满足外界的期待,评价两极分化。 주병기 공정거래위원장이 26일 서울 여의도 국회에서 열린 정무위원회 전체회의에서 2025회계연도 결산 제안설명을 하고 있다./사진제공=뉴스1주병기 공정거래위원장이 최근 쿠팡의 조사 거부로 공정위 현장조사가 불발된 것과 관련, "(형사)고발을 하려고 하고 있다"고 밝혔다.주 위원장은 이날 국회 예산결산특별위원회의 경제부처 부별심사에서 '대한민국의 공권력을 무력화시키는 시도'라는 취지의 송재봉 더불어민주당 의원의 질의에 "철저하게 대처하려고 하고 있다"며 이같이 답했다.앞서 공정위는 쿠팡의 대규모유통업법 위반 혐의를 확인하기 위해 현장조사에 나섰다가 쿠팡의 조사 거부로 철수하는 일이 발생했다.구체적으로 공정위는 쿠팡이 '가격 맞춤형 쿠폰' 비용을 납품업체에 부당하게 떠넘겼단 의혹을 확인하기 위해 쿠팡 본사에 현장조사를 나갔다. 가격 맞춤형 쿠폰은 쿠팡에서 파는 특정 제품 가격이 네이버 등 경쟁 쇼핑몰보다 비쌀 경우 쿠폰을 자동으로 발행해 소비자가 실제 결제하는 가격을 최저가 수준으로 낮추는 방식이다.하지만 쿠팡은 공정위로부터 조사 사실을 사전에 통지받지 못했다는 이유로 조사를 거부했다. 행정기관이 현장조사를 할 때는 원칙적으로 조사 개시 7일 전까지 조사 대상자에 서면으로 통지해야 한다는 행정조사기본법 조항을 이유로 들면서다.2007년 제정된 행정조사기본법은 공정거래법, 하도급법, 가맹사업법 등 공정위 소관 8개 법률 위반행위 조사의 경우 사전통지 규정 대상에서 제외하고 있다. 2011년 제정된 대규모유통업법은 원칙적으로 사전통지 대상에 포함되는 것이다.공정위는 대규모유통업법이 사전통지 대상이라고 하더라도 이번 조사는 예외 사유에 해당한다는 입장이다. 행정조사기본법 제17조는 증거 인멸 등으로 조사 목적을 달성할 수 없다고 판단되는 경우 조사대상자에 조사 개시와 동시에 조사 목적 등을 구두로 알릴 수 있도록 하고 있다. 증거인멸 우려가 있는지 여부는 조사하는 기관이 판단할 사안이지, 피조사 기업이 주장할 성격은 아니란 입장이다.공정위 현장조사는 메신저·메일 등 폐기가 쉬운 전자자료 확보가 핵심인 만큼, 공정위는 대개 사전통지 없이 현장조사를 벌여왔다. 피조사 기업이 조사 과정에서 자료 제출을 거부하는 등 조사에 비협조한 사례는 있었지만, 법 적용 자체에 문제를 제기하며 조사를 거부한 것은 전례를 찾기 어렵다는 설명이다.주 위원장은 "전례없는 일이 벌어져서 저희도 철저하게 대처하려고 하고 있다"며 "법에 미비한 것을 이용해 소송을 제기했기 때문에 저희로선 소송에 대응할 수밖에 없다"고 말했다.。 与此同时,旗舰模型Gemini 3.5 Pro依然没有露面成为此次焦点,从排行榜来看,谷歌的模型已经排在十名开外。 根据谷歌官方博客,此次发布的三款模型定位不同。 Gemini 3.6 Flash是主力模型,与上一代相比能使用更少的token,在相同成本下提供更高质量的工作;而Gemini 3.5 Flash-Lite则是快速、成本效益高的选项,适用于日常任务,如处理文档和搜索;Gemini 3.5 Flash Cyber是一种网络安全模型,专为发现和修补关键软件漏洞而构建。 但根据评测来看,此次谷歌的新模型在智能上并不出色。AI模型评测平台Arena.ai的研究显示,Gemini 3.6 Flash 在前端代码竞技场中以1537分排名第12位。 第三方评测机构Artificial Analysis的结论则是,Gemini 3.6 Flash 在智能方面较3.5 Flash没有提升,智能指数得分50,但任务效率有所提高,Gemini 3.6 Flash的平均每任务时间为 1.3 分钟,较上一代减少超过50%,同时每任务成本略有降低。 这意味着,谷歌优化的更多是速度和成本,而不是模型能力本身。 更值得关注的是,在Artificial Analysis最新智能指数排行榜中,谷歌目前已经没有任何一款模型进入前十。排名靠前的是Anthropic、OpenAI等海外厂商,也包括国内月之暗面的Kimi K3、智谱GLM-5.2等模型。这与去年Gemini一度站上全球第一梯队形成了鲜明反差。 除了排行榜,开发者社区的反馈同样出现明显分化。不少开发者用谷歌新模型做任务时未看到很好的表现,“前端能力糟糕、空间推理也很差,我安慰自己这其实不是在高思考水平上运行的,但我不确定。” 有开发者评论道,“谷歌就像龟兔赛跑里的兔子,领先一段时间后就开始睡觉。”也有人直言,Gemini 团队需要引入真正关心交付前沿模型的人。

B | 在关于谷歌新模型发布的评论中,相比Flash模型,大家更关注的是,旗舰模型Gemini 3.5 Pro什么时候发布? 在5月的谷歌I/O 大会上,谷歌发布了Gemini 3.5 Flash,当时曾预告Pro版本已在内部使用,预期一个月内推出。然而两个月过去了,Gemini 3.5 Pro依然没有公开亮相。据外媒报道,由于模型始终未达到内部预期性能,谷歌推迟了发布计划。 面对外界质疑,谷歌DeepMind技术负责人洛根·基尔帕特里克(Logan Kilpatrick)也在社交媒体上回应称,Gemini 3.5 Pro正在与合作伙伴进行测试,计划在准备就绪后立即广泛提供。但他未给出具体的时间节点。 与此同时,谷歌在这次博客中提到,团队已经开始着手构建下一代模型,“启动了迄今为止规模最大的 Gemini 4 预训练工作,并对目前的进展感到振奋”。

C | 这一表态,也让不少业内人士猜测,谷歌是否正在把更多资源转向下一代模型,而非继续打磨3.5 Pro。 针对现阶段谷歌模型的表现,很多人认为,并不是谷歌的能力不行,而是内部的策略方向问题,优先级放在产品上,而不是像Anthropic、OpenAI等厂商专注将AI做好。 从谷歌这次的更新来看,团队在大模型上的策略似乎是“速度胜过智慧”。有开发者认为,让任务时间缩短是很好,但停滞的智能意味着他们优先考虑了错误的指标。“创新也需要深度,而不仅仅是秒表”。

D | 不过,也有开发者认为,如果模型是为了赚钱,从这个商业角度看,谷歌是聪明的,毕竟现在新兴公司都是在烧钱运营,一旦钱烧完直接就倒闭,而谷歌是将模型降智节省成本。 相比Anthropic和OpenAI持续围绕模型能力竞争,谷歌拥有Android、Chrome、Workspace、搜索、云服务等庞大的产品生态,因此这一年其AI战略一直更偏向产品落地,而不是单纯追逐模型能力和榜单。

E | 但另一方面,开发者更倾向于将智能作为评价AI公司的第一标准。

F | 如果模型能力长期停滞,即便商业化领先,也难免影响开发者生态和市场预期。 遥想去年11月,谷歌发布Gemini 3模型时曾引发业界震动,反超OpenAI、坐稳第一梯队,股价一路飙升。而进入2026年以来,AI竞争的风向再次发生变化。OpenAI依靠持续推出新模型重新夺回行业关注度,Anthropic依旧保持着模型能力领先的位置,而谷歌更多展示的是成本优化和产品整合能力。 截至7月21日收盘,谷歌(GOOGL.US)跌超1%,股价收于347.15美元/股,较5月中旬高点累计回落近15%,当前谷歌总市值约4.2万亿美元,也从全球市值榜第二退居第三,被苹果赶超。 (本文来自第一财经)。

G |
Current article:http://puubzf.dinggaxilianmaiyuejienianguai.shop/yx7g28/xorebjb.html
Published on:03:51:31
