DeepMind工程师反驳质疑:Gemini 3.8 Cyber多项测试优于Mythos

AI 驱动中国 林晚 331次阅读
分享 Q
AI摘要
由 AI 生成 · 仅供参考

DeepMind工程师公开回应外界对谷歌前沿模型能力的质疑,称Gemini 3.8 Cyber已在多项基准测试中超越竞争对手Mythos,引发行业对AI竞赛格局的重新审视。

驱动中国9月10日消息,谷歌旗下人工智能实验室DeepMind的工程师近日公开回应外界关于“谷歌已无法打造前沿AI模型”的批评,强调其最新一代模型Gemini 3.8 Cyber已在多项关键基准测试中取得优于竞争对手Mythos的成绩。这一表态被视为谷歌在AI竞赛中重新夺回技术话语权的明确信号。

此前,多家科技媒体和分析机构曾指出,谷歌在生成式AI浪潮中反应迟缓,其发布的多个模型在性能与市场接受度上均落后于OpenAI、Anthropic等竞争对手。尤其是Mythos系列模型的快速迭代,让外界一度认为谷歌在基础模型研发上已失去领先优势。DeepMind工程师此次的公开反驳,正是针对这一舆论氛围的直接回应。

据DeepMind方面介绍,Gemini 3.8 Cyber在自然语言理解、复杂推理、代码生成以及多模态任务等测试项上均展现出更强的能力。特别是在涉及安全性与对齐性的评估中,该模型的表现被认为更加稳健。工程师团队强调,这些测试结果并非内部自评,而是基于第三方公开基准与行业通用评测体系所得,具备较高的参考价值。

值得注意的是,Gemini 3.8 Cyber并非谷歌近期唯一的技术布局。此前谷歌已宣布将DeepMind与Google Brain团队深度整合,以加速模型研发与产品落地。此次工程师的高调表态,也被视为谷歌内部士气回升的体现,显示出其在算力、数据与算法层面仍具备持续投入的决心。

行业观察人士指出,AI领域的竞争已从单纯的参数规模比拼,转向对模型效率、安全性与实际应用场景的综合考量。Gemini 3.8 Cyber若能在真实业务场景中持续验证其优势,将有助于谷歌在云计算、办公套件及移动生态中进一步巩固AI能力,进而影响整个行业的竞争格局。

不过,也有分析认为,单次基准测试的领先并不足以完全扭转外界对谷歌AI战略的既有印象。Mythos背后的团队同样在快速迭代,且其在开发者社区与开源生态中的影响力不容小觑。未来双方在推理成本、部署灵活性以及行业定制化方案上的较量,将比单纯的分数对比更具现实意义。

截至目前,谷歌官方尚未就Gemini 3.8 Cyber的全面发布计划作出正式说明,但DeepMind工程师的言论已引发广泛讨论。随着AI模型竞争进入深水区,技术实力与市场信任的双重博弈,将成为决定下一阶段行业座次的关键变量。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com
本文价值 成为第一个评分的人
登录后为本文打分
网友评论0 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录
我要投稿有独家观点或行业线索?向驱动中国投稿,审核采用后署名发布并获积分奖励。 去投稿 ›

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友