DeepMind工程师反驳质疑:Gemini 3.8 Cyber多项测试优于Mythos
DeepMind工程师公开回应外界对谷歌前沿模型能力的质疑,称Gemini 3.8 Cyber已在多项基准测试中超越竞争对手Mythos,引发行业对AI竞赛格局的重新审视。
驱动中国9月10日消息,谷歌旗下人工智能实验室DeepMind的工程师近日公开回应外界关于“谷歌已无法打造前沿AI模型”的批评,强调其最新一代模型Gemini 3.8 Cyber已在多项关键基准测试中取得优于竞争对手Mythos的成绩。这一表态被视为谷歌在AI竞赛中重新夺回技术话语权的明确信号。
此前,多家科技媒体和分析机构曾指出,谷歌在生成式AI浪潮中反应迟缓,其发布的多个模型在性能与市场接受度上均落后于OpenAI、Anthropic等竞争对手。尤其是Mythos系列模型的快速迭代,让外界一度认为谷歌在基础模型研发上已失去领先优势。DeepMind工程师此次的公开反驳,正是针对这一舆论氛围的直接回应。
据DeepMind方面介绍,Gemini 3.8 Cyber在自然语言理解、复杂推理、代码生成以及多模态任务等测试项上均展现出更强的能力。特别是在涉及安全性与对齐性的评估中,该模型的表现被认为更加稳健。工程师团队强调,这些测试结果并非内部自评,而是基于第三方公开基准与行业通用评测体系所得,具备较高的参考价值。
值得注意的是,Gemini 3.8 Cyber并非谷歌近期唯一的技术布局。此前谷歌已宣布将DeepMind与Google Brain团队深度整合,以加速模型研发与产品落地。此次工程师的高调表态,也被视为谷歌内部士气回升的体现,显示出其在算力、数据与算法层面仍具备持续投入的决心。
行业观察人士指出,AI领域的竞争已从单纯的参数规模比拼,转向对模型效率、安全性与实际应用场景的综合考量。Gemini 3.8 Cyber若能在真实业务场景中持续验证其优势,将有助于谷歌在云计算、办公套件及移动生态中进一步巩固AI能力,进而影响整个行业的竞争格局。
不过,也有分析认为,单次基准测试的领先并不足以完全扭转外界对谷歌AI战略的既有印象。Mythos背后的团队同样在快速迭代,且其在开发者社区与开源生态中的影响力不容小觑。未来双方在推理成本、部署灵活性以及行业定制化方案上的较量,将比单纯的分数对比更具现实意义。
截至目前,谷歌官方尚未就Gemini 3.8 Cyber的全面发布计划作出正式说明,但DeepMind工程师的言论已引发广泛讨论。随着AI模型竞争进入深水区,技术实力与市场信任的双重博弈,将成为决定下一阶段行业座次的关键变量。