DeepMind 工程师回应谷歌前沿模型质疑
「AI研究员伊森·莫利克称谷歌已不再拥有前沿模型,或错失数学与网络安全领域。谷歌 DeepMind 工程师洛根·基尔帕特里克反驳称,Gemini 3.8 Cyber 在多项网络安全测试与实际应用能力上已超过 Anthropic 的 Mythos,且已被谷歌内部 Chrome、Wiz 和 Cloud 团队广泛使用。」
一场关于谷歌是否还握有前沿模型的公开辩论,在 AI 研究社区迅速发酵。AI 研究员伊森·莫利克在 X 平台发文,直言谷歌已不再拥有前沿模型,并认为这将使谷歌在数学领域以及网络安全领域错失先机。这一判断把矛头直接指向了谷歌在大模型竞争中的位置。
该观点很快遭到谷歌方面的正面回应。谷歌 DeepMind 工程师洛根·基尔帕特里克公开反驳,称 Gemini 3.8 Cyber 在许多网络安全测试以及实际应用能力上已经超过 Anthropic 的 Mythos。这番表态把讨论的焦点从是否拥有前沿模型,转向了如何定义与衡量前沿模型这一更本质的问题。
从技术维度看,网络安全场景中的模型能力评测,通常并不只是静态题库上的分数比拼,还涉及真实漏洞分析、威胁情报理解、告警研判以及响应流程编排等复合任务。基尔帕特里克所强调的实际应用能力,正指向这一类更接近生产环境的评估方式,也是判断一个模型能否真正进入安全运营体系的关键指标。
更值得关注的是落地层面的进展。基尔帕特里克透露,谷歌内部的 Chrome、Wiz 和 Cloud 团队已经广泛使用 Gemini 3.8 Cyber。这意味着该模型并非停留在演示与基准测试阶段,而是已经嵌入到浏览器、云安全平台与云服务的真实工程流程之中,接受大规模实际业务的检验。
对于后续路线,基尔帕特里克进一步表示,团队的重点是让越来越多的网络安全防御人员拥有更强的能力,Gemini 4 系列模型将继续推动前沿网络安全模型的发展。这一表述既是对外界质疑的回应,也勾勒出谷歌在安全垂直方向上持续投入的意图。
这场交锋折射出当下大模型竞争的一个现实:前沿模型的定义正在被分化。通用能力榜单上的排名,与特定垂直领域的实战表现之间未必一致;一个模型是否前沿,取决于用什么样的任务集去衡量它。对于开发者和企业用户而言,比起争论谁更强,更值得关注的是模型在自身业务场景中的可用性、稳定性与工程集成成本。
来源:Heooo AI工具导航