2026-09-10 18:42 1001 次浏览

谷歌前沿模型之争再起:DeepMind 工程师称 Gemini 3.8 Cyber 已领先 Mythos

AI 研究员伊森·莫利克称谷歌已失去前沿模型地位,DeepMind 工程师洛根·基尔帕特里克反驳,称 Gemini 3.8 Cyber 在多项网络安全测试及实际应用中优于 Anthropic 的 Mythos,并透露谷歌内部多个团队已广泛使用。

围绕谷歌是否仍站在人工智能前沿模型的第一梯队,业界再度出现公开交锋。AI 研究员伊森·莫利克(Ethan Mollick)在 X 平台发表观点,认为谷歌已不再拥有前沿模型,并判断这可能导致其在数学与网络安全两个关键领域失去竞争优势。这一说法迅速引发讨论,谷歌 DeepMind 工程师洛根·基尔帕特里克(Logan Kilpatrick)随后作出回应,直接以具体模型表现作为反驳依据。

争议焦点:前沿模型能力是否已经易主

莫利克的判断建立在谷歌近年来在部分高难度基准上被竞争对手追赶甚至反超的观察之上。他将数学和网络安全视为检验前沿模型能力的两个重要场景,认为如果谷歌在这两个方向失去领先地位,其整体前沿模型叙事将受到冲击。这一观点在社交平台上被广泛传播,也触及了当前大模型竞争中最敏感的议题之一:领先优势究竟体现在通用能力,还是垂直领域的实战表现。

基尔帕特里克的回应则把讨论拉回到具体产品层面。他表示,Gemini 3.8 Cyber 在许多网络安全测试以及实际应用能力上已经超过 Anthropic 的 Mythos。这一表态并未停留在基准分数的比较,而是强调模型在真实任务中的可用性,试图说明谷歌在前沿模型上的投入仍在转化为可衡量的竞争力。

内部落地:Chrome、Wiz 与 Cloud 团队已广泛使用

为佐证 Gemini 3.8 Cyber 的实战价值,基尔帕特里克透露,谷歌内部的 Chrome、Wiz 和 Cloud 团队已经广泛使用该模型。这一信息将讨论从“实验室指标”推向“内部生产环境”,暗示该模型并非仅用于展示,而是已经嵌入到谷歌自身的安全与云业务工作流中。

  • Chrome 团队的使用可能涉及浏览器层面的安全防护与威胁识别;
  • Wiz 作为云安全领域的重要力量,其使用场景更偏向漏洞发现与风险分析;
  • Cloud 团队的参与则意味着模型能力正在与谷歌云的基础设施和安全服务结合。

基尔帕特里克进一步表示:“我们的重点是让越来越多的网络安全防御人员拥有更强能力。Gemini 4 系列模型将继续推动前沿网络安全模型发展。”这一表述既回应了外界对谷歌前沿模型地位的质疑,也释放出下一代模型将继续聚焦网络安全方向的信号。

行业视角:网络安全成为前沿模型的新竞技场

从更广的行业脉络看,网络安全正在成为大模型厂商争夺的前沿阵地。与通用对话能力相比,安全场景对模型的推理深度、代码理解、威胁情报整合以及误报控制都有更高要求,也更难通过单一基准测试来全面衡量。因此,厂商之间的比较往往需要结合内部落地规模、防御人员反馈和实际拦截效果来综合判断。

莫利克与基尔帕特里克的分歧,本质上反映了评价前沿模型的两套标准:一套看重公开基准与领域覆盖的广度,另一套看重特定垂直场景中的实战表现与内部采用程度。Gemini 3.8 Cyber 与 Mythos 的对比目前主要来自工程师一方的表述,尚缺乏第三方独立评测的完整数据,但围绕网络安全能力的竞争显然已经升温。随着 Gemini 4 系列被提上日程,谷歌能否在这一细分赛道建立持续优势,将成为观察其前沿模型战略成效的重要窗口。