DeepMind 工程师反驳“谷歌搞不出前沿模型”:Gemini 3.8 Cyber 已在多项测试中优于 Mythos

yhe 2026-09-10 18:15 1



9 月 10 日消息,AI 研究员伊森 · 莫利克(Ethan Mollick)今日在 X 平台发文称,谷歌已不再拥有前沿模型,这代表着谷歌将措施数学领域,以及网络安全领域。


谷歌 DeepMind 工程师洛根 · 基尔帕特里克(Logan Kilpatrick)对此反驳称,Gemini 3.8 Cyber 在许多网络安全测试、实际应用能力已经超过 Anthropic 的 Mythos。谷歌内部的 Chrome、Wiz 和 Cloud 团队已经广泛使用该模型。

最新回复 (8)
  • WWT 09-10 18:16
    1

    难怪之前风控大乱杀

    哈基米看到这么多人反代白嫖

    直接哈气了^-^

  • ajeow 09-10 18:20
    2

    (帖子已被作者删除)

  • javafun 09-10 18:29
    3

    真别小看谷歌,最近因为开发量比较大,捡起以前不用的antigravity配合3.8flash开发,体验很不错,快准狠,指哪打哪,也许该放下偏见自己体验一下看看

    还有就是AI的聪明程度除了编程可能还有其他的,比如识图,世界知识储备,问题理解能力等,可以看下今天测试的小案例,只有Gemini全对

    ChatGPT的:



    DeepSeek的:



    Gemini的:

  • ks 09-10 18:32
    4

    没有否认谷歌有东西,只是否认他的水平在最前沿

  • lyrx 09-10 18:38
    5

    flash模型吗?我不信这个消息,flash模型还能超过顶尖的大参数模型?你放个pro模型说不定还有点可信度

  • neteroster 09-10 18:41
    6

    3.8确实有不错提升,但主楼截图中谷歌员工声称「比 Mythos 更具能力」是彻底的谎言(尽管他选择用内部的 Cyber 模型给自己找个台阶下),特别是考虑到 Logan 是级别不低的领导者,更让人怀疑谷歌内部是否对自己和竞争对手的模型的能力有充分的了解

  • neteroster 09-10 18:50
    7



    虽然我知道这么比不公平,但毕竟Logan就是要在一起比


    我只能说 Gemini 的世界知识这个最强项现在也落后了,特别是在很多新知识(>2023)上,无论是flash还是pro

  • Mirroroad 09-10 18:56
    8

    3.8 cyber挖洞能比claude更强个人觉得还是有点戏的,毕竟gemini确实精神病人思路多,而挖洞还是更倾向于找非标准的方法每个都试试。

    至于其他的,反正deepmind内部还在3.1pp做集群……

* 帖子来源Linux.do
返回