Gemini 3.6 跑分已经来了(benchmark)

Bunn 2026-07-21 23:19 1






Gemini 3.6 Flash 可能会表现出基础模型的一些通用局限性,例如产生“幻觉”(hallucinations)。此外,我们一直在持续改进防越狱能力,并于近期加强了前沿安全(Frontier Safety)方面的防护与缓解措施。系统偶尔也可能会出现响应缓慢或超时的情况。Gemini 3.6 Flash 的知识截止日期为 2026 年 3 月。有关已知局限性的更多信息,请参阅 Gemini 3.5 Flash 模型卡片(Model Card)。

最新回复 (19)
  • prosumer 07-21 23:22
    2

    在无人在意的角落,pro又双叒叕跳票了…

  • plsthx 07-21 23:23
    3

    感觉是流口水的一位:Gemini 3.5 Pro目前正在与合作伙伴测试,计划在准备就绪后尽快广泛推出。已开始对Gemini 4进行预训练。

  • SakuraPY 07-21 23:23
    4

    谷^-^是不是根本不敢发pro了?一出来被kimi打爆就搞笑了 ^-^

  • skyblu 07-21 23:24
    5

    看了一眼最主要的提升是MRCR?

  • supermadmax 07-21 23:24
    6

    看起来注意力有提升? ^-^

  • Q A 07-21 23:24
    7

    拉完了,不如luna一根,不适合写代码

  • Sam 07-21 23:25
    8

    依旧美国豆包^-^这评分拉完了


    我都怀疑这跑分是不是真的超过豆包了

  • wjy 07-21 23:25
    9

    给我一个不用grok4.5的理由


    谷歌真拉完了

  • 星塔旅人 07-21 23:30
    10

    这还敢和 5.6 Luna / Sonnet 5 放一起比??^-^

  • TeainfrostOUO 07-21 23:34
    11

    不是合着你拿来对比的模型一个没打过?

  • todaywind 07-21 23:36
    12

    挺好的,实际测试除了快还是快 ^-^

  • 只一寸夜空 07-21 23:36
    13

    最大的更新是知识截止时间到2026.3了 ^-^

  • kooo13579 07-21 23:37
    14

    跟GPT-5.4 mini 放在一起了 ^-^

  • wklwkl 07-21 23:38
    15

    不是,不应该先是3.5p吗,怎么倒是跑出来个3.6f?

  • AIshidai2049 07-21 23:40
    16

    欢迎新加入的佬友第一次发帖,欢迎来到最好的AI交流地

  • ahutchen 07-21 23:42
    17

    不愧是北美豆包 跟小孩坐一桌去吧 拉完了

  • lmoonl 07-21 23:42
    18

    别逗你豆姐笑了

  • am7 07-21 23:43
    19

    确实拉完了,4.0的预训练都放出来了。

  • W1nge 07-21 23:45
    20

    我说Gemini3.5Pro比Mythos强所以不能放出来有懂的吗

* 帖子来源Linux.do
返回