Doubao-Seed-2.1官方跑分,对标gpt-5.5,奥特曼仿佛看到原子弹爆炸

羽织 2026-06-23 09:30 1






火山官方付费api已经可以调用了


测了下,有点烂,经典跑分没输过

最新回复 (19)
  • alan_wang 06-23 09:31
    1

    为啥没有 DeepSWE 的评分?这个更准一些,约等于体感分

  • bjnsfxs 06-23 09:31
    2

    原子弹今年属于是劳模了,出个新模型就得爆炸一次

  • 遗泽 06-23 09:31
    3

    比GLM5.2还要屌吗?新的国模之光?

  • 山寒 06-23 09:31
    4

    日常不信这些所谓的POC,能干好活的才是最好的

  • yuyumaster 06-23 09:39
    5

    佬我刚来,今天原子弹爆炸了没 ^-^

  • 咸鱼 06-23 09:43
    6

    跑分没输过,等大佬们的横向测评了

  • workerwork 06-23 09:46
    7

    豆包天天免费给用,训练数据肯定不缺,追赶条件之一有了

  • Bliod 06-23 09:47
    8

    训练数据可能是不缺,但是要高质量的训练数据那我觉得基本没有

  • luoxiaoxin 06-23 09:50
    9

    有人用豆包编程吗,哪来的编程数据啊

    不如看看远处的composer3

    豆包目前的第一要务是说人话,别再 一句话总结,要我帮你

  • 江雨衿 06-23 09:51
    10

    豆包的训练数据感觉也就提升提升airp的体验了,编码真不看好,应该没多少高质量的编码数据吧^-^

  • David Colin 06-23 09:53
    11

    什么时候看到眩晕瘫坐,原子弹爆炸这个梗能不笑 ^-^

  • Kz 06-23 10:08
    12

    等一个测评吧,别又是跑分没输过,体验没赢过

  • 达达马蹄 06-23 10:11
    13

    话说我们公司做业务连大模型都用了豆包,还持续挺久了,效果嘛…

  • ynlea 06-23 10:12
    14

    好家伙,依旧跑分模型,奥特曼表示一点压力没有

  • raokj 06-23 10:13
    15

    国模总感觉一直跑分没怂过,体验没赢过

  • 白芸汐 06-23 10:14
    16

    原子弹已经是威力太小了,下次得是地球爆炸,人类灭绝,太阳膨胀这种事件

  • VME50 06-23 10:17
    17

    豆包这是可以不流口水了么?哈哈哈

  • lza 06-23 10:17
    18

    又是典型的跑分永远没输过,体验从来没赢过,跑分截图还是对比claude opus 4.7,还是差非常多

  • 风之旅人 06-23 10:19
    19

    但豆包高质量的数据近乎没有吧,或者比例贼低,不知道有没有赞助我们的Any获取佬们的高质量数据

* 帖子来源Linux.do
返回