鹈鹕测试现在还准吗

云天明 2026-08-14 10:40 1

原作者开始用鹈鹕测试的时候,有个前提条件就是那时全世界可能也不会有几个人用鹈鹕骑自行车生成svg去测试大模型,所以大模型也基本上没有可能提前针对这方面做训练。

但现在这个测试几乎已经被用烂了,模型厂商难道不会对这个测试做针对性的优化吗

最新回复 (4)
  • SoldierBoy 08-14 10:43
    1

    有没有看过猪猡公园?不会,中国的那条肯定不会 ^-^

  • Ys Ltr 08-14 10:43
    2

    针对性优化一个鹈鹕,冒出来一个秦始皇。


    总会有新的办法的,针对来针对去,都是因为损害自己的利益。豆包修复了艾宾浩斯错觉,是因为会显得豆包是fw。对国内敏感知识特定优化,是因为怕被大手发力。


    鹈鹕谁关心啊,没有AI做的出来,画成屎了又怎样。

  • Hifumi Mizuhara 🍥 08-14 10:51
    3

    反过来说,鹈鹕画不好的模型就是真废了

    比如Grok的鹈鹕在天上转啊转啊转啊..

  • 夏天 08-14 23:36
    4



    我的感觉画出来正常,但是智力吗?真不如之前的grok风控前的4.5

* 帖子来源Linux.do
返回