【可能是慢讯】李飞飞团队用Qwen 3 VL 4B打标了1亿张图片

老火面 2026-06-07 17:09 1

项目名字叫做 GPIC,包含了一亿张图片,总像素接近 28 万亿。数据集已开源,在下面的抱脸网链接里,有13T之多。有哪个大佬能说下这个能做成一个什么样的前端应用吗?还是只能用来训练模型?

最新回复 (6)
  • Divergence 06-07 17:18
    1

    这得出了一周了吧佬^-^,我都下完数据清洗一轮了^-^

  • 老火面 楼主 06-07 17:19
    2

    大佬太厉害了,有什么发现能分享一下吗?或者打算用它来干什么?

  • Divergence 06-07 17:29
    3

    没有,我们是因为要做一个预训练的模型,然后现在现在数据准备就都开始大规模下。主要是里面很多动物特写,感觉这些其实没什么太大用处,可能有几张就可以了,有一些同样的动物,它可能有几百张图。

  • 老火面 楼主 06-07 17:31
    4

    原来是训练模型的大佬,那可是真真大佬了,膜拜一下。

  • Divergence 06-07 18:29
    5

    现在还在数据准备,到时候真训练的时候,应该也是挺多人一起干活的,也不是只有我。^-^

  • Allyourneed 06-07 18:31
    6

    什么组能自己训练模型。哪里来的卡啊

* 帖子来源Linux.do
返回