训练用图像的压缩问题,有懂的嘛?

mushokumunou 2026-07-24 02:18 1

生成ai的embedding训练几乎不受高保真的影响,所以超压后减少文件大小还能加快读取速度。

但问题来了,压到什么程度算是ok能接受的呢?这块算盲区,刚接触。


我当前看上的是https://squoosh.app/

对不同的图片,比如写实,二次元这两类做了测试,肉眼几乎无差异,压缩率70%+


还有什么优秀的压缩工具嘛?求推荐一个。

最新回复 (7)
  • 汐见萤 07-24 02:43
    1

    在说什么,你训练生成图像的话图片在现在的unet和dit这些主流架构不是自回归和像素空间的话,最后是latent,而不是embedding。目前应该会用到的是都是文本embedding多吧...


    然后图像压缩是会造成压缩伪影的,并且压缩率调高还会降低锐度和颜色丰富度,并不是所谓的几乎不受高保真影响...

  • mushokumunou 楼主 07-24 02:47
    2

    @汐见萤 #1

    了解了,先去问了ai,没实践。


    我先找找压缩率有没有检测损失的方法。

  • 汐见萤 07-24 02:48
    3

    不过不是图像生成类模型就无所谓,siglip这些都是在256~384~512尺度进行的,直接压分辨率大小就行,如果你压缩率拉到出现条带化啥的,最后对齐到文本内容我感觉也是会有问题的。。。

  • 汐见萤 07-24 02:48
    4

    压缩的话直接走普通jpeg和webp啥的就行,不用纠结,一般压缩质量75附近就好。一般你电脑不是什么石头盘的话,读图片的io不会成为变慢的瓶颈的。

  • mushokumunou 楼主 07-24 03:01
    5

    @汐见萤 #3

    不在本地,远程的,现在准备小量测试效果。

    大概率转到s3去,wasabi那种,压缩提高吞吐有必要。

    主要测这个workflow的可行性。第一次摸索,先纸上谈兵。

  • corenuclear 07-24 08:01
    6

    质量75左右就行

  • ctc 07-24 09:32
    7

    squoosh够用了,追求无损压缩搞点WebP,或者试试caesium,批量处理省事。

* 帖子来源NodeSeek
返回