还原设计图,哪个模型强一些?

nogeorge 2026-09-03 08:35 1

我看大家评判前端能力大都是用一句话生成的效果来评价,比如鹈鹕蹬自行车,但是工作中大都是还原设计图,目前发现gpt 5.6sol medium效果很差,grok 4.6 high要好一些但仍然达不到我的要求(还原度不够,相比大模型的逻辑能力,感觉在ui上面差很多),gemini因为大家都说编程能力不行还不敢在真实项目使用。所以想问下大家,还原设计图的能力哪个模型好一些呢

最新回复 (9)
  • 席乐 09-03 08:37
    1

    你说的还原是用网页还原你的网页设计图吗?


    还是用 SVG 还原位图?


    还是出一个 PPT?


    鹈鹕骑自行车根本就不是还原设计图,是文生网页。


    表达清楚想要的输入和输出是什么。




    我有个日志索引的设计图,可以试试。

  • AnimalCollective 09-03 08:38
    2

    我用sol xhigh,大概3.4轮能做到1:1完全复刻

  • 亚斯娜 09-03 08:43
    3

    设计图我觉得gpt就挺好还原的,特别是gpt自己生成的设计图,再用gpt去还原页面

  • nogeorge 楼主 09-03 11:38
    4

    就是前端工作 根据设计图写代码还原效果 比如我直接截图给GPT或者让它读取本地的figma dev mode,结果发现它很多时候都识别不了背景色或者阴影之类的

  • nogeorge 楼主 09-03 11:39
    5

    xhigh我用的比较少 一是慢 而是有点费token

  • nogeorge 楼主 09-03 11:40
    6

    我倒不是GPT自己出的图 是设计出的图 我自己体验下来效果不如grok

  • AnimalCollective 09-03 11:41
    7

    如果你要求是1:1完全复刻效果图的话,就得这样

  • nogeorge 楼主 09-03 11:42
    8

    有点不顺畅 相比逻辑 GPT就很强 大多数时候都是一遍过

  • 席乐 09-03 13:27
    9

    就目前看,啥模型都不可能 1:1 还原的


    xhigh 只是思考得多一些,视觉识别作为前置 NLP 处理单元并不会把参考图观察得更仔细,参考图被 token 化前会先压缩一次长宽比,还会切方格编码,很多信息在这过程中就丢失了


    楼上有谁不服气可以拿我的图去试试来证明,看上去很简单的设计图藏着很多细节处理


    如果叫 ai 画个大屏驾驶舱设计,能还原个 80% 算走大运了

* 帖子来源Linux.do
返回