有点瘫坐 难道Pi真有说法?Pi+Kimi Code+DSV4.1f three.js测试 瓶中沧海

sallyn 2026-09-14 00:03 1

由这个测试而来 deepseek-v4.1-flash瓶中沧海效果,震惊瘫坐.jpg 如果想要看各种其他模型做这个的效果 可以查看 GPT-6 Astra 大大的震惊,共四个场景,美到爆(测测你们的模型绘制情况吧) 这个帖子


第一轮在Pi中(非裸,有插件)输入提示词,大部分内容完成后被大量的playwright截图和读图卡死无响应,切换到Kimi Code继续完成和修复。修复共2轮完成。总共3轮


HTML文件和在线操作可以在这里进行 https://deepdemos.top/demo/pi-kimi-code-dcfac267







我很喜欢V4.1f给我做的这个天空盒和瓶子外的室内以及室外的场景,不知道它是怎么想到要做瓶子以外的场景的。




为了方便大家直接看模型的区别 放个表格




















Astra glm-5.3-flash gemini-3.8-flash gpt5 luna

在我前面几次测试别的three.js建模的时候,Kimi Code倾向于积极的派发多个子代理,基本派发出去2个以上的子代理都是很常见的情况;DSH和ZCode基本表现差不多,也会派发子代理但是基本上一个时间只会派发一个出去,但是ZCode在工具调用上不知道为什么比DSH慢不少,而且调用工具出错较多;Pi即使我装了子代理插件,但可能是提示词原因,并不会进行派发,而且截图和read图片多了非常卡顿,后面直接卡死了,不得不换别的工具来进行接手。

最新回复 (4)
  • 南箕子 09-15 08:35
    1

    所以这最后是在 kimi code 中使用 dsv4.1f 完成的吗

  • sallyn 楼主 09-15 10:47
    2

    对的 但是我看有一个新的benchmark FrontierHarness 可以在X上搜一下


    看上去按照那个来说 DSH和Zcode才是比较好的harness 智谱官方的人跑出来的结果 当然这个图中 DSH那个是在梁文锋测的 梁文谷测的是要比5.3 Flash便宜的


    但是Zcode我感觉它那个思考强度有白名单 以及里面还有阿里云的人机验证 让我实在是不是很想用它


  • SaitoSakuya 09-15 12:02
    3



    opencode go ds4.1 in Claudecode cli,这下真瘫坐了

  • 一颗星 09-15 14:15
    4

    思考强度是max吗,听说有时候high更好呢?

* 帖子来源Linux.do
返回