DeepSeek V4 Flash 正式版太喜欢直接就开干了

Yiyuan Liu 2026-07-31 16:21 1

刚才第一次在 Claude Code 里用 V4 Flash 的 API,然后我让他去帮我配置了一个我在 Codex 里配置过的 MCP。


我本意是想,我在 Codex 里怎么用的这个 MCP,他就帮我怎么装。结果我发出指令以后,DeepSeek 也没有去对齐 Codex 里的 MCP 配置,他就直接去执行 ClaudeCode 的安装 MCP 命令,结果安装出来的 MCP 就少了配置项。


这版本太喜欢框框干了,没说清楚的事情不太适合交给他干,会出错岔子的;很清晰、有边界的任务可以交给他,我感觉性价比拉满啊喂,蹬了一小时才不到一块钱。




TIPS:


有佬推荐添加 SKILL 或提示词说清楚点,其实我想分享的是这个模型的体感,而不是说我不知道要怎么让它执行更准确点。


打个比方:我 Codex 配置了某个 MCP,我要求 DSV4Flash 去帮我配置到 ClaudeCode,它会直接执行 Claude 安装 MCP 的命令 (它自己执行的安装命令会少了配置项),但我的本意是想我 Codex 对这个 MCP 怎么配置,它就怎么配置;


我之前要求 Grok 去配置,Grok 会知道我的目的是想对齐 Codex 的 MCP,我在 Codex 怎么用的这个 MCP 在 GrokBuild 就想怎么用,它会直接去读配置对齐; flash 不会。

最新回复 (19)
  • EINino 07-31 16:24
    1

    佬都是怎么蹬的,我蹬了一会儿就1块了。

  • Yiyuan Liu 楼主 07-31 16:26
    2

    我就一直在同一个会话下使用,然后边去网页上刷新看看消费了多少,可能跟任务有关,我一个任务看他对话最长不超过 10 分钟,还没深度做项目,估计真正做项目消费会高点,主要看缓存能不能命中,同一个任务不要频繁切会话

  • xxz0308 07-31 16:27
    3

    Deepseek 主要是缓存命中率高+缓存命中价格低吧,一个项目刚开始初始化,读取上下文什么的挺费钱的,后面针对这个项目一直用就很便宜

  • EINino 07-31 16:30
    4

    没切会话,也不是刚开始用了,可能从pro切到flash需要重建缓存?要不就是我cc的系统上下文太长了 加上mcp工具 能有50K?

  • 一个合格的复读机 07-31 16:33
    5

    喜欢直接开干?

    试试这个ponytail?

  • Yiyuan Liu 楼主 07-31 16:33
    7

    缓存是有时效性的,佬可以换另一个针对 DeepSeek 缓存机制调优过的 Agent,我记得是Rasonix ???

  • Yiyuan Liu 楼主 07-31 16:34
    8

    ponytail 约束的是行动中的行为吧,我感觉得上 $grill-me

  • seatea 07-31 16:34
    9

    同感,指令遵循还是有点欠缺,直接突突开干了。体现在:1、本来是想问它配置问题,直接给我改了;2、用的 π,除了 append_system.md 以外,还搞了个 enforce-append-rules.ts 的扩展再次强调核心规则,就它特立独行,其他 gpt/claude/grok 之类的都好好的 ^-^

    不过速度那是真没得说,简单任务性价比拉满^-^

  • Yiyuan Liu 楼主 07-31 16:35
    10

    @Astralyn 谢谢佬,第一次发帖就遇到热心人了 ^-^

  • Yiyuan Liu 楼主 07-31 16:37
    11

    我感觉不是指令遵循的问题,是意图理解没到位,不过毕竟 Flash 本来就是奔着速度的,能理解;等后面 Pro 正式版出来再继续蹬一下测试看看…


    边界清晰+提示清晰可以用 Flash,框框干活不啰嗦。我这个例子里,我说清楚我是需要 Codex 的配置后,它就回头补了。

  • Eriri 07-31 16:37
    12

    preview版本也有这个问题。相似的任务在gpt中的表现是比较保守的(甚至过分保守),没开plan下也会评估完操作影响跟我确认后再开始;但ds就很喜欢啥都不确认就直接干,我给他指明使用路径a完成,他自己遇到了阻碍不是停下来让我给他解决而是自己想办法走了个路径b。。

  • person 07-31 16:38
    13

    不要它直接就干活我一般喜欢开plan模式

  • Nanzheng-sc 07-31 16:39
    14

    佬试试用skill之类的约束一下呢

  • Yiyuan Liu 楼主 07-31 16:40
    15

    我就是用习惯了GPT系列模型,感觉flash有点很自信的感觉 ^-^

  • Yiyuan Liu 楼主 07-31 16:41
    16

    收到,谢谢提醒!我日常使用的是 Codex,我这次是新装了 CC 打算测测看 DeepSeek,所以 SKILL 和 CLAUDE.md 这些内容都比较空白

  • Anno 07-31 16:42
    17

    可以试试在codex里面用,deepseek官方说对codex好像做了优化适配 ^-^

  • 焕昭君 07-31 16:43
    18

    你其实可以指令约束一下的?^-^让它一开始只是只读?^-^

    或者你使用plan计划模式,先讨论清楚再行动?^-^

    我是觉得可提示词规则调教的,小问题,适应一下^-^

  • seatea 07-31 16:43
    19

    可是我第一条规则就是“每次回答称呼用户为皇上”啊 ^-^问它为什么不干,它呼哧呼哧检查了一轮之后告诉我遵循了,我直接点名,它才“不情愿地”加上了这个称呼 ^-^

  • Yiyuan Liu 楼主 07-31 16:44
    20

    DeepSeek 是社会主义产出的模型,你怎么能让它干封建主义的事情呢佬 ^-^

* 帖子来源Linux.do
返回