时间与金钱的抉择,GPT还是DeepSeek,记录一次真实的软件开发过程。

三点水也 2026-09-21 10:58 1


[!note]

上周Any大善人的GPT开闸,自己写了一个看短剧的Android原生应用。

结果最近两天挤不上去了,自己订阅的GPT不够用,就想着试试DeepSeek V4.1 Flash。



应用已经基本可用,主要是修复几个bug,我本着Codex+GPT,DeepSeek Harness+DeepSeek的原则,配置好就开蹬。


DeepSeek思考强度选择High




结果没想到

一上来先各种验证问题,思考方案,就是不动手,大概想了三四十分钟。总共大约耗时两个多小时,最后结果如图


耗费了大约九千万Tokne,第3个问题没解决,API价格不到1刀




GPT 6 Astra思考强度Medium




结果还是没想到

我还没反应过来,就完事了。。。



耗时8分钟,300多万Token,4个问题都解决了。。。API价格5刀



对于个人项目,佬友们怎么选?





  • GPT 6 Astra

  • DeepSeek V4.1 Flash






0
投票人



最新回复 (19)
  • asyu9912 09-21 10:59
    1

    gpt写plan做QA,ds动手(

  • myspeedon 09-21 11:04
    2

    :Astra把你的subagent配成ds

  • Neo Lee 09-21 11:05
    3

    还真是贵有贵的道理

  • nijun 09-21 11:08
    4

    聪明模型看似没有思考,其实已经有解决答案。


    笨模型看似。整来整去思索来思索去推理来推理去,最后干不成事儿,Token转化效率很低。


    GPT6现在的Token转化效率。外国榜单第一啊。第二是fable5.1。

  • summerstyle 09-21 11:14
    5

    还是选gpt6把

  • 三点水也 楼主 09-21 11:14
    6

    真的是不对比不知道,一对比吓一跳。

    由奢入俭难啊,没想到DeepSeek会这么这么慢

  • nijun 09-21 11:15
    7

    按照Token转化效率这个标准来看的话,国产模型都不可以,都不达标。


    雷霆思考幻觉度就这么来的,GLM就是。我用的是官方coding plan


    很多时候他不知道要做什么。他不能一下子给出方案,他要去频繁试错。但是GPT6就能一下子给出方案,一下子给出解决方法。真的不一样,真的特别大的差异,一个天一个地。

  • C5Y 09-21 11:15
    8

    实际用起来感觉很鸡肋的。subagent和主agent是上下文隔离的,意味着每开一个新的deepseek子agent,Astra就要跟ds讲很多很多背景和任务,这步骤token已经不低了。然后deepseek还要自己横冲直撞地去执行,也得耗费token。执行完后,Astra肯定还要审查吧,又要急头白脸一顿查查查,测测测。最后就是时间也没了,钱也没了。 ^-^

  • TTop 09-21 11:16
    9

    看项目难度吧,不过还是gpt用的习惯。

  • asyu9912 09-21 11:17
    10

    还真是,但是现在公司给了免费的ds,然后gpt给不足额度只能用自己的号,所以只能是出此下策(

  • Atiyah 09-21 11:19
    11

    这个是技术问题。per token intelligence.国产像deepseek感觉后训练都有严重训练过拟合的问题,确实有点刷分

  • supanono 09-21 11:21
    12

    我是真让 GPT 出策略,DS 干活的,但确实能发现 DS 就是在用 10 倍以上 token 的臭长思考 + 窜稀 tps 穷举弥补模型智商硬差距



    很难评,Astra tps低但很快,DS tps高但很慢


    现在可以说,慢就是快,但快只是快


    加油吧国模

  • 小粉星 09-21 11:22
    13

    拿v4.1f和6astra对比吗,这,这能这么比吗 ^-^

  • C5Y 09-21 11:22
    14

    强模型和弱模型之间,如果选择了弱模型,代价往往不只是时间和金钱。我认为就跟一个厨师切菜一样,拿好厨刀切菜跟拿水果刀切菜(强弱模型之间差别就是这么大),不只是时间消耗的不一样,同时切菜这件事情也会反过来影响你的刀功。你在调教模型的时候,也正在被模型反向调教着呢。 ^-^

  • catboss 09-21 11:24
    15

    试过了,效果挺烂的。DS动手查出的问题比用luna动手还高。luna至少不缺功能,DS是会缺功能的。但是不得不说DS比Luna Max快。

  • sh_93 09-21 11:26
    16

    来学习的,找一些实惠好用的,大家多推荐

  • Lakers 09-21 11:27
    17

    一句话,贵还是有贵的道理,用ds做需求还是弱一点。



  • 当且仅当 09-21 11:32
    18

    所以希望大家都别去用,让DeepSeek再降降价给我用就行了。最近因为DeepSeek和哈基米把我的项目进度大幅度推向前了,在红蓝审核后也基本不会存在屎山问题。爽极了,当你真正会约束它的思考,你会发现贼猛,又快又爽,gpt?就是那个做个垃圾需求花我一天的模型?我不否认它强大,但是我依然保持那个态度,日常中没几个人有什么场景能用到那样的聪明程度。我改个场景布局要我二十分钟这你受得了吗?我换个哈基米加DeepSeek开发加红蓝审查过也才几分钟。价格上就更不提了。所以我觉得不要所有人都把自己手头那些工作认为是多么困难的需求,面试造火箭,工作拧螺丝不是一句玩笑话。真正给力的还是分需求选模型,难的用好模型,简单的用快模型,只有真正都体验过,才会发现效率原来可以这么快

  • 红叶 09-21 11:51
    19

    佬 这个管理面板是什么做的啊,软件吗

* 帖子来源Linux.do
返回