kimi K3 是不是吹的厉害

1zh3n 2026-09-21 22:44 1

699/月用户,之前官网还有 kimi code 多少倍额度,悄悄移除了。


说是跑分比肩 fable ,实际体感没觉得比 DeepSeek 4.1 flash 高到哪里去。

最新回复 (34)
  • 1zh3n 楼主 09-21 22:46
    1
    网上测评测来测去的,没看到用一个中大型项目来测的。
  • shakaraka 09-21 22:55
    2
    可以生产使用,也是国模第一梯队。但是因为算力有限,即使 699 ,配合 cc 的 teamagent 、workflow ,实际用量非常少。个人体感至少要 4 个 699 的号,才能和 20x 的 gpt 搭配 5.6 sol xhigh|max 一个体感。
  • 106npo 09-21 22:57
    3
    3 个 699 都不够用的,现在 2 个 699+一个 glm pro 终于够用了.
    kimi 的缓存便宜,但输入输出非常之少,适合用来执行方案. 而 GLM 适合用来生产方案
  • 106npo 09-21 22:58
    4
    如果你能用 GPT/anthropic 那就别犹豫直接用,国产模型不管价格还是效果都没有能打的
  • 1zh3n 楼主 09-21 23:03
    5
    @106npo 主要是心理落差比较大
  • kindjeff 09-21 23:11
    6
    kimi 一开始本来也是前端 one shot 好看火起来的,最近 k3 降智也很严重,我觉得涉及到严肃逻辑没有 GLM-5.3 好
  • 1zh3n 楼主 09-21 23:23
    7
    @shakaraka 这……用不起
  • 1zh3n 楼主 09-21 23:24
    8
    @kindjeff 是不是国内都要搞训练,算力不够,所以会影响体验
  • Alwaysonline 09-21 23:48
    9
    我天天黑 Kimi ,也就黑它的量,模型质量真可以,特别是前端,其次是做 PPT 是真牛逼,输出即可用。
  • defa21312 09-21 23:49
    10
    terminal bench v4 里没跑赢参数小 4 倍的 glm ,v4 还是先发布模型一个多月后出的题,不存在刷题可能
  • 413420 09-21 23:49
    11
    kimi 还行,aws 已经和它合作了
  • imnotlxy 09-22 00:05
    12
    虽然 GLM 5.3 等模型在跑分上与 Kimi K3 非常接近,但 Kimi K3 的参数量大很多,这可能也是用起来更舒服的原因。Kimi K3 能更好地理解我的意思。
  • flowerains 09-22 00:07
    13
    KIMI 我拿来也是搞搞 PPT ,搞搞文档,尤其是让他搞代码设计,之前的 K3 模型也就搞搞这些。
    纯拿来干活,和 DS FLASH ,GLM5.3FLASH 速度差太远,而且价格也兜不住。

    不过最近 2.8preview 可以多观察一段时间
  • mmdsun 09-22 00:18
    14
    op 用的是 kimi 3 max 吗? max 思考版本才是排名前几名的版本。
    我用 kimi 3 max + claude code 感觉还可以。
  • chihiro2014 09-22 00:34
    15
    kimi 感觉降智严重,同时 199 感觉额度也不够用,不如 cursor
  • wolfie 09-22 00:40
    16
    能力还行,一个活多轮反复做,性价比稀烂。
  • 1zh3n 楼主 09-22 00:42
    17
    @mmdsun high 或者 max
  • nettest 09-22 00:45
    18
    我猜你的车肯定是国产电车
  • jjx 09-22 07:53
    19
    感觉有降智 或者是过誉了


    一直在 cursor 中用 k3 max , 审查过很多此代码, 产生多个误报同 deepseek 一样, 原因都是对项目了解不深入

    其次是对比下 glm 5.3 干活实在 很少出错, 智谱可惜了
  • DreamingCTW 09-22 09:21
    20
    k3 刚出来就买了,最近很明显的感觉降智了...但一直都很慢
  • RexKang 09-22 09:34
    21
    就传闻 k3 不会的内容会问 claude 这一点,我觉得可以用一用。
    就是量太少,登了不到半天,50% 周额度就没了。
  • gitlight 09-22 09:58
    22
    大就是好,好就是大
  • Mandelo 09-22 10:04
    23
    从来不信跑分,那些跑分高的拿来改代码,复杂点业务,多轮对话的能给你气到吐血。。。。。
  • gloeaerris 09-22 10:06
    24
    写前端爆锤所有模型,但是速度慢价格高,用了俩月退订了,400 块就写了个后台 UI
  • Meursau1T 09-22 10:12
    25
    智商没什么问题,我长期用 5.6 sol max 和 high ,明显感觉到 high 没 k3 max 聪明,sol max 和 k3 max 没太大差距。
    我的场景包含:
    1. 在大项目里让模型回答我某些细节问题。这个 sol high 就是个傻嗨,满脑子幻觉,经常编一些不存在的东西糊弄我,多问一句就道歉,k3 max 和 sol max 都没这问题
    2. 做基建相关的大工程。同样没看出 k3 max 和 sol max 的差别,俩都慢的要死,但结果基本都没问题,sol max 降智的时候还做出过一些缘木求鱼的操作,k3 反而没遇到,最差就是 429 。

    所以 k3 确实可以喷他贵、慢,但说他蠢并不公道。
  • noahliaszn 09-22 10:28
    26
    k3 max 挺不错的啊我说实话哈,就是慢和贵 还经常 429
  • cubecube 09-22 10:33
    27
    用起来还可以,体感上比 glm5.3 更全面点,但是太贵了,且慢
  • shintendo 09-22 10:41
    28
    @RexKang 那个传闻太扯了,如果为真的话所有第三方 provider 都应该跟官方有显著智商差异才对
  • daliusu 09-22 10:42
    29
    k3 做前端感觉还可以,比 grok 还强点的感觉,但是我订阅一个月都没用完,因为速度太慢了,正常来说如果省钱就用 deepseek 和 glm ,不然还是 gpt 省心,其实也没贵多少
  • daliusu 09-22 10:45
    30
    @daliusu #29 我觉得能跟 k3 比前端还原度的也就 astra 了,基本我用其他模型做大屏,对 figma 还原度都只有 50%都算高的,k3 估计有个 7-80%,astra 能有接近 90%,就个别细节不好,乍一看基本一样,自己对比细节让他调一下基本不写代码就能和 figma 几乎一样,而且 figma 上 ui 搞出的很多乱七八糟的写法,figma 自己导出的样式都不对的,其他模型识别不出来会写的乱七八糟的,astra 也能搞出来
  • tcchen 09-22 10:51
    31
    k3 在我的用例上非常聪明,很喜欢和 k3 说话
  • xiaomushen 09-22 11:16
    32
    除了慢和贵,其他都在线的
    真的很强
  • molvqingtai 09-22 11:32
    33
    聪不聪明不知道,用量太少了,周额度两天蹬完
  • colinchen 09-22 11:43
    34
    看怎么用吧,我不是写代码的,干硬件产品经理的。用它对策略和确认方案,确认了让它派活给 V4.1-FLASH 或者 GLM-5.3-FLASH ,还挺舒服的,体感比现在降智的 GPT-5.6sol 好些。
* 帖子来源V2EX
返回