Kimi K3 这波真的爆了,你们用着感觉怎么样?

cs1707 2026-07-19 18:11 1

这几天被 Kimi K3 刷屏了,X 上在吹,HN 上在吹,都说是国产之光,deepseek 时刻 2.0 来了。


我也试了一下,浅浅分享自己的体验吧。


先说好的地方:



  • 前端能力很强。


Kimi K3 前端能力这块,算是跻身全球第一梯队,真要个人排名的话,目前我给它排第二,还超越不了 Fable 5--LMArena 人类盲投榜上它前端甚至排第一,但我实测体感,Fable 5 还是更稳。


不过比 GPT-5.6 强得多,这是 GPT 系列家族的通病,前端能力一直很弱。


特别是那个刷屏的 3D 建模,我不知道设计圈怎么看,我觉得挺牛的。



  • 长时复杂任务处理能力也很不错。


比如要做一个复杂的系统,定好一份计划,扔给它,/goal 模式让它自动处理,出错的概率,以及最后交付的结果非常不错。



  • 原生多模态能力。


K3 可以直接理解视频,比如语气,音效,转场之类的,比普通的只能理解文字和图片的 CC/Codex 好多了。喂给 K3 一个视频,让它帮你生成同样风格的 seedance 的提示词,它可以生成得很精准。



  • 开源。


Kimi 是开源的,权重 7 月 27 日就放出来,这意味着以后任何一家 AI 公司都可以直接拿去用,拿去蒸馏,而 Fable 5 和 GPT-5.6 都是自家闭源的旗舰大模型。


然后再讲讲不好的地方吧。(轻喷)



  • 国产最贵。


目前 K3 价格是国产最贵,如果你和国产对比,你一定会不习惯,甚至说它想钱想疯了,但是和国外对比不算贵,成本和 GPT-5.6 差不多,约是 Opus 4.8 的一半。不过考虑到能力嘛,一分钱一分货,我觉得有道理。



  • 速度稍慢。


感觉它比 CC + Fable 5 慢得多,比 Codex + GPT-5.6 也一样慢不少。



  • 幻觉率偏高。


这个你瞎编一个问题去问它,你就知道了。幻觉率高的模型会给你一个答案,并且瞎编一个理由。


但是幻觉低的模型,它遇到它不知道的知识,会诚实地告诉你它不知道,甚至可以反问你。


最后,综合评价一下,我觉得它确实能跻身世界前三,但跟 CC + Fable 5 和 Codex + GPT-5.6 还有点差距。


但这毕竟是国产模型第一次敢跟 Anthropic 和 OpenAI 掰手腕,所以我觉得,还是未来可期啊。


你们试了没?

最新回复 (75)
  • 287854442 07-19 18:16
    1
    harness 用的什么?这么说 我想试试了
  • Rorysky 07-19 18:30
    2
    除了慢 没啥缺点
  • Cbdy 07-19 18:37
    3
    千万不要买 Kimi 的,计费是有问题的
  • YUX 07-19 18:47
    4
    699 的套餐不到两天蹬完了
  • Dragonphy 07-19 18:51
    5
    有 Claude Code 和 Codex 为啥要买 Kimi
  • SayHelloHi 07-19 19:20
    6
    太慢了

    换回 Grok + Codex 了
  • qW7bo2FbzbC0 07-19 19:59
    7
    刚刚你已经偷偷看使用额度了吧
    是啊,心情非常的激动
    是爆了啊
    额度已经爆了啊
  • xing7673 07-19 20:22
    8
    幻觉率这个后面可以看下修复,它这个版本的后训练做得不够,可以看看 k3.1 后训练补上来之后能不能大幅缓解

    不过说回来 kimi 家模型的幻觉率一直都比较高,以前用的时候也是这种感觉,看下模型大了优化后能不能争取做到一个基准线以内吧
  • dingawm 07-19 20:23
    9
    前端确实顶尖,可以只让他来干设计前端页面的活啥的,然后功能、逻辑啥的交给其他模型就行了
  • EliteOtaku 07-19 20:27
    10
    等 kimi 的新套餐看看再说,还有 DeepSeek 呢
  • ddczl 07-19 20:43
    11
    99 元,5 小时额度只够列一个计划,执行都有可能完成不了
  • gpt5 07-19 21:28
    12
    试用了一下,能力属于顶级。中国在偷偷摸摸训练的情况下,还能时不时冒出一个第 0 梯队来。
  • Msxx 07-19 22:03
    13
    综合算下来比 a/和 GPT 都贵,国内这么多做大模型的就他家最能吹
  • jakychen 07-19 22:09
    14
    一步步升订阅升过来的,本来升到第三档就这样了,这波用下来确实可以,支持下国产升到第四档了
  • masterclock 07-19 22:40
    15
    强、贵、慢
  • micean 07-19 23:00
    16
    kimi 最方便的就是识图,K2 开始本来就属于慢了,K2.5 慢上加慢,K3 是慢到姥姥家了,虽然说要出 K3.1 打补丁,但肯定也快不到哪里去
    还是期待 dsv4 正式版和 glm5.5 吧
  • liansishen 07-19 23:01
    17
    Kimi K3 199 额度< GPT Plus 140 的额度
    速度又慢,目前这个阶段没有选 Kimi 的理由吧
  • CoderLife 07-19 23:05
    18
    用了一下, 写了个单页面, 还没有写完, 卡了,
    花了 10 元
    Your account * / * reached TPD limit
  • PrinceofInj 07-19 23:07
    19
    网页版没法用了,自从发布后,免费的网页版我只跟他说了一句话,后面都是繁忙……
    API 倒是还好,然而只是问了一个问题干了三毛钱去。
  • gcgj72 07-19 23:27
    20
    前端能力很强 指的是哪方面 从零构建的 还是已有的落地项目基础上改动 如果是前者 没什么太大的参考价值 现在模型在已有的项目上去细节调整 简直折磨人
  • YICHUJIFA 07-19 23:37
    21
    停止新用户加入了,而且涨价了都
  • laikicka 07-19 23:43
    22
    作为国模之光,大家多多支持,把弱智 gpt 的算力让给我 😂😂
  • eroneko 07-20 00:37
    23
    幻觉率中等吧,没 GPT 高,GPT 可是高到爆表的
  • v400127 07-20 01:35
    24
    前些天 GLM5.2 也是类似的 没坚挺啊
    '
  • ifoto 07-20 02:10
    25
    刚发布的时候,69 没买。现在 299
  • JimmyChan1506 07-20 06:16
    26
    @v400127 你好, 请问可以说一下 GLM 在使用中有什么问题吗?
  • CHTuring 07-20 08:06
    27
    你吹任你吹,官方的 Token Plan 计费如果你用着不骂人我算你厉害。
  • Pennys 07-20 08:23
    28
    大家都在疯狂测试套餐呢。。 冷静一段时间就好。。在我心里和豆包差不多。
  • cat9life 07-20 08:39
    29
    这个价格,真的没有动力去尝鲜啊。老老实实 5.6 sol 吧
  • zuosiruan 07-20 08:40
    30
    @liansishen 卖断货了😂
  • fe619742721 07-20 08:46
    31
    你看,当能力追上来的时候,他们就只有计费可以拿出来说了
  • jaskle 07-20 08:57
    32
    @fe619742721 5 月评价:都不如 sonnet ,6 月评价:都不如 opus ,7 月评价:都不如 fable
  • 526457385 07-20 09:00
    33
    你发任你发,我用 code 叉
  • duanxianze 07-20 09:06
    34
    用不起
  • Rorysky 07-20 09:17
    35
    @ifoto 以前注册过的,官方还留了购买通道
  • moyupai 07-20 09:18
    36
    99 元档,一个 init5 小时额度没了,周额度吃进去 19%
  • txydhr 07-20 09:26
    37
    挺强的,k3 目前遇到的小问题是,遇到复杂问题时不说人话,语言组织混乱。理解人自然语言偶尔不按人类大脑理解,比如“游戏老玩家”理解成年纪大的游戏玩家,当然这两项和 coding/agent 无关。
  • xiejay97 07-20 09:34
    38
    单纯编码来说,k2.6 那时候是惊艳,k2.7 纯倒退(简直弱智),k3 的确不错,但是还没深度使用,目前感觉 GLM5.2 一个梯队,没感觉那么神。顺便说一句,Kimi token 计量非常不透明,体验有时候非常差( k2.6 那时候动不动超时,k2.7 token 消耗多了不少又弱智,还不能切换)
  • adajoy 07-20 09:36
    39
    之前用过 kimi ,配在 cc 上跑的,缓存命中 0
  • PalenessIb 07-20 09:37
    40
    国模现在的问题是看着便宜,实际用起来比 Codex 贵多了。
  • pigspy 07-20 09:38
    41
    太慢了
  • yrk20212021 07-20 09:41
    42
    你这帖子内容,和 https://mp.weixin.qq.com/s/YDt4ikpYpuYX8ZE1hZds7g 写差不多啊
  • Topmax 07-20 09:42
    43
    评论区真的太典了,双标的这么明显🤣
  • vencent00 07-20 09:47
    44
    @qW7bo2FbzbC0 笑死,这里还能看到铁成梗
  • goumadantui 07-20 09:58
    45
    3d 模型那个只是 three.js 把模型引进来再生成一些效果而已啊,重点是模型和贴图,这个场景和效果很多数字孪生和大屏都有,网上代码一大堆,其实别的模型也能生成类似的。

    引用别的帖子的一句话“我觉得这种宣传视频需要注意的一点是,Kimi 官方已经写清楚是用的公共美术资源了,但是很多人,包括我身边不懂 Coding 的同事,会下意识以为内容都是 Kimi 做的,比如上次,有人拿一个国产模型(还是 Gemini 我忘了)问我效果是怎么做的,我看了一下,发现完全是用美术图片堆积的,而不是 Coding 能力真的多么强”
  • gzk329 07-20 09:59
    46
    慢、频繁中断、贵,我开了 199 的套餐,随便用用就限额了,体验很差
  • shangsharon 07-20 10:00
    47
    之前一直用的网页版对话,但是总是提示等待,排队,垃圾玩意直接弃用了
    网页版引流的东西还能搞成这样,我用个鸡毛
  • minami 07-20 10:10
    48
    这家公司的模型每次出来都是一堆吹的😅
  • icanfork 07-20 10:17
    49
    莫要双标,我宁愿你忍一下 OA 厂出吊打模型再回来评论
  • cs1707 楼主 07-20 10:55
    50
    @goumadantui 原来是这样
  • suyuyu 07-20 11:11
    51
    我将像你推销化危手机和小康电器
  • gouyoudawang 07-20 11:13
    52
    断货了额度低完全没得用 完全不能加入生产流程
  • MIUIOS 07-20 11:23
    53
    @eroneko gpt 从以前到现在都存在的问题,上下文一大马上幻觉率就上来了,我都是用到 256K 左右就清掉了
  • lmmlwen 07-20 11:41
    54
    @fe619742721 这不是废话,能力在达到一个阈值后,当然更关心计费以及效率,反贼们不是已经承认 kimi3 能力达标了吗。
  • frantic 07-20 11:56
    55
    的确太贵了,感觉 199 都不够蹬。699 的话 和 codex 5x 的价钱一样,但速度和额度差别又太大
  • zfyime 07-20 12:01
    56
    如果以 gpt 和 opus 来看
    只有买不到和慢的缺点了
    能力顶级 价格没超 gpt 和 opus
    国模确实强了啊
  • xiaomushen 07-20 12:19
    57
    国内厂商算力不够
  • 54sword 07-20 12:20
    58
    效果确实不错,但思考太久了,太慢了
  • laikicka 07-20 12:24
    59
    @lmmlwen 能力不行就拿反贼/黑子说事 难道就不能是真比不上 OpenAI 和 Anthropics 吗? 😂😂
  • jimrok 07-20 12:45
    60
    先有了再说,这个模型的意义在于,很多能力已经逼近前沿模型,前沿模型对劳动生产率的提升已经有显著的影响了,阻碍对产业界的提升的问题在于,产业有很多私密数据不希望给到模型公司。kimi 公开了模型后,很多云托管的公司可以挣到钱,就为企业进行私有化云托管,系统微调,防止泄密,那样生产效率提升真正走通了。
  • noahliaszn 07-20 14:06
    61
    今天用它冒出了之前 opus 说的话砍一刀, 我严重怀疑🤨是不是学习了 opus
  • jokcylou 07-20 14:15
    62
    @laikicka 能力很多方面都超你白皮爹了还在这跪呢🥺
  • cokey 07-20 14:29
    63
    买了 199 的,体验下来就是慢,及慢,非常慢。

    能力大概就是 GPT5.5~5.6 水平,但是速度慢至少慢 3 倍,Codex 10 分钟能搞定的小修改,它硬是搞三四十分钟,习惯了 Codex 速度的,根本没法接收,几度以为是卡死了。

    再就是额度不够,199 我就搞了三个小需求,不到半天,周额度的 30% 就用完了,Codex 我随便踩,还经常重置。
  • wheelg 07-20 14:33
    64
    非常牛,一句话生成了可以联机的胡闹厨房(详情看之前发的帖子),我只能说国模之光
  • laoyutang 07-20 14:37
    65
    @liansishen #17 实测时能达到 1.5 倍的 plus 用量的,也就是说价格和 gpt 其实差不多。但是我还是选 gpt ,tps 快多了
  • qiaobeier 07-20 14:39
    66
    @YUX 那么离谱?刚想开个月付 199 的套餐😂
  • akring 07-20 14:52
    67
    前端质量没的说,就是消耗太快了
  • YanSeven 07-20 14:53
    68
    太慢太慢了,国内的算力基础设施还是差的太远。
  • daliusu 07-20 14:58
    69
    按这个使用价格,实际比 gpt 还贵,而且速度要慢得多,效果倒是还行
  • daliusu 07-20 14:59
    70
    @qiaobeier #66 我就执行了一个任务,这周 199 的套餐没了... 而且花了 25 个小时,不是我 token 消耗得多,是单纯他太慢了
  • laikicka 07-20 15:05
    71
    @jokcylou 超过 claude mythos 5 和 gpt 5.6 pro 了吗 😂😂
  • corlern 07-20 15:07
    72
    我觉得远没有超过 5.5 的水平,速度比 codex 差一大截,有点能力不足时间来凑的味道
  • vzong 07-20 15:10
    73
    全是软文,没必要跟风买,拉跨
  • han1988 07-20 15:34
    74
    @PalenessIb 没有国模就没有 Codex 的重置了,所以要支持国模
  • luckycat 07-20 15:40
    75
    “我们”没用,“我们”从来都只用 Codex/Claude 。
* 帖子来源V2EX
返回