• 请不要在回答技术问题时复制粘贴 AI 生成的内容
1zh3n
V2EX  ›  程序员

kimi K3 是不是吹的厉害

  •  
  •   1zh3n · 1 day ago via Android · 3311 views

    699/月用户,之前官网还有 kimi code 多少倍额度,悄悄移除了。

    说是跑分比肩 fable ,实际体感没觉得比 DeepSeek 4.1 flash 高到哪里去。

    Supplement 1  ·  23h 54m ago
    我忽然想到,我们各自的参照物是什么。我感觉对标 opus 4.8/5 或者 GPT 5.6/6 ,还是很勉强。

    而且主要是长时间运行,放手的能力。既人工要参与到什么程度。

    速度就不说了,慢这个有预期了。
    34 replies    2026-09-22 11:43:25 +08:00
    1zh3n
        1
    1zh3n  
    OP
       1 day ago via Android
    网上测评测来测去的,没看到用一个中大型项目来测的。
    shakaraka
        2
    shakaraka  
       1 day ago
    可以生产使用,也是国模第一梯队。但是因为算力有限,即使 699 ,配合 cc 的 teamagent 、workflow ,实际用量非常少。个人体感至少要 4 个 699 的号,才能和 20x 的 gpt 搭配 5.6 sol xhigh|max 一个体感。
    106npo
        3
    106npo  
       1 day ago
    3 个 699 都不够用的,现在 2 个 699+一个 glm pro 终于够用了.
    kimi 的缓存便宜,但输入输出非常之少,适合用来执行方案. 而 GLM 适合用来生产方案
    106npo
        4
    106npo  
       1 day ago
    如果你能用 GPT/anthropic 那就别犹豫直接用,国产模型不管价格还是效果都没有能打的
    1zh3n
        5
    1zh3n  
    OP
       1 day ago via Android
    @106npo 主要是心理落差比较大
    kindjeff
        6
    kindjeff  
       1 day ago
    kimi 一开始本来也是前端 one shot 好看火起来的,最近 k3 降智也很严重,我觉得涉及到严肃逻辑没有 GLM-5.3 好
    1zh3n
        7
    1zh3n  
    OP
       1 day ago via Android
    @shakaraka 这……用不起
    1zh3n
        8
    1zh3n  
    OP
       1 day ago via Android
    @kindjeff 是不是国内都要搞训练,算力不够,所以会影响体验
    Alwaysonline
        9
    Alwaysonline  
       1 day ago via iPhone
    我天天黑 Kimi ,也就黑它的量,模型质量真可以,特别是前端,其次是做 PPT 是真牛逼,输出即可用。
    defa21312
        10
    defa21312  
       1 day ago
    terminal bench v4 里没跑赢参数小 4 倍的 glm ,v4 还是先发布模型一个多月后出的题,不存在刷题可能
    413420
        11
    413420  
       1 day ago
    kimi 还行,aws 已经和它合作了
    imnotlxy
        12
    imnotlxy  
       1 day ago
    虽然 GLM 5.3 等模型在跑分上与 Kimi K3 非常接近,但 Kimi K3 的参数量大很多,这可能也是用起来更舒服的原因。Kimi K3 能更好地理解我的意思。
    flowerains
        13
    flowerains  
       1 day ago
    KIMI 我拿来也是搞搞 PPT ,搞搞文档,尤其是让他搞代码设计,之前的 K3 模型也就搞搞这些。
    纯拿来干活,和 DS FLASH ,GLM5.3FLASH 速度差太远,而且价格也兜不住。

    不过最近 2.8preview 可以多观察一段时间
    mmdsun
        14
    mmdsun  
       1 day ago
    op 用的是 kimi 3 max 吗? max 思考版本才是排名前几名的版本。
    我用 kimi 3 max + claude code 感觉还可以。
    chihiro2014
        15
    chihiro2014  
       1 day ago
    kimi 感觉降智严重,同时 199 感觉额度也不够用,不如 cursor
    wolfie
        16
    wolfie  
       23h 57m ago
    能力还行,一个活多轮反复做,性价比稀烂。
    1zh3n
        17
    1zh3n  
    OP
       23h 56m ago via Android
    @mmdsun high 或者 max
    nettest
        18
    nettest  
       23h 52m ago
    我猜你的车肯定是国产电车
    jjx
        19
    jjx  
       16h 44m ago
    感觉有降智 或者是过誉了


    一直在 cursor 中用 k3 max , 审查过很多此代码, 产生多个误报同 deepseek 一样, 原因都是对项目了解不深入

    其次是对比下 glm 5.3 干活实在 很少出错, 智谱可惜了
    DreamingCTW
        20
    DreamingCTW  
       15h 16m ago
    k3 刚出来就买了,最近很明显的感觉降智了...但一直都很慢
    RexKang
        21
    RexKang  
       15h 3m ago
    就传闻 k3 不会的内容会问 claude 这一点,我觉得可以用一用。
    就是量太少,登了不到半天,50% 周额度就没了。
    gitlight
        22
    gitlight  
       14h 40m ago
    大就是好,好就是大
    Mandelo
        23
    Mandelo  
       14h 34m ago
    从来不信跑分,那些跑分高的拿来改代码,复杂点业务,多轮对话的能给你气到吐血。。。。。
    gloeaerris
        24
    gloeaerris  
       14h 31m ago
    写前端爆锤所有模型,但是速度慢价格高,用了俩月退订了,400 块就写了个后台 UI
    Meursau1T
        25
    Meursau1T  
       14h 26m ago
    智商没什么问题,我长期用 5.6 sol max 和 high ,明显感觉到 high 没 k3 max 聪明,sol max 和 k3 max 没太大差距。
    我的场景包含:
    1. 在大项目里让模型回答我某些细节问题。这个 sol high 就是个傻嗨,满脑子幻觉,经常编一些不存在的东西糊弄我,多问一句就道歉,k3 max 和 sol max 都没这问题
    2. 做基建相关的大工程。同样没看出 k3 max 和 sol max 的差别,俩都慢的要死,但结果基本都没问题,sol max 降智的时候还做出过一些缘木求鱼的操作,k3 反而没遇到,最差就是 429 。

    所以 k3 确实可以喷他贵、慢,但说他蠢并不公道。
    noahliaszn
        26
    noahliaszn  
       14h 9m ago
    k3 max 挺不错的啊我说实话哈,就是慢和贵 还经常 429
    cubecube
        27
    cubecube  
       14h 5m ago
    用起来还可以,体感上比 glm5.3 更全面点,但是太贵了,且慢
    shintendo
        28
    shintendo  
       13h 57m ago
    @RexKang 那个传闻太扯了,如果为真的话所有第三方 provider 都应该跟官方有显著智商差异才对
    daliusu
        29
    daliusu  
       13h 55m ago
    k3 做前端感觉还可以,比 grok 还强点的感觉,但是我订阅一个月都没用完,因为速度太慢了,正常来说如果省钱就用 deepseek 和 glm ,不然还是 gpt 省心,其实也没贵多少
    daliusu
        30
    daliusu  
       13h 53m ago
    @daliusu #29 我觉得能跟 k3 比前端还原度的也就 astra 了,基本我用其他模型做大屏,对 figma 还原度都只有 50%都算高的,k3 估计有个 7-80%,astra 能有接近 90%,就个别细节不好,乍一看基本一样,自己对比细节让他调一下基本不写代码就能和 figma 几乎一样,而且 figma 上 ui 搞出的很多乱七八糟的写法,figma 自己导出的样式都不对的,其他模型识别不出来会写的乱七八糟的,astra 也能搞出来
    tcchen
        31
    tcchen  
    PRO
       13h 47m ago
    k3 在我的用例上非常聪明,很喜欢和 k3 说话
    xiaomushen
        32
    xiaomushen  
       13h 21m ago
    除了慢和贵,其他都在线的
    真的很强
    molvqingtai
        33
    molvqingtai  
       13h 5m ago
    聪不聪明不知道,用量太少了,周额度两天蹬完
    colinchen
        34
    colinchen  
       12h 55m ago
    看怎么用吧,我不是写代码的,干硬件产品经理的。用它对策略和确认方案,确认了让它派活给 V4.1-FLASH 或者 GLM-5.3-FLASH ,还挺舒服的,体感比现在降智的 GPT-5.6sol 好些。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   1493 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 87ms · UTC 16:38 · PVG 00:38 · LAX 09:38 · JFK 12:38
    ♥ Do have faith in what you're doing.