你要是为了“百万上下文”这四个字,特意把Kimi会员升到过199元那档,现在这笔账值得重新算一遍。
9月11日,月之暗面上线了K2.8 Preview,覆盖Kimi Code和Kimi Work。官方给的定位挺克制:综合性能接近旗舰K3,编程和Agent能力再进一步,支持low/high/max三档思考强度,能看图看视频,上下文1M。真正的变化不在参数,在权限。
199元门槛,没了
以前想在Kimi这边用上百万上下文,得买到199元的Allegretto档,连K3的1M也是199以上才给。现在K2.8一上来,从免费档开始全部开放1M。
说白了,这是把贵档位最硬的卖点拆下来,塞进了低价档。
官方这次一个跑分都没发。“接近K3”是它自己说的,不是谁测出来的,先听一半。好在它把定位讲得坦白——更适合代码补全和常规开发,不是冲榜选手。
还有两个细节值得留意。一是无感升级,原来的kimi-for-coding直接变成K2.8 Preview,Model ID不变,配置一行都不用改。二是流量接管,你在Kimi Code里用K3但关掉了thinking,这类请求会被转给K2.8的无思考版本。等于说,大量常规请求其实已经由更便宜的模型在跑,你感知不到而已。
K3太贵太重,必须有个便宜的主力
为什么急着推它?K3太贵太重。
2.8万亿参数,每天生成约3000亿token,7月发布没多久算力就被冲垮,只能暂停C端新用户订阅。另一头,月之暗面8月ARR突破10亿美元,年底要冲20亿,还在推进港股IPO。
靠一个高成本旗舰撑不起这个节奏,必须有个便宜的主力来接流量、压单位成本。旗舰负责秀肌肉,主力负责过日子,各干各的活。
一个更深的信号是:K3发布时,追求的是在各项基准上跑赢海外旗舰,代价是贵、慢、吃资源。而K2.8 Preview的定位是“纯过日子”——更适合代码补全和常规开发任务。模型竞争的重心,正在从“能不能做到”转向“默认给不给”。
给你的两条实在建议
第一,1M上下文不等于“读得就好” ,它只是“最多能装多少”。官方没公布长文本实测,别看到三个字就上头,先拿你手头最长的那份文档丢进去试一次,比看十个参数管用。
第二,如果你的活只是提炼长PDF、读长报告、整理会议记录,这些用不上K3那种级别的脑子,49元那档就够了,没必要为“百万上下文”每月多掏150块;真难啃的编程和复杂Agent流程,再往高配走。
贵档位以前卖的是“别人没有的能力”,现在慢慢变成“你还用得上的那部分”。想清楚续费时自己买的到底是哪一样,账很快就清楚了。
当模型越切越碎,你需要一个稳定的调用层
Kimi把K3的能力下放到K2.8,本质上是模型在后台被动态替换——你调的还是K3,跑的可能是更便宜的K2.8。这种“无感升级”对体验是好事,但对账单和稳定性来说,意味着你越来越难精确知道自己在为什么付费。
如果你同时在用Kimi、DeepSeek、GPT、Claude,模型切换和账单管理这种琐事,可以交给EasyAPI:一个接口管住所有模型,切换只改配置不碰业务代码,哪条划算走哪条。模型越换越勤,调用层反而可以保持稳定。

1966

被折叠的 条评论
为什么被折叠?



