涨了12倍,又砍了60%:大模型价格开始双向波动

同一家公司,27天内价格走了两个极端

9月10日中午12点起,DeepSeek Flash系列的缓存命中输入价,将从0.05元/百万token降到0.02元,降幅60%。缓存未命中从1.5元降到1元,输出从4.5元降到4元。

把时钟拨回27天前的8月17日,同一家公司刚把V4 Pro系列最高涨了12倍。缓存命中输入从0.025元涨到高峰时段的0.3元,涨幅1100%;输出价也从2元抬到了4.5元。当时有开发者抱怨“没有性价比了”。

结果不到一个月,价格又调了回来——只是调得很有讲究。

读价回到原点,写价留在高位

这次降价不是翻案。缓存命中和未命中的输入价,回到了涨价前的0.02元和1元;但输出价停在4元,仍是涨价前2元的两倍。

一句话:读价回到原点,写价留在高位。

这个结构是刻意的。Flash系列主要吃Agent场景——长上下文反复读、工具调用频繁写。读便宜、写贵,是在用价格引导开发者提高缓存命中率、少生成冗余输出。这跟8月那次涨价是同一套逻辑,只不过方向相反。

数据换折扣:Meta首次把“使用痕迹”当成货币

几乎同一时间,大洋彼岸的Meta给Muse Spark挂了个全新的价签:开发者只要愿意把自己的prompt和输出交出来当训练数据,输入输出只要0.10/0.20美元,是标准价1.25/4.25美元的约一折。

这是第一次有人把“使用痕迹”直接当成货币,用来抵扣token的差价——你不是用钱付,是用自己的数据付。

所有按钮都在被按:降价、涨价、促销、数据换价

把这几天海外厂商的动作一起摊开:

  • OpenAI把GPT-6 Astra定在10/50美元,比上一代Sol的4/20美元贵了2.5倍

  • Anthropic同日把Claude Fable 5.1的缓存读取价从1美元砍到0.25美元,直降75%

  • Google让Gemini 3.8 Flash用0.75/3.75美元的促销价卖到年底,2027年1月1日起翻倍

降价、涨价、促销、数据换折扣,所有按钮都在被按。

这指向同一件事:大模型的价格,已经从一个发布时定死的常数,变成一个可以随时双向调节的运营旋钮。

开发者的成本账,不能再“定一次、算一年”

直接后果是,开发者的成本账不能再“定一次、算一年”。一个Agent工作流,可能这个月因缓存命中价砍了60%而便宜四成,下个月又因高峰涨价而贵回一倍。定价权,正从“厂商一次定死”变成“厂商和你的使用方式共同决定”。

更深一层,是发布节奏在推着价格走。观察者网给过一个数:主要模型发布间隔的中位数,已从2023年的37.5天缩到11天。“模型疲劳”成了行业新词——客户还没评估完上一个,下一个就来了。

奥特曼给过一个预测:全球人均月token消耗,将从今天的约10万涨到5000亿。只要这个数对上一半,今天这种“涨12倍又砍60%”就只是序幕。

你需要的是能随时切换的工具

对开发者来说,唯一能确定的是:别再按固定价格做预算了。 你的账单,正在变成一个需要持续盯着的变量。

当价格在分时、缓存、促销和数据换价之间频繁跳动时,你需要的不再是“选一个最便宜的模型”,而是一套能帮你随时切换、按任务分配的工具。

EasyAPI 把主流模型收进同一套接口,一个Key接入所有模型,切换只改配置不碰业务代码。今天DeepSeek降价了,改个配置把流量切过去;明天另一家涨价了,再切回来。不用盯着每一家官网的改价公告跑,只需要关心单次任务的实际成本。

评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值