OpenRouter最新编程模型周榜数据出来了。9月首周(8月31日至9月6日),全球AI大模型总调用量达115万亿Token,其中编程类模型的排名出现了标志性变化:腾讯混元Hy4 preview以13.6T Tokens登顶编程榜,智谱GLM-5.3-Flash(12.3T)和DeepSeek V4 Flash 0731(11.9T)紧随其后,国产模型首次包揽编程榜Top 3。
三款模型各自凭什么
腾讯混元Hy4 preview是8月28日刚发布并开源的新一代MoE旗舰模型,总参数770B、激活参数49B,上下文长度突破100万Token。它重点面向Agent、Coding与生产力场景优化,设计目标是“规划、上下文连续性、持续多步执行”这类真实生产任务。
从编程榜登顶到全球周调用量榜第一,Hy4 preview只用了一周。据《每日经济新闻》报道,其全球周调用量达14.7万亿Token,环比增长379%。这种增速通常意味着有大规模应用场景突然接入,而且是真实生产流量。
智谱GLM-5.3-Flash是智谱首个原生多模态模型,采用全新架构,仅320B参数(激活18B)。它在Artificial Analysis Intelligence Index上拿到57分,与Claude Opus 4.8持平,超过DeepSeek V4 Pro(53分)。
更值得注意的是价格:GLM-5.3-Flash的API定价仅为Opus 4.8的约1/40。上线即开源,采用MIT协议。9月3日至20日期间,智谱还推出了夜间免费活动——每天23时至次日9时,通过官方编程工具ZCode使用该模型额度全免。
DeepSeek V4 Flash 0731是DeepSeek V4 Flash的GA发布版本,属于稀疏MoE架构,284B总参数、13B激活参数,同样支持1M Token上下文窗口。它的定位是“快速推理和高吞吐量工作负载”,同时保持较强的推理和编程性能。
这组数据意味着什么
三个国产模型包揽编程榜前三,放在一年前几乎不可想象。OpenRouter的编程榜基于数百万开发者的真实调用数据,反映的是开发者“用脚投票”的结果,而非厂商发布的基准测试分数。
从价格角度看,这三款模型的竞争力也很直观:Hy4 preview输入$0.834/M、输出$2.501/M;GLM-5.3-Flash输入$0.075/M、输出$0.25/M(目前五折);DeepSeek V4 Flash 0731输入$0.05/M、输出$0.16/M。
GLM-5.3-Flash的性价比尤为突出——它的智能指数与Claude Opus 4.8持平,但价格只有后者的几十分之一。这种“前沿能力+极低价格”的组合,正在改变开发者选择模型时的权衡逻辑。

452

被折叠的 条评论
为什么被折叠?



