旗舰模型的价目表还在眼前:输入10美元、输出50美元每百万token。对着账单算了一下毛利,还是把档位调回了“够用就行”。
但最近圈子里讨论最多的是另一个方向——腾讯混元开源的Hy4 preview,输入价只要0.834美元,差不多是旗舰报价的十二分之一,用的是Apache 2.0授权。便宜到这个程度,实际表现怎么样?
模型基础参数
8月28日,腾讯混元正式发布并开源新一代大语言模型Hy4 preview。总参数770B、激活参数49B,78层网络里每层配置了256个路由专家加1个共享专家,每token激活top-8路由。上下文长度达到1M。整体思路与DeepSeek-V4 Pro类似,但49B激活意味着推理开销按小模型档次计算,1M上下文允许整份代码仓库或长文档一次性输入。
权重已上线Hugging Face、GitHub、ModelScope和GitCode,API同步上线腾讯云TokenHub和OpenRouter。WorkBuddy、CodeBuddy、元宝、ima等平台也已集成,并提供两周免费试用。
性能表现
Code Arena WebDev榜单上,Hy4 preview排到全球第5、开源模型第3。前代Hy3还在34名。DeepSWE编码基准从Hy3的28.0提升到64.3。
具体数据如下:
-
DeepSWE:Hy4 preview 64.3,DeepSeek V4 Pro 62.7
-
Terminal-Bench 2.1:Hy4 preview 85.4,与Claude Opus 5持平
-
SWE-bench Pro:Hy4 preview 65.7
不过,腾讯公布的163位专家、203个工程任务盲评中,Hy4 preview均分2.99/4,GLM 5.3是2.92,Kimi K3是2.94——领先幅度在0.05到0.07分,基本在误差范围内。
榜单名次可以作为参考,但0.1分左右的领先不宜过度解读,更多是发布期的宣传口径。
对开发者意味着什么
对独立开发者来说,真正的价值在于“49B激活 + 1M上下文 + 低价格”的组合。
API定价(新加坡区域):输入0.834美元/百万token、输出2.501美元/百万token、缓存命中0.042美元/百万token。按人民币计:输入6元/百万token、输出18元/百万token、缓存命中0.3元/百万token。
相比旗舰模型输入10美元、输出50美元,Hy4 preview价格优势明显。长文本总结、代码分析、文档处理等场景值得尝试。对数据敏感的团队还可以选择私有化部署。
需要注意,Hy4目前仍为preview版本,仅支持文本,发布时缺少第三方独立测试数据。腾讯团队也表示“预训练和后训练仍有提升空间”。生产环境建议先从小流量开始试用。
多模型管理思路
旗舰模型价格维持高位,开源模型能力持续提升,模型选择越来越多。这时更需要一个统一的管理方式。
EasyAPI 将主流模型整合到同一接口,按任务类型选择最合适的模型。一个Key接入所有模型,切换时只需调整配置,无需修改业务代码——不必盯着每一家平台的调价通知,只需关注单次任务的实际成本。

328

被折叠的 条评论
为什么被折叠?



