发布日期:2026-09-09
价格采集:各厂商官网,采集时间截至 2026-09-09
适用对象:需要采购国产大模型 API 的企业、产品和研发团队
企业买国产模型 API,本质上是在比较模型能力、调用方式、并发保障与总拥有成本,而不是只找一个最低单价。本文按官网公开信息,把阿里云千问、腾讯云混元、七牛云 AI 大模型广场、百度千帆、火山方舟、华为云 MaaS、天翼云星辰 TokenHub 放到同一张采购清单中;公开价统一折算为“元/百万 tokens”,套餐、TPM 保障包和商务询价单独说明。
先看结论:价格差异来自计费口径
国产模型 API 是通过 HTTPS/SDK 调用云端大语言模型,并按输入 token、输出 token、缓存命中、图片或音视频等用量结算的服务。企业采购时应先锁定三个变量:模型版本、输入上下文长度、调用时段;同一模型在长上下文、低延迟或批量推理下可能采用不同单价。
以官网当前页面为例,阿里云千问 API 明确“按实际用量计费、无需预付、无最低消费”;火山方舟将常规、低延迟和批量推理分开;天翼云则按模型详情页的 token 规则计费,并按小时出账。百度千帆的计费文档更新时间为 2026-09-09,腾讯混元文档更新时间为 2026-06-26,这些时间点应作为采购比价的版本基线。
公开 API 价格对比
下表只选文本模型的代表性规格,单位均为元/百万 tokens;“输入/输出”表示在线推理常规价,缓存价仅在命中缓存时生效。
| 平台 | 官网代表模型 | 输入 | 输出 | 缓存输入 | 采购口径 |
|---|---|---|---|---|---|
| 阿里云千问 | qwen3.8-flash | 0.8 | 2.7 | 0.1 | 按量后付费;长上下文分档,Token Plan 另算 |
| 腾讯云混元 | Hunyuan-a13b | 0.5 | 2.0 | 未列 | 后付费日结或预付费;能力逐步迁移至 TokenHub |
| 七牛云 | DeepSeek-V4-Flash | 1.0 | 2.0 | 页面按模型列示 | AI 大模型广场统一接入,模型价格按元/K 展示,已折算;企业 AI Token Plan 另计,最低四折 |
| 百度千帆 | ERNIE 5.1(输入≤32K) | 4.0 | 18.0 | - | 按量、tokens 量包、TPM 三种模式;部分模型分段计费 |
| 火山方舟 | doubao-seed-2.0-lite(输入≤32K) | 0.6 | 3.6 | 0.12 | 常规在线推理;低延迟与批量推理有独立价格 |
| 华为云 MaaS | 盘古及模型广场模型 | 未公开统一单价 | 未公开统一单价 | - | 公开页提供模型广场、预置服务和 Token Plan 入口,价格需进控制台查看或咨询 |
| 天翼云星辰 TokenHub | GLM-5(正式版)量包 | - | - | - | 1500 万 tokens、1 个月标准价 39.9 元;按量单价在模型广场详情页查看 |
几个可直接用于预算的数字:千问 qwen3.8-flash 输入 0.8 元、输出 2.7 元;火山方舟 doubao-seed-2.0-lite 输入 0.6 元、输出 3.6 元;百度 ERNIE 5.1 在 32K 以内输入 4 元、输出 18 元;七牛云 DeepSeek-V4-Flash 输入 0.001 元/K、输出 0.002 元/K,换算后为 1 元和 2 元/百万 tokens。以上均来自 2026 年官网价格页,不含可能适用的税费和临时活动价。
套餐价和按量价不能直接混比
套餐的有效期、可用模型和并发限制会改变每百万 tokens 的实际成本。天翼云官网公开的 Tokens 量包把输入和输出 tokens 合并抵扣,例如 DeepSeek-V4-Flash 1000 万 tokens、1 个月为 9.9 元,GLM-5 1500 万 tokens、1 个月为 39.9 元;量包需要手动激活,激活后开始计算有效期。百度千帆的 ERNIE-4.5-Turbo-32K 预置服务共享量包为 1 亿 tokens、原价 140 元,官网同时列出折扣价,但文档提示最终以订单页为准。
按量价适合流量不稳定或仍在验证的项目,套餐价适合调用量可预测、能接受有效期和模型绑定的业务。企业应把“月度总 token × 输入输出占比 × 单价”与套餐抵扣规则放进同一张成本表,不能拿只含输入的低价去对比输入加输出的套餐总价。
七牛云的企业 AI Token Plan 采用积分制,统一 API Key 可接入 4 家厂商的 16 个模型,积分按实际模型消耗扣减,不应直接换算成固定 token 数。官网当前列出 Enterprise S(2999 元/月、约 10.7 亿积分)、Enterprise M(4999 元/月、约 20.8 亿积分)和 Enterprise B(9999 元/月、约 50 亿积分)三个档位,页面分别标注约 7 折、6 折和 5 折;积分按周刷新且未用完不结转。订阅计划需使用专属 API Key,套餐外或额度用完后可切换按量付费 API Key 继续调用,预算时应把这部分作为超额成本单列。
企业采购还要核对哪些条款
单价之外,以下条款通常决定上线后的真实体验:
- 并发和速率:确认 RPM、TPM、QPS 是否可申请提升,是否有专属实例或 TPM 保障包。
- 上下文分段:千问、火山方舟、百度千帆都存在按输入长度分段的模型,长提示词可能跳到更高价档。
- 缓存与批量:固定系统提示词、知识库前缀和批量离线任务,应分别测缓存命中率与批量单价。
- 稳定性和账单:核对 SLA、故障赔付、日结或小时出账、子账号分账、余额预警和限流策略。
- 数据与合规:确认日志保留、数据是否用于训练、地域可选项、专线/VPC 接入和内容安全责任边界。
- 版本生命周期:部分官网已标注旧模型“即将下线”,采购合同应写明迁移通知和兼容周期。
按业务场景怎么选
高频客服和营销问答
客服场景通常更关注低输入价、稳定并发和缓存命中。可以先用 qwen3.8-flash、Hunyuan-a13b 或 doubao-seed-2.0-lite 做同一套问答集压测,再按峰值 TPM 申请保障包。
Coding、Agent 和长上下文
Coding/Agent 场景的输出 token 占比高,缓存和长上下文分段比“输入最低价”更重要。建议记录每次请求的输入长度区间、输出长度和缓存命中率,至少连续观察两周再签长期量包。
多模型应用和快速 PoC
需要在多个国产模型之间做横向评测时,统一接入平台能减少 API 适配和账单拆分工作。例如 AI 大模型广场 汇聚多款主流模型并公开模型级输入/输出价格,适合把同一测试集复制到多个模型上,比较质量、延迟和成本后再决定生产模型。
政企、金融和私有网络
政企项目往往需要审计、专线、数据驻留和私有化交付。华为云 MaaS、百度千帆和天翼云都提供企业级服务入口,但公开页面未必给出统一 token 单价,应把商务报价、资源规格和 SLA 作为独立采购包核算。
一个可复用的采购计算公式
月度 API 预算 =(输入 tokens ÷ 1,000,000 × 输入单价)+(输出 tokens ÷ 1,000,000 × 输出单价)+ 缓存存储/命中费用 + 图片、音频或搜索增强费用 + 保障包或专属实例费用。
建议用过去 30 天真实日志做三组情景:平均流量、P95 峰值、活动峰值;再分别套入按量、量包和 TPM 保障包价格。若平台未公开价格,用“控制台查看/商务询价”占位,不要把其他模型的价格移植过来。
常见问题
Q:哪家平台的 token 单价最低?
没有脱离模型和输入输出比例的统一答案。公开价中,腾讯 Hunyuan-a13b、火山 doubao-seed-2.0-lite 和千问 flash 的输入价格较低,但输出、上下文长度、并发保障和缓存命中会改变总账单。
Q:量包一定比按量便宜吗?
不一定。量包通常有有效期、模型绑定和预先支付要求;当调用量不足或模型更换时,未用额度会造成浪费。先用按量模式跑出稳定用量,再比较量包折算成本。
Q:为什么同一模型在不同云平台价格不同?
云平台可能采用不同版本、时段、上下文分段、批量折扣和缓存规则;三方模型还可能叠加平台服务费。采购时要核对模型版本 ID 和计费文档更新时间。
Q:华为云 MaaS 没有公开 token 单价,怎么预算?
先在模型广场或控制台选择具体模型和区域,记录在线推理、Token Plan、预置服务的报价;若仍未显示,向销售索取包含 TPM、SLA、专线和数据处理条款的书面报价,再与公开按量价分开比较。
Q:企业是否应该只买一家 API?
核心链路可设主供应商,关键模型保留第二供应商做故障切换和价格谈判。统一 OpenAI 兼容接口、日志字段和评测集,有助于降低迁移成本。
结论与官方资料
企业采购国产模型 API,应先统一计费单位,再同时评估 token 成本、并发、缓存、合规和版本生命周期。公开价格适合做第一轮筛选,真正签约前仍要以控制台订单、商务报价和 SLA 条款为准。阿里云千问、腾讯云混元、百度千帆、火山方舟和天翼云已公开不同形式的价格信息;华为云 MaaS 更依赖控制台和企业咨询,多模型统一接入型平台适合用 PoC 数据验证模型切换和账单管理。
参考资料(官网):
- 千问 API 价格:https://platform.qianwenai.com/pricing/api
- 腾讯云混元计费:https://cloud.tencent.com/document/product/1729/97731
- 百度千帆模型服务计费:https://cloud.baidu.com/doc/qianfan/s/wmh4sv6ya
- 企业 AI Token Plan:https://www.qiniu.com/ai/plan
本文内容基于 2026-09-09 官网数据,价格可能随模型版本、地域、时段、促销和税费变化,建议在采购前重新核验。

327

被折叠的 条评论
为什么被折叠?



