AI API 成本
国产大模型 API 价格对比:DeepSeek、智谱 GLM、Kimi 怎么选
国产大模型 API 国内直连、支付方便、中文能力强,是很多团队的默认选择。这篇讲清 DeepSeek、智谱 GLM、Kimi 的计费口径与选型思路,并教你用可回看来源核对最新价格。
价格核算 · 适合开发者与 FinOps · 解决真实调用成本
为什么国产大模型 API 值得优先考虑
对国内团队,国产大模型 API 有三个天然优势:国内直连无需海外主体、支持人民币与国内支付、中文与本土场景能力强,且数据留在境内更利于合规。这让 DeepSeek、智谱 GLM、Kimi 等成为很多项目的默认起点。
价格上,国产 API 普遍以“元/百万 token”计价,并常有缓存优惠、错峰折扣、Batch 五折甚至免费的轻量模型,整体成本往往显著低于海外直连折算后的价格。
计费口径怎么读:token、缓存、错峰、并发
看国产 API 报价时,别只看一个“输入单价”。DeepSeek 区分缓存命中与未命中价格,并设有错峰时段折扣与并发上限;智谱 GLM 按上下文长度分档、缓存命中另有低价,并提供 Batch API 五折。
Kimi 则强调按 token 计费与缓存优惠,并提醒中文的 token 换算约为 1 token 对应 1.5–2 个汉字——这对估算中文场景成本很关键,同样的字数在不同 tokenizer 下 token 数可能差不少。
所以真正可比的是“同一业务样本下的每任务总成本”,把缓存、错峰、Batch 和中文 token 密度一并算进去,而不是对比首页那个最低单价。
三家横向:DeepSeek、智谱 GLM、Kimi 的特点
DeepSeek:长上下文、思考模式与错峰折扣是亮点,缓存命中价极低,适合成本敏感的大批量与推理任务;并发有上限,需要按业务规模申请或分流。
智谱 GLM:型号谱系最全,从旗舰到免费 Flash 都有,按上下文长度分档并提供 Batch 五折,适合需要按场景灵活切换型号、控制成本的团队。
Kimi:以长上下文和中文理解见长,计费清晰并有缓存优惠,适合长文档、中文密集的应用。具体单价会调整,选型时以各官方页与本站 /official-api 的带时间戳记录为准。
选型建议:按场景挑
把上面的差异落到你的场景,通常能很快锁定候选。
- 大批量、成本敏感、可离线:优先 DeepSeek 错峰 + 缓存,或智谱 Batch 五折。
- 需要多型号灵活切换、有免费档做验证:智谱 GLM 谱系最全。
- 长文档、中文密集、重理解:Kimi 或 DeepSeek 长上下文。
- 要和海外模型对比:用同一任务样本,把中文 token 密度和缓存/错峰折扣都算进去。
- 价格随时会变:下单前用官方页与本站 /official-api 的带时间戳记录复核。
用可回看来源核对最新价
国产 API 的促销与调价较频繁,任何“截图价”都可能过期。本站按官方来源整理各模型的输入、输出、缓存、Batch 等字段与更新时间,缺失项标注为未披露、不做推算;下单前建议同时打开厂商官方定价页确认当前数字。
参考来源
价格、规则和产品状态可能变化,可通过这些原始页面确认当前信息。
支持内容:DeepSeek 官方 API 按 token 计费,区分缓存命中与未命中价格,设有错峰时段折扣与并发上限。
支持内容:智谱 GLM 系列按每百万 token 计费(元),区分缓存命中、上下文长度档位,提供 Batch API 五折与部分免费 Flash 模型。
支持内容:Kimi(Moonshot)API 对输入、输出按 token 计费并提供缓存优惠;中文文本约 1 token 对应 1.5–2 个汉字。
支持内容:本站按官方来源整理各模型 API 的输入、输出、缓存、Batch 等字段与更新时间,缺失项标注为未披露。
相关文章
AI API 成本
AI API 价格对比:以 LLM API Pricing 证据统一 Token、缓存与工具费
不把厂商价目表机械拼在一起,而是统一 token 桶、缓存、Batch、工具费、错误重试和费率版本,再比较同一 AI 任务的可复核成本。
AI Token 成本
大模型 API Token 计费:从预估到 usage 对账的完整账本
把三家 AI API 的请求前估算与响应后 usage 映射为统一账本,避免用字符估算或单一每百万 token 价格替代真实任务成本。
AI API 缓存
大模型 API 缓存价格:命中、写入、TTL 与存储费怎么算
按同一成本式拆解 Prompt Caching 与 Context Caching:OpenAI 的缓存用量、Claude 的写入/读取倍率、Gemini 的显式存储与隐式命中。
常见问题
国产大模型 API 比海外便宜吗?
普遍更便宜,且国内直连、支付方便、数据留境内。国产 API 常有缓存优惠、错峰折扣与 Batch 五折甚至免费轻量模型;但要按同一任务样本算总成本,而不是只比单价。
DeepSeek、智谱、Kimi 怎么选?
成本敏感的大批量选 DeepSeek 错峰+缓存或智谱 Batch;需要多型号灵活切换选智谱谱系;长文档中文密集选 Kimi 或 DeepSeek 长上下文。具体以官方页与本站 /official-api 记录为准。
为什么中文场景要看 token 换算?
不同模型的 tokenizer 对中文切分不同,Kimi 提示中文约 1 token 对应 1.5–2 个汉字。同样字数的中文,在不同模型下消耗的 token 可能差别较大,直接影响真实成本,估算时要以实际 token 数为准。
国产 API 价格多久变一次,怎么拿到最新价?
促销与调价较频繁,截图价容易过期。建议以厂商官方定价页与本站 /official-api 的带时间戳记录为准,本站对缺失字段标注未披露、不做推算。