GLM API
GLM API Pricing:输入输出、缓存、上下文与 Batch 账本
按智谱官方价格和 Batch 文档,统一记录 GLM 模型、上下文档位、输入输出、缓存存储/命中与批处理状态,不把动态金额写死。
核心主题:glm api pricing · 搜索意图:交易
Keyword evidence
Semrush US 关键词研究记录
文章主题词:glm api pricing。仅用于选词与意图;不把 US 指标写成中国需求,不推断趋势。 no_data 保持原样,不换算为 0;趋势未导出数值,因此不展示或推断趋势。
| 角色 | 查询词 | 数据库 / 日期 | Volume | KD | Intent | CPC |
|---|---|---|---|---|---|---|
| 选定记录 | glm api pricing | US · 2026-08-29 | 70 | 50 | 交易 | $2.80 |
先识别价格表中的模型与上下文档位
智谱 BigModel 价格页按 GLM 模型展示上下文、输入、输出、缓存存储和缓存命中等栏目。模型代际与上下文区间会变化,采集时应保存精确 model id、上下文档位和核验日期。
不同计费项可能使用每百万 token、每 token-hour 或按请求等单位。统一账本保留原始单位与货币,再派生每成功任务成本;过早把所有项目塞进一个 token 单价会丢失缓存存储和多模态差异。
证据边界:本节以 S1 支持“官方价格页按 GLM 模型列出上下文、输入输出、缓存存储、缓存命中与 Batch 计价栏目。”。
Batch 价格要绑定支持列表和队列边界
智谱 Batch FAQ 列出支持模型,并说明 Batch 与标准 API 的价格关系。支持状态是版本化能力,提交前必须从当前文档或接口校验,不能因为同属 GLM 系列就默认全部可用。
官方文档还限制单个 Batch 的请求数、文件大小,并按模型设置最大排队量。分片器应同时检查 bytes、requests 和 queued_requests,给每项写入业务 key 以便结果乱序后回连。
证据边界:本节以 S2 支持“官方 Batch FAQ 说明支持模型、价格关系、文件请求数与大小限制及独立排队限制。”。
缓存存储与命中是两个成本桶
价格页把缓存存储和缓存命中分列,意味着保存缓存资源与实际读取不能混为一次输入折扣。账本字段至少包含 cache_storage_token_hours、cache_hit_tokens 和 uncached_input_tokens。
只有稳定公共前缀和足够复用次数时缓存才可能回本。对模板 hash 分组计算 token 加权命中率,再把存储时间和冷启动写入成本纳入,避免只展示漂亮的请求命中百分比。
用费率快照和逐项 usage 对账
为每次官方采集生成 price_version,记录 source_url、verified_at、model、tier 和所有单位。请求日志引用 price_version;价格更新后新增版本而不是覆盖旧行,历史账单才能重算。
规则核验于 2026-08-29。Batch 完成后逐项区分成功、永久错误和可重试错误,只重放必要项;最终用实际 usage、缓存状态和 attempt 数计算每个成功结果成本。
落地检查清单
工程落地时,为“glm api pricing”建立独立 article_run_id,并保存 selected_semrush_record、database、measured_on、source_snapshot_ids、content_hash、reviewer 与 gate_status。Semrush 字段只参与选词和意图决策,不进入价格公式,也不把 US 指标解释成中文或中国市场需求。
论点账本必须逐条可回放:S1 对应 C1:“GLM 价格核验应分别保存上下文、输入输出、缓存存储、缓存命中与 Batch 栏目。”;S2 对应 C2:“Batch 成本必须与支持模型、文件请求数量、文件大小和独立排队限制一起解释。”。编辑器在段落层写入 evidenceRefs,构建检查确认引用 ID 存在;来源页面发生结构变化时,只把对应论点退回复核,不让整篇文章静默继承旧快照。
动态复核字段包括:模型、上下文、输入输出与缓存费率、Batch 支持模型、文件和队列限制。发布任务应读取当前页面、保留原始单位和地区、与上一快照做字段级 Diff,并记录核验日期 2026-08-29。缺失、受限或无法确认的值保持 null 或“待复核”,不使用 0、均值或相邻产品代填。
独立 SVG 采用“GLM 模型、上下文、缓存与 Batch 价格矩阵”结构,输入维度为:model、context、input、output、cache storage、cache hit、Batch。图表只绘制有来源的数据,缺失项显示空缺;alt、caption、图内标题与正文使用同一术语,并在图注标明动态字段核验日期。
证据与来源链接
以下页面用于支持本文中的具体判断;价格、规则和产品状态可能变化,请按核验日期回到原始来源确认。
支持内容:官方价格页按 GLM 模型列出上下文、输入输出、缓存存储、缓存命中与 Batch 计价栏目。
支持内容:官方 Batch FAQ 说明支持模型、价格关系、文件请求数与大小限制及独立排队限制。
相关文章
AI API 成本
AI API 价格对比:以 LLM API Pricing 证据统一 Token、缓存与工具费
不把厂商价目表机械拼在一起,而是统一 token 桶、缓存、Batch、工具费、错误重试和费率版本,再比较同一 AI 任务的可复核成本。
AI Token 成本
大模型 API Token 计费:从预估到 usage 对账的完整账本
把三家 AI API 的请求前估算与响应后 usage 映射为统一账本,避免用字符估算或单一每百万 token 价格替代真实任务成本。
AI API 缓存
大模型 API 缓存价格:命中、写入、TTL 与存储费怎么算
按同一成本式拆解 Prompt Caching 与 Context Caching:OpenAI 的缓存用量、Claude 的写入/读取倍率、Gemini 的显式存储与隐式命中。
常见问题
GLM Batch API 是否所有模型都支持?
应以智谱当前 Batch 支持列表为准。模型代际和队列限制会更新,提交前需要按精确 model id 校验。
GLM 缓存命中价格包含缓存存储费吗?
价格页将缓存命中与缓存存储作为不同栏目,核算时应分别记录并相加,具体单位与价格以当前官方页为准。
GLM API Pricing:输入输出、缓存、上下文与 Batch 账本中的动态价格或规则怎样保持可复核?
每次更新都重新读取“模型、上下文、输入输出与缓存费率、Batch 支持模型、文件和队列限制”,保存来源 URL、核验日期、原始单位、地区和快照哈希,并按 evidenceRefs 定位受影响段落。后续若字段消失或规则变化则进入更新复核,不用 0、旧数字或相邻产品自动补位。