计费基本概念
Token 是模型处理内容时使用的基本计量单位,可能对应一个单词、汉语词语或短句、标点符号、数字等。通常情况下,GLM 系列模型的 Token 与汉字数量换算比例约为 1:1.6,实际数量以接口返回的用量信息为准。 模型推理通常按照输入 Tokens、输出 Tokens 和缓存命中 Tokens 分别计费:调用费用 = 未命中缓存的输入费用 + 缓存命中费用 + 输出费用 + 缓存存储费用
除特别说明外,模型价格统一按照“元/百万 Tokens”展示。图片、视频、语音等模型如采用按次、按分钟或按字符计费,将在对应价格表中单独标明。
旗舰模型
最新一代旗舰模型,覆盖文本与多模态任务。详细能力、接口参数及当前可用模型,请参见模型概览。GLM-5.3-Flash 表中划线价格为刊例价,当前限时 5 折优惠,活动截止 2026 年 9 月 9 日 24:00(UTC+8,北京时间),到期后自动恢复为刊例价。
模型推理
平台提供覆盖文本、视觉、多模态生成、语音和向量等场景的模型 API。除特别说明外,模型按照实际 Token 用量计费;图像、视频和部分语音模型按照请求次数、字符数或音频时长计费。文本模型
更多文本模型
更多文本模型
视觉理解
更多视觉模型
更多视觉模型
多模态生成
更多多模态生成模型
更多多模态生成模型
语音模型
更多语音模型
更多语音模型
向量模型
其他模型
Batch API 适用于大规模、非实时数据处理任务。支持 Batch API 的模型可享受标准调用价格的 5 折,具体支持范围和使用方式请参见 Batch API 使用说明。
搜索工具服务
搜索工具按照实际调用次数计费。知识库服务
知识库相关服务采用按量后付费模式,根据实际使用量计费。功能计费
容量扩容
知识库扩容根据实际占用容量和使用时长计费。模型微调
BigModel 平台提供 GLM 系列模型训练和部署服务,支持 LoRA 微调和全参数微调。模型训练
微调模型推理
模型私有实例
模型私有实例适用于对稳定性、推理性能、效果或资源隔离有更高要求的业务。服务按照模型实例占用的算力单元数量和使用天数计费。咨询方案详情算力单元是模型私有实例推理服务的最小计费单位。根据模型规格不同,每个模型部署单实例需要占用的算力单元数量不同。
语言模型
视觉模型
图像模型
视频模型
向量及其他模型
云端私有化套餐
适用于需要长期、稳定使用云端私有实例的企业客户。咨询方案详情
10 亿 Tokens 训练语料额度包括 5 亿 Tokens LoRA 微调额度和 5 亿 Tokens 全参数微调额度。具体赠送权益和适用范围以采购协议为准。
增购价格
本地私有化解决方案
本地私有化解决方案适用于对数据安全、部署环境和模型运行具有专属要求的企业客户。以下为刊例价格,最终方案和报价以商务沟通为准。模型及一体机
获取模型及一体机解决方案
知识库应用
获取知识库私有化解决方案
ChatGLM3-6B、GLM-4-9B 等模型已开放免费商用授权,可申请授权证书。
计费常见问题
缓存存储如何计费?
缓存存储当前限时免费。本页暂不展示免费期结束后的标准价格,后续如有调整,以页面最新信息为准。如何确认模型当前是否可用?
历史模型价格将继续保留,便于已有业务查询和核对费用。模型当前可用状态、详细说明及接口参数,请参见模型概览。Batch API 如何计费?
支持 Batch API 的模型按照对应标准调用价格的 5 折计费。具体支持范围和使用方式请参见 Batch API 使用说明。实际扣费金额以什么为准?
实际费用根据接口返回的用量数据、调用时适用的按量计费单价以及账户账单计算。如页面价格发生调整,新价格将以页面公告或最新展示为准。开始使用 | 联系销售