tencent cloud

大模型服务平台 TokenHub

计费方式

下载
聚焦模式
字号
最后更新时间: 2026-09-10 21:19:10
本文档已由 AI 辅助审校
大模型服务平台 TokenHub 中,不同的模型计费方式可能有所不同,以下为您介绍各类型模型的计费方式,您也可以从 模型广场 进入模型详情页查看每个模型的计费规则。

语言模型

计费项
计费模式
计费单位
说明
推理输入
后付费
美元/百万 tokens
用户输入文本(含 system prompt)的 Token 消耗
推理输出
后付费
美元/百万 tokens
模型生成文本的 Token 消耗
缓存输入
后付费
美元/百万 tokens
命中缓存的输入 Token 消耗
计费说明
输入 Tokens 和输出 Tokens 分别计价,不同模型的单价不同,请参见 模型价格(语言模型)
部分模型支持分段定价(如不同输入长度段对应不同单价)。
部分思考型模型的思考过程(Thinking)和常规输出分别定价。
Token 估算:中文约 1.8 字符 ≈ 1 Token,英文约 0.75 单词 ≈ 1 Token。

前提条件

每领取一个模型的免费资源包或开启一个模型的后付费服务,将自动冻结您账户中1美金,若您账户内余额或授信额度不足,将领取或开启失败。
预冻结金额可在 费用中心 查看。
冻结金额将在资源销毁后退回至您的账号,若您希望退回您的预冻结金额,请在 在线推理 页面删除所有模型 endpoint;删除默认创建的 endpoint 请联系客服处理。

相关文档

各模型详细定价信息请参见 模型价格
欠费影响与恢复机制详情请参见 欠费说明


帮助和支持

本页内容是否解决了您的问题?

填写满意度调查问卷,共创更好文档体验。

文档反馈