大模型服务平台 TokenHub 中,不同的模型计费方式可能有所不同,以下为您介绍各类型模型的计费方式,您也可以从 模型广场 进入模型详情页查看每个模型的计费规则。 语言模型
|
推理输入 | 后付费 | 美元/百万 tokens | 用户输入文本(含 system prompt)的 Token 消耗 |
推理输出 | 后付费 | 美元/百万 tokens | 模型生成文本的 Token 消耗 |
缓存输入 | 后付费 | 美元/百万 tokens | 命中缓存的输入 Token 消耗 |
计费说明:
输入 Tokens 和输出 Tokens 分别计价,不同模型的单价不同,请参见 模型价格(语言模型)。 部分模型支持分段定价(如不同输入长度段对应不同单价)。
部分思考型模型的思考过程(Thinking)和常规输出分别定价。
Token 估算:中文约 1.8 字符 ≈ 1 Token,英文约 0.75 单词 ≈ 1 Token。
前提条件
每领取一个模型的免费资源包或开启一个模型的后付费服务,将自动冻结您账户中1美金,若您账户内余额或授信额度不足,将领取或开启失败。
冻结金额将在资源销毁后退回至您的账号,若您希望退回您的预冻结金额,请在 在线推理 页面删除所有模型 endpoint;删除默认创建的 endpoint 请联系客服处理。 相关文档