tencent cloud

大模型服务平台 TokenHub

模型价格

Download
聚焦模式
字号
最后更新时间: 2026-08-28 18:41:54
注意:
1. DeepSeek-V4 正式版【原厂直供】模型已正式上线。同时,为了更合理地配置资源、提升服务稳定性,我们跟随原厂同步调整模型定价策略,引入峰谷定价机制,空闲时段价格为高峰时段价格的一半,高峰时段为北京时间 9:00-12:00 和 14:00-18:00(其余为空闲时段)。新价格将于北京时间2026年8月17日00:00开始生效。
2. 峰谷时段判定规则:单次请求的计费时段,以平台服务端接收到该请求的时间(北京时间)为准。请求接收时间处于高峰时段的,该次请求按高峰时段价格计费;处于空闲时段的,按空闲时段价格计费。请求的处理时长及返回时间不影响时段判定。
3. GLM-5.3-Flash 限时折扣说明:自本说明发布之日起至 2026 年 9 月 10 日 23:59:59(北京时间),GLM-5.3-Flash 模型调用费用按目录价格的 50% 结算。折扣仅适用于上述期间内实际产生的用量;期间届满后,该模型费用恢复按目录价格结算。

语言模型

新加坡
广州
硅谷
模型名称
条件
(token)
峰谷计费
推理输入
(美元/百万 tokens)
推理输出
(美元/百万 tokens)
缓存命中
(美元/百万 tokens)
Hy4 preview
--
-
0.834
2.501
0.042
Hy3
-
-
0.132
0.528
0.033
DeepSeek-V4-Flash 0731 正式版 原厂直供
-
空闲时段
0.22
0.66
0.007
高峰时段
0.44
1.32
0.014
DeepSeek-V4-Pro 0813 正式版 原厂直供
-
空闲时段
0.66
1.98
0.022
高峰时段
1.32
3.96
0.044
DeepSeek-V4-Flash-Vision-Exp 原厂直供
-
空闲时段
0.22
0.66
0.007
高峰时段
0.44
1.32
0.014
DeepSeek-V4-Flash 0731 正式版
-
空闲时段
0.22
0.66
0.007
高峰时段
0.44
1.32
0.014
DeepSeek-V4-Pro 0813 正式版
-
空闲时段
0.66
1.98
0.022
高峰时段
1.32
3.96
0.044
DeepSeek-V4-Flash
-
-
0.14
0.28
0.028
DeepSeek-V4-Pro
-
-
1.74
3.48
0.145
Deepseek-v3.2
-
-
0.57
1.71
0.114
GLM-5.3
-
-
1.4
4.4
0.26
GLM-5.3-Flash
-
-
0.15
0.50
0.03
GLM-5.2
-
-
1.4
4.4
0.26
GLM-5.1
-
-
1.4
4.4
0.26
GLM-5
-
-
1
3.2
0.2
GLM-5V-Turbo
-
-
1.2
4
0.24
GLM-5-Turbo
-
-
1.2
4
0.24
Kimi K3
-
-
3
15
0.3
Kimi K2.7 Code HighSpeed
-
-
1.9
8
0.38
Kimi K2.7 Code
-
-
0.95
4
0.19
kimi-k2.6
-
-
0.858
3.566
0.145
kimi-k2.5
-
-
0.6
3
0.1
MiniMax-M3
输入长度(0, 512k]
-
0.3
1.2
0.06
输入长度 512k+
-
0.6
2.4
0.12
MiniMax-M2.7
-
-
0.3
1.2
0.06
MiniMax-M2.5
-
-
0.3
1.2
0.03
Hy-MT2-Pro
-
-
0.074
0.295
-
Hy-MT2-Plus
-
-
0.074
0.295
-
Hy-MT2-Lite
-
-
0.044
0.177
-
MiMo-V2.5-Pro
-
-
0.435
0.87
0.0036
模型名称
条件
(token)
峰谷计费
推理输入
(美元/百万 tokens)
推理输出
(美元/百万 tokens)
缓存命中
(美元/百万 tokens)
Hy4 preview
--
-
0.834
2.501
0.042
Hy3
-
-
0.132
0.528
0.033
DeepSeek-V4-Flash 0731 正式版 原厂直供
-
空闲时段
0.22
0.66
0.007
高峰时段
0.44
1.32
0.014
DeepSeek-V4-Pro 0813 正式版 原厂直供
-
空闲时段
0.66
1.98
0.022
高峰时段
1.32
3.96
0.044
DeepSeek-V4-Flash-Vision-Exp 原厂直供
-
空闲时段
0.22
0.66
0.007
高峰时段
0.44
1.32
0.014
DeepSeek-V4-Flash 0731 正式版
-
空闲时段
0.22
0.66
0.007
高峰时段
0.44
1.32
0.014
DeepSeek-V4-Pro 0813 正式版
-
空闲时段
0.66
1.98
0.022
高峰时段
1.32
3.96
0.044
DeepSeek-V4-Flash
-
-
0.14
0.28
0.028
DeepSeek-V4-Pro
-
-
1.74
3.48
0.145
Deepseek-v3.2
-
-
0.28
0.42
0.056
GLM-5.3
-
-
1.1116
3.8907
0.2779
GLM-5.3-Flash
-
-
0.11116
0.38907
0.03196
GLM-5.2
-
-
1.12
3.92
0.28
GLM-5.1
0 ≤ 输入长度 < 32k
-
0.84
3.36
0.182
输入长度 ≥ 32k
-
1.12
3.92
0.28
GLM-5
0 ≤ 输入长度 < 32k
-
0.573
2.58
0.115
输入长度 ≥ 32k
-
0.86
3.154
0.172
GLM-5V-Turbo
0 ≤ 输入长度 < 32k
-
0.7
3.08
0.168
输入长度 ≥ 32k
-
0.98
3.64
0.252
GLM-5-Turbo
0 ≤ 输入长度 < 32k
-
0.7
3.08
0.168
输入长度 ≥ 32k
-
0.98
3.64
0.252
Kimi K3
-
-
2.731
13.653
0.2731
Kimi K2.7 Code HighSpeed
-
-
1.9
8
0.38
Kimi K2.7 Code
-
-
0.95
4
0.19
kimi-k2.6
-
-
0.858
3.566
0.145
kimi-k2.5
-
-
0.56
2.94
0.098
MiniMax-M3
输入长度(0, 512k]
-
0.3
1.2
0.06
输入长度 512k+
-
0.6
2.4
0.12
MiniMax-M2.7
-
-
0.3
1.2
0.06
MiniMax-M2.5
-
-
0.3
1.2
0.03
Hy-MT2-Pro
-
-
0.074
0.295
-
Hy-MT2-Plus
-
-
0.074
0.295
-
Hy-MT2-Lite
-
-
0.044
0.177
-
MiMo-V2.5-Pro
-
-
0.41
0.819
0.003
模型名称
条件
(token)
推理输入
(美元/百万 tokens)
推理输出
(美元/百万 tokens)
缓存命中
(美元/百万 tokens)
GLM-5.2
-
1.4
4.4
0.26

向量模型

模型名称
计费项
价格(美元/百万 tokens)
Kinfra-Text-Embedding-0.6b
文本输入
0.07
Kinfra-Text-Embedding-4b
文本输入
0.084
Kinfra-VL-Embedding-2b
文本输入
0.07
图片输入
0.098
视频输入
0.21
Kinfra-VL-Embedding-8b
文本输入
0.084
图片输入
0.126
视频输入
0.252
说明:
多模态向量模型的文本、图片和视频输入 token 数可通过响应中的 usage.prompt_tokens_details.text_tokensusage.prompt_tokens_details.image_tokensusage.prompt_tokens_details.video_tokens 查看。

视觉模型

生成

图片生成 模型采用按 Token 计费方式,后付费方式下,结算周期为小时结。
同一模型在不同参数配置下 Token 消耗数可能存在差异,生成费用可根据所选模型版本及参数,参考表格中的参数与费用进行测算,费用由 Token 单价 Token 用量 共同决定,具体计算公式为:
参考费用 = Token 用量 x Token 单价
各模型在不同参数配置下对应的 Token 用量,详见下方表格:
模型名称
功能
分辨率
Token 单价
Token 用量
折合参考费用
Hy-Image-3.0
文生图、参考生图
不区分
1.6 美元/百万 tokens
20,000 tokens/张
0.032 美元/张
Seedream-Image-v5.0-pro
文生图、参考生图
输出图≤261万像素
1.6 美元/百万 tokens
28,125 tokens/张
输入图片首张免费,第二张起1,875 tokens/张
0.045 美元/张
输入图片首张免费,第二张起0.003 美元/张
文生图、参考生图
输出图>261万像素
1.6 美元/百万 tokens
56,250 tokens/张
输入图片首张免费,第二张起1,875 tokens/张
0.09 美元/张
输入图片首张免费,第二张起0.003 美元/张
Seedream-Image-v5.0-lite
文生图、参考生图
不区分
1.6 美元/百万 tokens
21,875 tokens/张
0.035 美元/张
Vidu-Image-q2
文生图
1080P
1.6 美元/百万 tokens
18,750 tokens/张
0.03 美元/张
文生图
2K
25,000 tokens/张
0.04 美元/张
文生图
4K
31,250 tokens/张
0.05 美元/张
参考生图(1~3张)
1080P
25,000 tokens/张
0.04 美元/张
参考生图(1~3张)
2K
37,500 tokens/张
0.06 美元/张
参考生图(1~3张)
4K
62,500 tokens/张
0.1 美元/张
参考生图(4~7张)
1080P
31,250 tokens/张
0.05 美元/张
参考生图(4~7张)
2K
50,000 tokens/张
0.08 美元/张
参考生图(4~7张)
4k
93,750 tokens/张
0.15 美元/张
计费示例:
1. 成功调用 HY-Image-3.0 模型生成一张图片,使用功能为文生图,实际费用为 1 张 × 20,000 tokens/张 × 1.6 美元/百万 tokens = 0.032 美元。
2. 成功调用 Vidu-Image-q2 模型生成一张 4K 分辨率的图片,使用功能为参考生图(4~7张),实际费用为 1 张 × 93,750 tokens/张 × 1.6 美元/百万 tokens = 0.15 美元。
计费示例仅供费用计算方式参考,具体计费项、单价、消耗规则及最终费用以控制台展示和费用中心账单为准。

视频生成

视频生成 模型采用 按 Token 计费 方式,后付费方式下,结算周期为小时结。
同一模型在不同参数配置下 Token 消耗数可能存在差异,生成费用可根据所选模型版本及参数,参考表格中的参数与费用进行测算,费用由 Token 单价Token 用量 共同决定,具体计算公式为:
参考费用 = Token 用量 x Token 单价
各模型在不同参数配置下对应的 Token 用量,详见下方表格:
模型名称
生成功能
分辨率
Token 单价
Token 用量
折合参考费用
Hy-Video-1.5
文 / 图生视频
720P
1.6 美元/百万 tokens
30,000 tokens/秒
0.048 美元/秒
MiniMax-Video-H3
文 / 图生视频、参考生视频
768P
1.6 美元/百万 tokens
输入视频50,000 tokens/秒
输出视频50,000 tokens/秒
输入图片前5张免费,第六张起25,000 tokens/张
输入视频0.08 美元/秒
输出视频0.08 美元/秒
输入图片前5张免费,第六张起0.04 美元/张
2K
输入视频81,250 tokens/秒
输出视频81,250 tokens/秒
输入图片前5张免费,第六张起25,000 tokens/张
输入视频0.13 美元/秒
输出视频0.13 美元/秒
输入图片前5张免费第六张起0.04 美元/张
Kling-Video-V3
有声 - 未指定音色
720P
1.6 美元/百万 tokens
78,750 tokens/秒
0.126 美元/秒
有声 - 未指定音色
1080P
105,000 tokens/秒
0.168 元/秒
有声 - 未指定音色
4K
262,500 tokens/秒
0.42 元/秒
无声
720P
52,500 tokens/秒
0.084 元/秒
无声
1080P
70,000 tokens/秒
0.112 元/秒
无声
4K
262,500 tokens/秒
0.42 元/秒
动作控制
720P
78,750 tokens/秒
0.126 美元/秒
动作控制
1080P
105,000 tokens/秒
0.168 美元/秒
Kling-Video-v3-turbo
有声
720P
1.6 美元/百万 tokens
70,000 tokens/秒
0.112 美元/秒
1080P
87,500 tokens/秒
0.14 元/秒
Kling-Video-v3-omni
无参考视频 - 有声
720P
1.6 美元/百万 tokens
70,000 tokens/秒
0.112 美元/秒
无参考视频 - 有声
1080P
87,500 tokens/秒
0.14 美元/秒
无参考视频 - 有声
4K
262,500 tokens/秒
0.42 美元/秒
有参考视频 - 无声
720P
78,750 tokens/秒
0.126 美元/秒
有参考视频 - 无声
1080P
105,000 tokens/秒
0.168 美元/秒
有参考视频 - 无声
4K
262,500 tokens/秒
0.42 美元/秒
无参考视频 - 无声
720P
52,500 tokens/秒
0.084 美元/秒
无参考视频 - 无声
1080P
70,000 tokens/秒
0.112 美元/秒
无参考视频 - 无声
4K
262,500 tokens/秒
0.42 美元/秒
PixVerse-Video-v6
有声
360p
1.6 元/百万 tokens
19,444.44 tokens/秒
0.03111 元/秒
有声
540p
25,000 tokens/秒
0.04 元/秒
有声
720p
33,333.33 tokens/秒
0.05333 元/秒
有声
1080p
63,888.89 tokens/秒
0.10222 元/秒
无声
360p
13,888.89 tokens/秒
0.02222 元/秒
无声
540p
19,444.44 tokens/秒
0.03111 元/秒
无声
720p
25,000 tokens/秒
0.04 元/秒
无声
1080p
50,000 tokens/秒
0.08 元/秒
PixVerse-Video-c1
有声
360p
1.6 元/百万 tokens
22,222.22 tokens/秒
0.03556 元/秒
有声
540p
27,777.78 tokens/秒
0.04444 元/秒
有声
720p
36,111.11 tokens/秒
0.05778 元/秒
有声
1080p
66,666.67 tokens/秒
0.10667 元/秒
无声
360p
16,666.67 tokens/秒
0.02667 元/秒
无声
540p
22,222.22 tokens/秒
0.03556 元/秒
无声
720p
27,777.78 tokens/秒
0.04444 元/秒
无声
1080p
52,777.78 tokens/秒
0.08444 元/秒
计费示例:
成功调用 Kling-Video-v3 模型生成一段 1080P 分辨率 5 秒无声视频,实际费用为 5 秒 × 70,000 tokens/秒 × 1.6 美元/百万 tokens = 0.56 美元。
计费示例仅供费用计算方式参考,具体计费项、单价、消耗规则及最终费用以控制台展示和费用中心账单为准。

3D 生成

世界模型 采用 按 Token 计费 方式,后付费方式下,结算周期为小时结。
同一模型在不同参数配置下 Token 消耗数可能存在差异,生成费用可根据所选模型版本及参数,参考表格中的参数与费用进行测算,费用由 Token 单价Token 用量 共同决定,具体计算公式为:
参考费用 = Token 用量 x Token 单价
各模型在不同参数配置下对应的 Token 用量,详见下方表格:
模型名称
生成功能
Token 单价
Token 用量
折合参考费用
Hy-World-2.1-panorama
文 / 图生360° 全景图
1.6 美元/百万 tokens
481,250 tokens/个
0.77 美元/个
Hy-World-2.1-scene
文 / 图生3D 场景
7,687,500 tokens/个
12.3 美元/个
计费示例:
1. 成功调用 HY-World-2.1-panorama 模型生成一张全景图,实际费用为 1 个 × 481,250 tokens/个 × 1.6 美元/百万 tokens = 0.77 美元。
2. 成功调用 HY-World-2.1-scene 模型生成一次3D 场景,实际费用为 1 个 × 7,687,500 tokens/个 × 1.6 美元/百万 tokens = 12.3 美元。
计费示例仅供费用计算方式参考,具体计费项、单价、消耗规则及最终费用以控制台展示和费用中心账单为准。


帮助和支持

本页内容是否解决了您的问题?

填写满意度调查问卷,共创更好文档体验。

文档反馈