模型 | 模型 ID | 条件 | 未命中缓存输入的抵扣系数 | 输出的抵扣系数 | 命中缓存输入的抵扣系数 |
Auto 模型 | auto | - | 82 | 237 | 7 |
GLM-5.2 | glm-5.2 glm-5-2 | - | 154 | 482 | 29 |
Kimi-K2.6 | kimi-k2.6 kimi-k-2-6 | - | 115 | 474 | 20 |
DeepSeek-V4-Pro 0813 正式版 原厂直供 | deepseek-v4-pro-202606 deepseek/deepseek-v4-pro-0813 deepseek/deepseek-v4-pro | 空闲时段 | 94.286 | 282.857 | 3.143 |
| | 高峰时段 | 188.571 | 565.714 | 6.286 |
DeepSeek-V4-Flash 0731 正式版 原厂直供 | deepseek-v4-flash-202605 deepseek/deepseek-v4-flash-0731 deepseek/deepseek-v4-flash | 空闲时段 | 31.429 | 94.286 | 1 |
| | 高峰时段 | 62.857 | 188.571 | 2 |
MiniMax-M3 | minimax-m3 | 输入长度(tokens) ≤ 512k | 47 | 188 | 10 |
| | 输入长度(tokens) > 512k | 94 | 375 | 19 |
单次请求的积分消耗= (命中缓存输入的 Token 数 × 命中缓存输入的抵扣系数 +未命中缓存输入的 Token 数 × 未命中缓存输入的抵扣系数 +输出的 Token 数 × 输出的积分系数)/1,000,000= (50000 × 20 + 10000 × 115 + 500 × 474) / 1000000= 2.387
文档反馈