所有价格以元 / 百万 Tokens 为单位。价格可能根据平台活动及供给调整,最终以平台账单为准。
| 计费项 | 说明 |
|---|---|
| 输入 Token | 用户发送给模型的内容:文本、上下文、系统提示词等 |
| 输出 Token | 模型生成的回复内容 |
| 缓存命中 | 请求复用已存在缓存上下文时,以更低单价计费 |
| 缓存未命中 | 需重新计算推理时,按标准输入价格计费 |
| 显式缓存创建 | 适用 Qwen 模型,主动创建缓存时的费用 |
| 显式缓存命中 | 显式缓存被命中时,价格为创建价格的 10% |
qwen3.6-flash 或 deepseek-v4-flash,成本远低于 Pro 版deepseek-v4-pro 支持超长输出(384K),适合深度分析