1. token配置和使用手册
silievo用户使用手册
  • token配置和使用手册
    • 01-概要
    • 02-模型、价格
    • 03-模型接入
    • 04-常见问题
    • 05-合作伙伴与法律声明
    • 06-联系我们
    • API KEY获取指南
    • 视频模型
      • wan2.7视频模型接口
      • happyhorse视频模型接口
      • seedance模型
        • seedance视频接入
        • seedance视频素材接入文档
    • 向量模型
      • 向量模型接口
    • 语音模型
      • 语音合成接口
      • 音色创建接口
      • 语音转录接口
    • 文件上传
      • 文件上传接口
    • 常见AI工具接入
      • cc-switch接入claude code命令行版
      • cc-switch接入claude code桌面版
      • Claude-Desktop接入指南
      • Codex 桌面版安装配置指南
      • Traw work接入指南
      • workbuddy接入指南
    • 图像模型
      • gpt-image-2生图接入
      • nano banana生图接入
      • qwen-image-3.0-pro生图接入
      • 常见生图、图生图curl示例
  1. token配置和使用手册

02-模型、价格

02. 模型支持列表与收费标准#

所有价格以元 / 百万 Tokens 为单位。价格可能根据平台活动及供给调整,最终以平台账单为准。

详情可看网站模型广场那里的列表、价格
国外站:https://numspirit.com/models/
国内站:https://www.silievo.com/models/
9d6dcb85-75f7-4a19-a81b-57374ae6e016.png

📋 计费规则说明#

计费项说明
输入 Token用户发送给模型的内容:文本、上下文、系统提示词等
输出 Token模型生成的回复内容
缓存命中请求复用已存在缓存上下文时,以更低单价计费
缓存未命中需重新计算推理时,按标准输入价格计费
显式缓存创建适用 Qwen 模型,主动创建缓存时的费用
显式缓存命中显式缓存被命中时,价格为创建价格的 10%

💡 成本优化建议#

1.
高并发长对话场景 → 优先选择 qwen3.6-flash 或 deepseek-v4-flash,成本远低于 Pro 版
2.
固定 System Prompt 场景 → 保持提示词结构一致,最大化触发 KV 缓存命中,降低输入费用
3.
大批量离线任务 → 使用 Batch 模式,输入输出成本各降低 50%
4.
复杂推理场景 → deepseek-v4-pro 支持超长输出(384K),适合深度分析
修改于 2026-08-10 02:32:24
上一页
01-概要
下一页
03-模型接入
Built with