1. 语音模型
silievo用户使用手册
  • token配置和使用手册
    • 01-概要
    • 02-模型、价格
    • 03-模型接入
    • 04-常见问题
    • 05-合作伙伴与法律声明
    • 06-联系我们
    • 周活动特辑-免费模型接入指南
    • 视频模型
      • wan2.7视频模型接口
      • happyhorse视频模型接口
    • 向量模型
      • 向量模型接口
    • 语音模型
      • 语音合成接口
      • 音色创建接口
    • 文件上传
      • 文件上传接口
    • cc-switch接入各种工具
      • CC-Switch接入claude code命令行版
      • cc-switch接入claude code桌面版
    • 图像模型
      • gpt-image-2生图接入
  1. 语音模型

音色创建接口

音色创建接入指南#

概述#

本文档介绍如何通过 API 使用 SiliEvo 平台的音色创建(Voice Customization)服务,支持通过上传音频样本创建自定义音色,用于个性化语音合成。

前提条件#

请牢记 SiliEvo 中转服务的核心两要素:
1.
中转基地址 (Base URL): https://api.numspirit.com/
2.
安全秘钥 (API Key / Token): 通过平台官网 https://numspirit.com 或联系 15685255305 申请,形如 sk-silievo-xxxxxxxx

支持的模型#

模型说明
cosyvoice-v3.5-plus阿里云 CosyVoice 高级语音合成模型,支持自定义音色

接口说明#

请求 Header#

Content-Type: application/json
Authorization: Bearer sk-silievo-xxxxxxxx

音色创建接口#

接口信息#

属性说明
接口地址POST https://api.numspirit.com/v1/audio/tts/customization
模型voice-enrollment
计费模式按次计费,每次调用固定扣费 0.01 元

请求参数#

重要提示:当使用 cosyvoice-v3.5-plus 模型时,以下参数为固定值,无需修改,只需根据实际情况填写 prefix(音色前缀标识)和 url(音频样本 URL)即可。
{
    "model": "voice-enrollment",
    "input": {
        "action": "create_voice",
        "target_model": "cosyvoice-v3.5-plus",
        "prefix": "trump",
        "url": "https://numspirit-media.oss-cn-shenzhen.aliyuncs.com/users/15/uploads/2026-07/4785256dc0844a66b31bd0bd9b8ef210.mp3"
    }
}
参数说明:
参数类型必填固定值说明
modelstring是voice-enrollment固定为 voice-enrollment,标识音色创建接口
input.actionstring是create_voice固定为 create_voice(创建音色)
input.target_modelstring是cosyvoice-v3.5-plus固定为 cosyvoice-v3.5-plus
input.prefixstring是—需自定义,音色前缀标识,用于生成音色 ID,如 trump
input.urlstring是—需自定义,音频样本 URL,必须是可访问的音频文件
注意:音频样本要求音质清晰,建议时长 3-10 秒,采样率 16kHz 以上。支持的音频格式包括 WAV、MP3 等。

响应示例#

{
    "request_id": "0f91575f-3a9c-9ca7-a520-527b64702072",
    "usage": {
        "count": 1
    },
    "output": {
        "preview_audio": {},
        "voice_id": "cosyvoice-v3.5-plus-trump-108553d0ff844b84a1e13684f9a1019f"
    }
}
响应字段说明:
字段类型说明
request_idstring请求唯一标识
usage.countinteger调用次数,固定为 1
output.preview_audioobject预览音频信息(可能为空对象)
output.voice_idstring创建的音色 ID,格式为 cosyvoice-v3.5-plus-{prefix}-{随机字符串},可用于语音合成

cURL 示例#


使用自定义音色进行语音合成#

创建音色后,您可以在语音合成接口中使用自定义音色。自定义音色 ID 格式为 cosyvoice-v3.5-plus-{prefix}-{随机字符串}:
{
    "model": "cosyvoice-v3.5-plus",
    "input": {
        "text": "欢迎使用自定义音色进行语音合成!",
        "voice": "cosyvoice-v3.5-plus-trump-108553d0ff844b84a1e13684f9a1019f",
        "format": "mp3"
    }
}
提示:自定义音色 ID 格式为 cosyvoice-v3.5-plus-{prefix}-{随机字符串},创建后请妥善保存。

完整代码示例#

Python#

Node.js / TypeScript#

Java#


第四部分:应用场景#

常见用途#

1.
个性化语音助手 - 为智能助手创建独特的音色,提升品牌辨识度
2.
有声读物配音 - 使用特定人物音色批量生成有声内容
3.
游戏角色配音 - 为游戏角色创建专属音色,增强沉浸感
4.
营销视频配音 - 使用品牌专属音色制作宣传视频
5.
多语言本地化 - 保持同一音色跨语言合成,确保品牌一致性

附录:错误码速查表#

错误类型HTTP 状态码说明解决方案
auth_error401认证失败,API Key 无效或未提供检查 Authorization Header 格式
quota_exceeded402额度已用尽充值或联系客服
invalid_request400请求参数错误检查请求体 JSON 格式和必填字段
no_channel503模型未配置有效渠道检查 target_model 参数是否正确
upstream_error502/500上游 API 错误稍后重试或联系客服

注意事项#

1.
音频样本质量:建议使用清晰、无噪音的 WAV 格式音频,时长 3-10 秒
2.
音色 ID 有效期:创建的音色 ID 长期有效,请妥善保存
3.
计费说明:音色创建按次计费,每次调用固定扣费 0.01 元,与音频样本时长无关
4.
并发限制:每个 Token 有速率限制,请参考 API 文档
5.
音频 URL 要求:音频样本 URL 必须可公开访问,建议使用文件上传接口获取

技术支持: 如有任何问题,请联系客服微信或加入服务群获取帮助。
修改于 2026-07-08 23:35:25
上一页
语音合成接口
下一页
文件上传接口
Built with