1. 语音模型
silievo用户使用手册
  • token配置和使用手册
    • 01-概要
    • 02-模型、价格
    • 03-模型接入
    • 04-常见问题
    • 05-合作伙伴与法律声明
    • 06-联系我们
    • 周活动特辑-免费模型接入指南
    • 视频模型
      • wan2.7视频模型接口
      • happyhorse视频模型接口
    • 向量模型
      • 向量模型接口
    • 语音模型
      • 语音合成接口
      • 音色创建接口
    • 文件上传
      • 文件上传接口
    • cc-switch接入各种工具
      • CC-Switch接入claude code命令行版
      • cc-switch接入claude code桌面版
    • 图像模型
      • gpt-image-2生图接入
  1. 语音模型

语音合成接口

语音合成模型接入指南#

概述#

本文档介绍如何通过 API 使用 SiliEvo 平台的语音合成(Text-to-Speech, TTS)服务,将文本转换为自然流畅的语音。

前提条件#

请牢记 SiliEvo 中转服务的核心两要素:
1.
中转基地址 (Base URL): https://api.numspirit.com/
2.
安全秘钥 (API Key / Token): 通过平台官网 https://numspirit.com 或联系 15685255305 申请,形如 sk-silievo-xxxxxxxx

支持的模型#

模型说明
cosyvoice-v3-flash阿里云 CosyVoice 语音合成模型,支持多种音色

接口说明#

请求 Header#

Content-Type: application/json
Authorization: Bearer sk-silievo-xxxxxxxx

语音合成接口#

接口信息#

属性说明
接口地址POST https://api.numspirit.com/v1/audio/tts
模型cosyvoice-v3-flash
计费模式按字符数计费

请求参数#

{
    "model": "cosyvoice-v3-flash",
    "input": {
        "text": "今天天气太棒了,我该去哪里玩呢?",
        "voice": "longanhuan",
        "format": "mp3"
    }
}
参数说明:
参数类型必填说明
modelstring是模型名称,固定为 cosyvoice-v3-flash
input.textstring是要合成的文本内容
input.voicestring是音色名称,如 longanhuan、longanyang 等
input.formatstring是音频格式,可选值:mp3、wav、pcm
提示:voice 参数支持系统内置音色(如 longanhuan)和自定义音色(通过音色创建接口生成,格式为 cosyvoice-v3.5-plus-{prefix}-{随机字符串})。

响应示例#

{
    "output": {
        "audio": {
            "data": "",
            "expires_at": 1783639261,
            "id": "audio_b9b56240-41b9-9077-a2cc-cc334309d00e",
            "url": "http://dashscope-result-bj.oss-cn-beijing.aliyuncs.com/prod/cosyvoice-v3-flash/20260709/1498978315340840/b9b56240-41b9-9077-a2cc-cc334309d00e.mp3?Expires=1783639261&OSSAccessKeyId=LTAI5tGzqbGcEmE58b221XQy&Signature=aaWNCDAHgYywxldosBwh6DIwoPo%3D"
        },
        "finish_reason": "stop"
    },
    "usage": {
        "characters": 30
    },
    "request_id": "b9b56240-41b9-9077-a2cc-cc334309d00e"
}
响应字段说明:
字段类型说明
output.audio.urlstring合成后的音频文件 URL
output.audio.idstring音频文件唯一标识
output.audio.expires_atintegerURL 过期时间戳(Unix 时间戳)
output.finish_reasonstring完成原因,stop 表示正常完成
usage.charactersinteger消耗的字符数
request_idstring请求唯一标识

cURL 示例#


音色列表#

音色名称说明
longanyang通用男声
longanhuan通用女声
提示:更多音色请联系客服获取。
详情请参考:https://bailian.console.aliyun.com/cn-beijing/?tab=doc#/doc/?type=model&url=2879134

完整代码示例#

Python#

Node.js / TypeScript#

Java#


第四部分:应用场景#

常见用途#

1.
有声读物 - 将电子书、文章批量转为语音
2.
智能客服 - 为聊天机器人添加语音回复能力
3.
导航播报 - 将导航指令转为语音播报
4.
内容创作 - 为视频、播客生成配音
5.
无障碍辅助 - 为视障用户朗读屏幕内容

附录:错误码速查表#

错误类型HTTP 状态码说明解决方案
auth_error401认证失败,API Key 无效或未提供检查 Authorization Header 格式
quota_exceeded402额度已用尽充值或联系客服
invalid_request400请求参数错误检查请求体 JSON 格式和必填字段
no_channel503模型未配置有效渠道检查 model 参数是否正确
upstream_error502/500上游 API 错误稍后重试或联系客服

注意事项#

1.
音频 URL 有效期:返回的音频 URL 有过期时间,请及时下载保存
2.
文本长度限制:单次请求文本长度建议不超过 5000 字符
3.
特殊字符:文本中的特殊字符(如 emoji)可能不被支持,建议提前过滤
4.
并发限制:每个 Token 有速率限制,请参考 API 文档

技术支持: 如有任何问题,请联系客服微信或加入服务群获取帮助。
修改于 2026-07-08 23:36:52
上一页
向量模型接口
下一页
音色创建接口
Built with