1. 图像模型
silievo用户使用手册
  • token配置和使用手册
    • 01-概要
    • 02-模型、价格
    • 03-模型接入
    • 04-常见问题
    • 05-合作伙伴与法律声明
    • 06-联系我们
    • API KEY获取指南
    • 视频模型
      • wan2.7视频模型接口
      • happyhorse视频模型接口
      • seedance模型
        • seedance视频接入
        • seedance视频素材接入文档
    • 向量模型
      • 向量模型接口
    • 语音模型
      • 语音合成接口
      • 音色创建接口
      • 语音转录接口
    • 文件上传
      • 文件上传接口
    • 常见AI工具接入
      • cc-switch接入claude code命令行版
      • cc-switch接入claude code桌面版
      • Claude-Desktop接入指南
      • Codex 桌面版安装配置指南
      • Traw work接入指南
      • workbuddy接入指南
    • 图像模型
      • gpt-image-2生图接入
      • nano banana生图接入
      • qwen-image-3.0-pro生图接入
      • 常见生图、图生图curl示例
  1. 图像模型

nano banana生图接入

SiliEvo nano banana 生图模型接入指南#

1. 接口概览#

功能接口路径方法说明
图片生成/v1/images/generationsPOST文生图(同步返回)
图片编辑/v1/images/editsPOST图生图编辑(同步返回)
Base URL: https://api.numspirit.com/

2. 认证方式#

所有请求需要在 HTTP Header 中携带认证信息:
Content-Type: application/json    # 图片生成接口
Content-Type: multipart/form-data  # 图片编辑接口
Authorization: Bearer sk-silievo-xxxxxxxxxxxxxxxxxxxx
注意: sk-silievo- 开头的 API Key 需要通过平台官网 https://numspirit.com 申请。

3. 图片生成接口(/v1/images/generations)#

3.1 请求参数#

请求体结构#

参数说明#

参数类型必填说明
promptstring是提示词,描述要生成的图片内容。支持中英文,建议详细描述以获得更好效果。
modelstring是模型名称,可选值:vp/gemini-3-pro-image、vp/gemini-3.1-flash-image、vp/gemini-3.1-flash-lite-image
sizestring是图片尺寸,可选值见下表
qualitystring是图片质量,可选值:low(低)、medium(中)、high(高)
output_compressioninteger否输出压缩比例,默认 100(100%不压缩),范围 1-100
output_formatstring否输出格式,默认 png,可选值:png、jpeg、webp
ninteger否生成数量,默认 1,范围 1-10

支持的图片尺寸#

尺寸说明
1024x1024正方形
1024x1536竖屏
1536x1024横屏
auto自动选择

3.2 返回值格式#

成功响应#

{
  "created": 1784686812,
  "data": [
    {
      "b64_json": "iVBORw0KGgoAAAANSUhEUgAABOYAAATmCAIAAAAKnjl9AABKMGNhQlgAAEowanVtYgAAAB5qdW1kYzJwYQARABCAAACqADibcQNjMnBhAAAASgpqdW1iAAAAR2p1bWRjMm1hABEAEIAAAKoAOJtxA3VybjpjMnBhOmI0N2RmOTViLWIwMTktNDNhZi05MDliLTBlNzFhNGRmZjA2YwAAAAQjanVtYgAAAClqdW1kYzJhcwARABCAAACqADibcQNjMnBhLmFzc2VydGlvbnMAAAACGGp1bWIAAABBanVtZGNib3IAEQAQgAAAqgA4m3ETYzJwYS5hY3Rpb25zLnYyAAAAABhjMnNomaStbyqagIS827lY66f5iAAAA+DYrMYQiZ3OycxLNn1A5277z7TnBYiMnEIQYRAADGDINsbal/gvwbQ50wzBoyxnfu3Pll989Dhg5J+CChkVQOq+8DQjijSSQRIQQbYqEOVQhnAGP8f+bwHhSO1ei2AAAAAElFTkSuQmCC",
    }
  ],
  "usage": {
    "total_tokens": 3373,
    "input_tokens": 2253,
    "output_tokens": 1120,
    "input_tokens_details": {
      "text_tokens": 13,
      "image_tokens": 2240
    }
  }
}

响应字段说明#

字段类型说明
createdinteger响应创建时间戳
dataarray生成的图片数据数组
data[].b64_jsonstring图片的 Base64 编码数据
usageobjectToken 使用统计
usage.input_tokensinteger输入 Token 总数
usage.input_tokens_details.image_tokensinteger输入图片 Token 数(核验参考:纯文生图=0,1 张输入图约 1120,多图按张数累加)
usage.input_tokens_details.text_tokensinteger输入文本 Token 数
usage.output_tokensinteger输出 Token 总数
usage.total_tokensinteger总 Token 数

3.3 多图 JSON 编辑(参考图合并/替换)#

在 /v1/images/generations 的请求体中通过 images 数组携带一张或多张参考图,实现"把参考图合并进底图""替换图中某个区域"等多图场景(nano banana 上游原生支持一个 parts 含多张 inlineData)。

请求体结构#

images 数组元素为 {"image_url": "..."},支持两种形式:
base64 data URI:data:image/jpeg;base64,xxxx(推荐,图片经网关直传上游)
普通 URL:https://.../图片.jpg(网关自动下载图片转 base64 再传上游)
图片编号规则:文本提示在前,参考图按 images 数组顺序编号——images[0] 即"第一张图片",images[1] 即"第二张图片",以此类推。prompt 里的"第一张/第二张"即指该顺序
图片可多张混用 base64 与 URL,顺序以数组为准
file_id 暂不支持(网关未实现 /v1/files),传了会报错,请用 image_url
注意:URL 请传未编码的原始地址(如含中文文件名直接传原文)。已做百分号编码的 URL(如 %E6%B2%99)会被网关二次编码导致 404。

单参考图#

核验方式#

响应 usage.input_tokens_details.image_tokens 可作为"图是否进上游"的依据:纯文生图为 0;1 张输入图约 1120;2 张约 2240(按张数累加)。若多图场景下 image_tokens 明显偏小,说明参考图未正确传递。

4. 图片编辑接口(/v1/images/edits)#

4.1 请求参数#

请求体结构(multipart/form-data)#

参数说明#

参数类型必填说明
imagefile是原始图片文件,支持 PNG、JPEG、WEBP 格式
maskfile否遮罩图片文件(可选),用于指定编辑区域
promptstring是编辑提示词,描述要对图片进行的修改。支持中英文
modelstring是模型名称,可选值:vp/gemini-3-pro-image、vp/gemini-3.1-flash-image、vp/gemini-3.1-flash-lite-image
注意: 如果不传 mask,则会对整张图片进行编辑。
重要(nano banana): 当前版本 nano banana 渠道的 mask 不会透传给上游(只有原图进请求,遮罩被丢弃)。如需"只编辑指定区域",当前请改用 3.3 的多图 JSON 方式:把原图与遮罩都放进 images 数组,并用 prompt 文字描述遮罩区域。mask 结构化透传为平台待办能力。

4.2 返回值格式#

成功响应#

{
  "created": 1784687644,
  "data": [
    {
      "b64_json": "/9j/4AAQSkZJRgABAQAAAQABAAD/7QBQUGhvdG9zaG9wIDMuMAA4QklNBAQAAAAAABgcAm4AE01hZGUgd2l0aCBHb29nbGUgQUk4QklNBCUAAAAAABDIs4lltEU3qRin51mYyOP2/hvKc0pcliiq6qGpr0hWOSoSIojOFtq0lvE3q2lNZu2hb2Hif2ncHZxmXEklDCZ6ivlnZdnZTcE6pHYECOJF8TMbKiD6DHtd259rEFHCoZwWbxaV8RsB6D18sVr7F8rjo8wq821Q86usWLEaootjyxfoSbF+lyAPLGdypYsV3Yuwf8AU+VU9PNMaurWMCoq3uzux35aM5LiGP4I1J3VdRAZjhf96jvLUVAGgknTmhC7KGBZFttcDoW8h1xX7vP/AKUpKNXpaBVlqbFWksTHGem332Hp0v1Pljyk417QqmtnknqJXkklYu7MSSxPr5WHQDoBthZqv//Z"
    }
  ],
  "usage": {
    "total_tokens": 2251,
    "input_tokens": 1131,
    "output_tokens": 1120,
    "input_tokens_details": {
      "text_tokens": 11,
      "image_tokens": 1120
    }
  }
}

响应字段说明#

字段类型说明
createdinteger响应创建时间戳
dataarray编辑后的图片数据数组
data[].b64_jsonstring编辑后图片的 Base64 编码数据
usageobjectToken 使用统计(同图片生成接口)
usage.input_tokensinteger输入 Token 总数
usage.output_tokensinteger输出 Token 总数
usage.total_tokensinteger总 Token 数
usage.input_tokens_details.text_tokensinteger输入文本 Token 数
usage.input_tokens_details.image_tokensinteger输入图片 Token 数

5. 错误处理#

HTTP 状态码错误码说明
400invalid_request请求参数错误,如缺少必填字段
401unauthorizedAPI Key 无效或已过期
403forbidden无权限访问该模型
429rate_limit请求频率超限
500internal_error服务器内部错误

6. 常见问题#

Q1: 图片生成和图片编辑有什么区别?#

功能输入输出适用场景
图片生成文本提示词全新图片根据描述创建图片
图片编辑原始图片 + 文本提示词修改后的图片对现有图片进行修改

Q2: 图片编辑的 mask 参数有什么作用?#

mask 是可选参数。如果不传,编辑会应用于整张图片;如果传入,只有 mask 指定的区域会被编辑。注意:nano banana 渠道当前 mask 不会透传上游(详见 4.1 重要提示),遮罩区域请改用多图 JSON + prompt 描述实现。

Q3: 支持哪些图片格式?#

支持 PNG、JPEG、WEBP 格式。建议使用 PNG 格式以获得最佳质量。

Q4: 三个 nano banana 模型有什么区别?#

模型名称特点适用场景
vp/gemini-3-pro-image质量最高,生成细节最丰富需要高质量图片的场景
vp/gemini-3.1-flash-image速度快,质量较好平衡质量和速度的场景
vp/gemini-3.1-flash-lite-image速度最快,成本最低快速生成、成本敏感的场景
修改于 2026-08-10 14:27:18
上一页
gpt-image-2生图接入
下一页
qwen-image-3.0-pro生图接入
Built with