控制台 ↗
生图模型Gemini Native

gemini-3.1-flash-image

支持 512 / 1K / 2K / 4K 原生图像生成

能力概览

输入

文本参考图

输出

图片文本

文本生图

支持 512、1K、2K 与 4K 输出。

参考图生成

可编辑参考图、组合多张图片并保持主体。

人物一致性

适合角色连续性和多轮细化。

参考图最多 14 张

主体保持最多 10 个物体、4 个角色

内联请求参考图与文本合计小于 20 MB

生成与编辑图像

POSThttps://www.yunqiai.chat/v1beta/models/gemini-3.1-flash-image:generateContent

生成与编辑共用 Gemini Generate Content:只传文字时生成图片,加入 inlineData 参考图时进行编辑。

请求参数与范围

参数类型说明
contents必填array文本与参考图片输入;图片使用 inlineData
contents[].rolestringuser 或 model;单轮请求可省略,多轮编辑按对话顺序填写
contents[].parts[].textstring提示词;输入上下文最多 131,072 tokens
contents[].parts[].inlineDataobjectBase64 参考图;可与 text 放在同一个 parts 数组中
systemInstructionobject可选系统指令;计入输入上下文与请求体大小
generationConfig.responseModalitiesstring[]TEXT、IMAGE 或二者;只要图片可设为 ["IMAGE"]
generationConfig.imageConfig.aspectRatiostring1:1、1:4、1:8、2:3、3:2、3:4、4:1、4:3、4:5、5:4、8:1、9:16、16:9、21:9
generationConfig.imageConfig.imageSizestring512、1K、2K、4K;K 必须大写
safetySettingsarray可选安全策略;不要同时为同一类别传入重复设置
inlineData.mimeTypestringimage/png、image/jpeg、image/webp、image/heic、image/heif
inlineData.datastring裸 Base64 数据,不包含 data:image/... 前缀

比例与实际像素

Gemini 3.1 Flash Image 可生成 512、1K、2K、4K 图片。

宽高比5121K2K4K
1:1512×5121024×10242048×20484096×4096
1:4256×1024512×20481024×40962048×8192
1:8192×1536384×3072768×61441536×12288
2:3424×632848×12641696×25283392×5056
3:2632×4241264×8482528×16965056×3392
3:4448×600896×12001792×24003584×4800
4:11024×2562048×5124096×10248192×2048
4:3600×4481200×8962400×17924800×3584
4:5464×576928×11521856×23043712×4608
5:4576×4641152×9282304×18564608×3712
8:11536×1923072×3846144×76812288×1536
9:16384×688768×13761536×27523072×5504
16:9688×3841376×7682752×15365504×3072
21:9792×1681584×6723168×13446336×2688

常用参数组合

imageConfig输出尺寸
512 · 1:1512×512
1K · 16:91376×768
2K · 3:22528×1696
4K · 1:14096×4096

比例怎么选

宽高比适合场景
1:1头像、商品主图、社交媒体方图
3:2 / 2:3照片、横版或竖版构图
4:3 / 3:4演示配图、文章插图
16:9 / 9:16横版封面、竖版短视频封面
21:9超宽横幅
1:4 / 4:1 / 1:8 / 8:1长条海报、页面横幅

参考图生成

把参考媒体放在 parts 中,再写清楚要保留和要修改的内容。输出图片仍从 inlineData.data 读取。

能力可用范围
参考图总数最多 14 张
物体保持最多 10 个
人物一致性最多 4 个角色
风格参考随参考图一并描述
JSON · reference image
{
  "contents": [
    {
      "parts": [
        {
          "text": "保留主体,把背景改成夜景"
        },
        {
          "inlineData": {
            "mimeType": "image/png",
            "data": "BASE64_IMAGE_DATA"
          }
        }
      ]
    }
  ],
  "generationConfig": {
    "responseModalities": [
      "IMAGE"
    ],
    "imageConfig": {
      "aspectRatio": "1:1",
      "imageSize": "512"
    }
  }
}

Base64 参考图

输入字段只放裸 Base64;输出位于 candidates[].content.parts[].inlineData.data

JSON · Base64
{
  "contents": [
    {
      "parts": [
        {
          "text": "保留主体,把背景改成夜景"
        },
        {
          "inlineData": {
            "mimeType": "image/png",
            "data": "BASE64_IMAGE_DATA"
          }
        }
      ]
    }
  ],
  "generationConfig": {
    "responseModalities": [
      "IMAGE"
    ],
    "imageConfig": {
      "aspectRatio": "1:1",
      "imageSize": "512"
    }
  }
}

请求示例

curl · text to image
curl --request POST \
  --url https://www.yunqiai.chat/v1beta/models/gemini-3.1-flash-image:generateContent \
  --header "x-goog-api-key: YOUR_API_KEY" \
  --header "Content-Type: application/json" \
  --data '{
    "contents": [
      {
        "parts": [
          {
            "text": "生成一张雨后的未来城市,霓虹倒影,电影感构图"
          }
        ]
      }
    ],
    "generationConfig": {
      "responseModalities": [
        "IMAGE"
      ],
      "imageConfig": {
        "aspectRatio": "1:1",
        "imageSize": "512"
      }
    }
  }'

响应结构

JSON
{
  "candidates": [
    {
      "content": {
        "role": "model",
        "parts": [
          {
            "inlineData": {
              "mimeType": "image/png",
              "data": "BASE64_IMAGE_DATA"
            }
          }
        ]
      },
      "finishReason": "STOP"
    }
  ],
  "modelVersion": "gemini-3.1-flash-image"
}
YunQi AI 开放平台文档 · 客户接入与参数参考模型目录更新于 2026-08-06