1. Google Gemini接口
147API接口文档
  • 默认模块
    • 必看一 快速上手调用147ai 大模型
    • 必看二 站点模型分组介绍
    • 必看三 倍率介绍
    • 主流工具安装/接入147API 教程
      • claude code安装教程(win/mac)
      • GPT-codex安装教程
      • chatbox接入教程
      • cherry studio接入教程
      • CC Switch接入147ai教程
      • VScode安装cc插件教程(未安装CC终端使用)
      • Cursor接入147ai教程
      • Trae 接入147ai教程
      • Gemini cli 接入147ai教程
      • openclaw接入147ai教程
      • OpenClaw Web界面接入147ai教程
      • WorkBuddy接入147ai教程
      • opencode接入147ai教程
      • codex桌面版接入147ai教程
      • Claude Desktop接入147ai教程
      • Hermes Agent安装接入147ai教程
      • 腾讯云openclaw 接入147ai教程
      • Dify 配置使用147ai教程
      • n8n 配置使用147ai 教程
      • coze使用147ai教程
      • MiMoCode CLI接入147ai教程
      • Hermes Agent CLI 安装接入147AI-CC Switch
      • Windsurf接入147ai教程
      • Aider接入147ai教程
      • Continue接入 147ai 教程
      • Cline 接入 147ai 教程
      • ArkClaw 接入 147ai 教程
    • 模型接口
      • Openai
        • 文本生成
        • 图片理解
        • 图片编辑 (gpt-image-2)
        • 图片生成(gpt-image-2)
        • 图片编辑 (gpt-image-2-client)
        • 图片生成 (gpt-image-2-client)
        • 图片编辑 / 网页版
        • 函数调用 tools
        • v1/Responses / 通用
        • 创建文本嵌入
        • 批量创建嵌入
        • 文本转语音 / TTS
        • 语音转文本 / whisper-1
        • 语音转文本 / gpt-4o-transcribe
        • 音频翻译
        • Audio接口 / 输出
        • Audio接口 / 输入
        • 内容补全接口
        • 创建内容审核
        • PDF文件分析-chat
        • 文件分析
        • deep-research / 深度研究
        • Web search / 联网搜索
        • response_format
      • Anthropic
        • 原生接口
          • 文本生成
          • 图片理解
          • 文本生成 / 强制返回思考
          • 函数调用
          • Web search / 联网搜索
        • OpenAI兼容接口
          • 文本生成
          • 图片理解
          • 文本生成 / 强制返回思考
          • 函数调用
          • Web search / 联网搜索
      • Google
        • OpenAI兼容接口
          • 文本生成
          • 文本生成 / 强制返回思考
          • 图片理解
          • 图片生成
          • 图片修改
          • 图片编辑(Nano-banana)
          • 图片生成 / Imagen 4
          • 音频理解
          • 视频理解
          • 文本转语音 / TTS
        • Google Gemini接口
          • 文本生成
            POST
          • 文字转语音
            POST
          • 音频转文
            POST
          • 视频转文
            POST
          • 图片理解
            POST
          • 图片生成
            POST
          • 图片编辑(Nano-banana 支持比例)
            POST
      • 豆包
        • doubao-seedream-4-0-250828-文生图
        • doubao-seedream-4-0-250828-图生图
        • doubao-seedream-4-0-250828-多图生图
      • sora2
        • 官方格式
          • 创建视频
          • 视频状态
          • 获取视频
      • veo
        • 图生视频
        • 获取视频
        • 图生视频(chat格式)
      • Midjourney
        • 文生图(Imagine)
        • 图片融合(Blend)
        • 按钮点击(Action)
        • 窗口执行(Modal)
        • 生成视频(Video)
        • 图生文(Describe)
        • 编辑图片(Edit)
        • 上传(upload)
        • 换脸(FaceSwap)
        • 缩短提示词(Shorten)
        • 查询
        • 获取种子(Seed)接口
        • 批量查询
        • 文生图 / OpenAI兼容
      • omni
        • 创建视频生成任务(omni-fast / omni-fast-v2v)
        • 查询视频任务状态
        • 获取视频内容
      • Grok
        • Videos
          • 创建 Grok 视频任务(生成 / 编辑)
          • 查询 Grok 视频任务状态
      • Seedance 2.0 视频
        • 创建 Seedance 视频任务(文生 / 图生 / 全能参考 / 首尾帧)
        • 查询视频任务状态 / 获取成片
    • 平台API接口文档
      • 后台接口鉴权填写说明
      • 系统
        • 获取系统状态
        • 获取公告
        • 获取用户协议
        • 获取隐私政策
        • 获取关于信息
        • 获取首页内容
        • 获取定价信息
        • 获取模型列表
        • 获取模型定价配置
      • 用户登陆注册
        • 发送邮箱验证码
        • 发送密码重置邮件
        • 重置密码
        • 用户注册
        • 用户登录
        • 两步验证登录
        • 用户登出
        • 获取用户分组列表
      • 用户管理
        • 获取当前用户分组
        • 获取当前用户信息
        • 更新当前用户信息
        • 注销当前用户
        • 获取用户可用模型
        • 生成访问令牌
        • 获取邀请码
        • 转换邀请额度
        • 更新用户设置
      • 充值
        • 获取充值信息
        • 获取用户充值记录
        • 发起支付宝充值
        • 获取支付宝充值金额
      • 两步验证
        • 获取2FA状态
        • 设置2FA
        • 启用2FA
        • 禁用2FA
        • 重新生成备用码
      • 安全验证
        • 通用安全验证
        • 获取验证状态
      • 令牌管理
        • 通过令牌id获取明码密钥
        • 获取所有令牌
        • 创建令牌
        • 更新令牌
        • 搜索令牌
        • 获取指定令牌
        • 删除令牌
        • 批量删除令牌
        • 获取令牌使用情况
      • 日志
        • 获取个人日志统计
        • 获取个人日志
        • 通过令牌获取日志
        • 查询日志导出权限
        • 获取个人日志导出任务列表
        • 创建个人日志导出任务
        • 获取个人日志导出任务详情
        • 取消个人日志导出任务
        • 下载个人日志导出文件
      • 数据统计
        • 获取个人额度数据
      • 任务
        • 获取个人Midjourney任务
        • 获取个人任务
    • 数据模型
      • Log
      • VideoTask
      • Model
      • CreateVideoRequest
      • VideoTaskStatus
      • User
      • ErrorResponse
      • ListModelsResponse
      • CreateVideoResponse
      • Token
      • CreateChatCompletionRequest
      • CreateOmniFastVideoJsonRequest
      • TaskError
      • SyncErrorResponse
      • ChatMessage
      • CreateOmniFastV2VVideoJsonRequest
      • ReferenceImage
      • ChatCompletionResponse
      • VideoTaskData
      • ErrorDetail
      • CreateImageGenerationRequest
      • ImageGenerationResponse
      • CreateVideoJsonRequest
      • CreateOmniFastVideoMultipartRequest
      • CreateOmniFastV2VVideoMultipartRequest
  • 默认模块
    • 模型接口
      • omni
        • 创建视频生成任务(omni-fast / omni-fast-v2v)
        • 查询视频任务状态
        • 获取视频内容
    • 数据模型
      • VideoTask
      • ErrorResponse
      • CreateOmniFastVideoJsonRequest
      • CreateOmniFastV2VVideoJsonRequest
      • VideoTaskData
      • ErrorDetail
  1. Google Gemini接口

图片生成

开发中
POST
/v1beta/models/{model}:generateContent

Gemini 图片生成接口教程#

本文介绍如何通过 Gemini 原生接口进行文生图(Text-to-Image)。
如需图片编辑(改图),请参阅图片编辑教程。

一、接口信息#

项目说明
请求方式POST
端点{base_url}/v1beta/models/{model}:generateContent
认证Authorization: Bearer sk-xxxxxxxx
Content-Typeapplication/json

二、可用模型#

在请求 URL 中替换 {model} 为以下模型名称:
模型特点
gemini-3-pro-image-preview质量最高,支持 1K / 2K / 4K 分辨率
gemini-3.1-flash-image-preview速度快,支持 512 / 1K,比例最多(含 1:4、4:1、1:8、8:1)
gemini-3.1-flash-lite-image速度更快,成本更低,仅支持 1K,比例最多(含 1:4、4:1、1:8、8:1)
gemini-2.5-flash-image-previewFlash 系列
gemini-2.5-flash-imageFlash 系列
模型所在的分组请前往模型广场查看!

三、最小可用示例#

只需 contents + generationConfig 即可生成图片:
responseModalities 必须包含 "IMAGE",否则模型只返回文本不出图。

四、完整参数示例#


五、参数详解#

5.1 contents(必填)#

对话内容,文生图场景下只需一条 user 消息:
"contents": [
  {
    "role": "user",
    "parts": [
      { "text": "你的提示词" }
    ]
  }
]
字段类型说明
rolestring固定为 "user"
parts[].textstring图片生成提示词

5.2 generationConfig(必填)#

参数类型必填默认说明
responseModalitiesstring[]是—必须包含 "IMAGE"。推荐 ["TEXT", "IMAGE"]
imageConfigobject否—图像尺寸与比例配置
temperaturenumber否1.00~2,越高越随机
candidateCountint否1生成候选数量
maxOutputTokensint否—输出 token 上限
stopSequencesstring[]否—停止序列,最多 5 个

5.3 imageConfig(图像配置)#

"imageConfig": {
  "aspectRatio": "16:9",
  "imageSize": "2K"
}

aspectRatio 可选值#

比例所有模型仅 Flash 2(3.1)
1:1✓✓
2:3 / 3:2✓✓
3:4 / 4:3✓✓
4:5 / 5:4✓✓
9:16 / 16:9✓✓
21:9✓✓
1:4 / 4:1✗✓
1:8 / 8:1✗✓

imageSize 可选值#

值支持模型说明
512仅 gemini-3.1-flash-image-preview低分辨率,速度最快
1K全部模型默认值
2K仅 gemini-3-pro-image-preview高清
4K仅 gemini-3-pro-image-preview超高清
注意: 大小写敏感,必须大写 K(写 2k 会被忽略)。Flash 模型传 2K/4K 会静默回退到 1K。

5.4 safetySettings(可选)#

"safetySettings": [
  { "category": "HARM_CATEGORY_HARASSMENT", "threshold": "BLOCK_ONLY_HIGH" },
  { "category": "HARM_CATEGORY_HATE_SPEECH", "threshold": "BLOCK_ONLY_HIGH" },
  { "category": "HARM_CATEGORY_SEXUALLY_EXPLICIT", "threshold": "BLOCK_ONLY_HIGH" },
  { "category": "HARM_CATEGORY_DANGEROUS_CONTENT", "threshold": "BLOCK_ONLY_HIGH" },
  { "category": "HARM_CATEGORY_CIVIC_INTEGRITY", "threshold": "BLOCK_ONLY_HIGH" }
]
threshold 值含义
BLOCK_NONE完全不拦截
BLOCK_ONLY_HIGH仅拦截高风险
BLOCK_MEDIUM_AND_ABOVE中等及以上拦截(默认)
BLOCK_LOW_AND_ABOVE低及以上全部拦截

六、响应结构#

成功响应示例:
{
  "candidates": [
    {
      "content": {
        "role": "model",
        "parts": [
          { "text": "这是一幅未来城市..." },
          {
            "inlineData": {
              "mimeType": "image/png",
              "data": "<base64 编码的图片数据>"
            }
          }
        ]
      },
      "finishReason": "STOP"
    }
  ],
  "usageMetadata": {
    "promptTokenCount": 15,
    "candidatesTokenCount": 1290,
    "totalTokenCount": 1305
  }
}
字段说明
parts[].inlineData.data生成图片的 base64 数据,需解码后保存为图片文件
parts[].inlineData.mimeType图片格式,通常为 image/png
parts[].text模型可能附带的文字说明
finishReasonSTOP = 正常完成

异常 finishReason#

值含义
STOP正常完成
MAX_TOKENS超出 token 限制
SAFETY文本安全拦截
IMAGE_SAFETY图片安全拦截
PROHIBITED_CONTENT禁止内容
OTHER其他拦截

七、输出像素对照表#

Google 按「等面积」原则映射像素,不是按最长边。

1K#

比例输出像素
1:11024 x 1024
4:31184 x 864
3:4864 x 1184
3:21248 x 832
2:3832 x 1248
16:91344 x 768
9:16768 x 1344
5:41152 x 896
4:5896 x 1152
21:91536 x 672

2K(仅 Pro)#

比例输出像素
1:12048 x 2048
4:32304 x 1728
3:41728 x 2304
3:22496 x 1664
2:31664 x 2496
16:92752 x 1536
9:161536 x 2752
5:42304 x 1792
4:51792 x 2304
21:93072 x 1344

4K(仅 Pro)#

比例输出像素
1:14096 x 4096
4:34608 x 3456
3:43456 x 4608
3:24992 x 3328
2:33328 x 4992
16:95376 x 3024
9:163024 x 5376
5:44608 x 3584
4:53584 x 4608
21:96144 x 2688

八、内容安全须知#

请避免生成以下类型内容:
未成年人相关内容,包括儿童安全、性化、暴力化、校服/儿童与成人化语境组合
色情、暗示性成人内容、内衣/泳装/贴身服装、性感姿势或容易被判定为 NSFW 的人像
暴力、血腥、火灾、灾难、武器、战争、恐怖主义或危险违法行为
仇恨、骚扰、霸凌、威胁、辱骂、歧视或有毒攻击性内容
名人、政治人物、公众人物、真实人物肖像、换脸、换衣、身体编辑或隐私敏感人像
版权 IP、动漫/游戏/影视角色、品牌吉祥物、Logo、水印移除或仿冒受保护角色
金融、订单、票据、价格标签、支付截图、证件、个人信息等截图篡改
Google 可能返回 IMAGE_SAFETY、PROHIBITED_CONTENT、OTHER 等拦截结果;这些拦截通常无法通过安全参数完全关闭。

九、常见问题#

现象原因解决
请求成功但没有图片返回responseModalities 未包含 "IMAGE"改为 ["TEXT", "IMAGE"]
imageSize: "4K" 实际只出 1K使用了 Flash 模型改用 gemini-3-pro-image-preview
传了 2k 小写没效果大小写敏感改为 2K
返回 IMAGE_SAFETYGoogle 图片安全策略触发修改 prompt 内容,无法通过参数关闭
返回 PROHIBITED_CONTENT提示词包含禁止内容调整描述,避免敏感词
429 Too Many Requests超出速率限制降低并发频率
比例参数没生效模型不支持该比例检查模型支持的比例列表

十、保存图片示例(Shell)#

响应中的图片为 base64 编码,需解码保存:

十一、官方文档#

Gemini 图像生成文档

请求参数

Path 参数

Header 参数

Body 参数application/json必填

示例
{
    "contents": [
      {
        "role": "user",
        "parts": [
          { "text": "a futuristic city skyline at sunset, ultra realistic" }
        ]
      }
    ],
    "generationConfig": {
      "responseModalities": ["TEXT", "IMAGE"],
      "imageConfig": {
        "aspectRatio": "16:9",
        "imageSize": "2K"
      },
      "temperature": 1.0,
      "candidateCount": 1
    },
    "safetySettings": [
      { "category": "HARM_CATEGORY_HARASSMENT", "threshold": "BLOCK_NONE" },
      { "category": "HARM_CATEGORY_HATE_SPEECH", "threshold": "BLOCK_NONE" },
      { "category": "HARM_CATEGORY_SEXUALLY_EXPLICIT", "threshold": "BLOCK_NONE"
  },
      { "category": "HARM_CATEGORY_DANGEROUS_CONTENT", "threshold": "BLOCK_NONE"
  },
      { "category": "HARM_CATEGORY_CIVIC_INTEGRITY", "threshold": "BLOCK_NONE" }
    ]
  }

请求示例代码

Shell
JavaScript
Java
Swift
Go
PHP
Python
HTTP
C
C#
Objective-C
Ruby
OCaml
Dart
R
请求示例请求示例
Shell
JavaScript
Java
Swift
curl --location 'https://147ai.com/v1beta/models/:generateContent' \
--header 'Authorization: Bearer sk-' \
--header 'Content-Type: application/json' \
--data '{
    "contents": [
      {
        "role": "user",
        "parts": [
          { "text": "a futuristic city skyline at sunset, ultra realistic" }
        ]
      }
    ],
    "generationConfig": {
      "responseModalities": ["TEXT", "IMAGE"],
      "imageConfig": {
        "aspectRatio": "16:9",
        "imageSize": "2K"
      },
      "temperature": 1.0,
      "candidateCount": 1
    },
    "safetySettings": [
      { "category": "HARM_CATEGORY_HARASSMENT", "threshold": "BLOCK_NONE" },
      { "category": "HARM_CATEGORY_HATE_SPEECH", "threshold": "BLOCK_NONE" },
      { "category": "HARM_CATEGORY_SEXUALLY_EXPLICIT", "threshold": "BLOCK_NONE"
  },
      { "category": "HARM_CATEGORY_DANGEROUS_CONTENT", "threshold": "BLOCK_NONE"
  },
      { "category": "HARM_CATEGORY_CIVIC_INTEGRITY", "threshold": "BLOCK_NONE" }
    ]
  }'

返回响应

🟢200成功
application/json
Bodyapplication/json

示例
{}
修改于 2026-07-01 03:12:30
上一页
图片理解
下一页
图片编辑(Nano-banana 支持比例)
Built with