Skip to main content
本页提供一个开箱即用的 Agent 技能(Skill):把它放进你正在用的编码 Agent,就能用自然语言(或显式命令)直接调用 API易 平台的 Nano Banana Progemini-3-pro-image)完成生图与改图。整套东西就两个文件,复制即用。

这个技能能做什么

一个合并技能,脚本会根据是否传入图片自动判断是「文生图」还是「图片编辑」:

文生图

只给提示词 → 生成全新图片,支持 10 种宽高比与 1K/2K/4K 分辨率。

图片编辑

传入一张图 + 指令 → 局部编辑、风格迁移、背景替换等。

多图合成

传入多张图 + 一条指令 → 多图合成、对比、换装等高级玩法。

能用在哪些 Agent

一个 Skill 本质上就是一个文件夹:一份写给 Agent 看的说明(SKILL.md)+ 一个干活的脚本。所以凡是能读取本地文件、执行命令行的编码 Agent 都能用上——比如 Codex、OpenClaw、hermes-agent、Claude Code 等。唯一要求:跑 Agent 的那台机器(你的电脑或服务器)装了 Python 3 并且能联网(脚本要直连 api.apiyi.com)。仅此而已,不挑具体哪家 Agent。

三步装好

① 建目录、贴文件

新建一个技能文件夹,放入下面两个文件(完整内容见后两节):

② 同目录写 Key

nano-banana-pro/.env 里写上你的 API易 API Key(在 api.apiyi.com 控制台创建):
脚本会自动从这个 .env 读取 Key,无需任何额外配置或环境变量
.env 里是你的密钥。如果这个技能要随项目仓库共享,务必把 .env 加进 .gitignore,不要提交到 git

③ 交给 Agent

  • 支持技能自动发现的 Agent(如 Claude Code):把整个 nano-banana-pro/ 目录放进它的技能目录——个人级 ~/.claude/skills/,或项目级 .claude/skills/(随仓库共享)。
  • 其他 Agent:按它各自的技能/插件约定放置;或者最简单——直接让 Agent「读一下这个文件夹里的 SKILL.md,并照着执行」 即可。
装好后就能用了,跳到 怎么用 看示例。

SKILL.md

新建 nano-banana-pro/SKILL.md,完整内容如下(description 写清「做什么 + 何时用」,Agent 会据此自动触发):
name 必须是小写字母 + 连字符,且不能含 claude / anthropic 等保留词。在支持斜杠命令的 Agent 里,目录名就是命令名——叫 nano-banana-pro/nano-banana-pro${CLAUDE_SKILL_DIR} 是 Claude Code 提供的技能目录变量;其他 Agent 直接用脚本的实际路径即可。

scripts/nano_banana.py

新建 nano-banana-pro/scripts/nano_banana.py,使用 Gemini 原生格式(与本站文生图 / 图片编辑接口代码一致、已验证可跑)。纯 Python 标准库,无需 pip install 任何东西
模型名默认 gemini-3-pro-image(正式名)。如需用原 gemini-3-pro-image-preview,设环境变量 APIYI_IMAGE_MODEL=gemini-3-pro-image-preview 即可,两者价格一致、效果等价。

为什么一句话就能出图

很多人好奇:我又没敲命令,怎么说句”画只猫”它就出图了? 原理是这样:Agent 启动时会先读取每个技能 SKILL.md 里的 description(一段很短的元数据,说明「这个技能做什么、什么时候该用」)。当你说出的需求匹配上这段描述的场景(比如”画/生成/渲染一张图""把这张图改成…”),Agent 就自动决定调用这个技能,去读完整的 SKILL.md 并运行脚本——整个过程你不用记任何命令。 所以:
  • 写得好的 description = 更准的自动触发。本技能的描述已覆盖”生成/绘制/编辑/合成图片”等说法。
  • 不想靠 Agent 猜、想要百分百可控时,用下面的显性调用

怎么用

自然语言(隐式触发)

装好后直接对 Agent 说话即可:

显性调用(更可控)

不想让 Agent 自己判断时,两种显式方式:
  • 支持斜杠命令的 Agent(如 Claude Code):
  • 任意 Agent / 直接命令它跑脚本(最通用):
怎么控制比例和清晰度:用 --aspect 选宽高比(如 --aspect 16:9,10 选 1),用 --size 选分辨率(1K / 2K / 4K)。直接说”竖屏 9:16""画方图""出 4K”,Agent 也会自动带上这两个参数。

生成的图片在哪里

  • -o 只传文件名(如 -o dog.png)时,图片统一存到项目根目录下的 nano-banana-output/ 文件夹(脚本自动创建),所以你在项目里的这个文件夹就能直接找到。
  • 「项目根目录」= 脚本从自身位置向上找到的第一个含 .git.claude 的目录——不管 Agent 在哪个目录运行,图都落在项目里,不会跑进临时目录害你找不到。
  • 脚本会为每张图打印一行完整绝对路径,例如 图片已保存至 /Users/you/project/nano-banana-output/dog.png
  • 默认只出 1 张-n 3 一次出 3 张(最多 5,超过自动截到 5),文件名自动加 -1-2-3 后缀。
  • 带目录的路径(如 -o images/dog.png 或绝对路径)时,按你给的路径存(相对路径相对当前工作目录),不进 nano-banana-output/
  • 图片编辑同理:输出是新文件,不会覆盖你的原图
Nano Banana Pro 有严格的内容安全管控。若脚本提示 finishReasonSTOP 或返回的是拒绝说明文本,请按提示调整内容,不要对同一违规提示词反复重试。详见 生图接口的错误处理指南

相关文档