Design & media

agnes-image-skill

Try it

调用 Agnes Image 2.1 Flash 生成图像,支持文生图、图生图、URL / Base64 输出。当用户说"帮我生成一张图"、"文生图"、"图生图"、"把这张图改成 XX 风格"时触发。

What it does

调用 Agnes Image 2.1 Flash 生成图像,支持文生图、图生图、URL / Base64 输出。当用户说"帮我生成一张图"、"文生图"、"图生图"、"把这张图改成 XX 风格"时触发。

The skill document

Agnes Image 2.1 Flash 生图 Skill

基于 Agnes AI 官方文档:https://agnes-ai.com/zh-Hans/docs/agnes-image-21-flash

这个 Skill 做什么

调用 Agnes Image 2.1 Flash 模型生成图像,支持:

  • 文生图(text-to-image)
  • 图生图(image-to-image)
  • URL 输出或 Base64 输出
  • 自定义输出尺寸

何时使用

当用户出现以下任意意图时触发:

  • "帮我生成一张图" / "用 Agnes 生成图片"
  • "文生图" / "图生图"
  • "把这张图改成 XX 风格"
  • 明确提到 agnes-image-2.1-flashAgnes Image

前置要求

  1. 拥有 Agnes AI API Key。
  2. 在 skill 目录下创建 .env 文件并填入 API Key(已提供 .env.example 模板)。
  3. 可访问 https://apihub.agnes-ai.cn

配置方式:

# 进入 skill 目录
cd C:/Users/hevin/.workbuddy/skills/agnes-image-skill

# 复制模板
cp .env.example .env

# 编辑 .env,把你的 key 填进去
# AGNES_API_KEY=sk-...

脚本启动时会自动读取 skill 目录下的 .env 文件,也支持当前工作目录下的 .env 文件。

安全提示.env 文件已被加入 .gitignore,请勿将 API Key 提交到代码仓库。

工作流

Step 1 · 澄清需求

每次调用前确认:

问题默认值说明
文生图还是图生图?文生图图生图需要提供输入图片路径或 URL
prompt 是什么?生成或修改图像的文本指令
输出尺寸?1024x1024常见:1024x10241024x768768x1024
输出格式?url可选 urlb64_json
保存路径?当前目录 output.png仅 Base64 输出需要本地保存

Step 2 · 调用脚本

使用 WorkBuddy 托管的 Node.js 运行时执行 skill 内置脚本 generate.mjs

# 文生图 + URL 输出
"C:/Users/hevin/.workbuddy/binaries/node/versions/22.22.2/node.exe" \
  C:/Users/hevin/.workbuddy/skills/agnes-image-skill/generate.mjs \
  --prompt "日出时分薄雾峡谷上方的发光浮空城市,电影级写实风格,广角构图" \
  --size 1024x768 \
  --format url

# 文生图 + Base64 输出并保存
"C:/Users/hevin/.workbuddy/binaries/node/versions/22.22.2/node.exe" \
  C:/Users/hevin/.workbuddy/skills/agnes-image-skill/generate.mjs \
  --prompt "白色摄影棚中的玻璃立方体产品照,柔和阴影,高细节" \
  --size 1024x1024 \
  --format b64_json \
  --output product.png

# 图生图 + URL 输出
"C:/Users/hevin/.workbuddy/binaries/node/versions/22.22.2/node.exe" \
  C:/Users/hevin/.workbuddy/skills/agnes-image-skill/generate.mjs \
  --prompt "改为雨夜赛博朋克风格,保留原始构图" \
  --size 1024x1024 \
  --image https://example.com/input.png \
  --format url

Step 3 · 处理结果

  • URL 输出:脚本会打印图片 URL,直接展示给用户。
  • Base64 输出:脚本自动解码并保存到 --output 指定路径,同时打印保存位置。

生成图片后,使用 present_files 工具将图片文件路径传递给用户查看。

参数说明

参数类型必填说明
modelstring固定为 agnes-image-2.1-flash
promptstring图像生成或编辑的文本指令
sizestring输出尺寸,如 1024x1024
imagestring图生图必填输入图像 URL 或本地文件路径
formatstringurl(默认)或 b64_json
outputstringBase64 输出时保存的文件路径
timeoutstring请求超时毫秒数,默认 300000

重要规则

  1. 不要在请求体顶层放 response_format,必须放在 extra_body 内。
  2. 图生图不需要传递 tags: ["img2img"]
  3. 输入图像必须是公开可访问的 HTTPS URL,或本地文件路径(脚本会自动转 Base64 Data URI)。
  4. 客户端超时建议设置为 60s - 360s
  5. 当前官方标价为 $0 / 张(请以官方最新价格为准)。

提示词模板

文生图

[主体] + [场景/环境] + [风格] + [光照] + [构图] + [质量要求]

示例:

日出时分薄雾峡谷上方的发光浮空城市,电影级写实风格,广角构图,丰富的建筑细节,柔和的金色光线,高视觉密度

图生图

[改变要求] + [新风格/场景] + [需要添加或移除的元素] + [需要保留的元素]

示例:

将白天街道场景改为电影级赛博朋克夜景,添加霓虹招牌和湿滑路面倒影,同时保留原始街道布局、相机角度和主要建筑形状。

常见错误与排查

错误原因解决
response_format 无效放在了请求体顶层移到 extra_body.response_format
图生图失败缺少 extra_body.image提供 --image 参数
图片 URL 无法访问私有图片或需要登录使用公开 URL 或本地文件路径
请求超时生成需要数秒到几十秒脚本默认 300s 超时
401 UnauthorizedAPI Key 未设置或无效检查 AGNES_API_KEY

资源

Related skills

使用 Agnes AI 升级版图像生成模型 agnes-image-2.1-flash 生成图片。同时支持文生图(text-to-image)与图生图(image-to-image)。当用户说「用 Agnes 生成图片」「用 Agnes 画一张」「Agnes 生成」「用这张图生成/改成……」或明确要求使用 Agnes API 进行文生图/图生图时,加载本 skill。不消耗 WorkBuddy 积分,仅消耗 Agnes API 额度(当前图像生成免费)。

14 installs

使用 agnes-2.0-flash 多模态模型分析图片(看图 / OCR / 描述 / 识别)。当用户想用 agnes 或 agnes-2.0-flash 处理图片、把图片理解任务交给更便宜的 flash 模型、或需要与 app 中 agnes 模型结果一致时使用。运行 skill 目录下的 agnes_vision.py,将图片 base64 编码后调用 Agnes 的 OpenAI 兼容接口返回文本。

Generate images from prompts across OpenAI, Azure, Google, DashScope, Seedream, Jimeng and more, with batch mode.

159 installs1 stars

聚合数据提供的AI图像创作服务技能,本技能使用无需用户注册聚合数据平台,安装后即可按实际付费使用。 本技能是根据文本描述(prompt)生成具有特定风格、场景和氛围的图像,并自动下载保存的支付宝AI付付费技能。本技能基于 A2M(HTTP 402)收单协议。当用户需要生成图像的时候,调用本技能,并通过本 Skill 向卖家服务端发起请求,完成支付后获取相关结果。 使用场景:用户说"帮我生成一张猫咪在草地上玩耍的图片"、"画一幅水墨风格的山水画"、"生成一张16:9的科技感壁纸"、"创作一张新年祝福海报"、"用AI画一张小狗钓鱼的图"等。

5 installs1 stars

AI生图工具,根据提示词和参考图生成图片。支持多种模型(BANANA/BANANA_2/BANANA_PRO/GPT_2_IMAGE/AIDRAW_EDIT/WAN2_7/SEEDREAM5),可控制分辨率、宽高比、输出数量。用户说"生成图片"、"AI画图"、"AI生图"、"帮我画"、"图片生成"、"image generation"、"generate image"、"画一张图"、"做张图"、"图生图"时触发。

通过文本描述生成图片,支持多种比例与标准分辨率,适合个人创作者快速出图。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。