使用 Agnes AI 升级版图像生成模型 agnes-image-2.1-flash 生成图片。同时支持文生图(text-to-image)与图生图(image-to-image)。当用户说「用 Agnes 生成图片」「用 Agnes 画一张」「Agnes 生成」「用这张图生成/改成……」或明确要求使用 Agnes API 进行文生图/图生图时,加载本 skill。不消耗 WorkBuddy 积分,仅消耗 Agnes API 额度(当前图像生成免费)。
设计与多媒体
agnes-image-skill
试用调用 Agnes Image 2.1 Flash 生成图像,支持文生图、图生图、URL / Base64 输出。当用户说"帮我生成一张图"、"文生图"、"图生图"、"把这张图改成 XX 风格"时触发。
它能做什么
调用 Agnes Image 2.1 Flash 生成图像,支持文生图、图生图、URL / Base64 输出。当用户说"帮我生成一张图"、"文生图"、"图生图"、"把这张图改成 XX 风格"时触发。
技能文档
Agnes Image 2.1 Flash 生图 Skill
基于 Agnes AI 官方文档:https://agnes-ai.com/zh-Hans/docs/agnes-image-21-flash
这个 Skill 做什么
调用 Agnes Image 2.1 Flash 模型生成图像,支持:
- 文生图(text-to-image)
- 图生图(image-to-image)
- URL 输出或 Base64 输出
- 自定义输出尺寸
何时使用
当用户出现以下任意意图时触发:
- "帮我生成一张图" / "用 Agnes 生成图片"
- "文生图" / "图生图"
- "把这张图改成 XX 风格"
- 明确提到
agnes-image-2.1-flash或Agnes Image
前置要求
- 拥有 Agnes AI API Key。
- 在 skill 目录下创建
.env文件并填入 API Key(已提供.env.example模板)。 - 可访问
https://apihub.agnes-ai.cn。
配置方式:
# 进入 skill 目录
cd C:/Users/hevin/.workbuddy/skills/agnes-image-skill
# 复制模板
cp .env.example .env
# 编辑 .env,把你的 key 填进去
# AGNES_API_KEY=sk-...
脚本启动时会自动读取 skill 目录下的 .env 文件,也支持当前工作目录下的 .env 文件。
安全提示:
.env文件已被加入.gitignore,请勿将 API Key 提交到代码仓库。
工作流
Step 1 · 澄清需求
每次调用前确认:
| 问题 | 默认值 | 说明 |
|---|---|---|
| 文生图还是图生图? | 文生图 | 图生图需要提供输入图片路径或 URL |
| prompt 是什么? | — | 生成或修改图像的文本指令 |
| 输出尺寸? | 1024x1024 | 常见:1024x1024、1024x768、768x1024 |
| 输出格式? | url | 可选 url 或 b64_json |
| 保存路径? | 当前目录 output.png | 仅 Base64 输出需要本地保存 |
Step 2 · 调用脚本
使用 WorkBuddy 托管的 Node.js 运行时执行 skill 内置脚本 generate.mjs:
# 文生图 + URL 输出
"C:/Users/hevin/.workbuddy/binaries/node/versions/22.22.2/node.exe" \
C:/Users/hevin/.workbuddy/skills/agnes-image-skill/generate.mjs \
--prompt "日出时分薄雾峡谷上方的发光浮空城市,电影级写实风格,广角构图" \
--size 1024x768 \
--format url
# 文生图 + Base64 输出并保存
"C:/Users/hevin/.workbuddy/binaries/node/versions/22.22.2/node.exe" \
C:/Users/hevin/.workbuddy/skills/agnes-image-skill/generate.mjs \
--prompt "白色摄影棚中的玻璃立方体产品照,柔和阴影,高细节" \
--size 1024x1024 \
--format b64_json \
--output product.png
# 图生图 + URL 输出
"C:/Users/hevin/.workbuddy/binaries/node/versions/22.22.2/node.exe" \
C:/Users/hevin/.workbuddy/skills/agnes-image-skill/generate.mjs \
--prompt "改为雨夜赛博朋克风格,保留原始构图" \
--size 1024x1024 \
--image https://example.com/input.png \
--format url
Step 3 · 处理结果
- URL 输出:脚本会打印图片 URL,直接展示给用户。
- Base64 输出:脚本自动解码并保存到
--output指定路径,同时打印保存位置。
生成图片后,使用 present_files 工具将图片文件路径传递给用户查看。
参数说明
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 固定为 agnes-image-2.1-flash |
prompt | string | 是 | 图像生成或编辑的文本指令 |
size | string | 是 | 输出尺寸,如 1024x1024 |
image | string | 图生图必填 | 输入图像 URL 或本地文件路径 |
format | string | 否 | url(默认)或 b64_json |
output | string | 否 | Base64 输出时保存的文件路径 |
timeout | string | 否 | 请求超时毫秒数,默认 300000 |
重要规则
- 不要在请求体顶层放
response_format,必须放在extra_body内。 - 图生图不需要传递
tags: ["img2img"]。 - 输入图像必须是公开可访问的 HTTPS URL,或本地文件路径(脚本会自动转 Base64 Data URI)。
- 客户端超时建议设置为
60s - 360s。 - 当前官方标价为
$0 / 张(请以官方最新价格为准)。
提示词模板
文生图
[主体] + [场景/环境] + [风格] + [光照] + [构图] + [质量要求]
示例:
日出时分薄雾峡谷上方的发光浮空城市,电影级写实风格,广角构图,丰富的建筑细节,柔和的金色光线,高视觉密度
图生图
[改变要求] + [新风格/场景] + [需要添加或移除的元素] + [需要保留的元素]
示例:
将白天街道场景改为电影级赛博朋克夜景,添加霓虹招牌和湿滑路面倒影,同时保留原始街道布局、相机角度和主要建筑形状。
常见错误与排查
| 错误 | 原因 | 解决 |
|---|---|---|
response_format 无效 | 放在了请求体顶层 | 移到 extra_body.response_format |
| 图生图失败 | 缺少 extra_body.image | 提供 --image 参数 |
| 图片 URL 无法访问 | 私有图片或需要登录 | 使用公开 URL 或本地文件路径 |
| 请求超时 | 生成需要数秒到几十秒 | 脚本默认 300s 超时 |
| 401 Unauthorized | API Key 未设置或无效 | 检查 AGNES_API_KEY |
资源
- 官方文档:https://agnes-ai.com/zh-Hans/docs/agnes-image-21-flash
- API 端点:
https://apihub.agnes-ai.cn/v1/images/generations
相关技能
使用 agnes-2.0-flash 多模态模型分析图片(看图 / OCR / 描述 / 识别)。当用户想用 agnes 或 agnes-2.0-flash 处理图片、把图片理解任务交给更便宜的 flash 模型、或需要与 app 中 agnes 模型结果一致时使用。运行 skill 目录下的 agnes_vision.py,将图片 base64 编码后调用 Agnes 的 OpenAI 兼容接口返回文本。
通过单一脚本调用多家官方图像生成 API,支持参考图与批量并发。
聚合数据提供的AI图像创作服务技能,本技能使用无需用户注册聚合数据平台,安装后即可按实际付费使用。 本技能是根据文本描述(prompt)生成具有特定风格、场景和氛围的图像,并自动下载保存的支付宝AI付付费技能。本技能基于 A2M(HTTP 402)收单协议。当用户需要生成图像的时候,调用本技能,并通过本 Skill 向卖家服务端发起请求,完成支付后获取相关结果。 使用场景:用户说"帮我生成一张猫咪在草地上玩耍的图片"、"画一幅水墨风格的山水画"、"生成一张16:9的科技感壁纸"、"创作一张新年祝福海报"、"用AI画一张小狗钓鱼的图"等。
AI生图工具,根据提示词和参考图生成图片。支持多种模型(BANANA/BANANA_2/BANANA_PRO/GPT_2_IMAGE/AIDRAW_EDIT/WAN2_7/SEEDREAM5),可控制分辨率、宽高比、输出数量。用户说"生成图片"、"AI画图"、"AI生图"、"帮我画"、"图片生成"、"image generation"、"generate image"、"画一张图"、"做张图"、"图生图"时触发。
通过文本描述生成图片,支持多种比例与标准分辨率,适合个人创作者快速出图。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。