商品图生成(非服饰类)。支持单张或套图:白底主图、场景图、特写图、卖点版式图、A+详情页图。单张单类型直接出图;多张多类型自动编排规划。用户说"做套图""做白底图""做场景图""做卖点图""做A+图""做特写图"时触发。纯图片编辑操作走 linkfox-aigc-imagegen。
设计与多媒体
AIGC图像生成
试用AI生图工具,根据提示词和参考图生成图片。支持多种模型(BANANA/BANANA_2/BANANA_PRO/GPT_2_IMAGE/AIDRAW_EDIT/WAN2_7/SEEDREAM5),可控制分辨率、宽高比、输出数量。用户说"生成图片"、"AI画图"、"AI生图"、"帮我画"、"图片生成"、"image generation"、"generate image"、"画一张图"、"做张图"、"图生图"时触发。
它能做什么
AI生图工具,根据提示词和参考图生成图片。支持多种模型(BANANA/BANANA_2/BANANA_PRO/GPT_2_IMAGE/AIDRAW_EDIT/WAN2_7/SEEDREAM5),可控制分辨率、宽高比、输出数量。用户说"生成图片"、"AI画图"、"AI生图"、"帮我画"、"图片生成"、"image generation"、"generate image"、"画一张图"、"做张图"、"图生图"时触发。
技能文档
AI 生图
根据提示词和参考图生成图片,支持多种 AI 模型,异步创建任务后轮询获取结果。
核心特点
- 多模型选择:7 种模型可选,各有不同特长和分辨率支持。
- 图生图:可传入参考图+提示词生成新图。
- 批量输出:单次最多生成 10 张图片。
- 异步模式:创建任务立即返回 taskId,脚本自动轮询直到完成(超时 10 分钟)。
模型说明
| 模型(provider) | 说明 | 特点 |
|---|---|---|
| BANANA | LFBanana(基础版) | 仅支持 1K 分辨率 |
| BANANA_2 | LFBanana2 | 支持更高分辨率 |
| BANANA_PRO | LFBanana Pro(默认) | 综合效果最好 |
| GPT_2_IMAGE | Img2 | 支持 quality 参数控制质量 |
| AIDRAW_EDIT | Linkfox-Image-1 | 适合编辑类场景 |
| WAN2_7 | Wan 2.7 | 万相模型 |
| SEEDREAM5 | Seedream 5.0 | 仅支持2K |
参数概览
- 必填字段:
prompt、imageUrls、outputNum(默认1)、resolution(默认1K)、quality(默认high,仅 GPT_2_IMAGE)
完整参数表、响应字段结构与错误码,见 references/api.md。
调用方式
- 创建任务:
POST /aigc/imageGenAsync→ 返回{taskId} - 轮询结果:
POST /aigc/taskQuery→ 传入{taskId}→ 返回状态和结果 - Python 脚本:
python scripts/aigc_imagegen.py ''(脚本内部自动完成创建+轮询)
异步流程:
- 脚本调用
/aigc/imageGenAsync创建任务,获得taskId - 轮询
/aigc/taskQuery,初始间隔 10 秒,每次递减 1 秒至最低 5 秒,最长等待 10 分钟 - 成功后自动下载图片到会话
media/目录
文件存储路径约定(遵循 CLAUDE.md 规范):
所有文件存储在 /linkfox/// 下,按类型划分目录:
| 内容类型 | 目录 | 路径格式 | 说明 |
|---|---|---|---|
| 生成的图片 | media/ | /media/linkfox-aigc-imagegen-. | 如 media/linkfox-aigc-imagegen-1718000000000.png |
| 原始 API 响应 | data/ | /data/linkfox-aigc-imagegen-.json | 含完整 taskId、状态、临时 URL 等 |
输出策略(脚本默认行为):
-
成功生成图片时(无论多少张):
- stdout 输出
Saved full response: <路径数组>格式的行,例如:- 1张:
Saved full response: ["/path/to/media/a.png"] - 多张:
Saved full response: ["/path/to/media/a.png", "/path/to/media/b.png"]
- 1张:
- 原始 API 响应(含临时 URL 等)静默落盘到
data/。 - 前端 UI 可解析 stdout 中所有
Saved full response:行,把后续 JSON 数组渲染出来。 - 每次调用脚本通常输出一行;分多次调用时会有多行。
- stdout 输出
-
无图片产物时(失败/无结果):
- stdout 输出原始响应路径:
Saved full response: /path/to/data/xxx.json
- stdout 输出原始响应路径:
读数据建议:禁止 Read 转存的图片文件内容(避免 base64 进入上下文)。直接把 Saved full response: 后的本地路径提供给用户即可。
解决认证和积分问题
发生以下异常情况时,采用 references/onboarding.md 引导解决问题:
异常情况
- 未配置API Key:环境变量未配置
LINKFOX_AGENT_API_KEY,也未配置LINKFOXAGENT_API_KEY。 - 响应401或402状态码
- 响应提示积分或余额不足:消息含"积分余额不足/计费不足/余额不足/quota exceeded/insufficient balance/套餐到期/需充值/请充值",或类似含义的内容。
使用指引
- 模型选择:一般场景用
BANANA_PRO(默认);需要高质量画质控制用GPT_2_IMAGE;编辑现有图片用AIDRAW_EDIT。 - 提示词:描述越具体效果越好,建议用英文提示词获得更好效果。
- 参考图:必须提供至少一张参考图 URL。
- 分辨率:支持 1K/2K/4K,默认 1K。
示例
1. 用默认模型生成商品场景图
{"imageUrls": ["https://example.com/product.jpg"], "prompt": "product photography on white background, studio lighting", "provider": "BANANA_PRO", "outputNum": 1, "resolution": "1K", "aspectRatio": "1:1", "quality": "high"}
2. 用 GPT_2_IMAGE 高质量生图
{"imageUrls": ["https://example.com/ref.jpg"], "prompt": "modern minimalist product showcase", "provider": "GPT_2_IMAGE", "outputNum": 1, "resolution": "1K", "aspectRatio": "16:9", "quality": "high"}
3. 批量生成多张
{"imageUrls": ["https://example.com/ref.jpg"], "prompt": "creative product ad design", "provider": "BANANA_PRO", "outputNum": 4, "resolution": "2K", "aspectRatio": "1:1", "quality": "high"}
限制
- 必须提供至少一张参考图 URL。
- 单次最多生成 10 张。
- 生成时间视模型和分辨率不同,通常 10-120 秒。脚本自动轮询,超时 10 分钟。
- 失败时不重试(仅尝试 1 次)。
不适用
不适用:
- 纯文字生成 →
linkfox-aigc-textgen - 视频生成 →
linkfox-aigc-videogen
反馈
参见 references/api.md。
执行指令
重要:收到本文档末尾的 ARGUMENTS: 字段后,必须立即调用 python scripts/aigc_imagegen.py '' 执行,禁止等待用户确认或额外输入。
相关技能
AI驱动的图片生成与编辑工具,用于制作高质量产品图。当用户要求生成图片、制作图片、编辑照片、文生图、图生图、换背景、变换风格、替换图片中的物体、将产品合成到场景中、换模特、制作任何类型的AI生成视觉内容、AI drawing, image generation, text-to-image, image-to-image, background replacement, style transfer, product image creation, AI image editing时触发此技能。即使用户未明确说"AI图片",只要其请求涉及生成、修改或变换图片,也应触发此技能。
AI生视频工具(首尾帧/单图模式),根据原图和提示词生成视频,支持可选尾帧图控制结束画面。支持模型KLING可灵/WAN万相/SEED豆包/SEED_FAST/HAILUO海螺。用户说"生成视频"、"AI视频"、"图生视频"、"做个视频"、"video generation"、"generate video"、"图片转视频"、"动态视频"时触发。
AI生文工具,使用大语言模型根据提示词生成文本内容,支持图/视频/文结合理解。模型可选GEM_3_FLASH(快速)和GEM_3_1_PRO(高质量复杂分析)。用户说"AI生文"、"AI写作"、"文本生成"、"帮我写一段"、"text generation"、"generate text"、"用AI写"、"AI分析图片内容"、"图片识别"、"视频分析"时触发。
商品图生成(非服饰类)。支持单张或套图:白底主图、场景图、特写图、卖点版式图、A+详情页图。单张单类型直接出图;多张多类型自动编排规划。用户说"做套图""做白底图""做场景图""做卖点图""做A+图""做特写图"时触发。纯图片编辑操作走 linkfox-aigc-imagegen。
图转视频Skill,把图片生成短视频,覆盖参考图模式和首尾帧模式。参考图模式支持 seedance2.0、seedance2.0fast、可灵Omni、HappyHorse、海螺2.3、wan2.6;首尾帧模式支持 seedance2.0、seedance2.0fast、可灵2.6。用户说"图转视频"、"图片转视频"、"把这张图动起来"、"参考图生成视频"、"首尾帧视频"、"image to video"、"reference image video"、"first last frame video"时触发;带货口播、数字人讲解、完整广告成片不在本Skill范围。