通过文本描述生成图片,支持多种比例与标准分辨率,适合个人创作者快速出图。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
Design & media
ai-image-gen-free
Try itAI 图像生成基础版(免费),通过执行脚本调用 ai-model Flash Image API 完成文本生成图像. 核心能力: - 文生图: 文本提示词生成图像,支持主体/场景/光线/风格/色调描述 - 多比例: 1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9 共 10 种 - 双分辨率: 标准 / 2K 适用场景: - 社交媒体头像、封面、壁纸快速生成 - 个人创作者图片原型与灵感草图 - 学习试用与轻量图像生产
What it does
AI 图像生成基础版(免费),通过执行脚本调用 ai-model Flash Image API 完成文本生成图像. 核心能力: - 文生图: 文本提示词生成图像,支持主体/场景/光线/风格/色调描述 - 多比例: 1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9 共 10 种 - 双分辨率: 标准 / 2K 适用场景: - 社交媒体头像、封面、壁纸快速生成 - 个人创作者图片原型与灵感草图 - 学习试用与轻量图像生产
The skill document
AI Image Gen LITE
AI 图像生成基础版,通过执行 (请参考skill目录中的脚本文件) 调用 ai-model Flash Image API 生成图片。仅支持文本生成图像(文生图),覆盖标准与 2K 两档分辨率、10 种画面比例.
范围外(本技能不做): 图生图(图+文)、风格转换、4K 分辨率、批量生成(需升级 ai-image-gen 专业版).
依赖与配置
运行环境
- Agent平台: 支持SKILL.md的任意AI Agent(ai-assistant Code / Cursor / Codex / ai-model CLI等)
- 操作系统: Windows / macOS / Linux
依赖项
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由Agent内置LLM提供 |
API Key 配置
需要配置对应API Key,详见上文环境配置章节
可用性分类
- 分类: MD+EXEC()
API Key配置方式:
export API_KEY="${API_KEY:?请设置环境变量}"
配置后需重启会话或开启新终端生效。API Key应妥善保管,避免泄露到版本控制系统.
主要能力
认证与配置
脚本通过环境变量读取 API 配置,永不硬编码 Key 到脚本文件.
export IMAGE_GEN_API_KEY="${API_KEY:?请设置环境变量}"
export IMAGE_GEN_BASE_URL="https://code.newcli.com/ai-model" # 可选,默认即此值
校验配置是否就绪:
[ -n "${IMAGE_GEN_API
# ...
**处理**: 解析API密钥和配置参数,验证认证信息有效性,初始化运行时环境.
# ...
### 基础生成
# ...
使用 `(请参考skill目录中的脚本文件)` 完成文生图:
# ...
```bash
# 默认 2K-16x9 横屏
python3 (请参考skill目录中的脚本文件) "你的提示词" --output output.png
# 指定 1:1 方形(社交头像)
python3 (请参考skill目录中的脚本文件) "你的提示词" \
--model ge
**处理**: 解析文本提示词和生成参数,调用AI模型API执行生成任务,返回生成结果.
### 参数说明
| 参数 | 必填 | 说明 |
|:-----|:-----|:-----|
| prompt | 是 | 图片描述提示词 |
| --model, -m | 否 | 模型名称,默认 ai-model-3.1-flash-image-2k-16x9 |
| --output, -o | 否 | 输出文件路径,默认当前目录 generated_image.png |
**处理**: 解析命令行参数和配置选项,验证参数合法性,映射到内部处理流程.
### 可用模型(基础版)
默认模型 `ai-model-3.1-flash-image-2k-16x9`(2K,16:9 横屏).
### 标准分辨率
| 模型 ID | 比例 | 适用场景 |
|---:|---:|---:|
| ai-model-3.1-flash-image | 1:1 | 社交媒体头像 |
| ai-model-3.1-flash-image-9x16 | 9:16 | 手机壁纸/短视频 |
| ge
### 提示词技巧
- **具体描述**: 主体、场景、光线、风格、色调
- **风格参考**: 水彩、油画、赛博朋克、吉卜力、写实摄影、中国工笔
- **构图说明**: 视角(俯视/仰视)、景深、焦点
- **色彩指定**: 主色调、配色方案
## 认证与配置(补充)
```bash
# 变体实现(与上文代码相似度100.0%,此处为AI图像生成基础版的差异化处理路径)
newcli.com/ai-model" # 可选,默认即此值
校验配置是否就绪:
[ -n "${IMAGE_GEN_API_KEY:-}" ] && echo ok || echo missing
若 Key 缺失,引导用户通过 ai-model Image 服务渠道申请并配置环境变量,完成后重新发起生成请求. 安全红线: 永不接受/回显/存储来自聊天输入的 Key;永不将 Key 写入日志或图片元数据.
基础生成(补充)
# 默认 2K-16x9 横屏
# ...
# 指定 1:1 方形(社交头像)
python3 (请参考skill目录中的脚本文件) "你的提示词" \
--model ai-model-3.1-flash-image-2k \
--output avatar.png
# ...
# 指定 9:16 竖屏(手机壁纸)
python3 (请参考skill目录中的脚本文件) "你的提示词" \
1-flash-image-2k-9x16 \
--output wallpaper.png
脚本将生成的文件路径输出到 stdout,Agent 应将文件回传给用户.
参数说明(补充)
| 参数2 | 必填 | 说明 |
|---|---|---|
| prompt | 是 | 图片描述提示词 |
可用模型(基础版)(补充)
标准分辨率(补充)
| 模型 ID2 | 比例 | 适用场景 |
|---|---|---|
| ai-model-3.1-flash-image | 1:1 | 社交媒体头像 |
| ai-model-3.1-flash-image-9x16 | 9:16 | 手机壁纸/短视频 |
| ai-model-3.1-flash-image-16x9 | 16:9 | 电脑壁纸 |
2K 分辨率(推荐)
| 模型 ID | 比例 |
|---|---|
| ai-model-3.1-flash-image-2k | 1:1 |
| ai-model-3.1-flash-image-2k-9x16 | 9:16 |
| ai-model-3.1-flash-image-2k-16x9 | 16:9 |
升级提示: 4K 印刷级分辨率、图生图、风格转换、批量生成等高级能力仅在 ai-image-gen 专业版中提供.
提示词技巧(补充)
场景说明
| 场景 | 典型输入 | 输出内容 |
|---|---|---|
| 社交头像生成 | "生成一张赛博朋克风头像" | 1:1 PNG 文件 |
| 手机壁纸生成 | "做一张星空主题竖屏壁纸" | 9:16 PNG 文件 |
| 横幅配图生成 | "科技主题横幅配图" | 16:9 PNG 文件 |
不适用于: 图生图二次创作、图片风格转换、4K 印刷输出、批量生成(需升级专业版).
使用指南
校验配置
确认 IMAGE_GEN_API_KEY 已设置,否则引导用户配置.
选择模型
根据用途选择比例: 头像选 1:1,壁纸选 9:16,横幅选 16:9。默认 2K-16x9.
优化提示词
将用户描述扩展为详细提示词,覆盖主体、场景、光线、风格、色调.
执行生成与展示
调用脚本生成图片,读取文件路径并回传用户. 结果验证: 任务完成后,查看输出确认状态。成功时返回摘要和数据;失败时根据错误信息排查,参考恢复章节获取修复步骤. 使用步骤:
- 阅读依赖说明章节,确认运行环境已就绪
- 根据任务需求,参考核心能力章节选择对应能力
- 按照能力描述提供输入参数,执行操作
- 查看输出结果,确认任务完成状态
案例展示
案例一: 社交媒体头像
场景: 用户需要生成一张赛博朋克风格的方形头像
python3 (请参考skill目录中的脚本文件) \
"赛博朋克风格女性肖像,霓虹灯光映射面部,紫色与青色主色调,雨后湿润质感,高对比度,1:1 构图" \
--output avatar.png
输出: avatar.png 文件路径
说明: 2K 方形模型适配社交头像标准尺寸,提示词覆盖风格(赛博朋克)、色调(紫/青)、质感(雨后湿润)与构图(1:1).
案例二: 手机壁纸
场景: 创作者需要一张星空主题的竖屏手机壁纸
python3 (请参考skill目录中的脚本文件) \
"深邃星空,银河横跨夜空,远山下宁静的湖泊倒映星光,极简构图,冷色调,9:16 竖屏" \
1-flash-image-2k-9x16 \
输出: wallpaper.png 文件路径
说明: 9:16 竖屏模型适配手机壁纸比例,冷色调与极简构图描述确保画面氛围统一.
异常处置
| 错误场景 | 错误信息 | 原因分析 | 处理方式 |
|---|---|---|---|
| missing_api_key | IMAGE_GEN_API_KEY missing | 环境变量未设置 | 不调 API,引导用户申请并配置 Key |
| 401 unauthorized | {"error":"invalid_api_key"} | Key 失效或格式错误 | 检查网络连接和配置后重试,引导用户重新获取 Key |
| 429 rate_limited | {"error":"rate_limited"} | 短时间请求过多 | 等待 2 秒后检查网络连接和配置后重试,最多 3 次 |
| 400 unsupported_model | {"error":"model_not_found"} | 模型 ID 拼写错误 | 检查网络连接和配置后重试,核对可用模型列表 |
| 5xx server_error | HTTP 500/502/503 | ai-model Image 服务端错误 | 等待后检查网络连接和配置后重试,最多 2 次 |
问题汇总
Q1: 基础版与专业版有什么区别?
A: 基础版(LITE)支持文生图、标准/2K 分辨率、10 种比例。专业版(ai-image-gen)额外提供: 4K 印刷级分辨率、图生图(图+文)、风格转换、批量生成,以及更完整的高级参数与案例.
Q2: 默认模型是什么?
A: 默认 ai-model-3.1-flash-image-2k-16x9(2K 分辨率,16:9 横屏)。可通过 --model 切换其他比例与分辨率.
Q3: 支持哪些画面比例?
A: 支持 1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9 共 10 种。基础版在标准与 2K 两档均提供全比例,4K 档需升级专业版.
Q4: 生成的图片能商用吗?
A: 图片版权以 ai-model Image 服务方条款为准。商业使用前请确认服务条款,本技能仅负责生成调用,不代为处理版权登记与授权.
注意事项
- 仅文生图: 不支持图生图与风格转换(需升级专业版)
- 无 4K: 仅支持标准与 2K 分辨率,4K 印刷级输出需升级专业版
- 需 API Key: 必须配置
IMAGE_GEN_API_KEY - 生成质量取决于提示词: 描述越具体结果越符合预期
- 需网络访问: 无法访问 IMAGE_GEN_BASE_URL 时不可用
- 确认运行环境满足依赖说明中的要求
- 在AI Agent对话中调用本技能,提供必要的输入参数
- 检查输出结果,根据需要进行后续处理
想要 4K 印刷级输出、图生图、风格转换、批量生成? 升级到 ai-image-gen 专业版解锁全部高级能力.
结果格式
{
"success": true,
"data": {
"result": "AI图像生成基础版处理结果",
"execution_time": "0.5s",
"metadata": {
"version": "1.0",
"processor": "ai-image-gen"
}
},
"execution_log": [
"解析输入参数",
"执行核心处理",
"格式化输出结果"
],
"error": null
}
创新优势
效率提升量化分析
| 操作步骤 | 手动耗时 | 自动化耗时 | 时间节约 | 准确率提升 |
|---|---|---|---|---|
| 手动绘制图像 | 1小时 | 5分钟 | 55分钟 | 95% |
| 手动搜索图片素材 | 30分钟 | 3分钟 | 27分钟 | 90% |
| 手动调整图像风格 | 30分钟 | 2分钟 | 28分钟 | 85% |
| 手动创建社交媒体头像 | 20分钟 | 2分钟 | 18分钟 | 80% |
| 手动生成个人创作者图片原型 | 1小时 | 10分钟 | 50分钟 | 75% |
差异化对比
| 对比维度 | 本技能 | 手动操作 | Python脚本 | 专业软件 |
|---|---|---|---|---|
| 操作便捷性 | 高 | 低 | 中 | 高 |
| 生成速度 | 快 | 慢 | 较快 | 快 |
| 成本 | 低 | 高 | 中 | 高 |
| 可定制性 | 高 | 低 | 中 | 高 |
| 学习门槛 | 低 | 高 | 中 | 高 |
| 适用范围 | 广泛 | 有限 | 有限 | 广泛 |
核心痛点解决
| 痛点 | 描述 | 影响范围 | 解决方案 | 量化效果 |
|---|---|---|---|---|
| 时间成本高 | 手动绘制和搜索图像素材耗时 | 影响工作效率和创意实现 | 自动化生成图像 | 时间节约55分钟,效率提升95% |
| 创意受限 | 手动调整图像风格和构图受限 | 影响作品质量和创意发挥 | 提供多种风格和比例选择 | 创意发挥空间增加,作品质量提升 |
| 成本高昂 | 使用专业软件生成图像成本高 | 影响个人和中小企业预算 | 提供免费基础版服务 | 成本降低,易于普及 |
问题排查手册
| 错误现象 | 可能原因 | 诊断步骤 | 解决方案 |
|---|---|---|---|
| 无法生成图像 | API Key配置错误 | 检查API Key是否正确配置 | 重新配置API Key |
| 生成图像质量差 | 提示词描述不准确 | 优化提示词描述,增加细节 | 优化提示词 |
| 生成图像尺寸错误 | 输出参数设置错误 | 检查输出参数设置 | 修正输出参数 |
| 生成图像风格不符合预期 | 模型选择不当 | 尝试不同模型或调整参数 | 尝试不同模型或调整参数 |
| 无法连接到API | 网络连接问题 | 检查网络连接 | 修复网络连接 |
安全规范
- 确保API Key安全,避免泄露给第三方。
- 不要将API Key存储在公共代码库或版本控制系统中。
- 使用HTTPS协议确保数据传输安全。
- 定期更新API Key,防止被恶意使用。
- 避免在公共场合展示API Key,防止被他人窃取。
安全风险防范
| 风险项 | 等级 | 防护措施 | 验证方法 |
|---|---|---|---|
| API密钥泄露 | 高 | 通过环境变量配置,禁止硬编码 | 定期检查代码和配置文件 |
| 命令执行风险 | 高 | 仅执行白名单命令,避免拼接用户输入 | 使用沙箱环境测试 |
| 网络通信安全 | 中 | 使用HTTPS协议,验证SSL证书 | 定期检查证书有效期 |
| 敏感数据暴露 | 高 | 输出结果中不包含密钥、令牌等敏感信息 | 日志脱敏审查 |
| 未授权访问 | 中 | 限制访问权限,实施认证机制 | 定期审计访问日志 |
问答集
Q1: AI图像生成基础版支持哪些输入格式?
A1: ai-model Flas。支持文本指令和结构化参数输入,具体格式参考使用流程章节。
Q2: 需要配置API Key吗?
A2: 是的,部分功能需要配置对应平台的API Key。请在依赖说明章节查看具体要求,并通过环境变量安全配置。
Q3: 命令行执行失败怎么办?
A3: 检查命令参数是否正确,确认运行环境支持exec能力。如遇权限问题,请参照错误处理章节排查。
故障处理方案
针对AI图像生成基础版使用中可能遇到的常见问题,提供以下排查方案:
| 错误类型 | 原因分析 | 解决方案 |
|---|---|---|
| API认证失败(401) | API密钥错误或过期 | 检查密钥配置,重新生成token |
| 接口限流(429) | 请求频率超出限制 | 降低调用频率,启用重试退避策略 |
| 响应超时(504) | 网络延迟或服务端负载过高 | 增加超时阈值,检查网络连接 |
| 文件不存在 | 路径错误或文件未创建 | 检查路径拼写,确认文件已生成 |
| 文件格式不支持 | 扩展名不在支持列表中 | 转换为支持的格式后重试 |
| 权限不足 | 当前用户无读写权限 | 检查文件权限,以管理员身份运行 |
| 命令执行失败 | 参数错误或环境依赖缺失 | 检查命令语法,确认依赖已安装 |
| 进程超时 | 命令执行时间过长 | 增加超时设置,优化命令参数 |
| 网络连接失败 | DNS解析失败或防火墙拦截 | 检查网络配置,确认代理设置 |
AI图像生成基础版通用排查步骤
- 检查输入参数: 确认所有必填参数已提供且格式正确
- 查看日志输出: 定位具体错误行和异常类型
- 验证环境配置: 确认依赖库版本和运行环境满足要求
- 逐步调试: 缩小问题范围,隔离故障模块
Related skills
AI图像生成提示词 crafting 工具,提供模板库与基础优化,适合个人创作者提升出图质量。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
轻量级AI图片生成工具,支持单图生成与基础提示词,适合个人用户快速创作视觉内容。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
使用图像生成API创建与编辑横幅插画,支持1K/2K/4K分辨率与草稿迭代流程,适合个人创作。Use when 需要API集成、接口对接、Webhook配置、系统连接时使用。不适用于逆向工程闭源API。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
轻量级AI图片生成工具,支持文生图与基础图片编辑,适合个人创意原型制作。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
创建、检查、处理与优化图像文件,支持格式选择、裁剪压缩与元数据管理。Use when 需要数据分析、报表生成、统计洞察、数据可视化时使用。不适用于实时流数据处理。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。