设计与多媒体

ai-image-gen-free

试用

AI 图像生成基础版(免费),通过执行脚本调用 ai-model Flash Image API 完成文本生成图像. 核心能力: - 文生图: 文本提示词生成图像,支持主体/场景/光线/风格/色调描述 - 多比例: 1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9 共 10 种 - 双分辨率: 标准 / 2K 适用场景: - 社交媒体头像、封面、壁纸快速生成 - 个人创作者图片原型与灵感草图 - 学习试用与轻量图像生产

它能做什么

AI 图像生成基础版(免费),通过执行脚本调用 ai-model Flash Image API 完成文本生成图像. 核心能力: - 文生图: 文本提示词生成图像,支持主体/场景/光线/风格/色调描述 - 多比例: 1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9 共 10 种 - 双分辨率: 标准 / 2K 适用场景: - 社交媒体头像、封面、壁纸快速生成 - 个人创作者图片原型与灵感草图 - 学习试用与轻量图像生产

技能文档

AI Image Gen LITE

AI 图像生成基础版,通过执行 (请参考skill目录中的脚本文件) 调用 ai-model Flash Image API 生成图片。仅支持文本生成图像(文生图),覆盖标准与 2K 两档分辨率、10 种画面比例. 范围外(本技能不做): 图生图(图+文)、风格转换、4K 分辨率、批量生成(需升级 ai-image-gen 专业版).

依赖与配置

运行环境

  • Agent平台: 支持SKILL.md的任意AI Agent(ai-assistant Code / Cursor / Codex / ai-model CLI等)
  • 操作系统: Windows / macOS / Linux

依赖项

依赖项类型是否必需获取方式
LLM APIAPI必需由Agent内置LLM提供

API Key 配置

需要配置对应API Key,详见上文环境配置章节

可用性分类

  • 分类: MD+EXEC()

API Key配置方式:

export API_KEY="${API_KEY:?请设置环境变量}"

配置后需重启会话或开启新终端生效。API Key应妥善保管,避免泄露到版本控制系统.

主要能力

认证与配置

脚本通过环境变量读取 API 配置,永不硬编码 Key 到脚本文件.

export IMAGE_GEN_API_KEY="${API_KEY:?请设置环境变量}"
export IMAGE_GEN_BASE_URL="https://code.newcli.com/ai-model"  # 可选,默认即此值

校验配置是否就绪:

[ -n "${IMAGE_GEN_API
# ...
**处理**: 解析API密钥和配置参数,验证认证信息有效性,初始化运行时环境.
# ...

### 基础生成
# ...
使用 `(请参考skill目录中的脚本文件)` 完成文生图:
# ...
```bash
# 默认 2K-16x9 横屏
python3 (请参考skill目录中的脚本文件) "你的提示词" --output output.png

# 指定 1:1 方形(社交头像)
python3 (请参考skill目录中的脚本文件) "你的提示词" \
  --model ge

**处理**: 解析文本提示词和生成参数,调用AI模型API执行生成任务,返回生成结果.
### 参数说明

| 参数 | 必填 | 说明 |
|:-----|:-----|:-----|
| prompt | 是 | 图片描述提示词 |
| --model, -m | 否 | 模型名称,默认 ai-model-3.1-flash-image-2k-16x9 |
| --output, -o | 否 | 输出文件路径,默认当前目录 generated_image.png |

**处理**: 解析命令行参数和配置选项,验证参数合法性,映射到内部处理流程.
### 可用模型(基础版)
默认模型 `ai-model-3.1-flash-image-2k-16x9`(2K,16:9 横屏).

### 标准分辨率
| 模型 ID | 比例 | 适用场景 |
|---:|---:|---:|
| ai-model-3.1-flash-image | 1:1 | 社交媒体头像 |
| ai-model-3.1-flash-image-9x16 | 9:16 | 手机壁纸/短视频 |
| ge

### 提示词技巧

- **具体描述**: 主体、场景、光线、风格、色调
- **风格参考**: 水彩、油画、赛博朋克、吉卜力、写实摄影、中国工笔
- **构图说明**: 视角(俯视/仰视)、景深、焦点
- **色彩指定**: 主色调、配色方案

## 认证与配置(补充)

```bash
# 变体实现(与上文代码相似度100.0%,此处为AI图像生成基础版的差异化处理路径)
newcli.com/ai-model"  # 可选,默认即此值

校验配置是否就绪:

[ -n "${IMAGE_GEN_API_KEY:-}" ] && echo ok || echo missing

若 Key 缺失,引导用户通过 ai-model Image 服务渠道申请并配置环境变量,完成后重新发起生成请求. 安全红线: 永不接受/回显/存储来自聊天输入的 Key;永不将 Key 写入日志或图片元数据.

基础生成(补充)

# 默认 2K-16x9 横屏
# ...
# 指定 1:1 方形(社交头像)
python3 (请参考skill目录中的脚本文件) "你的提示词" \
  --model ai-model-3.1-flash-image-2k \
  --output avatar.png
# ...
# 指定 9:16 竖屏(手机壁纸)
python3 (请参考skill目录中的脚本文件) "你的提示词" \
1-flash-image-2k-9x16 \
  --output wallpaper.png

脚本将生成的文件路径输出到 stdout,Agent 应将文件回传给用户.

参数说明(补充)

参数2必填说明
prompt图片描述提示词

可用模型(基础版)(补充)

标准分辨率(补充)

模型 ID2比例适用场景
ai-model-3.1-flash-image1:1社交媒体头像
ai-model-3.1-flash-image-9x169:16手机壁纸/短视频
ai-model-3.1-flash-image-16x916:9电脑壁纸

2K 分辨率(推荐)

模型 ID比例
ai-model-3.1-flash-image-2k1:1
ai-model-3.1-flash-image-2k-9x169:16
ai-model-3.1-flash-image-2k-16x916:9

升级提示: 4K 印刷级分辨率、图生图、风格转换、批量生成等高级能力仅在 ai-image-gen 专业版中提供.

提示词技巧(补充)

场景说明

场景典型输入输出内容
社交头像生成"生成一张赛博朋克风头像"1:1 PNG 文件
手机壁纸生成"做一张星空主题竖屏壁纸"9:16 PNG 文件
横幅配图生成"科技主题横幅配图"16:9 PNG 文件

不适用于: 图生图二次创作、图片风格转换、4K 印刷输出、批量生成(需升级专业版).

使用指南

校验配置

确认 IMAGE_GEN_API_KEY 已设置,否则引导用户配置.

选择模型

根据用途选择比例: 头像选 1:1,壁纸选 9:16,横幅选 16:9。默认 2K-16x9.

优化提示词

将用户描述扩展为详细提示词,覆盖主体、场景、光线、风格、色调.

执行生成与展示

调用脚本生成图片,读取文件路径并回传用户. 结果验证: 任务完成后,查看输出确认状态。成功时返回摘要和数据;失败时根据错误信息排查,参考恢复章节获取修复步骤. 使用步骤:

  1. 阅读依赖说明章节,确认运行环境已就绪
  2. 根据任务需求,参考核心能力章节选择对应能力
  3. 按照能力描述提供输入参数,执行操作
  4. 查看输出结果,确认任务完成状态

案例展示

案例一: 社交媒体头像

场景: 用户需要生成一张赛博朋克风格的方形头像

python3 (请参考skill目录中的脚本文件) \
  "赛博朋克风格女性肖像,霓虹灯光映射面部,紫色与青色主色调,雨后湿润质感,高对比度,1:1 构图" \
  --output avatar.png

输出: avatar.png 文件路径

说明: 2K 方形模型适配社交头像标准尺寸,提示词覆盖风格(赛博朋克)、色调(紫/青)、质感(雨后湿润)与构图(1:1).

案例二: 手机壁纸

场景: 创作者需要一张星空主题的竖屏手机壁纸

python3 (请参考skill目录中的脚本文件) \
  "深邃星空,银河横跨夜空,远山下宁静的湖泊倒映星光,极简构图,冷色调,9:16 竖屏" \
1-flash-image-2k-9x16 \

输出: wallpaper.png 文件路径

说明: 9:16 竖屏模型适配手机壁纸比例,冷色调与极简构图描述确保画面氛围统一.

异常处置

错误场景错误信息原因分析处理方式
missing_api_keyIMAGE_GEN_API_KEY missing环境变量未设置不调 API,引导用户申请并配置 Key
401 unauthorized{"error":"invalid_api_key"}Key 失效或格式错误检查网络连接和配置后重试,引导用户重新获取 Key
429 rate_limited{"error":"rate_limited"}短时间请求过多等待 2 秒后检查网络连接和配置后重试,最多 3 次
400 unsupported_model{"error":"model_not_found"}模型 ID 拼写错误检查网络连接和配置后重试,核对可用模型列表
5xx server_errorHTTP 500/502/503ai-model Image 服务端错误等待后检查网络连接和配置后重试,最多 2 次

问题汇总

Q1: 基础版与专业版有什么区别?

A: 基础版(LITE)支持文生图、标准/2K 分辨率、10 种比例。专业版(ai-image-gen)额外提供: 4K 印刷级分辨率、图生图(图+文)、风格转换、批量生成,以及更完整的高级参数与案例.

Q2: 默认模型是什么?

A: 默认 ai-model-3.1-flash-image-2k-16x9(2K 分辨率,16:9 横屏)。可通过 --model 切换其他比例与分辨率.

Q3: 支持哪些画面比例?

A: 支持 1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9 共 10 种。基础版在标准与 2K 两档均提供全比例,4K 档需升级专业版.

Q4: 生成的图片能商用吗?

A: 图片版权以 ai-model Image 服务方条款为准。商业使用前请确认服务条款,本技能仅负责生成调用,不代为处理版权登记与授权.

注意事项

  1. 仅文生图: 不支持图生图与风格转换(需升级专业版)
  2. 无 4K: 仅支持标准与 2K 分辨率,4K 印刷级输出需升级专业版
  3. 需 API Key: 必须配置 IMAGE_GEN_API_KEY
  4. 生成质量取决于提示词: 描述越具体结果越符合预期
  5. 需网络访问: 无法访问 IMAGE_GEN_BASE_URL 时不可用

  1. 确认运行环境满足依赖说明中的要求
  2. 在AI Agent对话中调用本技能,提供必要的输入参数
  3. 检查输出结果,根据需要进行后续处理

想要 4K 印刷级输出、图生图、风格转换、批量生成? 升级到 ai-image-gen 专业版解锁全部高级能力.

结果格式

{
  "success": true,
  "data": {
    "result": "AI图像生成基础版处理结果",
    "execution_time": "0.5s",
    "metadata": {
      "version": "1.0",
      "processor": "ai-image-gen"
    }
  },
  "execution_log": [
    "解析输入参数",
    "执行核心处理",
    "格式化输出结果"
  ],
  "error": null
}

创新优势

效率提升量化分析

操作步骤手动耗时自动化耗时时间节约准确率提升
手动绘制图像1小时5分钟55分钟95%
手动搜索图片素材30分钟3分钟27分钟90%
手动调整图像风格30分钟2分钟28分钟85%
手动创建社交媒体头像20分钟2分钟18分钟80%
手动生成个人创作者图片原型1小时10分钟50分钟75%

差异化对比

对比维度本技能手动操作Python脚本专业软件
操作便捷性
生成速度较快
成本
可定制性
学习门槛
适用范围广泛有限有限广泛

核心痛点解决

痛点描述影响范围解决方案量化效果
时间成本高手动绘制和搜索图像素材耗时影响工作效率和创意实现自动化生成图像时间节约55分钟,效率提升95%
创意受限手动调整图像风格和构图受限影响作品质量和创意发挥提供多种风格和比例选择创意发挥空间增加,作品质量提升
成本高昂使用专业软件生成图像成本高影响个人和中小企业预算提供免费基础版服务成本降低,易于普及

问题排查手册

错误现象可能原因诊断步骤解决方案
无法生成图像API Key配置错误检查API Key是否正确配置重新配置API Key
生成图像质量差提示词描述不准确优化提示词描述,增加细节优化提示词
生成图像尺寸错误输出参数设置错误检查输出参数设置修正输出参数
生成图像风格不符合预期模型选择不当尝试不同模型或调整参数尝试不同模型或调整参数
无法连接到API网络连接问题检查网络连接修复网络连接

安全规范

  1. 确保API Key安全,避免泄露给第三方。
  2. 不要将API Key存储在公共代码库或版本控制系统中。
  3. 使用HTTPS协议确保数据传输安全。
  4. 定期更新API Key,防止被恶意使用。
  5. 避免在公共场合展示API Key,防止被他人窃取。

安全风险防范

风险项等级防护措施验证方法
API密钥泄露通过环境变量配置,禁止硬编码定期检查代码和配置文件
命令执行风险仅执行白名单命令,避免拼接用户输入使用沙箱环境测试
网络通信安全使用HTTPS协议,验证SSL证书定期检查证书有效期
敏感数据暴露输出结果中不包含密钥、令牌等敏感信息日志脱敏审查
未授权访问限制访问权限,实施认证机制定期审计访问日志

问答集

Q1: AI图像生成基础版支持哪些输入格式?

A1: ai-model Flas。支持文本指令和结构化参数输入,具体格式参考使用流程章节。

Q2: 需要配置API Key吗?

A2: 是的,部分功能需要配置对应平台的API Key。请在依赖说明章节查看具体要求,并通过环境变量安全配置。

Q3: 命令行执行失败怎么办?

A3: 检查命令参数是否正确,确认运行环境支持exec能力。如遇权限问题,请参照错误处理章节排查。

故障处理方案

针对AI图像生成基础版使用中可能遇到的常见问题,提供以下排查方案:

错误类型原因分析解决方案
API认证失败(401)API密钥错误或过期检查密钥配置,重新生成token
接口限流(429)请求频率超出限制降低调用频率,启用重试退避策略
响应超时(504)网络延迟或服务端负载过高增加超时阈值,检查网络连接
文件不存在路径错误或文件未创建检查路径拼写,确认文件已生成
文件格式不支持扩展名不在支持列表中转换为支持的格式后重试
权限不足当前用户无读写权限检查文件权限,以管理员身份运行
命令执行失败参数错误或环境依赖缺失检查命令语法,确认依赖已安装
进程超时命令执行时间过长增加超时设置,优化命令参数
网络连接失败DNS解析失败或防火墙拦截检查网络配置,确认代理设置

AI图像生成基础版通用排查步骤

  1. 检查输入参数: 确认所有必填参数已提供且格式正确
  2. 查看日志输出: 定位具体错误行和异常类型
  3. 验证环境配置: 确认依赖库版本和运行环境满足要求
  4. 逐步调试: 缩小问题范围,隔离故障模块

相关技能

通过文本描述生成图片,支持多种比例与标准分辨率,适合个人创作者快速出图。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

AI图像生成提示词 crafting 工具,提供模板库与基础优化,适合个人创作者提升出图质量。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

轻量级AI图片生成工具,支持单图生成与基础提示词,适合个人用户快速创作视觉内容。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

2 次安装

使用图像生成API创建与编辑横幅插画,支持1K/2K/4K分辨率与草稿迭代流程,适合个人创作。Use when 需要API集成、接口对接、Webhook配置、系统连接时使用。不适用于逆向工程闭源API。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

1 次安装

轻量级AI图片生成工具,支持文生图与基础图片编辑,适合个人创意原型制作。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

1 次安装

创建、检查、处理与优化图像文件,支持格式选择、裁剪压缩与元数据管理。Use when 需要数据分析、报表生成、统计洞察、数据可视化时使用。不适用于实时流数据处理。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。