设计与多媒体

AI图像生成-免费版

试用

通过文本描述生成图片,支持多种比例与标准分辨率,适合个人创作者快速出图。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

它能做什么

通过文本描述生成图片,支持多种比例与标准分辨率,适合个人创作者快速出图。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

技能文档

核心功能: 本技能提供中文交互、化工作流场景等能力。

AI图像生成工具 - 免费版

概述

AI图像生成免费版是一款面向个人用户的文本生成图像工具。通过自然语言描述即可生成高质量图片,支持多种画幅比例与标准分辨率,无需绘画基础,几秒钟即可获得原创图像。

本版本依托 Gemini Flash Image 模型能力,提供基础的文生图功能,支持社交媒体头像、配图、创意灵感等多种场景,适合个人创作者快速产出图像内容。

核心能力

能力项免费版支持说明
文本生成图片输入描述生成图像
多比例支持1:1/3:2/16:9 等 10 种
标准分辨率基础清晰度
2K 分辨率限制部分比例支持
4K 分辨率PRO 版支持
图生图(图+文)PRO 版支持
风格转换PRO 版支持
批量生成PRO 版支持
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置。

核心功能执行

input_params参数进行配置。

输出: 返回核心功能执行的执行结果,包含操作状态和输出数据。

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

参数配置与调用

config_options参数进行配置。

输出: 返回参数配置与调用的执行结果,包含操作状态和输出数据。

  • 执行此能力时使用config_options参数,支持修改/重置/导入操作

结果处理与输出

output_format参数进行配置。

输出: 返回结果处理与输出的执行结果,包含操作状态和输出数据。

  • 执行此能力时使用output_format参数,支持导出/保存/转换操作 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:通过文本描述生成、支持多种比例与标、适合个人创作者快、速出图、图像生成免费版、面向个人用户的文、本生成图像工具、文本描述生成图片、文生图、等多种比例、标准分辨率输出、满足社交媒体与基、础设计需求、多风格支持、赛博朋克、写实摄影等等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。

使用场景

场景一:社交媒体头像

用户需要一个独特的社交媒体头像,生成一张 1:1 的艺术风格图片。

python3 scripts/generate_image.py \
  "一只戴着圆框眼镜的橘猫,水彩风格,柔和色调,简洁背景" \
  --model gemini-3.1-flash-image \
  --output avatar.png

场景二:短视频封面图

内容创作者为短视频制作 16:9 横版封面图。

  "未来都市夜景,霓虹灯光,赛博朋克风格,雨后湿润街道反射,电影感构图" \
  --model gemini-3.1-flash-image-16x9 \
  --output video_cover.png

场景三:创意灵感可视化

设计师希望快速将一个创意概念可视化,用于灵感记录。

  "一座漂浮在云端的图书馆,书籍如瀑布般倾泻而下,暖色调,梦幻氛围,吉卜力风格" \
  --model gemini-3.1-flash-image-3x2 \
  --output inspiration.png

不适用场景

以下场景AI图像生成-免费版不适合处理:

  • 需要100%确定性的关键决策
  • 医疗诊断
  • 法律判决

触发条件

需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于非本工具能力范围的需求。

快速开始

领先步:配置 API Key

export IMAGE_GEN_API_KEY="${API_KEY:?请设置环境变量}"
export IMAGE_GEN_BASE_URL="https://code.newcli.com/gemini"

第二步:执行生成命令

  "你的提示词描述" \
  --model gemini-3.1-flash-image \
  --output output.png

第三步:查看结果

生成的图片保存在 --output 指定路径,直接展示给用户即可。

示例

基础配置项说明:

# 环境变量
IMAGE_GEN_API_KEY=your_key                    # 必填
IMAGE_GEN_BASE_URL=https://code.newcli.com/gemini  # 默认值

# 常用参数组合
# 1:1 头像
--model gemini-3.1-flash-image

# 16:9 横版
--model gemini-3.1-flash-image-16x9

# 9:16 竖版(手机壁纸)
--model gemini-3.1-flash-image-9x16

# 2K 高清(部分比例)
--model gemini-3.1-flash-image-2k-16x9

可用模型(标准分辨率)

模型 ID比例适用场景
gemini-3.1-flash-image1:1社交媒体头像
gemini-3.1-flash-image-3x23:2横版照片
gemini-3.1-flash-image-2x32:3竖版海报
gemini-3.1-flash-image-4x54:5Instagram
gemini-3.1-flash-image-9x169:16手机壁纸/短视频
gemini-3.1-flash-image-16x916:9电脑壁纸/视频
gemini-3.1-flash-image-21x921:9超宽屏

优选实践

  1. 提示词要具体:描述主体、场景、光线、风格、色调,例如"一位老匠人在木工作坊中雕刻,暖黄光线,写实摄影风格"
  2. 指定艺术风格:水彩、油画、赛博朋克、吉卜力、写实摄影、中国工笔等
  3. 说明构图:视角(俯视/仰视)、景深、焦点位置
  4. 色彩指定:主色调与配色方案,如"以深红、金色、墨黑为主"
  5. 比例匹配用途:头像用 1:1,视频封面用 16:9,手机壁纸用 9:16

常见问题

Q1:生成的图片质量不够清晰?

A:免费版默认标准分辨率,可尝试使用 2K 模型(如 gemini-3.1-flash-image-2k-16x9)。如需 4K 超高清,请使用 PRO 版。

已知限制

A:建议控制在 500 字以内,过长的提示词可能影响生成效果。核心元素前置描述。

Q3:可以生成人物肖像吗?

A:可以,但请避免生成真实公众人物的肖像,以免涉及版权与肖像权问题。

Q4:生成失败怎么办?

A:检查 API Key 是否正确;确认网络可访问 API 地址;尝试简化提示词后重试。

Q5:免费版有调用次数限制吗?

A:API 调用受服务商配额限制,免费版配额较低。如需高频调用或批量生成,请使用 PRO 版。

  • 当前为免费版本,如需完整功能请升级到付费版获取全部能力

依赖说明

运行环境

  • Agent平台: 支持 SKILL.md 的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
  • 操作系统: Windows / macOS / Linux
  • 运行时: Python 3.8+

依赖详情

依赖项类型是否必需获取方式
Gemini Image API外部 API必需服务商申请
Python 3.8+运行时必需官方安装
requestsPython 库必需pip install requests
Pillow图像处理推荐pip install Pillow

API Key 配置

  • 环境变量名: IMAGE_GEN_API_KEY
  • 附加变量: IMAGE_GEN_BASE_URL(可选,有默认值)
  • 获取方式: 通过 API 服务商申请
  • 存储建议: 写入 .env 文件或系统环境变量,避免硬编码到脚本

可用性分类

  • 分类: MD+execute(纯 Markdown 指令,核心功能需要 exec 命令行执行能力)
  • 说明: 基于Markdown的AI Skill,通过Python脚本调用外部API生成图像

错误处理

错误场景原因处理方式
配置错误参数缺失或格式错误检查依赖说明中的配置要求
运行时错误运行环境不满足确认运行环境符合依赖说明
网络错误连接超时或不可达执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案

安全注意事项

风险类型防范措施
API密钥泄露通过环境变量配置,禁止硬编码到代码或配置文件中
命令执行风险仅执行白名单命令,避免拼接用户输入到命令行参数中
网络通信安全使用HTTPS协议,验证SSL证书有效性
敏感数据暴露输出结果中不包含密钥、令牌等敏感信息

使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。

效率量化分析

操作场景手动耗时自动化耗时效率提升
文件解析与提取5-10分钟/个<5秒/个60-120x
批量文件处理(100个)8-16小时<5分钟96-192x
API调用与响应解析2-3分钟/次<1秒/次120-180x
多接口数据聚合15-30分钟<10秒90-180x
命令执行与结果收集3-5分钟/次<2秒/次90-150x
重复任务批量执行因任务而异线性缩减5-50x
错误排查与修复10-30分钟<30秒20-60x

差异化对比

对比维度本技能传统手动方式通用脚本工具
自动化程度全流程自动完全手动部分自动
错误处理内置错误恢复依赖人工经验基本try-catch
可复用性参数化配置一次性脚本模板化
安全合规内置安全检查无安全保障无安全保障
适用场景核心功能通用场景通用场景

相关技能

AI图像生成提示词 crafting 工具,提供模板库与基础优化,适合个人创作者提升出图质量。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

AI 图像生成基础版(免费),通过执行脚本调用 ai-model Flash Image API 完成文本生成图像. 核心能力: - 文生图: 文本提示词生成图像,支持主体/场景/光线/风格/色调描述 - 多比例: 1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9 共 10 种 - 双分辨率: 标准 / 2K 适用场景: - 社交媒体头像、封面、壁纸快速生成 - 个人创作者图片原型与灵感草图 - 学习试用与轻量图像生产

轻量级AI图片生成工具,支持单图生成与基础提示词,适合个人用户快速创作视觉内容。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

2 次安装

Generate images from text with a free-quota-first multi-provider workflow. Use this skill when a user asks for text-to-image generation that needs provider r...

33 次安装

通过单一脚本调用多家官方图像生成 API,支持参考图与批量并发。

159 次安装1 星标

使用图像生成API创建与编辑横幅插画,支持1K/2K/4K分辨率与草稿迭代流程,适合个人创作。Use when 需要API集成、接口对接、Webhook配置、系统连接时使用。不适用于逆向工程闭源API。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

1 次安装