Batch image processing - compress, resize, format convert, watermark, EXIF clean, and crop. All local, no upload needed.
设计与多媒体
图像处理基础版
试用创建、检查、处理与优化图像文件,支持格式选择、裁剪压缩与元数据管理。Use when 需要数据分析、报表生成、统计洞察、数据可视化时使用。不适用于实时流数据处理。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。
它能做什么
创建、检查、处理与优化图像文件,支持格式选择、裁剪压缩与元数据管理。Use when 需要数据分析、报表生成、统计洞察、数据可视化时使用。不适用于实时流数据处理。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。
技能文档
图像处理基础版
概述
本工具是 图像处理 领域的 FREE 版本 AI Skill,专为个人用户与轻量级场景设计。通过自然语言指令驱动 AI Agent 执行任务,提供核心功能与简洁易用的操作体验. FREE 版本与 PRO 版本完全兼容,可在需要时升级至 PRO 版本获取高级功能、批量操作与团队协同能力.
版本定位
| 维度 | FREE 版本 | PRO 版本 |
|---|---|---|
| 目标用户 | 个人用户 | 企业团队 |
| 功能范围 | 核心功能 | 全部功能 |
| 批量操作 | 不支持 | 支持 |
| 团队协作 | 不支持 | 支持 |
| 技术支持 | 社区支持 | 优先响应 |
| 数据分析 | 基础统计 | 高级分析 |
核心能力
FREE 版本提供以下能力:
检查图像尺寸、比例与色彩配置
检查图像尺寸、比例与色彩配置
处理: 解析检查图像尺寸、比例与色彩配置的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回检查图像尺寸、比例与色彩配置的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
裁剪、调整大小与格式转换
裁剪、调整大小与格式转换
处理: 解析裁剪、调整大小与格式转换的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回裁剪、调整大小与格式转换的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
压缩优化并控制文件大小
压缩优化并控制文件大小
处理: 解析压缩优化并控制文件大小的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回压缩优化并控制文件大小的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
管理 EXIF 与 ICC 元
管理 EXIF 与 ICC 元数据
处理: 解析管理 EXIF 与 ICC 元的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回管理 EXIF 与 ICC 元的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
支持 PNG/JPEG/Web
支持 PNG/JPEG/WebP/AVIF 格式
处理: 解析支持 PNG/JPEG/Web的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回支持 PNG/JPEG/Web的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
功能详情
本版本提供 5 项核心能力,覆盖 图像处理 的常见使用场景。如需批量操作、团队协作、数据分析等高级功能,可升级至 PRO 版本. FREE 版本核心功能清单:
- 检查图像尺寸、比例与色彩配置
- 裁剪、调整大小与格式转换
- 压缩优化并控制文件大小
- 管理 EXIF 与 ICC 元数据
- 支持 PNG/JPEG/WebP/AVIF 格式
PRO 版本扩展功能预览:
- 批量图像处理与自动化流水线
- 响应式图片生成:多尺寸 srcset 自动输出
- CDN 集成与图片上传管道
- 无障碍优化:Alt 文本建议与对比度检查
- 图片质量评分与自动优化建议
- 水印批量添加与品牌资源管理
处理: 解析功能详情的输入参数,完成核心逻辑,返回结构化响应.
输出: 返回功能详情的响应数据,包含状态码、结果和日志.
技术参数:使用input_params和output_format参数控制执行行为,支持json/text/csv输出格式.
能力覆盖范围:本skill的核心能力覆盖以下场景关键词:处理与优化图像文、支持格式选择、裁剪压缩与元数据、图像处理领域的专、辅助工具、提供核心基础功能等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持.
使用场景
场景 1: Web 图片优化
将图片优化为 Web 友好格式并控制大小
用户可通过自然语言指令触发此场景,工具将自动执行相应操作并返回结构化结果.
输入格式
| 参数名 | 类型 | 必填 | 说明 |
|---|---|---|---|
| input | string | 是 | 图像处理基础版处理的输入数据或指令 |
| options | object | 否 | 附加配置选项,如模式选择、格式偏好等 |
| callback_url | string | 否 | 异步处理完成后的回调通知URL |
# 转换为 WebP 并压缩
convert input.jpg -resize 1920x -quality 80 output.webp
# 生成多尺寸响应式图片
convert input.jpg -resize 640x small.webp
convert input.jpg -resize 1280x medium.webp
场景 2: 截图处理
截屏后裁剪、标注并优化输出
# 截图裁剪并添加标注
convert screenshot.png -crop 800x600+100+50 -fill red -draw "rectangle 10,10 50,50" annotated.png
不适用场景
以下场景图像处理基础版不适合处理:
- 实时流数据处理
- 小规模数据手动分析
- 非结构化文本情感分析
触发条件
需要数据分析、报表生成、统计洞察、数据可视化时使用。不适用于非本工具能力范围的需求.
快速开始
1. 环境准备
确保已安装并配置好 AI Agent 环境(Claude Code / Cursor / Codex / Gemini CLI 等),本 Skill 通过 SKILL.md 指令驱动 Agent 执行任务. 系统要求:
- 操作系统: Windows / macOS / Linux
- Agent 平台: 支持 SKILL.md 格式的任意 AI Agent
- 运行时: Python 3.8+ 或 Node.js 18+(视具体操作需求)
2. 配置参数
# ImageMagick 基本操作
convert input.jpg -resize 50% -quality 85 output.jpg
# 批量转换
mogrify -format webp -path output/ *.jpg
# 检查图片信息
identify -verbose image.png | head -20
3. 验证配置
配置完成后,可通过以下方式验证是否正常工作:
# 验证环境变量是否设置
echo "配置检查:"
env | grep -E "API|KEY|TOKEN|SECRET" | sed "s/=.*/=***/" # Linux/macOS
# 或 PowerShell
# Get-ChildItem Env: | Where-Object {$_.Name -match "API|KEY|TOKEN"} | Format-Table
4. 开始使用
在 AI Agent 对话中描述你的需求,Agent 会根据本 Skill 的指令自动执行对应操作.
请帮我Web 图片优化
Agent 将自动:
- 解析你的自然语言指令
- 调用相应的工具或 API
- 执行操作并返回结果
- 返回执行结果供你确认
示例
基础配置
# ImageMagick 基本操作
# 批量转换
# 检查图片信息
可选配置
{
"edition": "free",
"auto_retry": false,
"max_concurrent": 1,
"log_level": "info",
"cache_enabled": true,
"timeout": 30
}
FREE 配置项说明:
| 配置项 | 类型 | 默认值 | 说明 |
|---|---|---|---|
| auto_retry | bool | false | 失败后自动重试 |
| max_concurrent | int | 1 | 最大并发数(FREE 限制为1) |
| log_level | string | info | 日志级别 |
| cache_enabled | bool | true | 启用结果缓存 |
| timeout | int | 30 | 操作超时时间(秒) |
最佳实践
- 先确定宽高比再裁剪,最后压缩
- 不要默认放大图片,额外像素不创造细节
- Web 图片通常使用 sRGB 色彩空间
- 保留原始主文件,只导出交付版本
个人使用建议
- 从简单任务开始熟悉工具行为,逐步扩展到复杂场景
- 定期备份配置文件与数据,防止意外丢失
- 遇到问题先查阅常见问题章节,再寻求社区帮助
- 保持配置简洁,只启用必要的功能选项
- 定期更新工具版本以获取最新功能与修复
- 记录常用操作命令,提高日常使用效率
常见问题
Q: 透明图片保存为 JPEG 丢失透明度?
A: JPEG 不支持透明通道,请使用 PNG 或 WebP 格式.
Q: 截图用 JPEG 模糊怎么办?
A: 截图含文字等锐利边缘,应使用 PNG 或无损 WebP.
Q: 如何升级到 PRO 版本?
A: 升级到 PRO 版本非常简单:
- 获取 PRO 版本授权
- 安装 PRO 版本 Skill
- 原有配置自动迁移,无需额外操作
- 即可使用批量操作、团队协作等高级功能
已知限制
A: FREE 版本主要限制:
- 不支持批量操作(每次只能处理一个任务)
- 不支持团队协作(仅限个人使用)
- 不支持高级数据分析
- 技术支持依赖社区 如需这些功能,建议升级至 PRO 版本.
Q: FREE 版本的数据安全吗?
A: FREE 版本所有数据本地存储,不上传云端,确保隐私安全。建议定期备份配置文件与数据目录.
依赖说明
运行环境
- Agent 平台: 支持 SKILL.md 的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
- 操作系统: Windows / macOS / Linux
- 运行时: Python 3.8+ 或 Node.js 18+(视具体操作需求)
- 网络: 部分功能需要网络连接访问外部 API
依赖详情
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由 Agent 内置 LLM 提供 |
| curl | CLI 工具 | 推荐 | 系统自带或包管理器安装 |
| jq | JSON 处理 | 推荐 | apt install jq / brew install jq |
| Python 3.8+ | 运行时 | 视需求 | python.org 下载 |
| Node.js 18+ | 运行时 | 视需求 | nodejs.org 下载 |
API Key 配置
FREE 版本支持单一 API Key 配置,满足个人使用需求:
- 环境变量:通过环境变量配置 API Key
- 配置文件:支持配置文件方式存储 API Key
- 安全提醒:切勿将 API Key 硬编码到脚本或提交到版本控制系统
可用性分类
- 分类: MD+EXEC(纯 Markdown 指令,部分功能需要 exec 命令行执行能力)
- 说明: 基于 Markdown 的 AI Skill,通过自然语言指令驱动 Agent 执行任务
- FREE 特性: 支持单次执行、基础配置与社区支持
- 安全等级: 基础,数据本地存储,建议定期备份
- SLA: 社区支持,尽力响应
快速开始
- 确认运行环境满足依赖说明中的要求
- 在AI Agent对话中调用本技能,提供必要的输入参数
- 检查输出结果,根据需要进行后续处理
详细的输入输出格式请参考下方章节说明。
版本信息
| 项目 | 值 |
|---|---|
| 版本号 | 1.0.0 |
| 版本类型 | FREE |
| 许可证 | MIT |
| 兼容性 | 可升级至 PRO 版本 |
错误处理
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
输出格式
{
"success": true,
"data": {
"result": "图像处理基础版处理结果",
"execution_time": "0.5s",
"metadata": {
"version": "1.0",
"processor": "image"
}
},
"execution_log": ["解析输入参数", "执行核心处理", "格式化输出结果"],
"error": null
}
相关技能
AI图像生成提示词 crafting 工具,提供模板库与基础优化,适合个人创作者提升出图质量。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
通过文本描述生成图片,支持多种比例与标准分辨率,适合个人创作者快速出图。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
通过自然语言生成Mermaid流程图、时序图、ER图,快速可视化系统结构与业务流程。Use when 需要数据分析、报表生成、统计洞察、数据可视化时使用。不适用于实时流数据处理。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。
支持 Mermaid 和 Graphviz 生成流程图、思维导图、时序图等多种图表。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
轻量级AI图片生成工具,通过浏览器自动化操作Grok Imagine生成并保存图片。Use when 需要提升效率、自动化流程、批量处理、工作流优化时使用。不适用于需要人工创意判断的任务。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。