设计与多媒体

图像处理基础版

试用

创建、检查、处理与优化图像文件,支持格式选择、裁剪压缩与元数据管理。Use when 需要数据分析、报表生成、统计洞察、数据可视化时使用。不适用于实时流数据处理。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。

它能做什么

创建、检查、处理与优化图像文件,支持格式选择、裁剪压缩与元数据管理。Use when 需要数据分析、报表生成、统计洞察、数据可视化时使用。不适用于实时流数据处理。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。

技能文档

图像处理基础版

概述

本工具是 图像处理 领域的 FREE 版本 AI Skill,专为个人用户与轻量级场景设计。通过自然语言指令驱动 AI Agent 执行任务,提供核心功能与简洁易用的操作体验. FREE 版本与 PRO 版本完全兼容,可在需要时升级至 PRO 版本获取高级功能、批量操作与团队协同能力.

版本定位

维度FREE 版本PRO 版本
目标用户个人用户企业团队
功能范围核心功能全部功能
批量操作不支持支持
团队协作不支持支持
技术支持社区支持优先响应
数据分析基础统计高级分析

核心能力

FREE 版本提供以下能力:

检查图像尺寸、比例与色彩配置

检查图像尺寸、比例与色彩配置

处理: 解析检查图像尺寸、比例与色彩配置的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回检查图像尺寸、比例与色彩配置的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

裁剪、调整大小与格式转换

裁剪、调整大小与格式转换

处理: 解析裁剪、调整大小与格式转换的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回裁剪、调整大小与格式转换的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

压缩优化并控制文件大小

压缩优化并控制文件大小

处理: 解析压缩优化并控制文件大小的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回压缩优化并控制文件大小的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

管理 EXIF 与 ICC 元

管理 EXIF 与 ICC 元数据

处理: 解析管理 EXIF 与 ICC 元的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回管理 EXIF 与 ICC 元的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

支持 PNG/JPEG/Web

支持 PNG/JPEG/WebP/AVIF 格式

处理: 解析支持 PNG/JPEG/Web的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回支持 PNG/JPEG/Web的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

功能详情

本版本提供 5 项核心能力,覆盖 图像处理 的常见使用场景。如需批量操作、团队协作、数据分析等高级功能,可升级至 PRO 版本. FREE 版本核心功能清单:

  • 检查图像尺寸、比例与色彩配置
  • 裁剪、调整大小与格式转换
  • 压缩优化并控制文件大小
  • 管理 EXIF 与 ICC 元数据
  • 支持 PNG/JPEG/WebP/AVIF 格式

PRO 版本扩展功能预览:

  • 批量图像处理与自动化流水线
  • 响应式图片生成:多尺寸 srcset 自动输出
  • CDN 集成与图片上传管道
  • 无障碍优化:Alt 文本建议与对比度检查
  • 图片质量评分与自动优化建议
  • 水印批量添加与品牌资源管理

处理: 解析功能详情的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回功能详情的响应数据,包含状态码、结果和日志. 技术参数:使用input_paramsoutput_format参数控制执行行为,支持json/text/csv输出格式. 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:处理与优化图像文、支持格式选择、裁剪压缩与元数据、图像处理领域的专、辅助工具、提供核心基础功能等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持.

使用场景

场景 1: Web 图片优化

将图片优化为 Web 友好格式并控制大小

用户可通过自然语言指令触发此场景,工具将自动执行相应操作并返回结构化结果.

输入格式

参数名类型必填说明
inputstring图像处理基础版处理的输入数据或指令
optionsobject附加配置选项,如模式选择、格式偏好等
callback_urlstring异步处理完成后的回调通知URL
# 转换为 WebP 并压缩
convert input.jpg -resize 1920x -quality 80 output.webp
# 生成多尺寸响应式图片
convert input.jpg -resize 640x small.webp
convert input.jpg -resize 1280x medium.webp

场景 2: 截图处理

截屏后裁剪、标注并优化输出

# 截图裁剪并添加标注
convert screenshot.png -crop 800x600+100+50 -fill red -draw "rectangle 10,10 50,50" annotated.png

不适用场景

以下场景图像处理基础版不适合处理:

  • 实时流数据处理
  • 小规模数据手动分析
  • 非结构化文本情感分析

触发条件

需要数据分析、报表生成、统计洞察、数据可视化时使用。不适用于非本工具能力范围的需求.

快速开始

1. 环境准备

确保已安装并配置好 AI Agent 环境(Claude Code / Cursor / Codex / Gemini CLI 等),本 Skill 通过 SKILL.md 指令驱动 Agent 执行任务. 系统要求:

  • 操作系统: Windows / macOS / Linux
  • Agent 平台: 支持 SKILL.md 格式的任意 AI Agent
  • 运行时: Python 3.8+ 或 Node.js 18+(视具体操作需求)

2. 配置参数

# ImageMagick 基本操作
convert input.jpg -resize 50% -quality 85 output.jpg
# 批量转换
mogrify -format webp -path output/ *.jpg
# 检查图片信息
identify -verbose image.png | head -20

3. 验证配置

配置完成后,可通过以下方式验证是否正常工作:

# 验证环境变量是否设置
echo "配置检查:"
env | grep -E "API|KEY|TOKEN|SECRET" | sed "s/=.*/=***/"  # Linux/macOS
# 或 PowerShell
# Get-ChildItem Env: | Where-Object {$_.Name -match "API|KEY|TOKEN"} | Format-Table

4. 开始使用

在 AI Agent 对话中描述你的需求,Agent 会根据本 Skill 的指令自动执行对应操作.

请帮我Web 图片优化

Agent 将自动:

  1. 解析你的自然语言指令
  2. 调用相应的工具或 API
  3. 执行操作并返回结果
  4. 返回执行结果供你确认

示例

基础配置

# ImageMagick 基本操作
# 批量转换
# 检查图片信息

可选配置

{
  "edition": "free",
  "auto_retry": false,
  "max_concurrent": 1,
  "log_level": "info",
  "cache_enabled": true,
  "timeout": 30
}

FREE 配置项说明:

配置项类型默认值说明
auto_retryboolfalse失败后自动重试
max_concurrentint1最大并发数(FREE 限制为1)
log_levelstringinfo日志级别
cache_enabledbooltrue启用结果缓存
timeoutint30操作超时时间(秒)

最佳实践

  1. 先确定宽高比再裁剪,最后压缩
  2. 不要默认放大图片,额外像素不创造细节
  3. Web 图片通常使用 sRGB 色彩空间
  4. 保留原始主文件,只导出交付版本

个人使用建议

  • 从简单任务开始熟悉工具行为,逐步扩展到复杂场景
  • 定期备份配置文件与数据,防止意外丢失
  • 遇到问题先查阅常见问题章节,再寻求社区帮助
  • 保持配置简洁,只启用必要的功能选项
  • 定期更新工具版本以获取最新功能与修复
  • 记录常用操作命令,提高日常使用效率

常见问题

Q: 透明图片保存为 JPEG 丢失透明度?

A: JPEG 不支持透明通道,请使用 PNG 或 WebP 格式.

Q: 截图用 JPEG 模糊怎么办?

A: 截图含文字等锐利边缘,应使用 PNG 或无损 WebP.

Q: 如何升级到 PRO 版本?

A: 升级到 PRO 版本非常简单:

  1. 获取 PRO 版本授权
  2. 安装 PRO 版本 Skill
  3. 原有配置自动迁移,无需额外操作
  4. 即可使用批量操作、团队协作等高级功能

已知限制

A: FREE 版本主要限制:

  • 不支持批量操作(每次只能处理一个任务)
  • 不支持团队协作(仅限个人使用)
  • 不支持高级数据分析
  • 技术支持依赖社区 如需这些功能,建议升级至 PRO 版本.

Q: FREE 版本的数据安全吗?

A: FREE 版本所有数据本地存储,不上传云端,确保隐私安全。建议定期备份配置文件与数据目录.

依赖说明

运行环境

  • Agent 平台: 支持 SKILL.md 的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
  • 操作系统: Windows / macOS / Linux
  • 运行时: Python 3.8+ 或 Node.js 18+(视具体操作需求)
  • 网络: 部分功能需要网络连接访问外部 API

依赖详情

依赖项类型是否必需获取方式
LLM APIAPI必需由 Agent 内置 LLM 提供
curlCLI 工具推荐系统自带或包管理器安装
jqJSON 处理推荐apt install jq / brew install jq
Python 3.8+运行时视需求python.org 下载
Node.js 18+运行时视需求nodejs.org 下载

API Key 配置

FREE 版本支持单一 API Key 配置,满足个人使用需求:

  • 环境变量:通过环境变量配置 API Key
  • 配置文件:支持配置文件方式存储 API Key
  • 安全提醒:切勿将 API Key 硬编码到脚本或提交到版本控制系统

可用性分类

  • 分类: MD+EXEC(纯 Markdown 指令,部分功能需要 exec 命令行执行能力)
  • 说明: 基于 Markdown 的 AI Skill,通过自然语言指令驱动 Agent 执行任务
  • FREE 特性: 支持单次执行、基础配置与社区支持
  • 安全等级: 基础,数据本地存储,建议定期备份
  • SLA: 社区支持,尽力响应

快速开始

  1. 确认运行环境满足依赖说明中的要求
  2. 在AI Agent对话中调用本技能,提供必要的输入参数
  3. 检查输出结果,根据需要进行后续处理

详细的输入输出格式请参考下方章节说明。

版本信息

项目
版本号1.0.0
版本类型FREE
许可证MIT
兼容性可升级至 PRO 版本

错误处理

错误场景原因处理方式
配置错误参数缺失或格式错误检查依赖说明中的配置要求
运行时错误运行环境不满足确认运行环境符合依赖说明
网络错误连接超时或不可达执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案

输出格式

{
  "success": true,
  "data": {
    "result": "图像处理基础版处理结果",
    "execution_time": "0.5s",
    "metadata": {
      "version": "1.0",
      "processor": "image"
    }
  },
  "execution_log": ["解析输入参数", "执行核心处理", "格式化输出结果"],
  "error": null
}

相关技能

Batch image processing - compress, resize, format convert, watermark, EXIF clean, and crop. All local, no upload needed.

4 次安装

AI图像生成提示词 crafting 工具,提供模板库与基础优化,适合个人创作者提升出图质量。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

通过文本描述生成图片,支持多种比例与标准分辨率,适合个人创作者快速出图。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

通过自然语言生成Mermaid流程图、时序图、ER图,快速可视化系统结构与业务流程。Use when 需要数据分析、报表生成、统计洞察、数据可视化时使用。不适用于实时流数据处理。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。

1 次安装

支持 Mermaid 和 Graphviz 生成流程图、思维导图、时序图等多种图表。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

轻量级AI图片生成工具,通过浏览器自动化操作Grok Imagine生成并保存图片。Use when 需要提升效率、自动化流程、批量处理、工作流优化时使用。不适用于需要人工创意判断的任务。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

1 次安装