设计与多媒体

豆包图片生成-免费版

试用

轻量级AI图片生成工具,支持单图生成与基础提示词,适合个人用户快速创作视觉内容。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

它能做什么

轻量级AI图片生成工具,支持单图生成与基础提示词,适合个人用户快速创作视觉内容。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

技能文档

豆包图片生成工具 - 免费版

概述

豆包图片生成免费版是一款面向个人用户的轻量级 AI 图片生成工具。它通过标准化的生成流程(确认需求 → 输入提示词 → 设置比例 → 生成 → 截图确认 → 下载保存),帮助用户快速将创意想法转化为视觉作品. 免费版聚焦核心生成场景:单张图片生成、基础比例选择、生成结果确认与下载。配置简单,适合以下用户:

  • 个人用户快速生成创意图片
  • 社交媒体创作者制作配图
  • 设计师快速预览设计灵感
  • AI 绘图初学者入门体验

免费版限制:单次生成 1 张图片,默认 3:4 比例,不支持批量生成、多比例输出、风格预设、提示词增强等高级能力。如需这些能力,请使用 PRO 版本.

核心能力

能力清单

能力描述免费版
单图生成生成一张 AI 图片支持
提示词输入自定义提示词支持
比例选择选择图片比例支持(3:4 默认)
截图确认生成后截图供用户选择支持
图片下载下载原图到本地支持
简易提示词优化基础提示词建议支持
批量生成多图同时生成不支持
多比例输出同时生成多比例不支持
风格预设预设风格模板不支持
提示词增强AI 增强提示词不支持
参考图生成基于参考图生成不支持
工作流自动化批量自动化不支持

处理: 解析能力清单的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回能力清单的响应数据,包含状态码、结果和日志.

工作流程

输入格式

参数名类型必填说明
inputstring豆包图片生成-免费版处理的输入数据或指令
optionsobject附加配置选项,如模式选择、格式偏好等
callback_urlstring异步处理完成后的回调通知URL
询问用户生成需求
      ↓
用户确认提示词与比例
      ↓
输入提示词到生成页面
      ↓
设置图片比例(默认 3:4)
      ↓
点击生成按钮
      ↓
等待生成完成
      ↓
截图 4 张候选图发给用户
      ↓
用户选择并确认
      ↓
下载图片到本地
      ↓
复制到指定目录

处理: 解析工作流程的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回工作流程的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

生成流程关键步骤

  1. 需求确认:先询问用户想要什么样的图片
  2. 提示词输入:用户确认后输入提示词
  3. 比例设置:默认 3:4,用户可选其他比例
  4. 生成触发:点击发送按钮(向上箭头),不按回车
  5. 结果截图:生成完成后立即截 4 张图
  6. 用户选择:通过 message 工具发给用户选择
  7. 确认下载:用户选好后点开大图确认
  8. 保存图片:点击下载原图保存
  9. 复制到目标目录:复制到指定文件夹

处理: 解析生成流程关键步骤的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回生成流程关键步骤的响应数据,包含状态码、结果和日志. 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:轻量级、图片生成工具、支持单图生成与基、适合个人用户快速、创作视觉内容、豆包图片生成免费、为个人用户提供轻、量化的、图片生成能力、核心能力、单张图片生成、按提示词创作、基础比例选择、生成结果截图确认、图片下载与保存等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持.

核心功能执行

执行核心功能执行操作,使用input_params参数进行配置.

处理: 解析核心功能执行的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回核心功能执行的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

使用场景

场景 1:社交媒体配图创作

小张需要为社交媒体帖子生成一张配图. 操作步骤:

  1. Agent 询问:「您想要什么样的图片?有什么提示词要求?」
  2. 用户回答:「想要一张温馨的咖啡店场景,暖色调」
  3. Agent 输入提示词,设置 3:4 比例
  4. 生成完成后截图 4 张候选图
  5. 通过 message 工具发给用户选择
  6. 用户选择后下载保存

示例交互:

Agent: 您想要什么样的图片?有什么提示词要求?
用户: 想要一张温馨的咖啡店场景,暖色调
Agent: 好的,我将为您生成一张温馨咖啡店场景的图片,比例 3:4
[生成中.]
Agent: 已生成 4 张候选图,请选择您喜欢的一张
[发送 4 张截图]
用户: 我选第二张
Agent: 好的,已为您下载第二张图片并保存

场景 2:设计灵感预览

小李是设计师,希望快速预览某个设计概念. 操作步骤:

  1. Agent 询问需求
  2. 用户提供设计概念提示词
  3. Agent 生成图片
  4. 设计师查看候选图获取灵感

示例提示词:

提示词:现代简约风格客厅,大面积落地窗,木质地板,米色沙发,绿植点缀,自然光照明亮
比例:3:4

场景 3:学习 AI 绘图入门

小王想学习 AI 绘图,从简单的提示词开始尝试. 操作步骤:

  1. Agent 询问想要什么样的图片
  2. 用户输入简单提示词(如「一只可爱的橘猫」)
  3. Agent 给出提示词优化建议
  4. 生成图片并展示结果

示例提示词优化:

原始提示词:一只可爱的橘猫
优化建议:一只毛茸茸的橘色猫咪,坐在窗台上,阳光洒在身上,大眼睛,可爱表情,柔和色调,3:4 比例

不适用场景

以下场景豆包图片生成-免费版不适合处理:

  • 3D建模和动画制作
  • 照片级写实渲染
  • 手绘原创插画

触发条件

、品牌视觉时使用。不适用于非本工具能力范围的需求.

快速开始

第一步:需求确认

收到任务后,第一步必须是询问用户:

Agent: 您想要生成什么样的图片?
       - 主题内容是什么?
       - 风格偏好(写实/卡通/油画等)?
       - 比例要求(默认 3:4)?
       - 其他特殊要求?

第二步:输入提示词

用户确认需求后,输入提示词到生成页面:

[打开豆包 AI 创作页面]
[输入用户确认的提示词]
[设置比例为 3:4(或用户指定比例)]

第三步:生成图片

点击发送按钮(向上箭头)触发生成:

[点击发送按钮 - 不要按回车]
[等待图片生成完成]

第四步:截图与选择

生成完成后立即截图 4 张候选图:

# 示例
# 通过 message 工具发送图片给用户选择
message --image /tmp/candidate-1.jpg --text "候选图 1"
message --image /tmp/candidate-2.jpg --text "候选图 2"
message --image /tmp/candidate-3.jpg --text "候选图 3"
message --image /tmp/candidate-4.jpg --text "候选图 4"

第五步:下载与保存

用户选择后,点开大图确认并下载:

# 下载用户选择的图片
# 复制到指定目录
cp /tmp/selected-image.png /target/directory/

配置示例

生成参数说明

参数类型默认值说明
提示词字符串必需描述要生成的图片内容
比例字符串3:4图片宽高比
数量整数4候选图数量
保存路径字符串/tmp/下载保存目录

支持的比例

免费版支持以下比例:

比例适用场景
3:4(默认)竖版社交媒体
1:1方形头像
4:3横版配图
16:9宽屏壁纸

提示词建议格式

[主体描述] + [风格] + [色调] + [细节] + [比例]
# .
示例:
一只毛茸茸的橘猫(主体)
写实风格(风格)
暖色调(色调)
坐在窗台上 阳光洒在身上(细节)
3:4 比例

最佳实践

1. 提示词撰写技巧

# 推荐:详细具体
一只可爱的橘色猫咪,坐在窗台上,阳光洒在身上,大眼睛,可爱表情,柔和色调
# .
# 不推荐:过于简单
猫

2. 比例选择建议

用途推荐比例
朋友圈/小红书3:4
头像1:1
公众号配图4:3
手机壁纸9:16

3. 生成流程规范

  1. 必须先询问用户需求,不要直接生成
  2. 用户确认后再输入提示词
  3. 点击发送按钮(向上箭头),不要按回车
  4. 等待图片完全生成后再截图
  5. 用户选好后要点开大图确认
  6. 用户确认后才能下载保存
  7. 每步必须拿到结果才能进行下一步

4. 截图与发送规范

  • 截图必须用 message 工具发送图片给用户
  • 不要使用虚拟路径
  • 截图路径使用实际路径

常见问题

Q1:为什么必须先询问用户?

A: 询问用户需求可以:

  • 明确生成方向,避免浪费
  • 了解用户的风格偏好
  • 确认比例要求
  • 提升用户满意度

Q2:点击发送还是按回车?

A: 必须点击发送按钮(向上的箭头),不要按回车。按回车可能导致提示词格式错误.

Q3:生成的图片不满意怎么办?

A: 可以:

  1. 重新生成(调整提示词)
  2. 从 4 张候选图中选择最接近的
  3. 优化提示词后再生成

Q4:免费版支持哪些比例?

A: 支持常见比例:3:4、1:1、4:3、16:9。默认使用 3:4。如需更多比例或同时输出多比例,请使用 PRO 版本.

Q5:能否批量生成多张图片?

A: 免费版仅支持单次生成。如需批量生成,请使用 PRO 版本.

Q6:图片保存在哪里?

A: 默认保存到 /tmp/ 目录。建议复制到指定目录长期保存:

cp /tmp/generated-image.png /your/directory/

Q7:能否使用参考图生成?

A: 免费版仅支持文本提示词生成。如需基于参考图生成,请使用 PRO 版本.

依赖说明

运行环境

  • Agent 平台:支持 SKILL.md 规范的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
  • 操作系统:Windows / macOS / Linux
  • 浏览器:需要浏览器访问豆包 AI 创作页面
  • 网络:需要网络连接(访问豆包服务)

依赖详情

依赖项类型是否必需获取方式版本要求
浏览器应用必需系统自带Chrome 100+
message平台工具必需Skill 平台安装-
豆包账号服务必需豆包平台注册-
LLM APIAPI必需由 Agent 内置 LLM 提供-

环境准备

# 验证浏览器
google-chrome --version
# .
# 验证 message 工具
which message
# .
# 验证工作区目录
ls ~/.skill-platform/workspace/

API Key 配置

免费版需要以下配置:

配置项环境变量用途获取方式
豆包账号浏览器登录访问豆包 AI 服务豆包平台注册
Skill 平台 Token平台配置平台认证Skill 平台控制台
# 浏览器登录豆包账号即可
# Skill 平台通常会自动配置认证

可用性分类

  • 分类:MD+EXEC(Markdown 指令 + 命令行执行 + 浏览器自动化)
  • 说明:通过自然语言指令驱动 Agent 操作浏览器完成图片生成
  • 离线可用:否(需要网络访问豆包服务)
  • 隐私等级:中(提示词需上传至豆包服务)

版本说明

  • 当前版本:1.0.0
  • 版本类型:FREE(免费版)
  • 升级路径:如需批量生成、多比例输出、风格预设、提示词增强、参考图生成等能力,请使用 doubao-image-gen-tool-pro

错误处理

错误场景原因处理方式
配置错误参数缺失或格式错误检查依赖说明中的配置要求
运行时错误运行环境不满足确认运行环境符合依赖说明
网络错误连接超时或不可达执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案

已知限制

  • 需LLM支持,无LLM环境不可用
  • 复杂业务场景建议结合人工经验判断
  • 执行效率受模型能力与网络环境影响

示例

基本用法

输出:返回执行结果,包含操作状态和输出数据

用户: 执行核心功能
Skill: 正在执行核心功能.
Skill: 执行完成,结果如下: 操作成功

相关技能

当用户要求生成、编辑、改图、修图、重绘、文生图、图生图、扩图、换背景、换风格、局部替换、参考图衍生、系列延展或多比例适配商业创意图片时使用;触发任务包括做图、出图、生成图片、设计海报、主视觉/KV、Banner、封面、社媒配图、社媒长图、电商主图、详情页、产品图、Logo、IP角色、吉祥物、包装、品牌应用物料、活...

3 次安装

通过文本描述生成图片,支持多种比例与标准分辨率,适合个人创作者快速出图。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

轻量级AI图片生成工具,支持文生图与基础图片编辑,适合个人创意原型制作。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

1 次安装

Fast image generation with Doubao Seedream 5.0 Lite. Supports text-to-image and image-to-image. 使用豆包 Seedream 5.0 Lite 极速生成图像,支持文生图与图生图。

63 次安装

AI图像生成提示词 crafting 工具,提供模板库与基础优化,适合个人创作者提升出图质量。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

Generate high-quality images with Doubao Seedream 4.5. Supports text-to-image and image-to-image. 使用豆包 Seedream 4.5 模型生成高质量图像,支持文生图与图生图。

65 次安装