读懂文章结构,标出需要配图的位置,按 Type × Style × Palette 三维组合生成配套插图。
技能
设计与多媒体技能 — 第 2 页
图像、视频、音频与设计技能:生成提示词、剪辑流水线、转写、素材准备。大多把创意要求和具体制作步骤绑在一起。
面向长篇故事创作与多语言翻译的 AI Agent,以可验证的动作流完成交付。
让 Markdown 在 GitHub、MDX、Pandoc、文档站、Slack、Notion 等解析器中正确渲染,并定位修复具体损坏位置。
通过文本提示和三家语音服务商,生成配音、音乐、音效及克隆语音音频。
把自由职业当作一门生意来经营:费率底线、客户管线、现金缓冲、税务与合同。
撰写和修改读起来像母语者的日语,覆盖聊天、敬体到完整敬语。
把生硬、机翻味、AI 味的英文改写成地道版本,匹配任意语种变体与正式度。
通过文本或参考图生成与编辑图像,支持多模型路由、角色一致性以及电商产品图拍摄。
用提示词生成专业 PDF 与 DOCX 文档——涵盖简历、合同、报告、方案等多种类型。
从一段提示词生成风格统一的游戏美术、3D 模型、UI、配乐与 GDD。
把一个 AI agent 注册为 OpenBotCity 常驻共享城市的公民,并连上心跳和事件流。
把长文拆成小红书、微信贴图风格的信息图卡片系列,提供 12 种视觉风格与 8 种排版。
覆盖 147 个第三方 REST 与 GraphQL API 的参考与排错模式手册
编写、审阅、调优 MySQL、SQLite、MariaDB、SQL Server 上的 SQL,并安全迁移。
通过 PostFast API 在 11 个平台定时发布社交内容,支持文案、图文视频、草稿、数据与粉丝数据。
按需组合画风、氛围与版式,批量生成原创知识漫画。
审计并改写文本,去除其中的 AI 生成写作痕迹。
通过 CellCog SDK 生成短篇小说、长篇大纲、剧本与故事世界观。
按提示词自动选用合适的 dlazy CLI 音频模型,完成语音、音乐、音效与声音克隆。
一份简报即可生成完整品牌识别系统——标志、配色、字体、使用规范。
通过类型、调色板、渲染、文本、情绪和字体六个可定制维度生成文章封面图。
为站在讲台前的那个人——备课、出题、批改、管课堂。
通过 VAP Media API,用同一把 Bearer 密钥生成与编辑图像、视频和音乐。
为 Google Cloud 架构选型、部署调试、安全加固与成本优化,每次建议都附带每月美元估算。