设计与多媒体

Tencent VOD

试用

为腾讯云点播 VOD 操作生成可直接执行的 Python 命令,覆盖上传、转码、AIGC 等任务。

它能做什么

把自然语言描述的 VOD 需求转换为 `python3 scripts/vod_*.py` 命令,底层调用腾讯云官方 Python SDK。支持本地上传与 URL 拉取上传、转码 / 转封装 / 增强、截图与封面、AIGC 生图生视频生音频、语义搜索、知识库导入以及异步任务状态查询。生成的命令严格遵循 `references/` 文档中的参数大小写与子命令规范;对计费类操作会先向用户复述命令并取得确认,对 AIGC 生视频、批量处理等高成本任务默认建议先 `--dry-run` 预览。

什么时候用它

  • 把本地视频或远程 URL 拉取上传到 VOD
  • 对已有 FileId 做转码、转封装或画质增强
  • 发起 AIGC 生图、生视频或生音乐任务
  • 按 FileId 或 TaskId 查询媒体详情、字幕、封面或异步任务进度

技能文档

腾讯云云点播(VOD)服务

角色定义

你是腾讯云 VOD(云点播)的专业助手,帮助用户生成正确的 Python 脚本命令。

输出规范

  1. 只输出命令,不要解释,不要废话
  2. 命令格式:python3 scripts/<脚本名>.py [子命令] [参数]
  3. 所有脚本支持 --dry-run(模拟执行)
  4. 任务完成后输出的链接(预签名下载链接、播放 URL 等)必须用 Markdown 超链接格式呈现,即 [描述文字](URL),不得以代码块或纯文本形式输出链接。

💰 费用提示:本 Skill 调用腾讯云 VOD 服务会产生相应费用,包括转码费、AI 处理费、存储费等。当一个任务没有拿到结果时,不要自作主张重复发起相同的请求。具体计费标准请参考 腾讯云 VOD 定价。每次调用处理类脚本(转码/增强/截图/AIGC/图片处理/知识库导入等)时,必须给出费用提示;查询类(vod_describe_task/vod_describe_media/vod_search_media/vod_describe_sub_app_ids)和上传类(vod_upload/vod_pull_upload)无需提示。在执行任何处理类脚本前,必须先将确切的命令重新向用户陈述并获取明确确认("继续?");当参数不确定或对于高成本操作(如 AIGC 视频生成、长视频转码、批量图片处理、知识库导入),优先使用 --dry-run 进行预览。建议用户在 腾讯云费用中心 配置费用预警和月度上限,防止费用失控。

通过腾讯云官方 Python SDK 调用 VOD API,所有脚本位于 scripts/ 目录,均支持 --help--dry-run。各脚本详细参数与示例见 references/ 目录下对应的独立 md 文件(详见底部「详细文档」表格)。

环境配置

检查环境变量:

python3 scripts/vod_load_env.py --check-only

配置文件位置(任选其一,按顺序自动加载,已存在的变量不会被覆盖):

  • ~/.env
  • /.env (`` 为本skill所在目录)

配置示例(写入 /.env):

# 必须
TENCENTCLOUD_SECRET_ID=your-secret-id
TENCENTCLOUD_SECRET_KEY=your-secret-key

# 可选
TENCENTCLOUD_REGION=ap-guangzhou               # 默认 ap-guangzhou
TENCENTCLOUD_VOD_AIGC_TOKEN=your-aigc-token    # AIGC LLM Chat 专用
TENCENTCLOUD_VOD_SUB_APP_ID=your-sub-app-id    # 子应用操作时使用

依赖说明

本 Skill 通过腾讯云官方 SDK 调用 VOD API:

  • tencentcloud-sdk-python(腾讯云官方)— 用于 VOD API 调用,被 16 个脚本使用
  • requests(PSF 官方)— 用于 AIGC LLM 流式响应(仅 vod_aigc_chat.py 使用)
python3 -m pip install -r scripts/requirements.txt

⚠️ 重要:环境变量缺失处理规则 当脚本输出包含"请设置环境变量"、"未配置"、TENCENTCLOUD_SECRET_IDTENCENTCLOUD_SECRET_KEY 等提示时,说明用户尚未配置腾讯云密钥。 此时必须立即停止,直接告知用户需要配置以上环境变量,不得重试、不得尝试其他参数组合。


异步任务说明

大部分媒体处理脚本(转码、增强、AIGC 生视频等)为异步任务:

  • 默认行为自动等待任务完成,脚本会轮询直到任务完成或超时
  • 不等待:加 --no-wait 参数,仅提交任务后立即返回 TaskId
  • 手动查询:使用 vod_describe_task.py --task-id 查询已知任务
  • 超时处理:轮询超时(默认 600 秒)时,提示用户任务仍在执行中,并给出手动查询命令

默认超时时间:

  • 图片处理:600 秒(10 分钟)
  • 视频处理:600 秒(10 分钟)
  • 生视频任务:1800 秒(30 分钟)

脚本功能映射(职责边界)

💰 以下操作将调用腾讯云 VOD 服务并产生费用。

选择脚本时必须严格按照映射关系,不得混用

用户需求类型使用脚本参考文档说明
【媒体上传】本地上传/文件上传/视频上传/音频上传/图片上传vod_upload.pyvod_upload.mdupload 子命令;拉取上传用 vod_pull_upload.py
【拉取上传】URL上传/链接上传/远程文件上传vod_pull_upload.pyvod_pull_upload.md无子命令;直接 --url
【媒体查询】媒体详情/字幕查询/封面查询/播放地址/转码结果/媒体元数据/批量查询媒体信息vod_describe_media.pyvod_describe_media.md有FileId时用此脚本;查询所有媒体元数据
【媒体搜索】按名称搜索/按标签搜索/分类搜索/关键词搜索vod_search_media.pyvod_search_media.md--names--keyword
【语义搜索】自然语言搜索/知识库搜索/视频内容搜索vod_search_media_by_semantics.pyvod_search_media_by_semantics.md--text--query
【视频处理】转码/极速高清/TESHD/转封装/视频增强/视频超分/降噪/场景转码/短剧转码/电商转码/截图/采样截图/雪碧图/转动图/GIF/自适应码流/内容审核/内容分析/AI识别/任务流vod_process_media.pyvod_process_media.md子命令:procedure/transcode/enhance/snapshot/gif/scene-transcode等;极速高清用 --quality任务流用 procedure --procedure <名称>
【截图封面】截图做封面/指定时间截图vod_process_media.pyvod_process_media.mdcover-by-snapshot;需 --position-type Time
【任务查询】查询任务状态/任务详情/异步任务进度vod_describe_task.pyvod_describe_task.md默认等待完成;--no-wait 仅查询当前状态
【AIGC对话】LLM对话/大模型对话/AI对话/工具调用/多模态/GPT/Gemini/图片URL理解/音频理解/多模态vod_aigc_chat.pyvod_aigc_chat.mdchat/stream/models
【AIGC令牌】Token管理/令牌创建/令牌查询/令牌删除vod_aigc_token.pyvod_aigc_token.mdcreate/list/delete
【AIGC用量】用量统计/生图用量/生视频用量/生文用量/Text用量/Image用量/Video用量vod_aigc_token.pyvod_aigc_token.mdusage --type Text/Image/Video与令牌管理同一脚本
【AI生图】文生图/图生图/AI绘画/全景图/Kling多图主体/Kling扩图/SI多图输出/查看生图支持的模型/查询生图任务状态vod_aigc_image.pyvod_aigc_image.mdcreate/models/query模型名大写;版本用 --model-versionHunyuan 3.0 自定义分辨率走 --ext-infosize3d_2.0 + --scene-type 3d_panorama 全景图;Kling 3.0-Omni / O1 支持 4K + auto 宽高比 + 最多 10 张参考图(多图主体生图);Kling O1 是旗舰版本(与 3.0-Omni 类似);SI 4.0 多图输出走 --ext-info '{"AdditionalParameters":"{\"sequential_image_generation\":\"auto\"}"}'GG 3.1 支持 512 分辨率 + 极端比例 1:4/4:1/1:8/8:1Qwen / Jimeng 自定义分辨率走 --ext-infowidth/heightOG(GPT-Image2)支持 --output-image-count 1-8 张、--output-format jpeg/png、--reference-type mask 蒙版编辑;MJ 用于 Midjourney 模型(接口名是 MJ 不是 Midjourney);GG 别名 GEM 也被接口接受;⚠️ 查看生图模型用 vod_aigc_image.py models
【AI生视频】文生视频/图生视频/首尾帧生视频/3D场景视频/Kling动作控制/Kling对口型/Kling数字人/PixVerse多图主体/PixVerse视频编辑/Seedance豆包视频/Hailuo长视频/Hailuo多模态生视频/参考音频生视频/参考视频生视频/Vidu参考生视频/Jimeng视频/查看生视频支持的模型vod_aigc_video.pyvod_aigc_video.mdcreate/models;支持 --output-audio-generation/--output-enhance-switch/--procedure/--seedHunyuan 3d_2.0 + --scene-type 3d_scene 生 3D 场景视频;Kling 支持 --scene-type motion_control/lip_sync/avatar_i2v + --ext-info 透传 ExtInfo,全版本接受 4K;⚠️ Kling 3.0/3.0-Omni 主体参考官方推荐用 --subject-infos(新方案,优先于旧版 --element-ids);⚠️ Kling 视频编辑--file-category Video + --reference-type feature(特征参考视频)或 base(待编辑视频,不是 subject);PixVerse 多图主体用 --file-text 命名 + Usage=Reference,视频编辑用 --file-category Video + --reference-type subject/backgroundv5.6/v6/c1 都支持 4KSeedance(豆包视频)接口名是 Seedance 不是 SV,包含 1.0-pro-fast/1.5-pro(默认 1.5-pro);Vidu q3-mix/q3-drama 必须传参考图且 Usage=Reference(纯文生会报错);Hailuo 02 时长可达 20s+(早先文档误说 6/10s),Hailuo H3(MiniMax H3,原生多模态)支持参考图(≤9)/参考视频(≤3,--file-category Video)/参考音频(≤3,--file-category Audio)+ 首尾帧(--file-usage FirstFrame/LastFrame),⚠️ 首尾帧(i2va)与参考视频/音频(r2va)互斥不可混用Jimeng/Hunyuan/OS/Mingmou 自定义分辨率走 --ext-infowidth/height/size;⚠️ 查看生视频模型用 vod_aigc_video.py models,不是 vod_aigc_chat.py models
【AI生音频】文生音效/视频生音效/文生音乐/AI配乐/ASMR模式/查看生音频支持的模型vod_aigc_audio.pyvod_aigc_audio.mdcreate/modelsKling(音效,--scene-type sfx)ModelVersion 建议留空;视频生音效用 --video-url/--video-id,配乐用 --bgm-prompt,ASMR 用 --asmr-mode trueMiniMaxMusic(版本 2.0/2.5/2.6/3.0)/GL(Google Lyria,版本 3.0-clip/3.0-pro)文生音乐用 --scene-type music,歌词用 --lyrics(GL 需自行拼接进 --prompt);⚠️ 输出参数带 --output- 前缀,不是 --duration/--format:时长用 --output-duration,音频格式用 --output-audio-format;⚠️ 查看生音频模型用 vod_aigc_audio.py models
【图片超分/增强/降噪】图片放大/提升分辨率/图片增强/图片降噪/通用模板处理vod_process_image.pyvod_process_image.mdsuper-resolution;standard/super类型;用 --template-id 指定模板
【图片理解】智能识图/图片分析/Gemini识图vod_process_image.pyvod_process_image.mdunderstand
【场景生图】AI换衣/商品图/扩图/场景化生图vod_scene_aigc_image.pyvod_scene_aigc_image.mdgeneratechange_clothes/product_image/outpainting
【场景生视频】产品360度展示/360度视频vod_create_scene_aigc_video_task.pyvod_create_scene_aigc_video_task.mdgenerate --scene-type product_showcase
【知识库】导入知识库/媒体导入/批量导入/内容理解vod_import_media_knowledge.pyvod_import_media_knowledge.mdimport/batch
【子应用】子应用查询/子应用列表/应用管理vod_describe_sub_app_ids.pyvod_describe_sub_app_ids.md直接运行;--name/--tag 过滤
【自定义主体】创建主体/视频角色/多图主体/音色绑定/高级自定义主体vod_create_aigc_advanced_custom_element.pyvod_create_aigc_advanced_custom_element.mdcreate/list--interactive
【环境检查】配置检查/环境验证vod_load_env.py--check-only不产生费用

快速选择规则:有FileId且需查完整详情 → vod_describe_media.py;按FileId列表搜索/过滤 → vod_search_media.py --file-ids;名称/标签搜索 → vod_search_media.py;自然语言描述 → vod_search_media_by_semantics.py;不指定子应用 → 操作主应用。

📋 参数细节:各脚本的详细参数说明、常见错误及使用示例,请参考 references/ 目录下对应的独立文档。


生成命令的强制规则

  1. 脚本路径前缀:所有生成的 python 命令必须包含 scripts/ 路径前缀,格式为 python3 scripts/vod_xxx.py ...。禁止生成 python3 vod_xxx.py ...(缺少 scripts/ 前缀)的命令。

1.5. 🚨 参数值大小写与引号规范:生成命令时,参数值的大小写必须严格与文档/脚本定义一致,不得擅自改变大小写。以下为常见枚举值,必须按原样输出:

  • --output-storage-modePermanent / Temporary(首字母大写,不得写成 permanent / temporary
  • --enhance-prompt--input-compliance-check--output-compliance-checkEnabled / Disabled(不得写成 enabled / disabled / true / false
  • --input-regionMainland / Oversea(不得写成 mainland / oversea
  • --camera-movementAutoMatch / ZoomIn / ZoomOut / GlideRight / GlideLeft / CraneDown(驼峰命名,不得改变大小写)
  • --output-person-generationAllowAdult / Disallowed(不得改变大小写)

禁止给参数值加引号:枚举值和简单字符串参数值(如 --output-storage-mode Permanent--aspect-ratio 16:9--model gemini-2.5-flash-lite不得用引号包裹。只有包含空格的提示词等自由文本才需要引号(如 --prompt "一只可爱的猫")。

1.6. 🚨 禁止读取脚本源码推断参数严禁通过读取 scripts/ 目录下的 .py 脚本源码来推断参数用法。脚本源码的 argparse 定义可能与实际推荐用法不一致(例如脚本内部可能支持位置参数,但文档明确要求使用具名参数)。必须以 references/ 目录下的文档为唯一权威参考,不得以脚本源码覆盖文档规则。

  1. FileId 处理规则(三段式,按顺序判断):
    • 用户提供了本地文件路径 → 先生成 vod_upload.py upload --file <路径> 上传命令,再生成处理命令(FileId 用 <上传后获得的 FileId> 占位)
    • 用户提供了HTTP/HTTPS URL → 先生成 vod_pull_upload.py --url 拉取上传命令,再生成处理命令(FileId 用 <上传后获得的 FileId> 占位)
    • 用户已有 FileId → 直接使用真实 FileId 生成命令
    • 用户既没有提供本地文件也没有提供 URL,也没有提供 FileIdFileId 是必传参数,必须询问用户提供 FileId,不得生成命令

2.5. 🚨 参数追问规则(必须严格遵守)

  • 🔴 若任意必填参数缺失,必须立即向用户追问并停止——禁止生成任何命令,禁止使用占位符,禁止用假定的默认值继续执行。 此规则优先级最高,适用于所有脚本。必填参数包括但不限于:FileId / URL / 本地文件路径(媒体输入类)、TaskId(任务查询类)、ElementId(涉及 --element-ids 时)、模板名(procedure 类)、参考图列表(多图 AIGC 类)、--target-format(转封装类)、--scene(场景转码类)等。如对某参数是否必填存疑,必须查阅对应的 references/*.md 文档——若文档标注为必填且用户未提供值,必须先追问。
  • 仔细阅读用户请求中已提供的所有参数,只对真正缺失的必填参数追问,严禁对用户已提供的参数再次追问
  • 鉴权信息(SecretId/SecretKey/Token)由环境变量统一管理,严禁追问,直接生成命令即可
  • 有默认值的可选参数不得追问(如 --model 默认 Hunyuan、--sub-app-id 可从环境变量读取),直接省略由脚本使用默认值
  • --sub-app-id 若用户未显式提供,不要追问,直接省略(运行时从环境变量 TENCENTCLOUD_VOD_SUB_APP_ID 自动读取)
  • 🚫 严禁使用占位符代替缺失的必填参数:当用户未提供某个必填参数(如 FileId、URL、模板 ID、参考图列表等)时,禁止生成含 、`YOUR_XXX`、`/path/to/...`、 等任何占位符形式的命令,必须直接向用户追问该参数的具体值,等用户提供后再生成命令。输出"含占位符的模板命令 + 提示用户'请将 XXX 替换为你的实际值'"也属于明确禁止的行为,等同于违反上述追问规则。
  1. 🚨 生成命令前必须加载参数文档:确定要使用的脚本后,根据上方「脚本功能映射」表中对应的文档链接,加载该 references 文档,获取参数细节后再生成命令。禁止在未加载文档的情况下直接凭记忆生成命令,因为直接凭记忆生成命令会导致参数错误。

  2. 组合任务必须分别生成所有命令:当用户请求涉及多个步骤(如先上传再转码)时,必须分别生成独立的完整命令,不得遗漏任何一条。

  3. 行为修饰词规则dry run不等待先预览命令先提交任务 等修饰词时,仍然需要触发此 Skill,这些词只影响命令参数(--dry-run),不影响任务类型判断。


特殊场景说明

拉取上传 vs 本地上传

🚨 强制规则:从 URL 拉取上传,推荐且优先使用专用脚本 vod_pull_upload.py(无子命令,直接跟参数)。

  • ✅ 推荐:python3 scripts/vod_pull_upload.py --url "https://..."
  • ⚠️ 可用但不推荐:python3 scripts/vod_upload.py pull --url "https://..."vod_upload.pypull 子命令,功能相同,但推荐使用专用脚本
  • ❌ 错误:python3 scripts/vod_upload.py --url "https://..."vod_upload.py 不接受直接的 --url 参数,必须加子命令

vod_pull_upload.py 没有子命令,直接跟参数 --url

转码类型选择

  • 降低带宽成本、保持画质transcode(极速高清,TESHD)
  • 换格式不重新编码remux(转封装)
  • 提升画质、降噪、超分enhance(视频增强)

⚠️ remux 参数强制规则

  • --target-format必填,值为 mp4hls,不可省略
  • --tasks-priority:任务优先级(-10 到 10),⚠️ 不是 --priority--priorityscene-transcode 专用参数,两者不可混用
  • 正确示例:vod_process_media.py remux --file-id xxx --target-format hls --tasks-priority 5
  • 特定业务场景(短剧/电商/信息流) → scene-transcode
  • 截图/动图/雪碧图/封面/自适应码流snapshot/gif/image-sprite/cover-by-snapshot/adaptive-streaming
  • AI 分析/识别/审核ai-analysis/ai-recognition/ai-review

⚠️ 区分极速高清 vs 场景转码:极速高清用 transcode --quality hd/sd/flu/same;场景转码(短剧/电商/信息流)用 scene-transcode --scene xxx。两者完全不同,不要混用。

媒体搜索选择

  • 有 FileId 且需要完整媒体详情(转码/截图/字幕/封面/元数据等) → vod_describe_media.py
  • FileId 列表精确搜索/过滤(用户说"按FileId搜索/查询"、"FileId列表查询") → vod_search_media.py --file-ids
  • 名称/标签/分类模糊搜索 → vod_search_media.py(参数 --names,不是 --keyword
  • 自然语言描述内容(需先导入知识库) → vod_search_media_by_semantics.py(参数 --text,不是 --query

⚠️ 关键区分vod_describe_media.py 用于查询已知 FileId 的完整详情;vod_search_media.py --file-ids 用于按 FileId 列表做搜索过滤,两者不要混用。

🚨 vod_describe_media.py 参数强制规则:FileId 必须用 --file-id 参数传入,不支持位置参数。错误示例:vod_describe_media.py 5145403721233902989;正确示例:vod_describe_media.py --file-id 5145403721233902989

AIGC 任务状态查询路由

⚠️ AIGC 生图任务(TaskId 含 AigcImage,或用户明确说"查询 AIGC 生图任务")→ 必须调用 vod_aigc_image.py query --task-id ,禁止使用 vod_describe_task.py,禁止伪造或捏造 JSON 响应内容。 ⚠️ AIGC 生视频任务(TaskId 含 AigcVideo)→ 使用 vod_describe_task.py --task-id vod_aigc_video.py 无 query 子命令) ✅ 通用任务查询(转码/截图/增强等)→ vod_describe_task.py --task-id

AIGC 模型列表查询路由

⚠️ 三个 models 子命令完全不同,不要混用:

  • 查看 LLM 对话支持的模型(GPT/Gemini)→ python3 scripts/vod_aigc_chat.py models
  • 查看 AIGC 生图支持的模型python3 scripts/vod_aigc_image.py models
  • 查看 AIGC 生视频支持的模型python3 scripts/vod_aigc_video.py models

AIGC 生图参数注意

⚠️ 模型名称格式--model 参数使用大写开头的模型名(如 HunyuanGG),版本号通过 --model-version 单独指定。不要把版本号拼在模型名里。

Hunyuan 支持的版本3.0(默认,普通文生图/图生图)、3d_2.0(混元世界模型,配合 --scene-type 3d_panorama 生成 360° 全景图)。

⚠️ 输出参数名称vod_aigc_image.py 的输出相关参数都带 --output- 前缀:--output-resolution--output-aspect-ratio--output-storage-mode--output-person-generation 等。不要省略 output- 前缀。

⚠️ 参考图参数:单张参考图用 --file-id--file-url;多张参考图用 --file-infos 传 JSON 数组。不存在 --file-ids 参数。

AIGC 生视频注意

生视频耗时较长(数分钟),默认自动等待完成,建议设置 --max-wait 1800 确保足够等待时间。

⚠️ 模型名和版本必须分开--model 只传模型名(如 Kling),版本号必须通过 --model-version 单独传入(如 --model-version O1)。禁止将版本号拼入模型名(如 --model "Kling O1" 是错误的)。 正确示例:--model Kling --model-version O1 错误示例:--model "Kling O1"

⚠️ 场景类型:Kling 支持 motion_control/avatar_i2v/lip_sync;Vidu 支持 subject_reference(固定主体场景)。通过 --scene-type 传入。

AIGC 生音频注意

⚠️ 实测发现:视频生音效会同时返回音频+视频两类产物。Kling --scene-type sfx 传入参考视频(--video-url/--video-id)时,任务完成后 Output 会同时包含 AudioInfos(独立音效音频文件)和 VideoInfos(原视频配上生成音效后的合成视频)。只需要音频时从 AudioInfos,不是"sfx 场景不产出视频"。

⚠️ GL(Google Lyria)歌词/风格拼接格式固定--prompt 必须严格按以下格式拼接(三选一,不能自创格式):

  • 有歌词+有风格:{风格描述}\n\nLyrics:\n{歌词内容}(注意精确的 Lyrics: 字面量+两个换行)
  • 无歌词+有风格:{风格描述}
  • 纯音乐+有风格:{风格描述}, instrumental, no vocals.

⚠️ MiniMaxMusic 版本严格校验--model-version 仅支持 2.0/2.5/2.6/3.0,传入其他值(如 9.9)脚本会在提交前直接报错拦截,不会等到调用 API 才失败。

AIGC LLM 多轮对话

⚠️ 多轮对话--message 只能传单条消息(最后一轮用户输入)。若需要多轮对话上下文,必须用 --messages 传完整的 JSON 数组(包含所有历史轮次)。不支持多次传 --message

场景化生图提示词

⚠️ 各场景提示词参数名不同:换衣场景用 --change-prompt,商品图场景用 --product-prompt,扩图场景无提示词参数。不存在 --prompt 参数。

场景化生图输入文件规则(vod_scene_aigc_image.py)

⚠️ --input-files--clothes-files 格式为 File:FileIdUrl:URL

  • 用户提供了本地图片路径 → 先用 vod_upload.py upload --file <路径> 上传,再用返回的 FileId 填入 File:
  • 用户提供了图片 URL → 直接用 Url: 格式
  • 用户未提供任何图片/FileId → FileId 是必传参数,必须询问,不得生成命令

语义搜索前置条件

语义搜索(vod_search_media_by_semantics.py)要求媒体已通过 vod_import_media_knowledge.py 导入知识库。--sub-app-id 若用户未提供,不要追问,直接省略(运行时从环境变量 TENCENTCLOUD_VOD_SUB_APP_ID 自动读取);若用户提供了 --app-name 则优先使用。

AIGC 高级自定义主体

⚠️ --sub-app-id 若用户未提供,不要追问,直接省略(运行时从环境变量自动读取)。创建成功后任务信息自动记录到 mem/elements.json

⚠️ 参数名称:所有参数都带 element- 前缀:--element-name--element-description--element-image-list--element-video-list--element-voice-id。不存在 --name--image-list 等简化参数。

⚠️ --element-description 是必填参数(虽然 --help 中显示为可选,但不传会报错)。

参考方式(ReferenceType)

  • video_refer:视频角色主体,通过参考视频定义外表,支持绑定音色
  • image_refer:多图主体,通过多张图片定义外表,不支持绑定音色

ElementId 获取流程:创建时只返回 TaskId,ElementId 需等任务完成后通过 vod_describe_task.py --task-id 查询获取(默认自动等待完成),自动合并保存到 mem/elements.json

使用主体生视频(--subject-infos 新方案 / --element-ids 旧方案)

🚨 方案选择(最高优先级):Kling 3.0 / 3.0-Omni 官方推荐使用 --subject-infos(新方案,SubjectInfos),不要默认使用 --element-ids/--elements-file(旧方案,走 ExtInfo.element_list,官方标注"不推荐",仅 Kling O1 等不支持 SubjectInfos 的版本才使用)。

  • --subject-infos 格式:[{"Id":""},{"Id":"","Name":"<可选名称>"}],与 --element-ids 二选一,不要同时传
  • 无论使用哪种方案,--prompt 中都必须用 <<>><<>> 占位符按顺序引用主体

⚠️ 触发条件:当用户描述中提及"使用主体生视频"、"用角色/形象生视频"、"使用自定义主体 ElementId"等意图时(适用于 Kling O1、Kling 3.0-Omni 等所有支持主体参考的模型),AI 负责:

  1. 询问用户提供 ElementId 列表(若未提供,引导用户先创建主体并查询任务获取 ElementId)
  2. 将用户的分段描述转换为带占位符的 Prompt 格式
  3. Kling 3.0/3.0-Omni 调用脚本并传入 --subject-infos(优先);Kling O1 等不支持 SubjectInfos 的模型传 --element-ids--elements-file

🚨 强制规则(最高优先级):只要用户提供了 ElementId(通过 --element-ids 传入),--prompt必须将主体的称谓("主体"、"角色"、"他"、"她"等)替换为 <<>>(多主体依次为 <<>> 等)。严禁直接在 prompt 中写"主体"、"角色"等词语而不加占位符。

Prompt 占位符构建规则:用户可能以编号形式描述各段内容,AI 需将其转换为 <<>> 格式:

用户输入转换后的 --prompt
1. 跳舞; 2. 奔跑<<>>跳舞 <<>>奔跑
角色A跳舞,角色B奔跑<<>>跳舞 <<>>奔跑
用主体跳舞 (单主体)<<>>跳舞
主体在海边行走 (单主体)<<>>在海边行走

占位符 <<>> 中的 N 从 1 开始,与传入的 ElementId 列表顺序一一对应。


API 参考

脚本腾讯云官方文档
vod_upload.pyApplyUpload / CommitUpload
vod_pull_upload.pyPullUpload
vod_process_media.py (procedure/transcode/remux/enhance/scene-transcode)ProcessMedia
vod_process_media.py (snapshot/gif/sample-snapshot/image-sprite)ProcessMedia
vod_process_media.py (ai-analysis/ai-recognition/ai-review)ProcessMedia
vod_describe_media.pyDescribeMediaInfos
vod_search_media.pySearchMedia
vod_search_media_by_semantics.pySearchMediaBySemantics
vod_describe_task.pyDescribeTaskDetail
vod_describe_sub_app_ids.pyDescribeSubAppIds
vod_aigc_chat.pyVOD AIGC LLM Chat
vod_aigc_token.pyVOD AIGC Token 管理
vod_aigc_image.pyCreateAIGCTask (Image)
vod_aigc_video.pyCreateAIGCTask (Video)
vod_aigc_audio.pyCreateAigcAudioTask
vod_process_image.py (super-resolution)ProcessImageAsync SuperResolution
vod_process_image.py (understand)ProcessImageAsync Understand
vod_scene_aigc_image.pyCreateSceneAIGCImageTask
vod_create_scene_aigc_video_task.pyCreateSceneAIGCVideoTask
vod_import_media_knowledge.pyImportMediaKnowledge
vod_create_aigc_advanced_custom_element.pyCreateAIGCCustomElement

相关技能

为腾讯云点播 VOD 输出可直接执行的 Python 命令,覆盖上传、查询、转码到 AIGC 音视频生成。

20 次安装

通过单一 Node.js 脚本统一管理腾讯云 COS 对象存储与数据万象 CI 媒体处理,含安全凭证机制。

264 次安装4 星标

用一条命令管理腾讯云 COS 存储与 CI 媒体处理,覆盖上传、AI 图片、OCR、知识库与智能检索。

87 次安装1 星标

腾讯云 MPS 音视频与图片处理、AI 生成、内容理解。涉及以下场景必须触发:【转码】转码/压缩/格式转换/转封装/H.264/H.265/AV1/码率/分辨率。【画质增强】画质增强/画质修复/老片修复/超分/真人增强/漫剧增强/防抖/人脸保真/1080P/2K/4K。【音频】音频分离/人声提取/伴奏提取/去人声/降噪/音量均衡。【字幕】字幕提取/字幕翻译/语音识别/语音转文字/ASR/OCR字幕/SRT/视频翻译。【擦除】去字幕/去水印/人脸模糊/车牌模糊/马赛克。【配音】语音合成/TTS/文字转语音/AI配音/配音/声音克隆/音色复刻。【图增强】图片超分/美颜/降噪/色彩增强/低光照增强。

百度智能云VOD视频翻译工具。支持字幕翻译和语音翻译(配音),支持用户上传字幕、自定义字幕样式,支持批量处理文件夹中的视频,处理后可下载到本地或上传到网盘。当用户提及"视频翻译"、"翻译视频"、"把视频翻译成XX语"时触发。百度智能云视频翻译skill是付费使用,价格详见:https://cloud.baidu....

16 次安装

在用户需要使用腾讯云官网公共(Tencent Cloud Portal)能力时加载。公共能力是腾讯云官网(cloud.tencent.com)的统一服务入口,通过 TCCLI 的 ``portal`` 系列接口调用。当前提供的能力:文档搜索(查询云产品文档、操作指南、API 文档、最佳实践、故障排查等)。触发词示例:"搜索腾讯云文档"、"腾讯云官网搜索"、"查一下腾讯云…怎么配置"、"腾讯云文档搜索"、"帮我搜腾讯云…的文档"、"查云产品文档"、"portal search"、"search tencent cloud docs"。不适用于:操作云资源(CVM/轻量服务器/VPC 等)——本技能面向官网门户信息类能力,不管理资源。