Mmcp.market

video-creation-collaborator skill

by anbeime·anbeime/skill·7.3k stars

内容创作者与自媒体创作者在制作短视频时,若遇生图畸形、合成瑕疵或协同混乱,当需规范化多智能体流程时必用此技能。一键调度11个AI智能体,自动完成文案、分镜、音视频到视频合成的5阶段闭环,前置质检拦截瑕疵,高效产出统一可控的高质量短视频。

A100/100content scan

Is the video-creation-collaborator skill safe?

Clean: nothing in its files matched our rules. We read 12 files in the folder on 2026-09-28.

No findings.

Install the video-creation-collaborator skill

A skill is a folder. Copy it into your agent's skills folder and the agent loads it when the task matches its description.

git clone --depth 1 https://github.com/anbeime/skill.git /tmp/skill
mkdir -p ~/.claude/skills
cp -r /tmp/skill/skills/video-creation-collaborator/video-creation-collaborator ~/.claude/skills/video-creation-collaborator
available in every project

In the Claude apps, zip the folder and upload it from the Skills settings. The folder on GitHub

The instructions your agent would load

SKILL.md as published, without the frontmatter. Read it on GitHub

影品智创 - 多智能体协同视频创作管理

任务目标

  • 本Skill用于: 规范化和指导10个智能体的协同创作流程,解决生图失真(多肢体/畸形)、视频合成瑕疵等问题
  • 能力包含:
  • 11个智能体结构化分工(文案创作/故事策划/脚本创作/分镜导演/分镜画师/字幕师/配音师/音效师/视频工程师/质检/数据反馈)
  • 5阶段协同流程管理(需求承接→内容创作→生图创作→音频字幕→视频合成→全流程质检→数据迭代)
  • 质量管控与闭环反馈(前置质检拦截、数据沉淀迭代)
  • 素材生成支持(图片/音频/字幕/音乐)
  • 技术检测工具支持(图片质量、视频质量、音画同步)
  • 触发条件: 用户需要进行短视频创作,或需要规范化多智能体协同流程

前置准备

  • 依赖说明:
opencv-python>=4.8.0
  pillow>=10.0.0
  moviepy>=1.0.3
  numpy>=1.24.0
  • 非标准文件/文件夹准备:
# 创建工作目录
  mkdir -p ./input/{materials,scripts}
  mkdir -p ./output/{drafts,storyboards,final}
  mkdir -p ./cache/{images,audio}

操作步骤

标准流程(5个阶段,10个智能体)

第一阶段: 需求承接与内容框架搭建

触发节点: 用户输入核心需求(商品信息+视频需求)

步骤1: 文案创作师智能体(首节点)

  • 职责: 基于商品信息提炼核心卖点,生成适配短视频的文案
  • 输入: 商品品类、核心卖点、目标受众、视频风格、时长
  • 输出:
  • 核心Slogan(8-12字,简洁有力)
  • 分镜适配文案(3-5句,每句4-8字)
  • 质量标准: 无歧义、无夸大,贴合视频调性
  • 下一级触发: 立即触发【故事策划师】、【字幕师】(暂存)

步骤2: 故事策划师智能体

  • 职责: 基于卖点、文案,设计适配短视频时长的场景化故事线
  • 输入: Slogan、分镜文案、商品信息、视频时长、风格
  • 输出:
  • 场景化故事线(镜头拆分、场景/动作标注)
  • 镜头数量(30秒8-10个、45秒12-15个、60秒15-18个)
  • 质量标准: 逻辑连贯,时长严格匹配,无无关场景
  • 下一级触发: 立即触发【脚本创作师】

步骤3: 脚本创作师智能体

  • 职责: 将故事线转化为标准化、可执行的分镜脚本
  • 输入: 故事线、文案、视频时长、分辨率、比例
  • 输出:
  • 标准化分镜脚本(镜头序号、时长、场景描述、画面动作、文案、音效备注)
  • 画面动作描述(明确人体肢体姿态,规避模糊表述)
  • 质量标准: 时长精准分配,画面动作具体,格式统一
  • 下一级触发: 立即触发【分镜导演】、【分镜画师】、【字幕师】、【音效师】

第二阶段: 视觉内容创作与质检

触发节点: 分镜脚本确认

步骤4: 分镜导演智能体

  • 职责: 规划每个镜头的画面细节、光影、构图,为分镜画师提供精准依据
  • 输入: 分镜脚本、商品细节图(如有)、视频风格
  • 输出:
  • 镜头画面规范(构图/光影/色调/肢体规范/商品细节)
  • 负面规避清单(禁止多余肢体、畸形、虚化等)
  • 质量标准: 构图清晰,光影均匀,肢体规范,商品细节明确
  • 下一级触发: 立即触发【分镜画师】

步骤5: 分镜画师智能体

  • 职责: 基于画面规范,生成高质量、无瑕疵的分镜图片
  • 输入: 画面描述、分镜脚本、商品信息
  • 输出: 1080P合格分镜图片(单张对应单个镜头,命名规范)
  • 质量标准:
  • 人体结构正常(无多余肢体/畸形/重影)
  • 商品细节精准(无变形/模糊)
  • 画质细腻(1080P,无颗粒感)
  • 负面规避: 禁止多余肢体、手部畸形、商品变形、画面噪点等
  • 下一级触发:
  • 图片生成后,触发【视频工程师】素材预处理
  • 同时触发【质检智能体】分镜图片专项质检

第三阶段: 音频字幕创作(并行执行)

触发节点: 分镜脚本确认(可并行启动,无需等待视觉内容)

步骤6: 配音师智能体

  • 职责: 根据分镜文案生成高质量旁白/配音
  • 输入: 分镜文案、视频风格、情感基调
  • 输出:
  • 旁白文本(与分镜文案对应,可适当口语化)
  • 音色建议(活力男声/专业女声/稳重男声/亲切女声等)
  • 语速要求(中等/稍快/稍慢)
  • 情感标注(积极/专业/沉稳/亲切等)
  • 质量标准: 语音自然流畅,情感贴合场景,无明显机械感
  • 下一级触发: 输出同步至【音效师】,调用audio_generator.py生成音频文件

步骤7: 字幕师智能体

  • 职责: 创作适配画面的字幕,确保显示效果与可读性
  • 输入: 分镜文案、分镜脚本、视频风格、画面比例
  • 输出:
  • 字幕信息包(文本+对应镜头时长+叠加位置)
  • 格式规范(字体/字号/颜色/位置)
  • 质量标准: 无错别字,字数适配(每秒1-2字),避开商品主体
  • 下一级触发: 输出同步至【视频工程师】

步骤8: 音效师智能体

  • 职责: 推荐适配的背景音乐与场景音效,确保音画协调
  • 输入: 分镜脚本、视频风格、时长、核心场景
  • 输出:
  • 音效方案包(背景音乐+场景音效+时间节点+音量参数)
  • 音效名称、风格描述、时长、音量建议
  • 质量标准: 风格贴合,节奏匹配,音量适中,无版权问题
  • 下一级触发: 输出同步至【视频工程师】

第四阶段: 视频合成与成品质检

触发节点: 分镜图片质检合格

步骤9: 视频工程师智能体

  • 职责: 基于各智能体输出素材,完成高质量视频合成
  • 输入: 合格分镜图片、字幕信息、音效方案
  • 输出: 合成后的MP4成品视频
  • 质量标准:
  • 素材预处理(调用质量检测脚本,识别瑕疵)
  • 合成参数(1080P, 25fps, 8Mbps,无黑边/卡顿)
  • 转场效果(淡入淡出,0.3-0.5秒,过渡自然)
  • 音画同步(音频偏移≤0.1秒)
  • 下一级触发: 成品输出后立即触发【质检智能体】

步骤10: 质检智能体(全流程穿插)

  • 职责: 对各智能体输出物进行全环节质检,拦截瑕疵,推动整改
  • 输入: 各环节输出物、质量标准、负面规避清单
  • 输出:
  • 分环节质检报告(合格/不合格,瑕疵类型,整改建议)
  • 质检台账(瑕疵数据、整改结果、合格率)
  • 质检维度:
  • 内容层(文案/故事线/脚本/字幕)
  • 视觉层(分镜图片/成品视频)
  • 音频层(背景音乐/音效/音画同步)
  • 格式层(比例/脚本格式/视频参数)
  • 处理规则:
  • 轻微瑕疵(文案语序微调)→直接反馈优化

第五阶段: 数据沉淀与迭代优化

触发节点: 全流程质检合格

步骤11: 数据反馈智能体

  • 职责: 收集分析全流程数据,输出迭代建议,优化智能体提示词与协同逻辑
  • 输入: 质检台账、创作耗时数据、用户反馈
  • 输出:
  • 数据统计报告(合格率、高频瑕疵、创作耗时、整改率)
  • 迭代优化建议(针对高频瑕疵优化提示词、调整协同流程)
  • 数据沉淀(瑕疵类型-优化方案-效果验证闭环)
  • 分析维度:
  • 瑕疵分析(TOP3高频瑕疵,定位根因)
  • 效率分析(识别流程瓶颈)
  • 优化效果(验证迭代有效性)
  • 下一级触发: 输出同步至技能开发端,更新智能体配置,完成迭代闭环

并行协同与闭环管控

并行执行

  • 字幕师、音效师可在脚本创作师输出分镜脚本后并行启动,无需等待视觉内容完成
  • 效率提升: 减少等待时间,整体创作周期缩短

闭环管控

  • 所有输出物需经质检智能体校验合格后方可进入下一环节
  • 重大瑕疵直接拦截,避免问题流转
  • 跟踪整改结果,确保100%解决

迭代联动

  • 数据反馈智能体的优化建议直接作用于各智能体底层配置
  • 形成"创作-质检-优化"持续迭代机制

质量检测工具使用

图片质量检测

# 调用图片质量检测脚本
python scripts/image_quality_checker.py --image ./cache/images/shot_001.jpg --resolution 1920x1080

检测维度:

  • 肢体异常(多余肢体/畸形/重影)
  • 画面质量(模糊/噪点/变形)
  • 商品细节(纹理/轮廓/按键)
  • 分辨率/比例

视频质量检测

# 调用视频质量检测脚本
python scripts/video_quality_checker.py --video ./output/final/video.mp4 --resolution 1920x1080 --duration 30 --fps 25

检测维度:

  • 分辨率/时长/帧率/码率
  • 画面质量(卡顿/撕裂/转场瑕疵)
  • 音频质量(清晰度/杂音)
  • 音画同步(偏移≤0.1秒)
  • 字幕遮挡检测

素材生成与视频合成流程

素材生成流程

More skills from anbeime/skill

  • APDF Processing Pro综合办公文员与软件开发工程师当需要批量处理PDF表单、提取表格或进行OCR识别时,使用内置脚本一键完成自动化提取与数据校验,彻底告别繁琐的手动录入,让复杂文档工作流高效、稳健落地。
  • Aagent-team产品经理与项目管理专家在应对复杂项目时,使用此技能可动态组建包含“执行、指挥、评审”的专属AI团队。实时查看多智能体辩论与决策全过程,共享统一上下文记忆,一键完成从会议决策到系统构建的全流程高效协同!
  • Aagentkit-multimedia-shopping电商运营与内容创作者在需要制作带货短视频时,用此技能一键生成9:16竖屏数字人成片。自动编排AI绘画、语音合成与视频生成,快速产出“小省导购员”专属形象与专业配音,让多模态视频制作省时省力。
  • Aantinet-doc-parse软件开发工程师与数据科学家在构建RAG系统时,当需处理PDF/Word/Excel等多格式复杂文档,用此技能可自动触发三级解析降级,一键输出高置信度结构化Markdown与元数据,免去繁琐清洗,直接夯实企业知识库数据底座!
  • Aantinet-four-color-cards财务和投资分析师、律师助理与法律助手在撰写金融研报或分析法律文档时,必用此技能!基于解析文档一键生成事实蓝卡、解释绿卡、风险黄卡与行动红卡。自动完成深度剖析与风险排查,产出100%可溯源的结构化四色报告,让复杂分析高效且严谨。
  • Aantinet-provenance软件开发工程师与信息安全分析师在构建多智能体系统时,当需全链路可观测与安全审计,请用此技能。它自动收集操作日志,生成可追溯证据链与向量索引,开箱即用实现系统审计与精准回放,让Agent运行安全透明。
  • Aantinet-security-scan信息安全分析师与软件开发工程师在搭建文档处理流水线时,当需要拦截违规文件或外部URL,请挂载此技能作为强制前置安检,自动输出 pass/reject 判定与详细合规扫描报告,一键守住零信任安全底线。
  • AarchifyCreate polished, validated architecture, workflow, sequence, data-flow, and lifecycle/state diagrams as explorable standalone HTML with inline SVG, dark/light themes, optional trace motion, and PNG/JPEG/WebP/SVG/WebM export. Accept plain-language requirements or pasted Mermaid flowchart, sequenceDiagram, and stateDiagram input; inspect repository evidence when the diagram must reflect real code. Use when the user asks to visualize system architecture, infrastructure, cloud/security/network topology, technical workflows, API call sequences, request lifecycles, data pipelines, ETL/ELT, data lineage, state machines, or to convert/beautify Mermaid.
  • Aarticle-illustrator内容创作者与自媒体创作者在撰写长文缺乏视觉辅助时,当需要给文章配图或生成插图请使用。自动分析文章结构,精准识别位置并生成插画插入段落,将抽象概念具象化。一键完成智能图文排版,省去手动找图时间,大幅提升阅读体验!
  • Aarticle-illustrator内容创作者和自媒体创作者在撰写长文时,当需要“给文章配图”或“添加插图”时使用。自动分析文章结构,精准识别需要视觉辅助的位置,生成并插入契合语境的插画,将抽象概念具象化,一键完成高质量图文排版,大幅提升阅读体验。
  • Aatutun-xhs-cover阿囤囤风格小红书封面提示词生成。用于AI工具、效率方法、产品测评、教程部署、个人经验、播客推荐、职场认知类内容的爆款竖版封面设计。特点是真人出镜、超大柔和浅黄(#FDFFA7)/白色中文标题、粗黑描边、人物抠图描边、绿色勾选清单、emoji贴纸、箭头标注、高对比高密度构图。关键词:小红书封面、爆款封面、阿囤囤风格、AI教程封面、产品测评封面、封面提示词。
  • Abaoyu-format-markdown技术写作员与内容创作者在处理纯文本或 Markdown 稿件时,若需优化文章结构、添加 frontmatter 或自动修正中英文排版间距,使用此技能可一键生成专业美观的 {filename}-formatted.md 文件,让文档排版更完美。

All agent skills → · MCP servers