video-recreation skill
自媒体创作者与影片与视频编辑在需要视频二创或反推参考视频时,一键完成从AI视觉分析、图文音素材生成到最终合成的全流程,自动产出包含配音与字幕的高质量二创视频,让创作效率翻倍!
A100/100content scan
Is the video-recreation skill safe?
Clean: nothing in its files matched our rules. We read 14 files in the folder on 2026-09-28.
No findings.
Install the video-recreation skill
A skill is a folder. Copy it into your agent's skills folder and the agent loads it when the task matches its description.
git clone --depth 1 https://github.com/anbeime/skill.git /tmp/skill mkdir -p ~/.claude/skills cp -r /tmp/skill/skills/video-recreation/video-recreation ~/.claude/skills/video-recreation
available in every project
In the Claude apps, zip the folder and upload it from the Skills settings. The folder on GitHub
The instructions your agent would load
SKILL.md as published, without the frontmatter. Read it on GitHub
video-recreation
任务目标
- 本Skill用于:视频二创创作,从原视频反推分析到新视频合成的完整流程
- 能力包含:视频分析、素材生成(图片/音频/配音/字幕)、视频合成、文件下载
- 触发条件:用户要求"二创视频"、"反推视频"、"视频重制"、"根据参考视频创作"等
前置准备
- 环境依赖:
opencv-python>=4.8.0
pillow>=10.0.0
moviepy>=1.0.3
numpy>=1.24.0
requests>=2.28.0
edge-tts>=6.1.0- Edge-TTS安装:
pip install edge-tts- Suno API(可选):
- 用于生成真实的背景音乐
- 三种配置方式:
- 开发者模式: 技能已预置 API Key,开箱即用
- 用户模式: 设置环境变量 export SUNOAPIKEY=yourapikey
- 命令行模式: 执行时指定 --suno-api-key yourapikey
- 配置优先级: 命令行参数 > 环境变量 > 技能凭证
- 占位模式: 未配置 API Key 时自动使用占位实现
- 官网: https://suno.com
- 环境变量:
- COZEBOTID: Coze Bot ID (默认: 7572557757883383858)
- COZEAPIKEY: Coze API Key (需配置)
- 输出目录结构:
./output/
├── frames/ # 视频关键帧
├── analysis.json # 反推分析结果
├── images/ # 生成的图片素材
├── audio/ # 音效和背景音乐
├── voice/ # 配音音频
├── subtitles/ # 字幕文件
└── final.mp4 # 最终合成视频操作步骤
第一阶段:视频反推分析
- 提取视频关键帧
- 调用 scripts/videoframeextractor.py 提取关键帧
- 参数: --input <原视频路径> --output ./output/frames --interval 2
- 输出:序列图片到 ./output/frames/
- 视觉分析
- 调用 scripts/cozebotclient.py 分析关键帧
- 智能体描述分析需求:"分析这些视频帧,提取:1.画面风格 2.色调特征 3.构图方式 4.节奏模式"
- 参数: --message "<分析提示>" --image_path <关键帧路径>
- 输出:分析结果保存到 ./output/analysis.json
- 生成创作方案
- 智能体根据分析结果,生成二创方案:
- 新视频主题
- 画面风格调整
- 脚本大纲
- 素材需求清单
第二阶段:素材生成
- 生成图片素材
- 智能体根据脚本生成关键帧提示词
- 调用 scripts/image_generator.py 生成图片
- 参数: --prompt "<提示词>" --output ./output/images/frame_xxxx.png
- 重要:图像生成应由智能体创作,脚本仅负责技术实现
- 输出:图片到 ./output/images/
- 生成音效和背景音乐
- 智能体描述音效需求:"根据场景生成音效:1.转场音效 2.背景音乐风格 3.环境音"
- 调用 scripts/sound_generator.py 生成音效和背景音乐
- 参数: --type sound --input <音效配置JSON> --output ./output/audio (生成音效)
- 参数: --type music --input <音乐配置JSON> --output ./output/audio (生成背景音乐)
- 参数: --type both --input <完整配置JSON> --output ./output/audio (同时生成两者)
- API Key 配置(可选):
- 不配置: 自动使用占位实现(开箱即用,无需任何配置)
- 环境变量: export SUNOAPIKEY=yourapikey
- 命令行参数: --suno-api-key yourapikey
- 强制占位: --use-placeholder (即使有 API Key 也使用占位)
- 输出:音效到 ./output/audio/soundeffects/, 背景音乐到 ./output/audio/backgroundmusic/
- 模式说明:
- 生成配音
- 智能体作为配音师,创作旁白脚本:
- 分析原视频节奏
- 创作贴合画面的旁白
- 选择合适的音色(中文/英文/日文等20+音色)
- 调整语速、音调、音量参数
- 调用 scripts/voice_generator.py 合成配音(基于Edge-TTS)
- 参数: --input <旁白脚本JSON> --output ./output/voice
- 参数: --list-voices (列出所有可用音色)
- 输出:配音文件到 ./output/voice/
- 音色示例:
- 中文女声: zh-CN-XiaoxiaoNeural(活泼)、zh-CN-XiaohanNeural(知性)、zh-CN-XiaomengNeural(温柔)
- 中文男声: zh-CN-YunyangNeural(沉稳)、zh-CN-YunjianNeural(深沉)、zh-CN-YunxiNeural(活泼)
- 生成字幕
- 智能体创作字幕内容,确保:
- 文字简洁有力
- 与画面同步
- 符合视频节奏
- 调用 scripts/subtitle_generator.py 生成字幕文件
- 参数: --input <字幕数据JSON> --output ./output/subtitles
- 输出:SRT字幕到 ./output/subtitles/
第三阶段:视频合成
- 合成最终视频
- 调用 scripts/video_compositor.py 合成视频
- 参数: --images ./output/images --audio ./output/audio --voice ./output/voice --subtitles ./output/subtitles --output ./output/final.mp4
- 输出:最终视频 ./output/final.mp4
- 文件下载
- 启动HTTP服务器供下载
- 调用 scripts/file_server.py
- 参数: --port 8080 --directory ./output
- 输出:下载链接 http://localhost:8080/final.mp4
错误处理与断点续传
- 重试机制:所有API调用已配置最大重试次数(2-3次),避免无限消耗Token
- 错误日志:错误自动记录到 ./output/error_log.json,可用于问题诊断
- 断点续传:
- 检查 ./output/error_log.json 确认失败步骤
- 从失败步骤重新执行,已生成的素材可复用
- 例如:仅重新生成失败的音频,不重复已有图片
- 重试限制:
- Coze Bot API调用:最多重试3次,每次间隔1秒
- 图像生成:最多重试2次,每次间隔0.5秒
- 音频生成:最多重试2次,每次间隔0.5秒
- 音效和背景音乐:最多重试2次,每次间隔0.5秒
资源索引
- 视频处理:见 scripts/videoframeextractor.py(提取关键帧)
- 视觉分析:见 scripts/cozebotclient.py(调用Coze Bot API)
- 图像生成:见 scripts/image_generator.py(生成图片素材)
- 音频生成:见 scripts/audio_generator.py(生成旁白/配音)
- 音效和音乐:见 scripts/sound_generator.py(生成环境音效和背景音乐,集成Suno API)
- 配音合成:见 scripts/voice_generator.py(合成旁白,基于Edge-TTS)
- 字幕生成:见 scripts/subtitle_generator.py(生成字幕)
- 视频合成:见 scripts/video_compositor.py(合成最终视频)
- 文件服务:见 scripts/file_server.py(HTTP下载服务器)
- 错误处理:见 scripts/error_handler.py(重试和错误日志)
- 创作指南:见 references/recreation-guide.md(视频二创方法论)
- 提示词模板:见 references/prompt-templates.md(分析提示词示例)
注意事项
- 智能体职责:内容创作(剧本、旁白、字幕、图像提示词)由智能体完成,脚本负责技术处理
- 重试限制:避免无限重试消耗Token,已配置合理重试次数
- 错误日志:遇到错误时检查 ./output/error_log.json,从失败步骤恢复
- 断点续传:重复执行时,已存在的素材会被复用,无需重新生成
- Coze Bot API:视觉分析依赖用户发布的Coze Bot,需配置API Key
- 文件路径:所有输出使用相对路径 ./output/,确保下载时能正确访问
使用示例
示例1:完整二创流程
# 1. 提取关键帧
python scripts/video_frame_extractor.py \
--input original_video.mp4 \
--output ./output/frames \
--interval 2
# 2. 视觉分析(智能体描述分析需求)
python scripts/coze_bot_client.py \
--message "分析这些视频帧,提取:画面风格、色调特征、构图方式、节奏模式" \
--image_path ./output/frames/frame_0001.jpg
# 3. 生成图片素材(智能体创作提示词)
python scripts/image_generator.py \
--prompt "现代科技风格,蓝色调,未来城市景观" \
--output ./output/images/frame_0001.png
# 4. 生成音效和背景音乐
# 方式1: 使用技能预置的 API Key(开箱即用)
python scripts/sound_generator.py \
--type both \
--input audio_config.json \
--output ./output/audio
# 方式2: 使用自己的 API Key
export SUNO_API_KEY=your_api_key
python scripts/sound_generator.py \
--type both \
--input audio_config.json \
--output ./output/audio
# 方式3: 命令行指定 API Key
python scripts/sound_generator.py \
--type both \
--input audio_config.json \
--output ./output/audio \
--suno-api-key your_api_key
# 方式4: 强制使用占位实现(不调用 API)
python scripts/sound_generator.py \
--type both \
--input audio_config.json \
--output ./output/audio \
--use-placeholder
# 其中audio_config.json示例:
{
"sound_effects": [
{"name": "transition_01", "type": "transition", "duration": 2.0, "description": "转场音效"},
{"name示例2:单独生成音效
python scripts/sound_generator.py \
--type sound \
--input sound_effects.json \
--output ./output/audio示例3:单独生成背景音乐
python scripts/sound_generator.py \
--type music \
--input background_music.json \
--output ./output/audio示例4:断点续传
# 检查错误日志
cat ./output/error_log.json
# 从失败步骤重新执行(例如仅重新生成失败的音效)
python scripts/sound_generator.py \
--type sound \
--input sound_effects.json \
--output ./output/audio智能体角色分工
- 视觉分析师:分析原视频,提取风格、色调、构图等特征
- 脚本策划师:根据分析结果创作新视频脚本和大纲
- 提示词设计师:为图像生成工具创作精准的提示词
- 配音师:创作旁白脚本,确定音色、节奏、情感
- 音效师:设计音效方案,确定音效类型、时长和位置
- 音乐师:选择背景音乐风格,确定节奏和情绪基调
- 字幕师:创作字幕内容,确保与画面同步
- 技术协调员:调用脚本完成技术处理,管理文件路径,启动下载服务
More skills from anbeime/skill
- APDF Processing Pro综合办公文员与软件开发工程师当需要批量处理PDF表单、提取表格或进行OCR识别时,使用内置脚本一键完成自动化提取与数据校验,彻底告别繁琐的手动录入,让复杂文档工作流高效、稳健落地。
- Aagent-team产品经理与项目管理专家在应对复杂项目时,使用此技能可动态组建包含“执行、指挥、评审”的专属AI团队。实时查看多智能体辩论与决策全过程,共享统一上下文记忆,一键完成从会议决策到系统构建的全流程高效协同!
- Aagentkit-multimedia-shopping电商运营与内容创作者在需要制作带货短视频时,用此技能一键生成9:16竖屏数字人成片。自动编排AI绘画、语音合成与视频生成,快速产出“小省导购员”专属形象与专业配音,让多模态视频制作省时省力。
- Aantinet-doc-parse软件开发工程师与数据科学家在构建RAG系统时,当需处理PDF/Word/Excel等多格式复杂文档,用此技能可自动触发三级解析降级,一键输出高置信度结构化Markdown与元数据,免去繁琐清洗,直接夯实企业知识库数据底座!
- Aantinet-four-color-cards财务和投资分析师、律师助理与法律助手在撰写金融研报或分析法律文档时,必用此技能!基于解析文档一键生成事实蓝卡、解释绿卡、风险黄卡与行动红卡。自动完成深度剖析与风险排查,产出100%可溯源的结构化四色报告,让复杂分析高效且严谨。
- Aantinet-provenance软件开发工程师与信息安全分析师在构建多智能体系统时,当需全链路可观测与安全审计,请用此技能。它自动收集操作日志,生成可追溯证据链与向量索引,开箱即用实现系统审计与精准回放,让Agent运行安全透明。
- Aantinet-security-scan信息安全分析师与软件开发工程师在搭建文档处理流水线时,当需要拦截违规文件或外部URL,请挂载此技能作为强制前置安检,自动输出 pass/reject 判定与详细合规扫描报告,一键守住零信任安全底线。
- AarchifyCreate polished, validated architecture, workflow, sequence, data-flow, and lifecycle/state diagrams as explorable standalone HTML with inline SVG, dark/light themes, optional trace motion, and PNG/JPEG/WebP/SVG/WebM export. Accept plain-language requirements or pasted Mermaid flowchart, sequenceDiagram, and stateDiagram input; inspect repository evidence when the diagram must reflect real code. Use when the user asks to visualize system architecture, infrastructure, cloud/security/network topology, technical workflows, API call sequences, request lifecycles, data pipelines, ETL/ELT, data lineage, state machines, or to convert/beautify Mermaid.
- Aarticle-illustrator内容创作者与自媒体创作者在撰写长文缺乏视觉辅助时,当需要给文章配图或生成插图请使用。自动分析文章结构,精准识别位置并生成插画插入段落,将抽象概念具象化。一键完成智能图文排版,省去手动找图时间,大幅提升阅读体验!
- Aarticle-illustrator内容创作者和自媒体创作者在撰写长文时,当需要“给文章配图”或“添加插图”时使用。自动分析文章结构,精准识别需要视觉辅助的位置,生成并插入契合语境的插画,将抽象概念具象化,一键完成高质量图文排版,大幅提升阅读体验。
- Aatutun-xhs-cover阿囤囤风格小红书封面提示词生成。用于AI工具、效率方法、产品测评、教程部署、个人经验、播客推荐、职场认知类内容的爆款竖版封面设计。特点是真人出镜、超大柔和浅黄(#FDFFA7)/白色中文标题、粗黑描边、人物抠图描边、绿色勾选清单、emoji贴纸、箭头标注、高对比高密度构图。关键词:小红书封面、爆款封面、阿囤囤风格、AI教程封面、产品测评封面、封面提示词。
- Abaoyu-format-markdown技术写作员与内容创作者在处理纯文本或 Markdown 稿件时,若需优化文章结构、添加 frontmatter 或自动修正中英文排版间距,使用此技能可一键生成专业美观的 {filename}-formatted.md 文件,让文档排版更完美。