fuke 是一个面向 Codex 的视频逆向分析 Skill。它读取参考视频和产品图片,逐镜拆解场景、人物、构图、动作、运镜、屏幕文字、口播与剪辑节奏,并输出可直接用于即梦全能参考、Seedance 2.0 等 AI 视频模型的高还原度分镜提示词。
它适合以下任务:
- 复刻参考视频的镜头结构与节奏
- 从视频反推生成提示词和分镜
- 用自己的产品图替换参考片商品
- 只引用产品图片生成视频,不把参考视频上传给生成模型
- 校准日语口播、字幕、商品名、价格、重量和促销信息
- 按时间输出镜头、场景、动作、口播、表情和情绪
- 读取视频时长、分辨率、帧率和音轨信息
- 提取每秒关键帧和每半秒关键帧接触表
- 检测场景切换候选时间
- 生成低码率音频预览
- 建立完整且不重叠的逐镜时间线
- 使用产品图锁定商品身份和跨镜头一致性
- 对齐用户确认的口播、字幕和促销信息
- 输出全局一致性提示词和逐镜分镜提示词
- 在交付前检查遗漏镜头、错误商品信息和生成缺陷
当参考视频、产品图片和用户文字出现冲突时,Skill 按以下顺序处理:
- 用户明确确认或更正的文字事实
- 参考视频中的可见事实
- 产品图片中的商品身份与视觉特征
- 模型根据上下文作出的推断
没有可靠口播转录时,生成的文案会明确标注为“按画面节奏反推的口播”,不会冒充原视频逐字转录。
.
├─ README.md
├─ LICENSE
├─ .gitignore
└─ skills/
└─ fuke/
├─ SKILL.md
├─ agents/
│ └─ openai.yaml
├─ references/
│ └─ pitfalls.md
└─ scripts/
└─ extract_video_reference.py
- 支持 Skills 的 Codex 环境
- Python 3.10 或更高版本
- FFmpeg
分析脚本会优先使用系统 PATH 中的 FFmpeg。在 Windows 上,如果没有找到系统 FFmpeg,它还会自动检查剪映专业版和 CapCut 的常见安装目录。也可以通过 --ffmpeg 显式指定可执行文件。
将 skills/fuke 复制到个人 Codex Skills 目录。
Windows PowerShell:
Copy-Item -Recurse ".\skills\fuke" "$env:USERPROFILE\.codex\skills\fuke"macOS 或 Linux:
cp -R ./skills/fuke ~/.codex/skills/fuke重新启动或刷新 Codex 后即可使用。
在 Codex 中附加参考视频和产品图片,然后明确调用 $fuke。例如:
使用 $fuke 逐帧分析这个参考视频。这三张是我的产品图,生成端不要引用参考视频,只引用 @图片1、@图片2、@图片3。请输出可直接用于即梦全能参考的完整提示词。
如果有准确的日语口播、商品名称、尺寸、重量、价格或优惠信息,请与文件一起提供。用户确认的文字会覆盖视觉或音频推测。
python .\skills\fuke\scripts\extract_video_reference.py `
"E:\视频\reference.mp4" `
--output ".\video-analysis-reference"显式指定 FFmpeg:
python .\skills\fuke\scripts\extract_video_reference.py `
"E:\视频\reference.mp4" `
--output ".\video-analysis-reference" `
--ffmpeg "C:\path\to\ffmpeg.exe"脚本会生成:
metadata.txt:媒体元数据frame_*.jpg:每秒关键帧contact_half_*.jpg:每半秒关键帧接触表scene_cuts.txt:场景切换候选时间audio_preview.m4a:音频预览summary.json:提取结果摘要
这些分析产物默认被 .gitignore 排除,不会随仓库提交。
Skill 默认先输出“全局一致性提示词”,再按时间顺序输出所有分镜。每个分镜包含:
- 分镜编号与时间范围
- 镜头描述
- 场景设定
- 画面与动作描述
- 对应口播
- 表情和情绪描述
默认输出纯文本,不使用表格或附件,方便直接复制到视频生成平台。
- 不要把客户视频、商品素材、口播音频或分析产物提交到公开仓库。
- 只分析和复刻你有权使用的参考内容。
- 发布带货视频前,请自行核对商品名称、尺寸、价格、促销时限及平台合规要求。
.gitignore已默认排除常见视频、音频和分析输出,但提交前仍应运行git status人工检查。
本项目采用 MIT License。