Skip to content

Latest commit

 

History

1 Commit

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 
 
 

Repository files navigation

Fuke:AI 视频复刻提示词 Skill

fuke 是一个面向 Codex 的视频逆向分析 Skill。它读取参考视频和产品图片,逐镜拆解场景、人物、构图、动作、运镜、屏幕文字、口播与剪辑节奏,并输出可直接用于即梦全能参考、Seedance 2.0 等 AI 视频模型的高还原度分镜提示词。

它适合以下任务:

  • 复刻参考视频的镜头结构与节奏
  • 从视频反推生成提示词和分镜
  • 用自己的产品图替换参考片商品
  • 只引用产品图片生成视频,不把参考视频上传给生成模型
  • 校准日语口播、字幕、商品名、价格、重量和促销信息
  • 按时间输出镜头、场景、动作、口播、表情和情绪

核心能力

  • 读取视频时长、分辨率、帧率和音轨信息
  • 提取每秒关键帧和每半秒关键帧接触表
  • 检测场景切换候选时间
  • 生成低码率音频预览
  • 建立完整且不重叠的逐镜时间线
  • 使用产品图锁定商品身份和跨镜头一致性
  • 对齐用户确认的口播、字幕和促销信息
  • 输出全局一致性提示词和逐镜分镜提示词
  • 在交付前检查遗漏镜头、错误商品信息和生成缺陷

信息优先级

当参考视频、产品图片和用户文字出现冲突时,Skill 按以下顺序处理:

  1. 用户明确确认或更正的文字事实
  2. 参考视频中的可见事实
  3. 产品图片中的商品身份与视觉特征
  4. 模型根据上下文作出的推断

没有可靠口播转录时,生成的文案会明确标注为“按画面节奏反推的口播”,不会冒充原视频逐字转录。

仓库结构

.
├─ README.md
├─ LICENSE
├─ .gitignore
└─ skills/
   └─ fuke/
      ├─ SKILL.md
      ├─ agents/
      │  └─ openai.yaml
      ├─ references/
      │  └─ pitfalls.md
      └─ scripts/
         └─ extract_video_reference.py

环境要求

  • 支持 Skills 的 Codex 环境
  • Python 3.10 或更高版本
  • FFmpeg

分析脚本会优先使用系统 PATH 中的 FFmpeg。在 Windows 上,如果没有找到系统 FFmpeg,它还会自动检查剪映专业版和 CapCut 的常见安装目录。也可以通过 --ffmpeg 显式指定可执行文件。

安装

skills/fuke 复制到个人 Codex Skills 目录。

Windows PowerShell:

Copy-Item -Recurse ".\skills\fuke" "$env:USERPROFILE\.codex\skills\fuke"

macOS 或 Linux:

cp -R ./skills/fuke ~/.codex/skills/fuke

重新启动或刷新 Codex 后即可使用。

使用方法

在 Codex 中附加参考视频和产品图片,然后明确调用 $fuke。例如:

使用 $fuke 逐帧分析这个参考视频。这三张是我的产品图,生成端不要引用参考视频,只引用 @图片1、@图片2、@图片3。请输出可直接用于即梦全能参考的完整提示词。

如果有准确的日语口播、商品名称、尺寸、重量、价格或优惠信息,请与文件一起提供。用户确认的文字会覆盖视觉或音频推测。

单独运行视频提取脚本

python .\skills\fuke\scripts\extract_video_reference.py `
  "E:\视频\reference.mp4" `
  --output ".\video-analysis-reference"

显式指定 FFmpeg:

python .\skills\fuke\scripts\extract_video_reference.py `
  "E:\视频\reference.mp4" `
  --output ".\video-analysis-reference" `
  --ffmpeg "C:\path\to\ffmpeg.exe"

脚本会生成:

  • metadata.txt:媒体元数据
  • frame_*.jpg:每秒关键帧
  • contact_half_*.jpg:每半秒关键帧接触表
  • scene_cuts.txt:场景切换候选时间
  • audio_preview.m4a:音频预览
  • summary.json:提取结果摘要

这些分析产物默认被 .gitignore 排除,不会随仓库提交。

输出结构

Skill 默认先输出“全局一致性提示词”,再按时间顺序输出所有分镜。每个分镜包含:

  • 分镜编号与时间范围
  • 镜头描述
  • 场景设定
  • 画面与动作描述
  • 对应口播
  • 表情和情绪描述

默认输出纯文本,不使用表格或附件,方便直接复制到视频生成平台。

隐私与版权

  • 不要把客户视频、商品素材、口播音频或分析产物提交到公开仓库。
  • 只分析和复刻你有权使用的参考内容。
  • 发布带货视频前,请自行核对商品名称、尺寸、价格、促销时限及平台合规要求。
  • .gitignore 已默认排除常见视频、音频和分析输出,但提交前仍应运行 git status 人工检查。

许可证

本项目采用 MIT License

About

AI视频复刻提示词 Codex Skill

Resources

Stars

5 stars

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages