参考先行的整片视觉导演工作流:先锁定全片职责与动效清单,再检索参考,逐项交付一张严格 2048×1152 的成片级参考图和一条按内容定时的 AI 视频提示词。
它不是“每句话都生成一张人物图”的提示词模板。它先判断哪里应该使用人物、真实证据、录屏、现有素材、动态包装或生成镜头,再只制作真正需要独立设计的动效。
flowchart LR
A[完整脚本 / SRT / 文案] --> B[visual-master-plan.md]
B --> C[motion-production-queue.md]
C --> D[精确检索本地或随包参考]
D --> E[final-video-reference 成片级参考图]
E --> F[真实像素验收 2048×1152]
F --> G[按内容路由时长]
G --> H[AI 视频提示词]
- 整片优先:先保存完整视觉总表,避免被上一张图或最近上下文带偏。
- 清单优先:从总表派生动效制作清单,先让用户确认真正需要制作的内容。
- 证据优先:真实页面、作品、录屏和现有素材优先于抽象包装。
- 参考可追溯:分别绑定色彩/材质、构图/字体和运动/镜头参考,不复制品牌、原文案或完整布局。
- 单张完成图:默认只交付一张接近成片的
final-video-reference,文字或 UI 需要参与构图时直接在图中完成。 - 真实 2K 验收:读取文件真实像素;不足时保留源图并高质量重采样到 2048×1152,内容失真则重新生成。
- 内容决定时长:根据事件数量、阅读负担与模型档位选择时长,再编译 I2VA、L2VA、FL2VA、Ref2VA 或 T2VA 提示词。
推荐直接在 Codex 中输入:
使用 $skill-installer 安装这个 Skill:
https://github.com/Work-Fisher/reference-first-motion-director/tree/main/reference-first-motion-director
也可以克隆仓库后,把 reference-first-motion-director 目录复制到:
$HOME/.agents/skills/reference-first-motion-director
安装后重新打开 Codex 任务,调用:
$reference-first-motion-director
示例请求:
使用 $reference-first-motion-director 分析这份完整口播脚本。
先保存整片视觉总表,再把需要单独制作的动效清单给我确认;
确认后从参考库找精确案例,逐项生成严格 2K 完成图,再输出按内容定时的 AI 视频提示词。
不配置本机素材路径也能检索 4 支原创轻量案例和对应的 12 帧联络表。四支案例全部由仓库内可复现的 Python 源码以纯矢量图元逐帧渲染:
| 模式 | 预览 | 学习机制 | 视频 |
|---|---|---|---|
| M02 | ![]() |
固定构图、单变量换色、状态索引 | MP4 |
| M03 | ![]() |
矢量模块依次进入、锁定、完成态 | MP4 |
| M05 | ![]() |
导线、描边显影、实字收束 | MP4 |
| M10 | ![]() |
方向对撞、斜切、编号钉合 | MP4 |
这些案例用于学习信息关系、注意力顺序、色彩行为和运动规律,不是要求复制演示文案或完整布局。
正常检索和预览不需要重渲染;只有复现这些公开资产时才需要 Pillow 与 FFmpeg。
除了 4 支纯代码 starter,Skill 还随包提供 48 项由 Work-Fisher 授权公开分发的视觉参考:33 张图片、15 支视频和逐支 12 帧联络表。无需配置本机路径即可检索色彩、构图、字体、材质和运动机制。
公开副本使用哈希文件名,已移除本机路径、原始文件名和可移除元数据。媒体与描述索引采用 CC BY-NC 4.0,完整数量、来源声明和隐私处理见 manifest.json。
从技能目录运行:
python -X utf8 scripts/reference_library.py status
python -X utf8 scripts/reference_library.py search --query "章节 标题"
python -X utf8 scripts/reference_library.py preview --asset-id cbb79775b708 --frames 12上面三条命令无需配置即可使用 48 项创作者参考与 4 项 starter 案例。需要接入自己的主知识库和增量素材库时:
python -X utf8 scripts/reference_library.py configure `
--reference-library "<reference-library>" `
--primary-learning-root "<learning-root>"个人视频需要生成新联络表时,系统还需可调用 ffmpeg 和 ffprobe。个人路径写入用户目录下的本机配置,不进入 SKILL 或仓库。
| 文件 | 作用 |
|---|---|
visual-master-plan.md |
全片唯一视觉真源,记录时间、职责、证据、表现形态、制作层和状态 |
motion-production-queue.md |
从总表派生的动效制作视图,每个 FXxx 回链总表 |
final-video-reference |
一张经过真实像素验收的 2048×1152 PNG 成片级参考图 |
| AI video prompt | 标明原视频覆盖时间,并按内容关系与事件数量选择时长的视频提示词 |
若具体模型要求精确首尾帧,工作流可以在内部准备与完成图空间对齐的干净输入帧;这属于模型输入要求,不增加默认用户交付数量。
- 仓库不包含未授权个人素材、本机绝对路径、原始文件名、字幕或逐秒拆帧;创作者随包媒体有独立权利声明和许可证。
- 新参考只在用户有权持有时进入个人库;保存参考不代表获得再分发权。
- SKILL 负责整片规划、参考检索、关键静帧流程和提示词编译,不声称自动生成最终视频。
- 随包 starter library 的逐项来源与排除边界记录在
manifest.json,完整画面可由render_original_starter_library.py重新生成。仓库全部公开视觉资产另见ASSET_PROVENANCE.md。
python -m unittest discover -s reference-first-motion-director/scripts/tests -p "test_*.py" -v
python reference-first-motion-director/scripts/reference_library.py status
python reference-first-motion-director/scripts/ensure_2k.py "<source.png>" --output "<final-2K.png>"Skill 指令与代码采用 MIT。assets/creator-reference-library/ 中的媒体、预览、总览图和描述索引采用 CC BY-NC 4.0。




