← 查看文章

视频

别再只写电影感了:这个仓库把 Claude 训练成短视频提示词导演

深拆 rediumvex/ai-video-generator-claude:它用 10 个 Claude Skill,把短视频 prompt 拆成 hook、镜头、灯光、声音和平台适配。

别再只写电影感了:这个仓库把 Claude 训练成短视频提示词导演

我以前试 AI 视频,最常犯的错很简单:上来就写风格词。

做一个高级一点的产品视频。
要电影感。
节奏快一点。
适合小红书。

这几句话不能说错。问题是,视频模型拿到以后也很难办。

“高级”到底是黑底、侧光、金属质感,还是干净白棚?

“电影感”到底是推镜、环绕、浅景深,还是只是画面暗一点?

“节奏快一点”也不够。前 2 秒怎么进,0.8 秒有没有切,声音什么时候落,字幕放不放,最后一帧要不要能循环,这些都没说。

模型会补。它当然会补。只是它补出来的,常常像一段平均水平的 AI 视频:看着有画面,细看没调度。

rediumvex/ai-video-generator-claude 治的就是这个毛病。

这个仓库不是剪辑工具,也不会直接帮你生成 MP4。它做得更靠前:把 Claude 变成一个短视频 prompt 导演,让它生成可以粘到 Higgsfield Seedance 2.0 里的生产级提示词。

仓库里一共有 10 个 Claude Skill:

01-viral-hook
02-saas-launch
03-personal-brand
04-course-promo
05-faceless-channel
06-luxury-aesthetic
07-before-after
08-testimonial-story
09-ai-avatar
10-podcast-visual

这 10 个名字看起来像分类,实际更像 10 套短视频分镜习惯:有的专门管开头 2 秒,有的管 SaaS 产品发布,有的管播客音频怎么视觉化,有的管前后对比。

ai-video-generator-claude 把一句想法拆成视频 prompt 的流程

1. 它先解决一个老问题:prompt 太空

短视频 prompt 最怕只剩形容词。

高级、震撼、丝滑、电影感、科技感

这些词人看得懂,模型也能猜,但它们不够可执行。一个能落到视频里的 prompt,要把几个东西说清楚:

  • 多长时间
  • 什么比例
  • 前 2 秒怎么抓人
  • 镜头怎么动
  • 光从哪里来
  • 声音怎么进
  • 如果有素材,怎么引用

这个仓库的 README 里说得很直:你给一个想法,它返回 15 到 25 行的 Seedance 2.0 prompt,里面有 timing、camera angles、lighting setup 和 sound design。

我喜欢它这一点。它没有让 Claude 去“发挥创意”,而是让 Claude 按短视频生产里的几个硬问题往下追。

比如你说:

我想做一个 10 秒 SaaS 产品发布视频。
产品是一个 AI 会议纪要工具。
目标平台是 Reels 和视频号,竖屏。
前 2 秒先打痛点,再展示产品界面。

如果直接丢给普通模型,它可能写一段漂亮但泛的英文 prompt。

用这个仓库里的 02-saas-launch,它会更容易往几个具体方向走:UI 不能只是平面截图,要有 perspective、reflection、environment、motion;点击按钮时要有声音;产品界面要成为画面主角,而不是旁白解释半天。

这就不一样了。

它开始像视频 prompt,而不是广告文案。

2. 它把“短视频感”拆成几层规则

这个仓库最主要的资产是 skills/*/SKILL.md

没有复杂服务,也没有一堆神秘脚本。每个 Skill 都是一份长规则文档,告诉 Claude 在某类视频里应该问什么、怎么拆、怎么输出。

01-viral-hook/SKILL.md 来看,它把开头 2 秒拆得很细。

它会讲 12 种 hook pattern:

Pattern Interrupt
Curiosity Gap
Dopamine Trigger
Eye Contact
Sudden Movement
Silence Then Sound

这些词如果只是列出来,还是鸡汤。它继续往下写,每种 pattern 都给了机制和 prompt template。

比如 Silence Then Sound,它不会写到“先安静再爆发”就停住,还会把时间写进去:

前 1.5 秒接近静音
1.5 秒时给一个强声音
视觉上同步硬切

02-saas-launch/SKILL.md 也是类似写法。

它不满足于说“做一个好看的产品视频”,而是把 SaaS 视频拆成几个镜头问题:

  • 不要只展示平面截图
  • UI 是主角
  • 软件交互要有声音
  • 可以用 floating device、perspective zoom、split comparison

这里的启发挺实在。

很多人写 Skill 时,只写结果:

请生成一个高质量视频 prompt。

这个仓库写的是中间过程:

先判断视频类型。
再选 hook。
再写镜头。
再写灯光。
再写声音。
再适配平台比例。

中间过程越清楚,AI 越不容易回到“高级感、电影感、震撼感”那一套。

3. 它的安装脚本做得很朴素

仓库里还有一个 install.py

这个脚本没有做什么花活,主要做三件事:

  1. 扫描 skills/ 下面带 SKILL.md 的目录。
  2. 从每个 SKILL.md 里读出第一个 H1 标题,列给用户看。
  3. 把选中的 Skill 复制到 Claude 的 skills 目录。

macOS 上它默认找:

~/Library/Application Support/Claude/skills

Linux 上默认找:

~/.config/Claude/skills

从这里也能看出它的底层很简单:这些 Skill 本质上就是一组可安装的规则文件。它好用不靠安装方式复杂,而靠每个 SKILL.md 里把视频生产经验写得够细。

对普通读者来说,没必要自己敲命令。

仓库地址在这里:

https://github.com/rediumvex/ai-video-generator-claude

你把这个地址丢给 AI,然后说:

帮我安装这个仓库里的 Claude 视频生成 Skills。

装好以后,别只说“帮我生成视频 prompt”。最好把平台、时长、素材和目标说清楚。

可以这样问:

用 SaaS Launch Skill。

我想做一个 10 秒产品发布视频。
产品:AI 会议纪要工具。
目标平台:视频号和 Reels,竖屏。
素材:产品首页截图、Logo、一个会议录音片段。
希望前 2 秒先表现“会后整理很烦”,再切到产品界面自动生成纪要。

请生成 Higgsfield Seedance 2.0 可用的 prompt。

这类输入,才给了它发挥空间。

4. 公开反馈不多,主要看源码

我去找了一圈公开反馈,没有找到足够扎实的一手长评。这个仓库目前更像一个作者把自己的 Claude Skills 开源出来,README 里也说这些 Skill 来自作者自己的生产流程。

GitHub API 在 2026 年 7 月 17 日返回的数据是:278 个 star,37 个 fork,open issues 是 0。这个数字只能说明有一小批人关注,不能证明效果。

所以这篇我不拿“社区都说好”当依据。这里更值得看的,是它怎么把短视频 prompt 拆细。

5. 如果自己实现一套,该怎么写

这套结构很好迁移。

你不一定要做 Seedance 2.0,也不一定要做英文短视频。你可以给中文视频号、小红书、B 站、产品演示片各写一套。

最小版本可以这样拆:

场景:视频号产品发布短片

输入:
- 产品是什么
- 给谁看
- 视频时长
- 目标平台
- 可用素材
- 必须出现的信息

工作流:
1. 先判断视频类型:产品发布 / 教程 / 口播切片 / 前后对比
2. 选一个 hook:痛点闪回 / 一键变化 / 反差前后 / 悬念开场
3. 写 0-2 秒:画面、声音、字幕、镜头
4. 写 2-8 秒:产品怎么出现,界面怎么动
5. 写 8-12 秒:结果和收尾
6. 补平台比例、字幕安全区、素材引用

输出:
- 一段可复制给视频模型的 prompt
- 一段给剪辑工具用的旁白或字幕
- 一段说明:哪些地方需要用户提供素材

关键约束也要写清楚。

比如:

不要只写“高级感”。
每个镜头必须有时间点。
有声音就要写声音进入的时间。
有素材就用 @material[name] 引用。
视频号竖屏默认 9:16,字幕避开底部按钮区。

自己实现视频 prompt Skill 的最小结构

这比一句“请写得更有电影感”管用。

“电影感”是结果,不是方法。

6. 我的判断

这个仓库适合已经在试 AI 视频的人。

如果你还没用过 Higgsfield、Seedance 2.0,也没有准备参考图、产品截图、音频素材,它可能会显得有点靠前。它不会替你完成剪辑,也不会替你处理素材。

但如果你已经被“高级感 prompt”折磨过,它就很值得看。

它最大的启发不在那 10 个分类,而在写 Skill 的方式:别把审美留给模型猜,尽量把它拆成镜头、时间、声音、素材和平台。

如果你只是想用:

把 GitHub 地址给 AI,让它安装这些 Claude 视频生成 Skills,然后用具体视频任务去触发。

如果你想学着写:

先挑一个视频场景,不要一上来写“万能视频 Skill”。场景越窄,规则越能写细。

你可以这样写自己的 Skill

适用场景:给某类短视频生成视频模型 prompt。

触发条件:用户提到平台、视频类型、参考素材、时长或目标受众。

输入:产品/人物/主题说明,目标平台,素材引用,视频时长,风格偏好。

输出:可复制到视频生成工具里的完整 prompt,最好附一段素材缺口说明。

工作流:先问清目标,再选 hook,再写时间轴、镜头、声音和平台适配。

关键约束:不要只写风格词;每个镜头要有时间点、镜头运动、灯光、声音和素材引用。

可选工具:Claude Skill、Seedance 2.0、Higgsfield、参考图片/视频/音频。

可改造方向:把这 10 个英文场景改成更适合中文视频号、小红书、B 站和产品演示片的版本。