Install
openclaw skills install @liveljack/video-storyboard-pro全类型视频分镜生成指引。基于17本经典电影/动画分镜专著整合,覆盖短视频/营销视频/长视频。从内容到分镜、从叙事到镜头语言、从角色设计到图像生成参数,一站式输出。当用户需要将文案/脚本转化为视频分镜时加载。
openclaw skills install @liveljack/video-storyboard-pro本skill不是简单的"写个分镜表",而是从叙事策略→镜头语言→角色资产→图像生成的完整生产管道。它整合了17本经典专著的精华:
| 来源 | 核心贡献 |
|---|---|
| Steven D. Katz(电影镜头设计+分镜概论) | 四层递进框架、180度规则、30度规则、空间三角系统 |
| Jeremy Vineyard(电影镜头入门) | 150+镜头类型辞典、场景镜头套餐 |
| Christopher Kenworthy(大师镜头1-3) | 300个高级实战技巧(打斗/对话/悬疑/调度) |
| Marcie Begleiter(从文字到影像) | 3A框架、平面图+分镜联合设计 |
| Francis Glebas(故事编导) | 认知地图、情绪弧线、"为什么驱动什么" |
| Nancy Beiman(准备分镜图) | 动画表演原则、剪影法、角色设定 |
| Mark Simon(故事板:运动的艺术) | 六维运动系统、分镜格规范、媒体差异 |
| John Hart(故事板的艺术) | 构图/透视/光影实战技法 |
| Matt Madden(99种讲法) | 视角×叙事结构×风格=无限创意组合 |
| Giuseppe Cristiano(分镜头脚本设计教程) | 标准分镜表、八大创作原则 |
| 李杰/姚桂萍/靳晶(国内教材) | 蒙太奇、顺畅连接、国产动画流程 |
拿到任何内容后,先做三层分解:
| 层次 | 分析对象 | 提取内容 | 转化为 |
|---|---|---|---|
| 场景描述层 | 环境/时间/天气/氛围 | 地点、时段、色调关键词 | 光影方案+色彩基调 |
| 角色动作层 | 角色做什么/怎么动/情绪变化 | 动词、情绪词、转折点 | 动作序列+关键帧 |
| 对话/对白层 | 角色说什么/画外音/字幕 | 核心台词、信息密度 | 表演设计+表情库 |
从内容中提取"一句话情绪核心"——Katz强调:每个场景只有一个情绪核心,所有镜头围绕它展开。
输入内容 → 情绪关键词 → 视觉化方案
"深夜加班,孤独感" → 孤独+压抑 → 大背景小人物、侧光半脸阴影、冷色调
"新产品发布,激动人心" → 兴奋+期待 → 快速剪辑、推镜揭示、暖金+科技蓝配色
根据内容特征和用户要求,判定视频类型(决定后续采用哪套Reference):
| 判定条件 | 类型 | 加载Reference |
|---|---|---|
| 60秒以内、单一场景、强钩子开头 | 短视频 | reference/short-video.md |
| 含品牌/产品露出、行动号召CTA、转化目标 | 营销视频 | reference/marketing-video.md |
| 3分钟以上、多场景、完整叙事弧线 | 长视频 | reference/long-video.md |
| 不确定时 | 默认短视频 | reference/short-video.md |
确定类型后,基于Matt Madden的"99种讲法"选择叙事策略(至少从5个维度中各选1个):
| 维度 | 可选策略 |
|---|---|
| 视角 | 主观POV / 客观观察 / 上帝全知 / 多视角交叉 |
| 时间结构 | 顺序 / 倒叙(先结果)/ 回文对称 / 碎片拼贴 / 循环 |
| 分段密度 | 1-4镜(慢叙事)/ 6-12镜(标准)/ 15-30镜(快节奏) |
| 视觉风格 | 暗黑科技风 / 温暖纪实风 / 赛博朋克 / 极简白 / 动画风格 / 复古胶片 |
| 形式实验 | 左右分屏对比 / 画中画 / 纯画面无文字 / 信息图风格 / 第一人称Vlog |
无论视频长短,都必须有一条清晰的情绪弧线:
情绪强度
↑ ┌── 高潮/转折
│ ╱ ╲
│ ╱ ╲
│ ╱ ╲___ 释放/回落
│ ╱ ╲___
│ ╱ ╲__ 记忆锚点
│ ╱
│──┴──────────────────────────→ 时间
建置 冲突发展 解决
三幕与镜头节奏的对应关系:
| 幕 | 分镜重点 | 推荐景别递进 | 推荐时长/镜 | 情绪基调 |
|---|---|---|---|---|
| 第一幕(建置/钩子) | 广角环境+角色引入 | VLS→WS→MS | 3-5s | 好奇/吸引 |
| 第二幕(冲突/展开) | 密集正反打+特写 | MS→CU→XCU交替 | 2-5s | 紧张/对抗/期待 |
| 第三幕(解决/金句) | 全景+情感释放 | CU→MS→WS | 5-10s | 共鸣/回味 |
每个视频分镜必须包含以下故事要素(缺一不可):
| 要素 | 定义 | 实现手段 | 禁忌 |
|---|---|---|---|
| 钩子(Hook) | 开篇3-5s强冲击 | 灵魂拷问、惊人数据、反常识命题 | 不能放Logo、不能说"大家好" |
| 悬念(Suspense) | 制造"然后呢?"的期待 | 信息延迟揭示、动作未完成切镜、窥视构图 | 不能一次性给完所有信息 |
| 冲突(Conflict) | 让观众感同身受的困境 | 对比蒙太奇、角色VS环境、理想VS现实 | 不能是无关痛痒的小麻烦 |
| 转折(Turn) | 情绪或认知的翻转 | 期待→反转、低谷→希望、问题→方案 | 不能预测得到 |
| 记忆锚点(Anchor) | 一句可独立传播的金句 | 结尾大字+停顿+收声 | 不能是空洞鸡汤 |
观众首先需要知道"为什么"(动机),才能关心"什么"(结果)。
分镜设计时,每个动作序列前必须有1-2个镜头展示动机:
每个镜头必须输出以下完整信息:
镜号: [唯一编号,如 SC-01]
景别: [ELS/VLS/WS/LS/MLS/MS/MCU/CU/XCU]
角度: [平视/仰视/俯视/鸟瞰/倾斜/主观POV/过肩OTS]
运镜: [固定/推/拉/摇/移/跟/升降/手持/变焦/复合]
时长: [X秒,精确到0.5s]
画面内容: [角色位置+动作状态+场景环境+构图要点]
对白/旁白: [角色台词或画外音内容]
音效: [环境音/特效音/音乐节点]
转场: [切/淡入淡出/化/划/匹配剪辑]
| 镜号 | 景别 | 角度 | 运镜 | 时长 | 画面内容 | 对白/旁白 | 音效 | 转场 |
|---|---|---|---|---|---|---|---|---|
| SC-01 | VLS | 平视 | 固定 | 3s | ... | ... | ... | 切 |
| 场景类型 | 每镜时长 | 说明 |
|---|---|---|
| 建置镜头 | 3-5s | 让观众有足够时间理解空间 |
| 动作/追逐 | 1-3s | 快速切换制造紧张感 |
| 对话 | 3-8s | 留出对白时间+反应镜头 |
| 情绪/沉思 | 5-15s | 给观众共情的时间 |
| 关键信息 | 2-4s | 数据/文字需要停留阅读时间 |
需要展示环境全貌? → VLS/WS
需要展示角色全身动作? → LS/MLS
需要展示角色表情+手势? → MS
需要聚焦角色情绪反应? → CU
需要极致情绪冲击? → XCU
需要建立两个角色关系? → 2-Shot MS → OTS交替
| 角度 | 心理效果 | 使用时机 |
|---|---|---|
| 平视 | 中性、平等、客观 | 日常对话、信息传递 |
| 低角度(仰拍) | 强大、威严、压迫 | 权威角色、产品展示、高潮 |
| 高角度(俯拍) | 脆弱、无力、渺小 | 受困角色、失败时刻 |
| 鸟瞰(垂直俯) | 上帝视角、全局审视 | 场景建置、地图说明 |
| 倾斜(Dutch) | 不安、混乱、迷失 | 心理危机、转折前兆 |
| 主观POV | 代入感、沉浸 | 产品体验、发现时刻 |
| 运镜 | 叙事效果 | 使用场景 |
|---|---|---|
| 固定 | 客观、稳定 | 信息传递、对话 |
| 推(Dolly In) | 强调、进入内心 | 情绪升级、关键信息 |
| 拉(Dolly Out) | 揭示上下文、疏离 | 场景建置、情感抽离 |
| 摇(Pan) | 揭露空间、跟随视线 | 环境介绍、角色搜寻 |
| 移(Track) | 平行跟随、速度感 | 追逐、漫步、展示 |
| 跟(Follow) | 保持关注 | 角色移动中的关键动作 |
| 升降(Boom) | 视角变换 | 从局部到全局、震撼揭示 |
| 手持 | 紧张、真实 | 追逐、冲突、纪录片感 |
| Dolly Zoom | 眩晕、顿悟 | 角色认知颠覆的瞬间 |
| 对话类型 | 推荐方案 | 景别节奏 | 特色技巧 |
|---|---|---|---|
| 合作友好 | 同框+双人中景+平视 | MS为主 | 开放构图、空间宽敞 |
| 对抗冲突 | OTS交替+推进 | MS→CU递进 | 距离=关系,越近越紧张 |
| 试探谈判 | 远近交替+反射利用 | WS↔CU跳跃 | 镜中/玻璃反射替代正反打 |
| 亲密温情 | 柔焦+慢推+双人全景 | LS→CU慢变 | 身体语言强调、静默反应 |
场景A:产品展示
建置(WS 3s) → 环境氛围 → 细节1(CU 2s) → 细节2(CU 2s) → 使用场景(MS 3s) → 效果对比(Split Screen 3s) → logo收尾(WS 2s)
场景B:痛点→方案(营销视频核心)
痛点场景(MS 3s) → 表情CU(2s) → 问题放大(XCU 1.5s) →
方案引入(WS→MS Push-in 3s) → 使用过程(POV 2s) →
效果展示(CU 2s) → 满足表情(MS 3s) → 品牌logo+CTA(WS 3s)
场景C:悬念揭示
窥视构图(门框/窗框框架 3s) → 角色反应(MS 2s) →
主观POV(看到什么 2s) → 慢速推近(XCU 2s) →
揭示结果(WS拉出 3s) → 空镜头留白(3s)
每个角色需要生成完整的描述档案,用于后续分镜中保持一致性:
角色名称: [名字/代号]
外形特征: 身高、体型、脸型、标志性特征
剪影: [描述角色纯剪影形态——Beiman原则:不看清细节就能识别]
动作风格: 走路姿势、习惯手势、标志性动作
性格标签: 内向/外向、主动/被动、理性/感性
核心姿态: [描述角色的"默认站姿/坐姿",反映性格]
表情库(5态): 喜/怒/哀/惊/平静 的具体描述
服装道具: 核心服装+随身物品
颜色标识: 角色的主题颜色
物品名称: [名称]
外观: 形状、大小、材质、颜色
功能: 在视频中的作用
关键状态: 正常态/使用态/损坏态/特写态 分别描述
场景名称: [名称]
空间描述: 室内/室外、大小、布局
时间: 年代、季节、昼夜
色调: 主色调+辅助色+光源方向
氛围: 情绪关键词
关键元素: 场景内的标志性物体/建筑
俯视图(可选): 角色位置+摄影机位置标注
| 状态 | 描述维度 | 用途 |
|---|---|---|
| 正面静止 | 角色面向镜头,自然站立 | 角色设定参考图 |
| 侧面动作 | 角色侧身,正在做标志性动作 | 动作场景参考 |
| 背面远景 | 角色背对镜头,在环境中 | 气氛镜头 |
| 情绪极端 | 角色处于情绪最高/最低点 | 情绪镜头参考 |
| 使用产品(如适用) | 角色正在使用/体验产品的姿态 | 营销场景 |
每帧的分镜描述需要转化为图片模型可执行的Prompt,规则如下:
Prompt组成 = 主体描述 + 构图指令 + 风格参数 + 质量限定
[主体描述]:角色外观+动作+表情+位置
[构图指令]:景别(Grid Rule、三分法位置)、角度、光影方向
[风格参数]:色调、渲染风格、画幅比
[质量限定]:分辨率、细节要求
构造示例:
分镜描述:
SC-05 | CU | 平视 | 推镜 | 角色发现关键信息,瞳孔放大,嘴巴微张
转化为图像Prompt:
"Extreme close-up of a character's face, eyes widening in shock, mouth slightly open, discovery moment. Side lighting from left creating dramatic shadows on half of face. Warm amber tone on the lit side, deep shadows on the dark side. Cinematic lighting, photorealistic, shallow depth of field. 16:9 aspect ratio."
跨镜头生成时保持角色一致性的关键方法:
同一场景内所有镜头必须保持一致的色调方案。每个场景定义:
根据第一步的类型判定,加载对应的专项Reference文件:
reference/short-video.md:钩子设计、节奏控制、竖版适配reference/marketing-video.md:品牌植入、CTA设计、传播性reference/long-video.md:章节结构、转场设计、节奏变化以下内容绝对不能出现在视频分镜中(无论任何类型):
以下是一个"AI办公工具"营销短视频的完整分镜输出(30秒版):
角色:职场人小王
道具:笔记本电脑
场景:办公室
| 镜号 | 景别 | 角度 | 运镜 | 时长 | 画面内容 | 旁白 | 音效 |
|---|---|---|---|---|---|---|---|
| SC-01 | CU | 平视 | 固定 | 3s | 手机屏幕显示"周报已提交,老板点赞👍"。屏幕光映在人物脸上。 | "你有没有想过——" | 手机消息提示音 |
| SC-02 | MS | 平视 | 闪回切 | 4s | 同一角色,昨晚11点,趴在桌前对空白文档发愁。暖黄台灯。 | "上周的你,对着空白周报" | 时钟滴答声 |
| SC-03 | CU | 俯30° | 推 | 3s | 手指在键盘上方犹豫,光标在空白文档上闪烁 | "想了半小时打出三个字" | 键盘敲击→停顿 |
| SC-04 | POV | 主观 | 固定 | 2.5s | 屏幕视角:鼠标移向仙踪问道图标,点击打开 | "然后你试了这个" | 鼠标点击声 |
| SC-05 | MS | 平视 | 推镜 | 2.5s | 角色看着屏幕,表情从困惑→惊讶→微笑 | "只用了30秒" | 轻快的"叮" |
| SC-06 | CU | 平视 | 固定 | 4s | 屏幕显示自动生成的完整周报,数据清晰,排版美观 | "AI帮你梳理了整周的工作" | 键盘自动打字声效 |
| SC-07 | MS | 平视 | 慢拉出 | 3s | 角色靠在椅背上,双手枕在脑后,轻松微笑。窗外晨光 | "把时间还给创造" | 轻柔的钢琴单音 |
| SC-08 | WS | 平视 | 固定 | 3s | 俯拍办公桌全景,笔记本屏幕显示"仙踪问道",右下角logo+二维码 | "让AI替你打工。仙踪问道。" | 品牌音效 |
总时长:25秒
SC-01:
"Close-up of smartphone screen showing 'weekly report submitted, boss liked it 👍', screen light reflecting on a young professional's face in dark room, warm phone glow. Cinematic, photorealistic, shallow depth of field. 9:16 vertical."
SC-07 (情绪帧):
"Medium shot of relaxed office worker leaning back in chair, hands behind head, gentle smile, morning sunlight streaming through window, warm golden light. Tech office background with laptop. Cinematic lighting, photorealistic. 9:16 vertical."
video-script-creation 之后、video-storyboard-generation 之前video-script-creation(写脚本)→ 本skill(设计分镜+角色+镜头)→ video-storyboard-generation(批量生成分镜图)