矩阵式文本→影像拆解体系(整合版)
〇、体系定位与原创性边界
前半部分(文本→矩阵→拆分/建构)为本体系首创 :现有主流拆解方法(三幕结构、节拍表、Save the Cat、英雄之旅)均按情节功能 切分,依赖主观判断;本体系按语义算子 + 集合层级切分,具备可判定性(算子可判、层级可算、时长可推),这是方法论层面的差异,不是表述差异。
后半部分(镜头空间构成)为对齐与工程化 :视高、焦段、景别、剪辑率等参数均有电影摄影教材与计量电影学实证支撑,本体系的贡献在于把它们纳入同一套可填空的结构化流程,并针对 AI 生成补上传统分镜表不需要的字段(时空编号、连续性标记、首尾帧衔接)。
核心命题 :文本是时间序列,视频是空间艺术。拆解的本质不是"把句子变成画面",而是把语义结构映射为空间结构,再用观测者参数与时间参数还原其观感。
一、原理层
1.1 矩阵结构
原文本矩阵为三元:⟨节点₁ --- 过程(算子)--- 节点₂⟩ + 时空坐标
加入摄影机后成为四元:⟨节点₁ --- 算子 --- 节点₂⟩ × ⟨观测者 O:视高 / 视角 / 焦段 / 距离 / 运动 / 帧率⟩
观测者不是装饰项,它直接改变语义输出------同一句"荒村横着",仰拍与俯拍、广角与长焦,产出的是不同含义。
1.2 四支算子(拆分的判定基础)
| 算子 | 语义特征 | 判定线索 |
|---|---|---|
| 存在 | 一元、无方向、坐标绑定 | 有/在/位于/横着/出现(存现句) |
| 属性 | 归类、质感、状态 | 是/像/很/苍黄/萧索 |
| 耗散 | 有向、双节点、能量传递 | 动作、致使、位移、吹、走、打 |
| 内生跃迁 | 一元、状态跳变、无施事 | 死/消失/化了/阴晦了/悲凉起来 |
结构规律:存在句撑空间(锚点),属性句给质感(定义落点),耗散句给节奏(推进),跃迁句给转折(变化可见)。一段的镜头节奏曲线由这三支在文本中的分布比例决定,不是主观审美选择。
1.3 拆分与建构
- 拆分:一个小句含多节点/多过程 → 拆为多镜(如"冷风吹进船舱,呜呜的响"=画面+声音两镜)。
- 建构:多个小句压缩为一镜(如"苍黄的天底下,远近横着几个萧索的荒村,没有一些活气"三句 → 一个 15 秒长镜头)。
- 建构的增值 :两个存在镜头并置生成第三个意义(荒村 + 无活气 = 衰败),该意义不存在于任何单镜中------不是相加,是生成新节点。
1.4 集合层级 → 景别(面到点)
| 集合层级 | 语义角色 | 景别 | 时长策略 |
|---|---|---|---|
| 全集 U | 背景、语境、坐标 | 大全景/远景/空镜 | 短(除段落开场锚点) |
| 子集 S ⊂ U | 定义、限定 | 中景/近景 | 中 |
| 单元素 {x} | 焦点、落点 | 特写/大特写 | 最长 |
默认方向:面 → 点 (定义/说明类文本,属性句的逻辑即"从大集合取子集")。
例外方向:点 → 面 (揭示/反转类文本,先给特写再拉开)。
判据:该段是"收窄定义"还是"放大反差"------前者子集是重点,后者全集是重点。
焦点判定三信号同时命中:① 定义句或状态跃迁句;② 位于嵌套最深层(子集末端);③ 前后有节奏落差。命中即为语义焦点,给最长时长 + 最近景别 + 最少运动。
1.5 时空一致性(防漂移的机制)
编号是唯一寻址方式 :段号-镜号(S02-03),跨段引用 S01-05 → S02-03。任何生成任务只认编号,不认自然语言描述。
每镜的时空坐标必须能回溯到全局时空定义 或分段时空定义,冲突即作废重填;跨镜不得出现基线外的物象。
1.6 超文本补充原则(空间构成的必要前提)★
这是必须写进原理的一条:文本从不完备。
小说与剧本只记录"被叙述的部分",而一个可拍摄的空间场景需要环境、光线、质感、道具、背景人物、声音、空气状态等大量文本中并不存在的信息。因此:
大多数场景必须通过"超文本"(supra-textual)补充必要的空间元素,才能完成表达需要。补充不是偏离原文,而是把文本的隐含空间显性化。
三类补充,各有边界:
| 类型 | 内容 | 约束 |
|---|---|---|
| 物理补全 | 空间结构、光源方向、材质、天气、环境音 | 必须与全局时空定义一致,不得引入基线外物象 |
| 氛围补全 | 尘雾、色温、烟气、光斑、雨、呼吸白气 | 必须绑定到具体算子(属性/存在),无绑定即视为装饰 |
| 叙事补全 | 客观对应物(希望→地上的路)、过渡物、反应物 | 不得新增叙事事件,只允许承载已有语义 |
三条硬规则:
- 可回溯:每一处补充都要标注它服务的原文锚点与算子,能被追溯到某一句。
- 不改时空:补充只增加"空间元素",不改变时间坐标、空间坐标、视角归属。
- 标注来源:表内区分「文本直译」「超文本补充」「舍弃」三种状态,舍弃须注明由哪一镜或声音层承接。
反向原则同样成立 :文本中的重复修饰、纯议论、可由声音承载的内容应当舍弃------补充与舍弃是同一枚硬币,目的都是让空间表达成立。
1.7 目标函数:观测者接受度
规则分三类,AI 生成时区别对待:
- A 拍摄物理约束 (轨道、摇臂、跟焦、手持抖动)→ 可弃,AI 无器材,照抄只限制表达。
- B 感知约束 (追踪速度、识别时间、空间建模、光敏安全)→ 硬约束,必须保留。
- C 行业/平台惯例 (正反打、平均镜头时长、竖屏偏好)→ 可调,改动有代价。
接受度 ≠ 越舒服越好:惊恐、混乱、主观眩晕需要主动违反 B 类参数,但必须①登记为"有意违反"(写明目的与持续时长),②在 ≤3 秒内用稳定锚点镜把观众接回舒适区间。这是"乱得有力"与"拍坏了"的唯一区别。
二、参数表
表1 算子 → 镜头映射
| 算子 | 镜头对应 | 运动 | 时长 |
|---|---|---|---|
| 存在/存现 | 空镜、大全景、静止 | 完全静止(静止即语义) | 13--15s |
| 属性/定义 | 特写、质感、光影色彩 | 静止或极缓 | 12--15s |
| 耗散 | 运动镜头、跟拍、推拉 | 运动 | 10--12s |
| 内生跃迁 | 光线渐变、延时、物态特写 | 变速(ramp) | 10--13s |
| 时空跳变 | 叠化、匹配剪辑、地图/时间轴 | 转场承载 | 1.5--3s |
表2 切点节奏分档(认知层,非生理层)
| 区间 | 感知状态 | 用途 |
|---|---|---|
| < 0.2s | 只留刺激,读不出内容 | 闪白、冲击帧(慎用) |
| 0.2--0.5s | 能感知,无法完成理解 | 击打点、节奏重音 |
| 0.5--1.0s | 舒适下限,动作可读 | 动作段常态 |
| 1.0--1.5s | 最合理,能读完一个动作单元 | 叙事默认档 |
| 1.5--3.0s | 可容纳过渡逻辑 | 转场、场景交代 |
| 3s 以上(+2s 强化) | 情绪沉淀、定义落点 | 存在句、属性焦点 |
硬规则 :承载语义的镜头切点 ≥1.0s;连续快切(<0.8s)不超过 5 个,之后必须接 ≥1.5s 的全集层级锚点镜重建空间方位;亮度/画面剧变 ≤3 次/秒。
表3 视高基准(须有来源标注)
| 类型 | 高度 | 触发 |
|---|---|---|
| 成人站立眼高 | 1.60--1.70m | 默认(近距离) |
| 成人坐姿 | 1.10--1.25m | 坐着 |
| 儿童站立眼高 | 1.00--1.20m | 儿童 |
| 蹲/跪 | 0.70--0.90m | 文本"蹲下""跪着" |
| 微俯 | 2.00--2.50m | 审视、长者看晚辈 |
| 俯拍 | 3.00--5.00m | 无力感、鸟瞰 |
| 仰拍 | 0.30--0.80m | 敬畏、压迫 |
| 贴地 | 0.10--0.30m | 特殊主观 |
距离修正(重要):近距离(<2m)用眼平 1.60--1.70m;中距离(2--4m)用腰高 1.10--1.30m;远距离(>4m)用腰高或略低,避免严格眼平造成透视失真。
表4 垂直视场角 ↔ 等效焦段(全画幅)
| 垂直视场角 | 等效焦距 | 水平视场角 | 观感 |
|---|---|---|---|
| 30° | 44.8mm | 43.8° | 接近自然视觉 |
| 40° | 33.0mm | 57.3° | 标准纪实 |
| 50° | 25.7mm | 69.9° | 环境感增强 |
| 60° | 20.8mm | 81.8° | 边缘开始变形 |
| 65° | 18.8mm | 87.4° | 广角上限 |
定位说明 :30°--65° 是舒适取景范围(人眼双眼水平视场约 200°,不可混称"人眼极限")。<30° 用于特写与心理压缩;>65° 用于宏大环境或主观眩晕,须注明理由。
表5 距离适配(D = (H/2) ÷ tan(θ/2))
| 取景对象 | H(m) | 30° | 40° | 50° | 65° |
|---|---|---|---|---|---|
| 成人全身 | 1.70 | 3.17 | 2.34 | 1.82 | 1.33 |
| 儿童全身 | 1.20 | 2.24 | 1.65 | 1.29 | 0.94 |
| 成人半身 | 0.85 | 1.59 | 1.17 | 0.91 | 0.67 |
| 胸上 | 0.55 | 1.03 | 0.76 | 0.59 | 0.43 |
| 面部特写 | 0.25 | 0.47 | 0.34 | 0.27 | 0.20 |
| 局部(手/眼) | 0.10 | 0.19 | 0.14 | 0.11 | 0.08 |
流程:定视高(谁在看)→ 定取景对象(集合层级)→ 查表得距离 → 视高+距离共同决定俯仰角。三者必须同时填写,"俯拍"不能只写角度。
俯仰角控制区间:叙事常态 |pitch| ≤15°;强调 15°--30°;强烈权力/压迫 30°--45°;>45° 仅限特殊主观或鸟瞰,不连续使用。
表6 连续性三态(默认 MOVE,切是例外)
| 标记 | 含义 | AI 行为 |
|---|---|---|
| MOVE(默认) | 不切,靠位移/推拉/摇移/变焦完成 | 以上一镜落幅为起幅,场景/光线/人物位置不得变 |
| MOVE+TR | 不切,内部有过渡(变速、叠化、焦点转移) | 同上,过渡在镜头内部 |
| CUT | 硬切,独立镜头 | 允许场景变化 |
CUT 仅限三种情况:时空跳变、视角归属改变、主体彻底更换。同一时空、同一主体、仅景别或角度不同 → 必须 MOVE。
运动替代切换对照:
| 想表达的语义 | 优先做法(0 切) |
|---|---|
| 集合收窄(全集→子集→单元素) | 推近/变焦推进,一镜走完 |
| 揭示环境(点→面) | 拉远/后拉 |
| 并列陈列 | 横摇/横移 |
| 视角归属切换 | 前推入视线方向 + 焦点转移(或此处唯一一次 CUT) |
| 时间流逝 | 同机位延时/变速 |
| 情绪强化 | 缓慢推近 + 景深变浅 |
| 空间关系交代 | 环绕/弧形运动 |
MOVE 段生成要求 :场景描述与上一镜逐字复用;用上镜末帧作下段首帧,运动矢量同向同速;段内禁止新人物、新道具、新光源;能一次生成 10--15s 就不拆段拼接。
表7 超文本 / 特效四类绑定
| 类别 | 手段 | 绑定算子 |
|---|---|---|
| 状态外显 | 泪、汗、颤抖、呼吸白气 | 内生跃迁 |
| 氛围渲染 | 烟雾、雨、尘、色温、光斑 | 属性/存在 |
| 主观认知 | 虚化、黑白、抽帧、失焦、叠化 | 观测者切换 |
| 时空压缩 | 延时、快放、匹配剪辑、跳切 | 坐标跳变 |
无绑定的特效视为装饰,一律删除。
表8 观测者接受度参数(F 表)
| 参数 | 建议值 |
|---|---|
| 每切新增显著元素 | ≤1 个 |
| 焦点可寻时间 | ≤0.5s(靠明暗/对比/运动保证) |
| 摇/移角速度 | 15--30°/s,避免加速度突变 |
| 语义镜头下限 | ≥1.0s |
| 冲击帧 | 0.2--0.5s,前后各需 ≥1.5s 锚点 |
| 亮度/画面剧变 | ≤3 次/秒 |
| 运动模糊 | 必须显式声明(缺失是"AI 感"主要来源) |
| 时间一致性 | 无纹理闪烁、无身份漂移、无物体漂移、运动路径连续(优先级高于镜头语法) |
三、填空模板
A 全局时空(一次填写,全程锁定)
作品编号 / 年代 / 地域 / 季节气候
主视角(客观/POV/混合,切换点)
色调基调 / 光线基调
全集 U 定义(最大叙事范围)
观看条件:设备(竖/横/影院)· 屏幕尺寸 · 受众年龄 · 平台
默认视高:成人___m 儿童___m 坐姿___m(含距离修正条件)
默认垂直视场角___°(等效___mm)
禁止项(不得出现的时代物/地理物/人物)
B 分段时空(每段一次)
段号 / 原文范围(第__---__句)
本段时空(相对基线偏移)
本段算子构成(存在__ 属性__ 耗散__ 跃迁__)
本段焦点句(子集末端)
本段视角(客观/POV/记忆/想象)
与上段衔接(连续/跳切/叠化,时间跨度)
C 镜头拆解表(每镜一行,编号强制)
| 编号 | 原文锚点 | 算子 | 集合层级 | 景别 | 连续性(CUT/MOVE) | 运动类型与速度曲线 | 起幅→落幅 | 视高(m) | 视场角/焦段 | 距离(m) | 俯仰角 | 时长 | 切点间隔 | 转场类型/时长 | 时空坐标 | 超文本补充 | 舍弃项 | 轴线/匹配点 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
D 补充与舍弃登记:逐条写明「内容 / 类型(物理·氛围·叙事)/ 服务的原文锚点与算子 / 是否新增事件(必须为否)」。
E 校验清单
- 编号连续无跳号,跨段引用可解析
- 每镜时空坐标可回溯至 A 或 B,无基线外物象
- 每镜视高有来源(文本线索/身份默认/推定),"推定"≤全片 30%
- 距离符合 D=(H/2)/tan(θ/2),误差 ≤10%;视场角落在 30°--65° 或注明越界理由
- 同一时空仅景别/角度不同的相邻镜标 MOVE 而非 CUT
- MOVE 段场景描述与上镜逐字一致,首尾帧衔接已设定
- 焦点镜时长 ≥ 全段均值 1.2 倍且 ≥13s;单镜不低于 10s
- 承载语义镜头切点 ≥1.0s;连续快切 ≤5 个后接 ≥1.5s 锚点镜
- 所有特效均绑定算子;转场特效总时长 ≤ 全片 15%
- MOVE 镜头占比 ≥50%(低于此值说明拆得过碎)
- 有意违反项已登记(目的+时长),且 ≤3s 内有恢复锚点镜
四、与前沿的对照(简)
- 连续性剪辑 / 轴线 / 动作匹配(波德维尔《电影艺术》)→ 对应本体系"轴线状态 + 匹配点 + 时空编号"。
- 景别与心理距离 (贾内梯《认识电影》、《视听语言》)→ 本体系用集合层级给出可推导的依据,而非仅描述效果。
- 平均镜头时长(ASL)实证(计量电影学:美 7.8s、英 8.1s、中国大陆 9.6s、港 4.8s;动作片 2.4--2.9s)→ 印证"惯例随类型与平台变化,故时长须按感知负荷计算,惯例仅作校准"。
- 分镜锚定生成(STAGE 类思路):把多镜头生成定义为"起始帧---结束帧对"预测,以结构化分镜保证跨镜头一致性 → 与本体系"MOVE 段首尾帧衔接 + 场景描述逐字复用"同源。
- AI 生成现实约束:单镜 10--15s 恰在主流模型能力上限。复杂运动(推+摇+焦点转移)建议拆为两段首尾帧衔接,而非硬塞进一次 15s 生成;纯静止或单一运动才用满 15s。
五、一句话总纲
A 锁世界与观看条件 → B 锁段落时空 → C 锁镜头(算子·集合·视高·焦段·距离·俯仰·连续性·运动)→ D 管超文本补充与舍弃 → E 防时空漂移 → F 以观测者接受度为最终判据。
前半段(算子 + 集合层级的文本拆分)是本体系的原创内核;后半段(空间参数)是把成熟电影语言工程化为可填空流程,并以"超文本补充"补齐文本天然的不完备性------因为文本只说被看见的部分,而镜头必须把整个空间立起来。
举个拆解案例:
先说一处小订正:那句是「云中谁寄锦书来」,出自李清照《一剪梅·红藕香残玉簟秋》。全词如下------
红藕香残玉簟秋。轻解罗裳,独上兰舟。云中谁寄锦书来?雁字回时,月满西楼。
花自飘零水自流。一种相思,两处闲愁。此情无计可消除,才下眉头,却上心头。
选它确实选到了最难的类型。下面按 A--F 全套跑一遍,顺便把这套模型在纯抒情文本上暴露的问题也标出来。
〇、为什么这首最难:四个结构性障碍
| 难点 | 具体表现 | 本体系的解法 |
|---|---|---|
| ① 无叙事动作主体 | 全词几乎没有事件,只有状态与感受 | 以存在句 + 属性句为骨架撑空间,耗散句只占两处(解罗裳、上兰舟) |
| ② 抽象判断无对应物 | "一种相思,两处闲愁""无计可消除"是纯判断,无物可拍 | 走替代路径 :先由"花自飘零水自流"提供客观对应物,再用双时空并置(符号化)+ 声音层承载判断 |
| ③ 时空跳跃与双空间 | 白昼上舟 → 夜月满楼;"两处"要求同时呈现两个空间 | 分段时空定义锁坐标;"两处"用分屏并置,标注为叙事补全、不得新增事件 |
| ④ 内生跃迁无外显物 | "才下眉头,却上心头"是状态跳变,无施事、无对象 | 用超文本补充 (手按心口、呼吸、烛光)承载,且必须一镜 MOVE 完成,不能切 |
一、A 全局时空(锁定)
作品编号:W-LQZ-01
年代:北宋(推定,青州时期,赵明诚外出)
地域:江南水乡庭院/荷塘/西楼
季节气候:初秋,晴转夜,微凉,无风至微风
主视角:第一人称 POV(词人)为主;S05 段短暂跳出为"双视角并置"
色调基调:低饱和暖灰 + 残荷赭红;夜段冷青
光线基调:日间散射柔光;夜段月光侧逆 + 一点烛火
全集 U:初秋的庭院---荷塘---夜空(天地)
观看条件:横屏 16:9,1080P+,受众成人,无光敏限制
默认视高:成年女性(宋代)眼高 1.50--1.58m【推定,可按演员实高替换】
坐姿 1.05--1.15m;贴水/贴地 0.20--0.30m
默认垂直视场角:30°--50°(45mm--26mm)
禁止项:现代物、清代服饰形制、多人群像、任何新增情节人物
二、B 分段时空(六段)
| 段 | 原文范围 | 本段时空 | 算子构成 | 本段焦点 | 视角 | 衔接 |
|---|---|---|---|---|---|---|
| S01 | 红藕香残玉簟秋 | 初秋·庭院+荷塘+室内·白昼 | 属性×3 | "秋"(氛围落点) | 客观 | 开场 |
| S02 | 轻解罗裳,独上兰舟 | 同上·白昼·岸边 | 耗散×2+属性(独) | "独" | 客观跟拍 | 连续 |
| S03 | 云中谁寄锦书来?雁字回时,月满西楼 | 黄昏→夜·天空/西楼 | 耗散(悬置)+存在×2 | "月满西楼" | POV→客观 | 时间跨度:约 4 小时(叠化) |
| S04 | 花自飘零水自流 | 夜·水面 | 内生跃迁+耗散 | "自流" | 客观 | 连续 |
| S05 | 一种相思,两处闲愁 | 双空间并置·夜 | 属性(判断) | "两处" | 双视角 | 跳切(符号化) |
| S06 | 此情无计可消除,才下眉头,却上心头 | 夜·西楼内 | 属性(否定)+内生跃迁 | "却上心头" | POV 近景 | 连续 |
三、C 镜头拆解表(13 镜,约 160 秒)
| 编号 | 原文锚点 | 算子 | 层级 | 景别 | 连续 | 视高/焦段/距离/俯仰 | 时长 | 切点·转场 | 运动与起→落 | 时空 | 补充/舍弃 |
|---|---|---|---|---|---|---|---|---|---|---|---|
| S01-01 | (无) | 存在 | U | 大全景 | CUT | 3.00m/45mm/8m/俯19° | 10s | 1.5s·无 | 静止→极缓下摇 | 白昼·庭院 | 补充·物理(建立坐标,面→点起点) |
| S01-02 | 红藕香残 | 属性 | S | 特写 | CUT | 0.30m/26mm/0.5m/俯10° | 13s | 1.5s·无 | 极缓推近:残荷全景→一茎枯梗 | 白昼·荷塘 | 直译 |
| S01-03 | 玉簟秋 | 属性 | {x} | 大特写 | CUT | 1.10m/33mm/0.35m/平 | 12s | 2.0s·无 | 静止+焦点转移:席纹→一处冷光斑 | 白昼·室内 | 直译("秋"由凉意承载) |
| S02-01 | 轻解罗裳 | 耗散 | S | 近景 | CUT | 1.50m/33mm/1.6m/平 | 11s | 1.0s·无 | 固定,人物动作为唯一运动源 | 白昼·室内 | 直译 |
| S02-02 | 独上兰舟 | 耗散+属性 | U→S | 全景→中景 | MOVE | 1.50m/45mm/4.0m→2.0m/平 | 13s | 1.5s·无 | 横移跟拍+缓推;起:岸边空阔 落:舟上人 | 白昼·岸边 | 直译("独"=画面留白无人) |
| S03-01 | 云中谁寄锦书来 | 耗散(悬置) | U | 空镜 | CUT | 0.50m/19mm/∞/仰60° | 10s | 1.5s·叠化2s | 静止,云缓移 | 黄昏·天空 | 直译;有意越界(仰角>45°,理由:主观仰望无参照) |
| S03-02 | 雁字回时 | 存在 | U | 大远景 | MOVE | 0.50m/19mm/∞/仰45° | 12s | 2.0s·叠化2.5s | 缓慢上摇,雁阵入画→出画 | 黄昏→夜 | 直译;补充·氛围(雁鸣声) |
| S03-03 | 月满西楼 | 存在(锚点) | U | 大全景 | CUT | 2.00m/45mm/15m/平 | 15s | 3.0s·无 | 完全静止 | 夜·西楼外 | 直译;全段焦点镜 |
| S04-01 | 花自飘零 | 内生跃迁 | {x} | 特写 | CUT | 0.30m/26mm/0.5m/俯10° | 12s | 1.5s·无 | 固定,落花入水为唯一运动 | 夜·水面 | 直译 |
| S04-02 | 水自流 | 耗散(无施事) | S | 中景俯 | MOVE | 1.20m/33mm/2.0m/俯28° | 12s | 2.0s·无 | 同机位延时,水面流动加速 | 夜·水面 | 直译 |
| S05-01 | 一种相思 | 属性(判断) | S | 分屏·中景 | CUT | 左右各 1.50m/33mm/1.8m/平 | 12s | 1.5s·无 | 双画面同时微动 | 双空间·夜 | 补充·叙事(另一处灯下人,仅状态,无事件) |
| S05-02 | 两处闲愁 | 属性(判断) | S | 分屏·中景 | MOVE+TR | 同上 | 13s | 3.0s·叠化2s | 两侧同步缓推,中间光带渐亮 | 双空间·夜 | 同上;舍弃"闲"字的重复修饰→由静默承载 |
| S06-01 | 此情无计可消除 | 属性(否定) | S | 近景 | CUT | 1.50m/45mm/1.0m/平 | 12s | 1.5s·无 | 固定,仅呼吸与烛光微动 | 夜·西楼内 | 直译;舍弃议论语气→由无配乐静默承载 |
| S06-02 | 才下眉头,却上心头 | 内生跃迁 | {x} | 大特写→特写 | MOVE | 1.50m/85mm→65mm/0.3m→0.5m/平 | 15s | 结束 | 一镜下摇+焦点转移:眉间舒展(5s)→ 缓摇下(6s)→ 手按心口、呼吸起伏(4s) | 夜·西楼内 | 补充·状态外显 (手、呼吸、烛焰);有意越界(焦段>45mm,理由:特写心理压缩) |
全片合计约 160 秒,MOVE 镜头 5 个(38%)------低于 50% 阈值,原因见第七节。
四、D 超文本补充与舍弃登记
补充(全部可回溯,均不新增事件)
| 内容 | 类型 | 服务的锚点/算子 |
|---|---|---|
| S01-01 庭院大全景空镜 | 物理补全 | "秋"/存在(建立全集坐标) |
| 残荷赭红、水气、微尘 | 氛围补全 | "红藕香残"/属性 |
| 竹席冷光斑 | 氛围补全 | "玉簟秋"/属性(凉意的物质载体) |
| 雁鸣 | 氛围补全 | "雁字回时"/存在 |
| 烛火、呼吸、手按心口 | 状态外显 | "却上心头"/内生跃迁 |
| 另一处灯下人(仅姿态) | 叙事补全 | "两处"/属性(不给任何情节动作) |
舍弃
| 内容 | 承接方式 |
|---|---|
| "无计可消除"的议论语气 | S06-01 静默 + 无配乐 |
| "闲愁"的重复修饰 | S05-02 分屏光带 + 静默 |
| "一种/两处"的数量概念 | 由分屏结构本身承载,不加字幕 |
五、E 校验结果
- 编号连续,跨段引用可解析
- 每镜时空坐标可回溯至 A/B,无基线外物象
- 视高"推定"占比 100% 的 S01-01、S05 双屏右侧------超出 30% 上限,需补演员实高后回填
- 距离符合 D=(H/2)/tan(θ/2),误差 <10%
- 两处越界(S03-01 仰60°、S06-02 85mm)均已注明理由
- 同空间同主体仅景别不同者均标 MOVE(S02-02、S04-02、S06-02)
- 焦点镜 S03-03 与 S06-02 均 15s ≥ 均值 1.2 倍
- 所有特效绑定算子;转场总时长 6.5s ≈ 4%,<15%
- MOVE 占比 38% < 50%------不达标,原因见下
- 有意越界项均有恢复位(S03-03 静止锚点、S06-01 平视近景)
六、生成提示词(关键五镜,其余同构)
S01-02
特写,初秋荷塘,一茎残荷枯梗斜出水面,赭红褪成灰褐,水面浮薄雾。机位贴水面 0.3m,微俯 10°,26mm 等效,距离 0.5m。镜头极缓匀速推近,13 秒,从残荷局部推至单茎。低饱和暖灰色调,散射柔光,轻微运动模糊,浅景深。禁止:人物、现代物、镜头切换。
S03-03(全段焦点)
大全景,夜,一座宋代木构西楼临水而立,满月悬于楼檐右上方,月光侧逆,水面一条碎银光带。机位 2.0m,45mm,距离 15m,平视。完全静止 15 秒,零运动,零转场。冷青色调,低照度,可见月光体积感与轻微空气颗粒。禁止:人物入画、镜头运动、任何特效。
S04-02
中景俯拍,夜,河水缓缓东流,水面映月光。机位 1.2m,俯 28°,33mm,距离 2m。同机位延时摄影,12 秒,水流与云影加速,月光位置不变。冷青色调。禁止:人物、船只、镜头运动。
S05-01/02(双时空并置)
左右分屏,各为中景,同一冷青夜调。左:宋代女子凭栏,侧身,仅姿态静止微动;右:另一处室内,男子坐灯下,背影或侧影,同样仅姿态微动。两侧机位均 1.5m、33mm、距离 1.8m、平视。12+13 秒,两侧同步极缓推近,中间分界线光带渐亮。禁止:两人对视、任何互动动作、新增情节、字幕。
S06-02(全词落点)
大特写至特写,夜,室内烛光。起幅:女子眉间,眉头由蹙到舒展,85mm,距离 0.3m,平视,静止 5 秒;中段:镜头缓慢匀速下摇 6 秒,焦点随之转移;落幅:手轻按心口,胸腔随呼吸轻微起伏,65mm,距离 0.5m,静止 4 秒。全程一镜,无切点,总 15 秒。暖烛冷月混合光,浅景深,柔焦边缘,轻微胶片颗粒。禁止:说话、转身、镜头跳切。
七、这次拆解暴露的三个模型盲区(诚实反馈)
1. MOVE 占比只有 38%,不是拆得碎,是文本本身不支持。
纯抒情词没有连续动作链,"红藕---玉簟---兰舟---西楼"是四个互不相邻的空间 ,物理上无法用运动连通。这说明**"MOVE ≥50%"这条阈值只适用于叙事性文本**,对抒情/写意文本应改为:同一空间内的相邻镜头必须 MOVE,跨空间则允许 CUT。建议把 E 表这条改成条件式。
2. "两处闲愁"这类双空间判断句,现有分镜范式没有标准解。
我用了分屏并置,但这属于非连贯性剪辑 ,观众接受度未经本体系验证。更保守的替代是:只拍词人一侧,另一侧用声音(远处更鼓、风声)+ 空镜插入 暗示。建议模板里为"多主体共时"单开一个字段:并置方式(分屏/插入空镜/声音暗示/匹配剪辑)。
3. 内生跃迁的"补充"边界最容易越线。
"却上心头"补了"手按心口"------这是表演动作 ,严格说已接近新增行为。判断标准应当是:补充物是否可被观众读作"状态"而非"事件" 。手按心口是状态,起身离座就是事件。建议在 D 表加一列 读作状态/事件,凡判为"事件"一律否决。
本方法是从基础原理来进行,用于训练AI,使AI有正确的拆分文本,并构建视频文本的能力,通过实际动作几次,固定模板,让AI持续完成拆解文本和构建视频提示模板。AI选择优选有视频生成能力的模型进行,如千问,豆包,优选豆包。