文本矩阵化拆解与视频矩阵化构建

矩阵式文本→影像拆解体系(整合版)

〇、体系定位与原创性边界

前半部分(文本→矩阵→拆分/建构)为本体系首创 :现有主流拆解方法(三幕结构、节拍表、Save the Cat、英雄之旅)均按情节功能 切分,依赖主观判断;本体系按语义算子 + 集合层级切分,具备可判定性(算子可判、层级可算、时长可推),这是方法论层面的差异,不是表述差异。

后半部分(镜头空间构成)为对齐与工程化 :视高、焦段、景别、剪辑率等参数均有电影摄影教材与计量电影学实证支撑,本体系的贡献在于把它们纳入同一套可填空的结构化流程,并针对 AI 生成补上传统分镜表不需要的字段(时空编号、连续性标记、首尾帧衔接)。

核心命题 :文本是时间序列,视频是空间艺术。拆解的本质不是"把句子变成画面",而是把语义结构映射为空间结构,再用观测者参数与时间参数还原其观感。


一、原理层

1.1 矩阵结构

原文本矩阵为三元:⟨节点₁ --- 过程(算子)--- 节点₂⟩ + 时空坐标

加入摄影机后成为四元:⟨节点₁ --- 算子 --- 节点₂⟩ × ⟨观测者 O:视高 / 视角 / 焦段 / 距离 / 运动 / 帧率⟩

观测者不是装饰项,它直接改变语义输出------同一句"荒村横着",仰拍与俯拍、广角与长焦,产出的是不同含义。

1.2 四支算子(拆分的判定基础)

算子 语义特征 判定线索
存在 一元、无方向、坐标绑定 有/在/位于/横着/出现(存现句)
属性 归类、质感、状态 是/像/很/苍黄/萧索
耗散 有向、双节点、能量传递 动作、致使、位移、吹、走、打
内生跃迁 一元、状态跳变、无施事 死/消失/化了/阴晦了/悲凉起来

结构规律:存在句撑空间(锚点),属性句给质感(定义落点),耗散句给节奏(推进),跃迁句给转折(变化可见)。一段的镜头节奏曲线由这三支在文本中的分布比例决定,不是主观审美选择。

1.3 拆分与建构

  • 拆分:一个小句含多节点/多过程 → 拆为多镜(如"冷风吹进船舱,呜呜的响"=画面+声音两镜)。
  • 建构:多个小句压缩为一镜(如"苍黄的天底下,远近横着几个萧索的荒村,没有一些活气"三句 → 一个 15 秒长镜头)。
  • 建构的增值 :两个存在镜头并置生成第三个意义(荒村 + 无活气 = 衰败),该意义不存在于任何单镜中------不是相加,是生成新节点。

1.4 集合层级 → 景别(面到点)

集合层级 语义角色 景别 时长策略
全集 U 背景、语境、坐标 大全景/远景/空镜 短(除段落开场锚点)
子集 S ⊂ U 定义、限定 中景/近景 中
单元素 {x} 焦点、落点 特写/大特写 最长

默认方向:面 → 点 (定义/说明类文本,属性句的逻辑即"从大集合取子集")。

例外方向:点 → 面 (揭示/反转类文本,先给特写再拉开)。

判据:该段是"收窄定义"还是"放大反差"------前者子集是重点,后者全集是重点。

焦点判定三信号同时命中:① 定义句或状态跃迁句;② 位于嵌套最深层(子集末端);③ 前后有节奏落差。命中即为语义焦点,给最长时长 + 最近景别 + 最少运动。

1.5 时空一致性(防漂移的机制)

编号是唯一寻址方式 :段号-镜号(S02-03),跨段引用 S01-05 → S02-03。任何生成任务只认编号,不认自然语言描述。

每镜的时空坐标必须能回溯到全局时空定义 或分段时空定义,冲突即作废重填;跨镜不得出现基线外的物象。

1.6 超文本补充原则(空间构成的必要前提)★

这是必须写进原理的一条:文本从不完备。

小说与剧本只记录"被叙述的部分",而一个可拍摄的空间场景需要环境、光线、质感、道具、背景人物、声音、空气状态等大量文本中并不存在的信息。因此:

大多数场景必须通过"超文本"(supra-textual)补充必要的空间元素,才能完成表达需要。补充不是偏离原文,而是把文本的隐含空间显性化。

三类补充,各有边界:

类型 内容 约束
物理补全 空间结构、光源方向、材质、天气、环境音 必须与全局时空定义一致,不得引入基线外物象
氛围补全 尘雾、色温、烟气、光斑、雨、呼吸白气 必须绑定到具体算子(属性/存在),无绑定即视为装饰
叙事补全 客观对应物(希望→地上的路)、过渡物、反应物 不得新增叙事事件,只允许承载已有语义

三条硬规则:

  1. 可回溯:每一处补充都要标注它服务的原文锚点与算子,能被追溯到某一句。
  2. 不改时空:补充只增加"空间元素",不改变时间坐标、空间坐标、视角归属。
  3. 标注来源:表内区分「文本直译」「超文本补充」「舍弃」三种状态,舍弃须注明由哪一镜或声音层承接。

反向原则同样成立 :文本中的重复修饰、纯议论、可由声音承载的内容应当舍弃------补充与舍弃是同一枚硬币,目的都是让空间表达成立。

1.7 目标函数:观测者接受度

规则分三类,AI 生成时区别对待:

  • A 拍摄物理约束 (轨道、摇臂、跟焦、手持抖动)→ 可弃,AI 无器材,照抄只限制表达。
  • B 感知约束 (追踪速度、识别时间、空间建模、光敏安全)→ 硬约束,必须保留。
  • C 行业/平台惯例 (正反打、平均镜头时长、竖屏偏好)→ 可调,改动有代价。

接受度 ≠ 越舒服越好:惊恐、混乱、主观眩晕需要主动违反 B 类参数,但必须①登记为"有意违反"(写明目的与持续时长),②在 ≤3 秒内用稳定锚点镜把观众接回舒适区间。这是"乱得有力"与"拍坏了"的唯一区别。


二、参数表

表1 算子 → 镜头映射

算子 镜头对应 运动 时长
存在/存现 空镜、大全景、静止 完全静止(静止即语义) 13--15s
属性/定义 特写、质感、光影色彩 静止或极缓 12--15s
耗散 运动镜头、跟拍、推拉 运动 10--12s
内生跃迁 光线渐变、延时、物态特写 变速(ramp) 10--13s
时空跳变 叠化、匹配剪辑、地图/时间轴 转场承载 1.5--3s

表2 切点节奏分档(认知层,非生理层)

区间 感知状态 用途
< 0.2s 只留刺激,读不出内容 闪白、冲击帧(慎用)
0.2--0.5s 能感知,无法完成理解 击打点、节奏重音
0.5--1.0s 舒适下限,动作可读 动作段常态
1.0--1.5s 最合理,能读完一个动作单元 叙事默认档
1.5--3.0s 可容纳过渡逻辑 转场、场景交代
3s 以上(+2s 强化) 情绪沉淀、定义落点 存在句、属性焦点

硬规则 :承载语义的镜头切点 ≥1.0s;连续快切(<0.8s)不超过 5 个,之后必须接 ≥1.5s 的全集层级锚点镜重建空间方位;亮度/画面剧变 ≤3 次/秒。

表3 视高基准(须有来源标注)

类型 高度 触发
成人站立眼高 1.60--1.70m 默认(近距离)
成人坐姿 1.10--1.25m 坐着
儿童站立眼高 1.00--1.20m 儿童
蹲/跪 0.70--0.90m 文本"蹲下""跪着"
微俯 2.00--2.50m 审视、长者看晚辈
俯拍 3.00--5.00m 无力感、鸟瞰
仰拍 0.30--0.80m 敬畏、压迫
贴地 0.10--0.30m 特殊主观

距离修正(重要):近距离(<2m)用眼平 1.60--1.70m;中距离(2--4m)用腰高 1.10--1.30m;远距离(>4m)用腰高或略低,避免严格眼平造成透视失真。

表4 垂直视场角 ↔ 等效焦段(全画幅)

垂直视场角 等效焦距 水平视场角 观感
30° 44.8mm 43.8° 接近自然视觉
40° 33.0mm 57.3° 标准纪实
50° 25.7mm 69.9° 环境感增强
60° 20.8mm 81.8° 边缘开始变形
65° 18.8mm 87.4° 广角上限

定位说明 :30°--65° 是舒适取景范围(人眼双眼水平视场约 200°,不可混称"人眼极限")。<30° 用于特写与心理压缩;>65° 用于宏大环境或主观眩晕,须注明理由。

表5 距离适配(D = (H/2) ÷ tan(θ/2))

取景对象 H(m) 30° 40° 50° 65°
成人全身 1.70 3.17 2.34 1.82 1.33
儿童全身 1.20 2.24 1.65 1.29 0.94
成人半身 0.85 1.59 1.17 0.91 0.67
胸上 0.55 1.03 0.76 0.59 0.43
面部特写 0.25 0.47 0.34 0.27 0.20
局部(手/眼) 0.10 0.19 0.14 0.11 0.08

流程:定视高(谁在看)→ 定取景对象(集合层级)→ 查表得距离 → 视高+距离共同决定俯仰角。三者必须同时填写,"俯拍"不能只写角度。

俯仰角控制区间:叙事常态 |pitch| ≤15°;强调 15°--30°;强烈权力/压迫 30°--45°;>45° 仅限特殊主观或鸟瞰,不连续使用。

表6 连续性三态(默认 MOVE,切是例外)

标记 含义 AI 行为
MOVE(默认) 不切,靠位移/推拉/摇移/变焦完成 以上一镜落幅为起幅,场景/光线/人物位置不得变
MOVE+TR 不切,内部有过渡(变速、叠化、焦点转移) 同上,过渡在镜头内部
CUT 硬切,独立镜头 允许场景变化

CUT 仅限三种情况:时空跳变、视角归属改变、主体彻底更换。同一时空、同一主体、仅景别或角度不同 → 必须 MOVE。

运动替代切换对照:

想表达的语义 优先做法(0 切)
集合收窄(全集→子集→单元素) 推近/变焦推进,一镜走完
揭示环境(点→面) 拉远/后拉
并列陈列 横摇/横移
视角归属切换 前推入视线方向 + 焦点转移(或此处唯一一次 CUT)
时间流逝 同机位延时/变速
情绪强化 缓慢推近 + 景深变浅
空间关系交代 环绕/弧形运动

MOVE 段生成要求 :场景描述与上一镜逐字复用;用上镜末帧作下段首帧,运动矢量同向同速;段内禁止新人物、新道具、新光源;能一次生成 10--15s 就不拆段拼接。

表7 超文本 / 特效四类绑定

类别 手段 绑定算子
状态外显 泪、汗、颤抖、呼吸白气 内生跃迁
氛围渲染 烟雾、雨、尘、色温、光斑 属性/存在
主观认知 虚化、黑白、抽帧、失焦、叠化 观测者切换
时空压缩 延时、快放、匹配剪辑、跳切 坐标跳变

无绑定的特效视为装饰,一律删除。

表8 观测者接受度参数(F 表)

参数 建议值
每切新增显著元素 ≤1 个
焦点可寻时间 ≤0.5s(靠明暗/对比/运动保证)
摇/移角速度 15--30°/s,避免加速度突变
语义镜头下限 ≥1.0s
冲击帧 0.2--0.5s,前后各需 ≥1.5s 锚点
亮度/画面剧变 ≤3 次/秒
运动模糊 必须显式声明(缺失是"AI 感"主要来源)
时间一致性 无纹理闪烁、无身份漂移、无物体漂移、运动路径连续(优先级高于镜头语法)

三、填空模板

A 全局时空(一次填写,全程锁定)

复制代码
作品编号 / 年代 / 地域 / 季节气候
主视角(客观/POV/混合,切换点)
色调基调 / 光线基调
全集 U 定义(最大叙事范围)
观看条件:设备(竖/横/影院)· 屏幕尺寸 · 受众年龄 · 平台
默认视高:成人___m 儿童___m 坐姿___m(含距离修正条件)
默认垂直视场角___°(等效___mm)
禁止项(不得出现的时代物/地理物/人物)

B 分段时空(每段一次)

复制代码
段号 / 原文范围(第__---__句)
本段时空(相对基线偏移)
本段算子构成(存在__ 属性__ 耗散__ 跃迁__)
本段焦点句(子集末端)
本段视角(客观/POV/记忆/想象)
与上段衔接(连续/跳切/叠化,时间跨度)

C 镜头拆解表(每镜一行,编号强制)

| 编号 | 原文锚点 | 算子 | 集合层级 | 景别 | 连续性(CUT/MOVE) | 运动类型与速度曲线 | 起幅→落幅 | 视高(m) | 视场角/焦段 | 距离(m) | 俯仰角 | 时长 | 切点间隔 | 转场类型/时长 | 时空坐标 | 超文本补充 | 舍弃项 | 轴线/匹配点 |

|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|

D 补充与舍弃登记:逐条写明「内容 / 类型(物理·氛围·叙事)/ 服务的原文锚点与算子 / 是否新增事件(必须为否)」。

E 校验清单

  • 编号连续无跳号,跨段引用可解析
  • 每镜时空坐标可回溯至 A 或 B,无基线外物象
  • 每镜视高有来源(文本线索/身份默认/推定),"推定"≤全片 30%
  • 距离符合 D=(H/2)/tan(θ/2),误差 ≤10%;视场角落在 30°--65° 或注明越界理由
  • 同一时空仅景别/角度不同的相邻镜标 MOVE 而非 CUT
  • MOVE 段场景描述与上镜逐字一致,首尾帧衔接已设定
  • 焦点镜时长 ≥ 全段均值 1.2 倍且 ≥13s;单镜不低于 10s
  • 承载语义镜头切点 ≥1.0s;连续快切 ≤5 个后接 ≥1.5s 锚点镜
  • 所有特效均绑定算子;转场特效总时长 ≤ 全片 15%
  • MOVE 镜头占比 ≥50%(低于此值说明拆得过碎)
  • 有意违反项已登记(目的+时长),且 ≤3s 内有恢复锚点镜

四、与前沿的对照(简)

  • 连续性剪辑 / 轴线 / 动作匹配(波德维尔《电影艺术》)→ 对应本体系"轴线状态 + 匹配点 + 时空编号"。
  • 景别与心理距离 (贾内梯《认识电影》、《视听语言》)→ 本体系用集合层级给出可推导的依据,而非仅描述效果。
  • 平均镜头时长(ASL)实证(计量电影学:美 7.8s、英 8.1s、中国大陆 9.6s、港 4.8s;动作片 2.4--2.9s)→ 印证"惯例随类型与平台变化,故时长须按感知负荷计算,惯例仅作校准"。
  • 分镜锚定生成(STAGE 类思路):把多镜头生成定义为"起始帧---结束帧对"预测,以结构化分镜保证跨镜头一致性 → 与本体系"MOVE 段首尾帧衔接 + 场景描述逐字复用"同源。
  • AI 生成现实约束:单镜 10--15s 恰在主流模型能力上限。复杂运动(推+摇+焦点转移)建议拆为两段首尾帧衔接,而非硬塞进一次 15s 生成;纯静止或单一运动才用满 15s。

五、一句话总纲

A 锁世界与观看条件 → B 锁段落时空 → C 锁镜头(算子·集合·视高·焦段·距离·俯仰·连续性·运动)→ D 管超文本补充与舍弃 → E 防时空漂移 → F 以观测者接受度为最终判据。

前半段(算子 + 集合层级的文本拆分)是本体系的原创内核;后半段(空间参数)是把成熟电影语言工程化为可填空流程,并以"超文本补充"补齐文本天然的不完备性------因为文本只说被看见的部分,而镜头必须把整个空间立起来。

举个拆解案例:

先说一处小订正:那句是「云中谁寄锦书来」,出自李清照《一剪梅·红藕香残玉簟秋》。全词如下------

红藕香残玉簟秋。轻解罗裳,独上兰舟。云中谁寄锦书来?雁字回时,月满西楼。

花自飘零水自流。一种相思,两处闲愁。此情无计可消除,才下眉头,却上心头。

选它确实选到了最难的类型。下面按 A--F 全套跑一遍,顺便把这套模型在纯抒情文本上暴露的问题也标出来。


〇、为什么这首最难:四个结构性障碍

难点 具体表现 本体系的解法
① 无叙事动作主体 全词几乎没有事件,只有状态与感受 以存在句 + 属性句为骨架撑空间,耗散句只占两处(解罗裳、上兰舟)
② 抽象判断无对应物 "一种相思,两处闲愁""无计可消除"是纯判断,无物可拍 走替代路径 :先由"花自飘零水自流"提供客观对应物,再用双时空并置(符号化)+ 声音层承载判断
③ 时空跳跃与双空间 白昼上舟 → 夜月满楼;"两处"要求同时呈现两个空间 分段时空定义锁坐标;"两处"用分屏并置,标注为叙事补全、不得新增事件
④ 内生跃迁无外显物 "才下眉头,却上心头"是状态跳变,无施事、无对象 用超文本补充 (手按心口、呼吸、烛光)承载,且必须一镜 MOVE 完成,不能切

一、A 全局时空(锁定)

复制代码
作品编号:W-LQZ-01
年代:北宋(推定,青州时期,赵明诚外出)
地域:江南水乡庭院/荷塘/西楼
季节气候:初秋,晴转夜,微凉,无风至微风
主视角:第一人称 POV(词人)为主;S05 段短暂跳出为"双视角并置"
色调基调:低饱和暖灰 + 残荷赭红;夜段冷青
光线基调:日间散射柔光;夜段月光侧逆 + 一点烛火
全集 U:初秋的庭院---荷塘---夜空(天地)
观看条件:横屏 16:9,1080P+,受众成人,无光敏限制
默认视高:成年女性(宋代)眼高 1.50--1.58m【推定,可按演员实高替换】
          坐姿 1.05--1.15m;贴水/贴地 0.20--0.30m
默认垂直视场角:30°--50°(45mm--26mm)
禁止项:现代物、清代服饰形制、多人群像、任何新增情节人物

二、B 分段时空(六段)

段 原文范围 本段时空 算子构成 本段焦点 视角 衔接
S01 红藕香残玉簟秋 初秋·庭院+荷塘+室内·白昼 属性×3 "秋"(氛围落点) 客观 开场
S02 轻解罗裳,独上兰舟 同上·白昼·岸边 耗散×2+属性(独) "独" 客观跟拍 连续
S03 云中谁寄锦书来?雁字回时,月满西楼 黄昏→夜·天空/西楼 耗散(悬置)+存在×2 "月满西楼" POV→客观 时间跨度:约 4 小时(叠化)
S04 花自飘零水自流 夜·水面 内生跃迁+耗散 "自流" 客观 连续
S05 一种相思,两处闲愁 双空间并置·夜 属性(判断) "两处" 双视角 跳切(符号化)
S06 此情无计可消除,才下眉头,却上心头 夜·西楼内 属性(否定)+内生跃迁 "却上心头" POV 近景 连续

三、C 镜头拆解表(13 镜,约 160 秒)

编号 原文锚点 算子 层级 景别 连续 视高/焦段/距离/俯仰 时长 切点·转场 运动与起→落 时空 补充/舍弃
S01-01 (无) 存在 U 大全景 CUT 3.00m/45mm/8m/俯19° 10s 1.5s·无 静止→极缓下摇 白昼·庭院 补充·物理(建立坐标,面→点起点)
S01-02 红藕香残 属性 S 特写 CUT 0.30m/26mm/0.5m/俯10° 13s 1.5s·无 极缓推近:残荷全景→一茎枯梗 白昼·荷塘 直译
S01-03 玉簟秋 属性 {x} 大特写 CUT 1.10m/33mm/0.35m/平 12s 2.0s·无 静止+焦点转移:席纹→一处冷光斑 白昼·室内 直译("秋"由凉意承载)
S02-01 轻解罗裳 耗散 S 近景 CUT 1.50m/33mm/1.6m/平 11s 1.0s·无 固定,人物动作为唯一运动源 白昼·室内 直译
S02-02 独上兰舟 耗散+属性 U→S 全景→中景 MOVE 1.50m/45mm/4.0m→2.0m/平 13s 1.5s·无 横移跟拍+缓推;起:岸边空阔 落:舟上人 白昼·岸边 直译("独"=画面留白无人)
S03-01 云中谁寄锦书来 耗散(悬置) U 空镜 CUT 0.50m/19mm/∞/仰60° 10s 1.5s·叠化2s 静止,云缓移 黄昏·天空 直译;有意越界(仰角>45°,理由:主观仰望无参照)
S03-02 雁字回时 存在 U 大远景 MOVE 0.50m/19mm/∞/仰45° 12s 2.0s·叠化2.5s 缓慢上摇,雁阵入画→出画 黄昏→夜 直译;补充·氛围(雁鸣声)
S03-03 月满西楼 存在(锚点) U 大全景 CUT 2.00m/45mm/15m/平 15s 3.0s·无 完全静止 夜·西楼外 直译;全段焦点镜
S04-01 花自飘零 内生跃迁 {x} 特写 CUT 0.30m/26mm/0.5m/俯10° 12s 1.5s·无 固定,落花入水为唯一运动 夜·水面 直译
S04-02 水自流 耗散(无施事) S 中景俯 MOVE 1.20m/33mm/2.0m/俯28° 12s 2.0s·无 同机位延时,水面流动加速 夜·水面 直译
S05-01 一种相思 属性(判断) S 分屏·中景 CUT 左右各 1.50m/33mm/1.8m/平 12s 1.5s·无 双画面同时微动 双空间·夜 补充·叙事(另一处灯下人,仅状态,无事件)
S05-02 两处闲愁 属性(判断) S 分屏·中景 MOVE+TR 同上 13s 3.0s·叠化2s 两侧同步缓推,中间光带渐亮 双空间·夜 同上;舍弃"闲"字的重复修饰→由静默承载
S06-01 此情无计可消除 属性(否定) S 近景 CUT 1.50m/45mm/1.0m/平 12s 1.5s·无 固定,仅呼吸与烛光微动 夜·西楼内 直译;舍弃议论语气→由无配乐静默承载
S06-02 才下眉头,却上心头 内生跃迁 {x} 大特写→特写 MOVE 1.50m/85mm→65mm/0.3m→0.5m/平 15s 结束 一镜下摇+焦点转移:眉间舒展(5s)→ 缓摇下(6s)→ 手按心口、呼吸起伏(4s) 夜·西楼内 补充·状态外显 (手、呼吸、烛焰);有意越界(焦段>45mm,理由:特写心理压缩)

全片合计约 160 秒,MOVE 镜头 5 个(38%)------低于 50% 阈值,原因见第七节。


四、D 超文本补充与舍弃登记

补充(全部可回溯,均不新增事件)

内容 类型 服务的锚点/算子
S01-01 庭院大全景空镜 物理补全 "秋"/存在(建立全集坐标)
残荷赭红、水气、微尘 氛围补全 "红藕香残"/属性
竹席冷光斑 氛围补全 "玉簟秋"/属性(凉意的物质载体)
雁鸣 氛围补全 "雁字回时"/存在
烛火、呼吸、手按心口 状态外显 "却上心头"/内生跃迁
另一处灯下人(仅姿态) 叙事补全 "两处"/属性(不给任何情节动作)

舍弃

内容 承接方式
"无计可消除"的议论语气 S06-01 静默 + 无配乐
"闲愁"的重复修饰 S05-02 分屏光带 + 静默
"一种/两处"的数量概念 由分屏结构本身承载,不加字幕

五、E 校验结果

  • 编号连续,跨段引用可解析
  • 每镜时空坐标可回溯至 A/B,无基线外物象
  • 视高"推定"占比 100% 的 S01-01、S05 双屏右侧------超出 30% 上限,需补演员实高后回填
  • 距离符合 D=(H/2)/tan(θ/2),误差 <10%
  • 两处越界(S03-01 仰60°、S06-02 85mm)均已注明理由
  • 同空间同主体仅景别不同者均标 MOVE(S02-02、S04-02、S06-02)
  • 焦点镜 S03-03 与 S06-02 均 15s ≥ 均值 1.2 倍
  • 所有特效绑定算子;转场总时长 6.5s ≈ 4%,<15%
  • MOVE 占比 38% < 50%------不达标,原因见下
  • 有意越界项均有恢复位(S03-03 静止锚点、S06-01 平视近景)

六、生成提示词(关键五镜,其余同构)

S01-02

特写,初秋荷塘,一茎残荷枯梗斜出水面,赭红褪成灰褐,水面浮薄雾。机位贴水面 0.3m,微俯 10°,26mm 等效,距离 0.5m。镜头极缓匀速推近,13 秒,从残荷局部推至单茎。低饱和暖灰色调,散射柔光,轻微运动模糊,浅景深。禁止:人物、现代物、镜头切换。

S03-03(全段焦点)

大全景,夜,一座宋代木构西楼临水而立,满月悬于楼檐右上方,月光侧逆,水面一条碎银光带。机位 2.0m,45mm,距离 15m,平视。完全静止 15 秒,零运动,零转场。冷青色调,低照度,可见月光体积感与轻微空气颗粒。禁止:人物入画、镜头运动、任何特效。

S04-02

中景俯拍,夜,河水缓缓东流,水面映月光。机位 1.2m,俯 28°,33mm,距离 2m。同机位延时摄影,12 秒,水流与云影加速,月光位置不变。冷青色调。禁止:人物、船只、镜头运动。

S05-01/02(双时空并置)

左右分屏,各为中景,同一冷青夜调。左:宋代女子凭栏,侧身,仅姿态静止微动;右:另一处室内,男子坐灯下,背影或侧影,同样仅姿态微动。两侧机位均 1.5m、33mm、距离 1.8m、平视。12+13 秒,两侧同步极缓推近,中间分界线光带渐亮。禁止:两人对视、任何互动动作、新增情节、字幕。

S06-02(全词落点)

大特写至特写,夜,室内烛光。起幅:女子眉间,眉头由蹙到舒展,85mm,距离 0.3m,平视,静止 5 秒;中段:镜头缓慢匀速下摇 6 秒,焦点随之转移;落幅:手轻按心口,胸腔随呼吸轻微起伏,65mm,距离 0.5m,静止 4 秒。全程一镜,无切点,总 15 秒。暖烛冷月混合光,浅景深,柔焦边缘,轻微胶片颗粒。禁止:说话、转身、镜头跳切。


七、这次拆解暴露的三个模型盲区(诚实反馈)

1. MOVE 占比只有 38%,不是拆得碎,是文本本身不支持。

纯抒情词没有连续动作链,"红藕---玉簟---兰舟---西楼"是四个互不相邻的空间 ,物理上无法用运动连通。这说明**"MOVE ≥50%"这条阈值只适用于叙事性文本**,对抒情/写意文本应改为:同一空间内的相邻镜头必须 MOVE,跨空间则允许 CUT。建议把 E 表这条改成条件式。

2. "两处闲愁"这类双空间判断句,现有分镜范式没有标准解。

我用了分屏并置,但这属于非连贯性剪辑 ,观众接受度未经本体系验证。更保守的替代是:只拍词人一侧,另一侧用声音(远处更鼓、风声)+ 空镜插入 暗示。建议模板里为"多主体共时"单开一个字段:并置方式(分屏/插入空镜/声音暗示/匹配剪辑)。

3. 内生跃迁的"补充"边界最容易越线。

"却上心头"补了"手按心口"------这是表演动作 ,严格说已接近新增行为。判断标准应当是:补充物是否可被观众读作"状态"而非"事件" 。手按心口是状态,起身离座就是事件。建议在 D 表加一列 读作状态/事件,凡判为"事件"一律否决。

本方法是从基础原理来进行,用于训练AI,使AI有正确的拆分文本,并构建视频文本的能力,通过实际动作几次,固定模板,让AI持续完成拆解文本和构建视频提示模板。AI选择优选有视频生成能力的模型进行,如千问,豆包,优选豆包。

相关推荐
昨日之日20061 小时前
Visual Enhancer:一键让模糊照片视频变清晰,升分辨率、插帧、转HDR,一键搞定素材修复
计算机视觉·音视频
李子红了时1 小时前
阿狸舞台APP(安卓端手机EncFS解密+压缩包解压+视频播放)
android·音视频
程序猿老A1 小时前
云服务器怎么配置视频存储?
运维·服务器·音视频
开开心心就好1 小时前
以图搜图找重复图片,本地工具离线就能用
javascript·智能手机·ffmpeg·c#·ocr·word·音视频
企业数字化笔记2 小时前
视频局部合成怎么做得自然?掩膜修复、边缘羽化、时序稳定与背景替换
java·javascript·音视频
企业数字化笔记12 小时前
视频目标跟踪怎么选?SORT、DeepSORT、ByteTrack 的连续性、遮挡与计算成本对比
人工智能·目标跟踪·音视频
Godspeed Zhao13 小时前
现代智能雷达技术14——算法(0)
线性代数·算法·雷达
zhizhizhuzhuxia15 小时前
情感解说短视频的配音选型:从工程视角看情感音色与批量出片
人工智能·音视频
AOI小白新手上路19 小时前
RainMamba 视频去雨复现实录:从 AutoDL 开机到 PSNR 出分
音视频