Unbow
English·中文

一分钟故事的视觉锚点

把一个短故事整理成视觉锚点、镜头起点和复查规则。

在提示词之前,先用语义层、Reference Pack 和 Shot Block 固定故事不能丢的事实。

  • 故事系统
  • Reference Pack
  • Shot Block
  • AI 视频

《早期推文形式测试片》,由这套 Reference Pack 产出的竖屏成片。

任务

一分钟故事不难读,但很容易被视频模型拍散。

真正要先处理的不是“风格像不像电影”,而是哪些事实不能丢:房间方向、门口位置、地面物件、手机状态、人物被遮挡的原因,以及镜头应该停在哪个压力点。只要这些东西在镜头之间漂移,故事还会显得紧张,但已经不是同一场戏。

Reference Pack 的任务,是把文字里的压力链变成可见锚点。

约束

Reference Pack 不能太大。太大的资料包会变成另一份剧本,模型不会把它当成记忆。

先回答四个问题:

哪个空间必须被认出来
哪个物件承担故事压力
哪个情绪点需要自己的镜头起点
哪些东西可以变化,哪些不可以

这些答案构成文字契约。语义层负责判断,参考图负责继承可见事实。

做法

1. 先写文字契约,再找参考图

文字契约先说明这一镜为什么存在:压力从哪里来,物件为什么重要,门口或遮挡为什么是信息,镜头不能提前交代什么。

参考图不负责讲完整故事。它只锁住模型容易忘掉的东西:空间方向、物件状态、光线、距离、视线和起始画面。

2. 按生产用途整理参考图

更稳的分类不是“好看 / 不好看”,而是:

空间锚点
道具锚点
情绪落点
镜头起点
复查规则

一张图如果只提供氛围,就不够。它必须能保护某个可复查的事实。

3. 用 Shot Block 交付当前镜头

Shot Block 不重写整段故事,只交付当前几秒钟:

起始状态
可见主体
房间记忆
物件归属
镜头行为
结束状态
禁止漂移

Reference Pack 让世界不重置。Shot Block 让这一镜可以执行。

成片

《早期推文形式测试片》是这套 Reference Pack 对应的竖屏成片。它把文字契约、视觉锚点和 Shot Block 压进一分钟发布形式里,检验这些约束在运动画面中是否还能成立。

它只保留一个可见问题、一次压力转折和一个收束点。放在这里看的重点,不只是完成了一条视频,而是从资料包到成片时,空间、物件和压力关系有没有被保住。

产物

Threshold pressure frame 门口、物件痕迹和压力方向同时可见时,参考图才真正开始承担故事记忆。

Phone evidence frame 手机不是普通道具。它承担信息压力,所以位置和屏幕状态都要被保护。

最后留下的是一套很小的结构:

  • 文字契约:说明故事不能丢什么。
  • Reference Pack:把判断变成可见锚点。
  • Shot Block:把当前镜头变成可执行请求。
  • 复查规则:判断画面是否还承担原来的压力。

复盘

参考图没有替代文字。

它只是把文字契约变成模型更容易继承的形式。真正稳定的不是某一张图,而是图背后那层可复查的语义层。