如何为TikTok、Reels和Shorts制作垂直AI视频的故事板
横向故事板被挤进竖屏框架,就不是真正的竖屏故事板。9:16的格式改变了场景布局、动作设计、文字位置,甚至观众一次能理解的故事量。对于AI生成的视频而言,规划更为重要,因为一个薄弱的构图可能会耗费多次昂贵的重试。
目标不是填满手机屏幕的每一厘米,而是在一个狭窄、移动的框架内控制注意力。
从平台观看体验开始
竖屏视频通常在手机上观看,界面元素常常会遮挡画面的一部分,且声音初始时较低或处于关闭状态。具体的覆盖元素因平台和设备而异,因此请将重要的人脸、动作和文字远离画面边缘及底部交互区域。
在中心创建一个安全构图区域。以实际手机尺寸预览草稿。在桌面显示器上看起来优雅的副标题,在六英寸屏幕上可能难以辨认。
将钩子构建为一个视觉问题
第一枪应立即建立方向感或引发好奇心。避免以缓慢的logo展示或主体在9:16画幅中显得很小的广角风景开场。
有用的钩子包括:
- 角色在原因显示之前就做出反应
- 物体意外进入画面
- 清晰的转换状态
- 一种视觉上的矛盾
- 屏幕文字中简短而具体的承诺
钩子必须属于故事本身。随意的奇观或许能赢得片刻停留,但当下一个镜头无法回应它时,便会削弱观众的留存。
垂直分层设计
将画面想象为顶部、中部和底部区域。面部通常位于中上区域,主要动作位于中部,次要信息位于下方。利用景深——前景、主体、背景——来避免构图显得像是一个狭窄的裁剪。
垂直运动读起来很自然:上升、下降、从上方进入,或从底部向上显现。水平追逐需要更多规划,因为主体会迅速离开画面。跟随主体移动,或安排朝向和远离摄像机的动作。
将节拍转换为短镜头
故事板在生成前规划了构图、动作、镜头运动、对话、时间安排和音效。每个分镜应回答:
- 观众在这里理解了什么?
- 拍摄过程中发生了什么变化?
- 是什么促使了这次削减?
对于一个20秒的故事,四到六个镜头可能就足够了。示例:
- 0–2秒:近距离反应——角色听到一部被遗弃的手机传来通知声
- 2–5秒:插入——屏幕显示同一房间的实时图像
- 5–9秒:中景——他们回头看身后
- 9–14秒:缓慢推进——手机画面显示一个人影正在靠近
- 14–20秒:回报——房间是空的,但电话掉落
这个方案比用一个提示词生成整个序列更容易实现。
故事板字幕与声音分开
不要依赖生成的视频文字来获取关键信息,除非模型已经过相关测试。在编辑时添加字幕以确保准确性和可访问性。保持句子简短,使用强对比度,并根据语音调整字幕时间,而不是将整段文字留在屏幕上。
在画面中规划声音:对白、环境音、音效、音乐,以及有意的静默。当画外音暗示空间时,竖屏短视频可以显得比其画框更宏大。
在昂贵运动之前生成参考帧
使用粗略的草图、照片或AI图像来测试构图。Elser AI 可以在浏览器中快速生成故事板和视觉素材。故事板不需要精美的艺术效果,它需要清晰的镜头决策。
当重复出现的角色或地点出现时,应使用已批准的参考资料,而不是允许每个分镜重新设计故事。对于多镜头制作,ElserStudio 可以连接剧本节拍、世界资产、可选指导板、视频生成以及最终合成。
适应——而非裁剪——一个横向的想法
如果原始概念是为16:9设计的,需确定核心关系。两个角色面对面时,可能需要过肩镜头而非宽幅双人镜头。全景展示可能变为俯拍或一系列细节镜头。
保留故事信息,而非框架。尽可能从一开始就生成垂直源素材。
测试未经润色的编辑
用静态面板、大致时长、临时配音和基础效果制作一个动态分镜。在手机上观看。如果作为动态分镜故事令人困惑,更高质量的视频也无法解决这个问题。
检查钩子是否诚实,主题是否清晰易读,剪辑是否感觉有动机,以及结尾是否在界面元素分散注意力之前落地。只有这样才能进行最终生成。
常见问题解答
Shorts、Reels 和 TikTok 应该使用什么宽高比?
9:16是标准全屏竖屏格式。导出前请确认当前平台规格。
一个短视频需要多少分镜画板?
每个有意义的镜头至少需要一个面板,这是一个有用的最低标准。一个15到30秒的叙事通常需要大约四到八个面板,具体取决于节奏。
生成的视频中是否应包含字幕?
通常会在编辑时添加它们,以确保准确性、可读性、时机把握和本地化。
我可以将横向的AI视频裁剪为纵向吗?
有时候,但重要的动作可能会超出画面。通常采用垂直构图进行规划和生成,能获得更好的画面布局。
结论
竖屏叙事更看重聚焦。构建一个真正的钩子,为窄画幅设计动作,预留安全区域,规划字幕和声音,并以动态分镜的形式测试故事。分镜脚本能节省制作成本,因为它在生成开始前就确定了镜头决策。




