03 / Workflow & AI process
从文字,到镜头。
以《成都.唐朝的一日》为例:从最初的点子到完成整支短片,共用了 6 天。
从一个点子出发,扩展成可用选题并列出基础大纲;根据大纲准备资料,再整理成简单文字脚本。
将文字脚本拆成分镜,确定镜头数量,使用 Codex 辅助生成每个镜头的 Midjourney 关键帧提示词,在 Midjourney 中生成、筛选并精修图片。
关键帧完成后,使用 Codex 辅助编写对应的视频提示词,逐个镜头生成视频,最后完成剪辑、配乐和后期处理。
生成之后,仍然需要判断。
多人和复杂场景中,AI 容易出现传统服饰年代错误、建筑风格偏差以及画面细节失控。例如唐代建筑场景中,仅靠文字提示也容易生成带有明显日式特征的结构。
通过反复生成、判断和局部精修,对服饰、建筑、人物和场景细节逐项修正。创作者需要具备一定的中国传统服饰、建筑与历史视觉常识,才能判断问题并进行针对性修改。

