从零做一部 AI 短片:完整工作流拆解
2026 年做一部三五分钟的 AI 短片,已经不需要团队——需要的是一条清晰的流水线。这套流程我们反复验证过,拆出来照着走就行。
第一步:把「点子」变成「参数」
大部分人卡在第一步:脑子里有画面,写不成故事。别硬写,去故事工坊选一个叙事传统——想做热血连载选「网文升级流」,想做治愈短片选「治愈系/日常系」,想做有后劲的选「古希腊悲剧」。填一句话点子,生成的参数卡直接粘给 DeepSeek 或 Claude,两分钟拿到三幕大纲和角色表。
第二步:大纲拆分镜,每场配镜头语言
把大纲拆成 6~12 个 5 秒左右的分镜。每个分镜到电影语言工坊配镜头:类型定骨架,导演定气质。比如雨夜告别的戏,选「爱情片+王家卫」,提示词里自动带上步进摄影、青绿霓虹、框架构图——这些词单靠自己想是想不全的。
第三步:先出概念图,再图生视频
直接文生视频容易跑偏。稳妥的做法是先在 PixPix 工作台把每个分镜生成一张静帧概念图(用第二步的提示词),满意后再用图生视频让画面动起来。这样风格是锁死的,不会一段一个样。要更强的动作连贯性,可灵值得一试;叙事长镜头则是 Sora 2 的主场。
第四步:剪辑合成
所有片段扔进剪映:对齐节奏、加转场、配乐、上字幕。配乐风格可以回到故事工坊看那条「跨模态关键词」,里面连配乐建议都给了。
整条链路的时间参考:大纲 10 分钟、分镜提示词 30 分钟、生成 1~2 小时(含重试)、剪辑 1 小时。一个下午,一部短片。
新手最容易翻的三个车
- 一段提示词写完整个故事。视频模型的有效注意力就几秒,一段只写一个动作。
- 每段换风格。画风词、色调词全程锁死不动,只换主体和动作。
- 跳过概念图。文生视频翻车率远高于图生视频,概念图那一步省不得。
常见问题
没有任何剪辑基础也能做吗?
能。剪映的模板和自动踩点足够用,AI 短片的难点在前期分镜而不是剪辑。第一部片子建议控制在 60 秒内,跑通流程比做长更重要。
一部短片的成本大概多少?
用国内工具的免费额度,60 秒短片基本零成本;重度重试或上 Sora,预算在几十元量级。相比传统拍摄,成本差了两个数量级。