一条三分钟的动画短片,角色说了七八句话,背景换了五六个,音乐还是原创的。做出来要多久?把流程拆开看,其实卡人的地方不在生成,在衔接。镜头和镜头对不上,人物一转身就换脸,台词没说完画面先跳了。这篇把从选故事到配乐的每一步参数和坑都写清楚,以聊斋里的《南柯》一类短篇为例走一遍。
一、先看全局:一条视频由哪几块拼成
整条片子拆成四段:写剧本、生图、生视频、剪辑。剧本决定后面所有环节的资产清单,图决定人物长相的一致性,视频负责动起来,剪辑把碎片缝成一条。
生成视频这一步,豆包有免费额度,一个账号每天大概四到五个。十几个账号轮流用,凑出几十条免费生成量,够撑完一个作品。需要会员的工具(即梦等)生成速度更快,预算够可以开,预算紧就靠多账号堆。

二、写剧本:选故事、改剧本、提取资产、分镜
选故事直接打开百度百科搜“聊斋志异”,看篇目和简介。最近做得多的有《韦公子》《霍女》《姚安》《胡架女》,挑自己看着有兴趣的篇目下手。
实在不知道选哪个,把需求丢给DeepSeek。比如“给我推荐几个聊斋志异骗局的故事”,它会给出《聂小倩》长途旅行连环骗局、《局诈》三部曲、《刁姓》等。不满意就让它再推荐几个,直到挑中为止。这里建议用DeepSeek,国内直接能用。
选好篇目后让它输出白话文。聊斋原文是文言文,看起来费劲。短篇内容太少,就让它给几个改写方案。比如《男妾》可以出反转视角、黑色喜剧等五六个方向,挑一个喜欢的,让它按方案输出大纲,再让它“输出成剧本”。
剧本出来后要逐句顺一遍。台词太文绉绉,就单独复制那一段发给它“帮我改一下台词,通俗易懂”。某句太长,就“把这句台词剪短一些”。场景或剧情不满意,同样复制对应段落让它改。改完保存下来。

接下来提取资产。新开一个对话,把剧本文件拖进去,配上提取资产的提示词发过去。它会输出这个剧本里用到的全部人物、场景、道具,每个人物还标注了长相、穿着、发型。让它“输出成可下载格式”,下载下来备用。注意下载的是MD格式,别双击打开,右键选办公软件打开。

最后分镜。再开一个新对话,把剧本拖进去,用分镜提示词。提示词有15秒和12秒两版,15秒的更好用。要求它“严格按照我的剧本,输出完整提示词,注意开头要给一个钩子”。生成的镜头数量看剧本长度,短的十几镜,长的上百镜。同样下载成可下载格式,存好。
分镜里每个镜头包含固定画面动作、对白、所用到的资产。资产名要和后面生图、生视频时的命名对上,这是后面能自动连线的关键。


三、生图:用AI工具生成人物三视图和场景图
生图工具用过豆包、即梦、原籍。原籍出来的图更真实,人物脸部稳定,做动画更合适。即梦价格偏高,最低一档69;原籍开一个月会员35到49,给4000多个豆,画图够用。
画人物时把资产清单里对应角色的年龄、穿着、发型粘进去,前面加上统一画风前缀,这个前缀是保证所有角色画风一致的核心。再接上人物生成提示词,要求出三视图。比例选16:9,画质1K低画质就够。一张图现在4个积分,之前是10个,趁打折多画几张。
场景图同理,把提示词换成场景与物品的设定,统一画风前缀不动。小道具不用这么麻烦,直接用豆包画就行,比如册子、琵琶这类,把道具提示词发过去,16:9生成,选一张下载。
画好的图统一命名,人物叫“颜某”“媒婆”“孙婆”,场景叫“孙婆宅中”,道具叫“册子”。名字对应上资产清单,后面生视频时能一键连线。


四、生视频:用画布工具批量生成视频片段
生视频用豆包,因为免费。但豆包网页版一个个上传图片、复制提示词太慢。用画布工具,可以同时挂十几个豆包账号,每个账号每天四到五个免费额度,加起来几十条,够一个作品用。
画布的操作逻辑:新建工程,把资产图拉进来摆好,人物、道具、场景分类排列,统一大小后横向贴紧。新建文本框,把第一镜的提示词复制进去。提示词里提到“颜某”“媒婆”“茶具”这些资产名,直接在画布里搜对应图片名字回车,线就连上了,不用手动拖。
连线完成后点同步发送,加一句“帮我生成16:9、15秒的视频”。豆包免费版只能生成10秒,开了会员可以15秒。生成完的视频没有水印,直接保存到桌面,命名成“一”“二”对应镜头号。
一个镜头不满意就重抽,抽七八次很正常。生成的时候可以同时做下一镜,不用干等。画布本身收费,几十块钱,比开会员生成视频便宜。
五、剪辑:用剪映拼接、变速、转场、补帧、加字幕
剪映里把生成好的视频按镜头顺序拖到主轨。建议生成一个剪一个,不要全生成完再剪,否则素材堆一起容易乱。
画面太拖沓就变速。镜头移动慢或台词说得慢,调到1.1或1.2;台词太快就调到0.9或0.8。幅度别太大,太快太慢都会变形。
转场分两种。同一个场景内的镜头切换,加叠画;背景换了的,加闪黑。流畅的话可以不加。
开头要放钩子,3到5秒。从已有素材里挑一句最抓人的台词,Ctrl+C复制、Ctrl+V粘贴到主轨最前面,Ctrl+B剪掉多余部分。也可以单独生成一个新画面配一句钩子台词,能接上就行。
片名用文本工具自己打,字体自选,加阴影。做好后存进预设,下次直接调用改字。人物名称在角色第一次出场时加,用括号括起来,入场渐显、出场渐隐,时间别太长。
字幕最后统一识别。
生出来的视频分辨率只有480P左右。选中片段,在画面里找“补帧”和“补分辨率”,两个都开,补到1080P。边做边补,别攒到最后,全部补一遍很费时间。补完加一个统一滤镜,电影质感或电影大片,画面会清晰不少。

六、配乐:用AI生成符合剧本的原创背景音乐
把剧本(不要分镜)上传到DeepSeek,用歌词生成提示词,让它按剧本写歌词。歌词出来后复制,打开剪映的音频-AI音乐,把自定义歌词打开粘进去,描述想要的音乐类型,点生成。一次会给三四首,有高潮版和完整版,挑一首加到画面里。
背景音乐音量调到13左右,别盖过人声。根据剧情剪辑,喜欢的段落留下,不合适的剪掉。生成出来的音乐是原创的,不涉及版权问题。
七、首尾帧技巧:解决镜头衔接不流畅的问题
镜头衔接不上,多半是上一个镜头的尾帧和下一个镜头的首帧对不上。解决方法是取上一个镜头的尾帧当下一镜的首帧。
在画布里把镜头拉到最尾部,点截图,尾帧图片就直接进画布了。复制下一个镜头的提示词,在画面动作里@这张截图,加上一句“严格参考图片为首帧”,发给豆包。这样下一镜就会从上一镜的结尾画面接着生成。
这个方法会有个小跳变,画面可能稍微放大或缩小,颜色可能变亮。跳一下是正常的,单独调:颜色亮了就调暗一点或拉一下对比度,画面缩小了就拉大一点,幅度别超过12%,加太多反而不自然。
八、总结与注意事项
几个容易踩的坑记一下。
资产命名必须和分镜里的名字完全对应,差一个字连线就失败。MD格式的资产文件别双击,右键选办公软件打开。分镜提示词开头一定要有钩子,前3到5秒决定完播率。抽卡是常态,一个镜头抽七八次不用焦虑。补帧和补分辨率边做边补,别堆到最后。画布工具收费几十块,比开视频会员划算,十几个豆包账号的免费额度足够跑完一个作品。
想从哪一步开始试,建议先拿一个短篇走通全流程,比如《南柯》这种篇幅短的,跑完一遍就知道每个环节卡在哪了。
视频教程下载
文章可能无法完整分享清楚,下面是原项目视频教程,粉丝朋友可以自行下载学习。提前说明:资源链接内可能会存在引流广告信息,请自行甄别。
百度网盘:
