去年冬天我连着刷了十几个AI动画科普号,越看越不对劲——画面精致得像电影,可文案一听就是AI写的,比喻尬到脚趾抠地。后来我自己下场跑了三个月,才搞明白这里面的门道:画面能靠工具堆,文案和导演思维堆不出来。今天拆一个跑通的案例,33万粉的科普号,从选题到导出全流程,包括我踩过的坑。
开篇引入:AI动画科普赛道的闭合流程与难度
先说这个赛道为什么吸引人。它是一条完整的闭合流程:文案、资产图、分镜提示词、生成、剪辑、导出,一个人一台电脑就能跑完,不用对接团队,不用等排期。我身边做这个的朋友,基本都是一台笔记本加一个下午就能出一条。
复杂的地方在镜头量。一条3分钟的口播视频,背后是几十个镜头。每个镜头都得想清楚场地在哪、角色站哪、镜头怎么走、观众看的时候是什么感受。有一个镜头答错了,整段就废,最惨的是拖到剪辑阶段才发现要重新生成。我第一次做的时候,光一个对战场景就返工了四次,积分烧掉小两百。
项目介绍:适合一人操作的抖音精选独家收益模式
这个项目适合一人操作的原因,是它把传统视频制作里最吃人力的几个环节都工具化了。分镜有skill帮你出提示词,生图有LiblibTV,配音有开源克隆软件,剪辑就是拼素材加字幕。你不需要会画画,不需要会写代码,甚至不需要会写提示词——前提是你得知道工具能给你什么、给不了什么。
收益模式走的是抖音精选的独家分成,具体单价平台会调整,我不写死数字。但可以算一笔账:一条3分钟视频的积分成本,实测LiblibTV大几十块,即梦大概20块左右。这个成本结构决定了你不可能靠量堆,必须靠单条质量拉播放。
文案写作:选题、查资料、AI辅助与润色技巧
文案是这个赛道真正的分水岭。我见过太多人画面做得漂亮,文案一开口就劝退。
流程就四步:查原文、用AI查资料、总结要点、填充内容。找题材可以去知乎高赞、公众号、B站,挑那些让你自己觉得有意思的观点。查资料用DeepSeek,设定科普创作者身份,豆包和千问也能用,但输出更通俗,适合做初稿。
AI给的模板不能直接套。比如问“为什么只有碳酸饮料没有硫酸饮料”,AI会给你碳酸与硫酸的差别、硫酸不能做饮料的原因、碳酸是什么、体内强酸盐酸这些点。你要自己判断哪些能写、哪些跑题。写作结构走总分总,可以延伸到人体、自然界,但别跑远。
填充内容时把AI的话转成自己的话。科普为主,娱乐为辅,大白话优先。比喻要自己润色,硫酸像狂暴粉碎机、碳酸口感像奶茶,这种得你亲手调,不然一股AI味。结尾别强行升华,可以直接结束、总结、转移话题或者玩个梗。
开头有两种写法。直奔主题型,比如“动物长得人畜无害杀伤力爆表”,直接从小体型讲到大体型、飞行讲到陆地,不墨迹。总结式最难写但效果最好,把整篇问题总结前置,比如“蜻蜓虽最古老原始但像穿现代高科技装备”,后面再拆蜻蜓器官怎么像高科技。

素材搜集:YouTube关键词搜索与4K下载
素材只需要三样东西:YouTube、YouTube视频下载工具、在线翻译。中文搜出来的是中国视频,英文搜才出英文素材。YouTube上素材库全,所有视频都在那找。
根据文案提取关键词去搜。比如“非洲土地辽阔”就找非洲版图地图素材,“宁愿饿死也不种地”就找种地画面流程素材。操作上搜“非洲人种植”,进频道后点右上角过滤选4K,点分享复制链接,解析视频,下1080P就够清晰。点右下角下载会自动存到C盘下载文件夹,没有声音,后面按文案重复操作就行。

操作流程:skill调用、LiblibTV生图与视频生成
团队做的skill叫“小树苗参考图分镜导演”,定位是帮不会写提示词的人理解能力边界。工具用workbody,把skill拖到桌面后对workbody说“帮我把桌面的s装到库里”,模型选deep seek v4.1flash。调用这个skill只需要发文案,生成完会新建一个MD文件,让它直接发到聊天框。

拿到分镜表后先筛资产。单镜头角色不建,多镜头角色必须建,保证一致性。重要场景比如开头对战擂台要建,旷野战场可以略过,草原猎场出现多就建。道具可做可不做。角色、场景、道具的提示词按代码块给出,按类别列出并标注出现镜头。这一步的作用是在动手前把素材备齐,别跑到第十个镜头才发现缺角色。提示词要写清标准,标准越清楚,后面几十个镜头越不容易跑偏。
复制到LiblibTV新建画布,画质选2K标准或高画质,比例1:1或16:9。背景从浅米色平地改为空白背景,生图模型用image2.5就够。

分镜提示词建议时长5秒,对应文案直接复制。场景对战擂台,角色大局,图片不满意可以重新生成。提示词里背景写干涩纯色渐变,左半边印羽毛,马卡龙配色。重新生成后效果不错,场景图用16:9再生成一张。
到生成视频环节,把副本图片连一条线并复制视频。分镜提示词写对战擂台,中央分界两侧,大局金雕站左台、另一只金雕站右台,两只面对面互看,大局把下巴抬起,2到4秒镜头拉近。设置5秒、16:9、2.0迷你,生成音频、生成数量1,填风格提示词,点生成。

常用模型cd2.0mini,效果不好换fest 2.0fa。迷你7秒约100多积分,15秒200多。这个赛道不需要抽卡,最多两次,大多一条过。
剪辑与字幕:画面匹配、字体动画与音效
剪辑本身很简单。导入C盘下载的视频,拼接就行。BGM在文档里有。录音用话筒PDA200X,或者清晰的有线耳机也够用,录完剪掉气口和瑕疵。
核心是一句话对应一个画面。比如死刑犯种树、打捞、监狱场景,按文案逐句匹配。

字幕效果三要素:字体、音效、动画。字体选圆润的,比如精灵体,放大一点,加颜色和阴影,突出的地方选星座放大。动画和音效结合,模糊出现或跳出,调短时间,加音效。高阶玩法是弯曲文字,新建复合片段,点画面变形出场。表情包用于歇后语,从截图贴图库搜,找不到素材就用表情替代。

配音与字幕:TDS克隆配音与参数设置
配音用B站开源的克隆软件TDS,免费。解压路径必须全英文,右键解压启动,第一次打开会慢,要下载模型。

音源去抖音找电影解说真人配音,别偷声音,有版权风险。下载2到3个音频,拖进剪映做人声分离,只留人声,每个5秒。生成声音后进高级设置,温度0.78,topP 0.88,topK 50,出条数4或2,显卡差就设2。

用完记得清理OT开头的文件夹,不然C盘会爆。
收益模式与成本控制:积分消耗与平台价格对比
成本上你要准备好积分和时间。这个赛道没有捷径,练的量和试错积分是硬门槛。
平台价格实测有差距。LiblibTV大几十一条3分钟视频,即梦20左右。常用模型cd2.0mini,效果不好换fest 2.0fa。迷你7秒100多积分,15秒200多。这个赛道不需要抽卡,最多两次,大多一条过,所以成本可控。
但别只看单价。返工才是最大的成本。我第一次做的时候,因为资产没备齐,跑到第十个镜头才发现缺角色,整段重来,积分翻倍。所以前面筛资产那一步,别省。
注意事项:导演思维、拆片复盘与版权规避
skill能帮不会写提示词的人,但替代不了手工手搓。老师写的镜头,你不知道哪句生成哪个镜头、给观众什么感觉。拿到的是成品,不是能力。成品用一次,能力用一辈子。
skill给的是合格镜头,但整篇视频的内核、想让观众记住哪个镜头哪句话,只有人能做。正确用法是把skill当起点,它给合格骨架,你在上面二次加工。哪个镜头换原镜、加表情、时长多加2秒,这些得你自己判断。
导演思维没有好办法,只能自己慢慢试。两个笨方法:一是拆片,找网上好看的片子,一句句暂停,拆下每帧对应文案和画面,你会发现好片子的画面和文案有规律。二是复盘,自己生成的镜头,满意不满意都存下,标注哪句话哪个词造成差别,攒成自己的语料库。后期你会发现有些词特别有效,比如“镜头拉近”比“推近”好用,“俯视全景”比“从上往下拍”好用,某个表情一出效果就稳。这些经验别人没法说。
版权方面,音源别偷真人声音,素材尽量用可商用的,YouTube下载的视频注意来源标注。
总结:从合格骨架到个人风格的进阶路径
这个项目的路径很清楚:先用skill跑出一条合格视频,知道流程怎么闭合。然后拆片、复盘,攒自己的语料库。最后你会发现,工具给的是骨架,风格得自己长出来。
别一上来就追求爆款。先跑通一条,再跑顺十条,然后回头看第一条,你会知道哪里该改。积分和时间花下去,手感自然来。
视频教程下载
文章可能无法完整分享清楚,下面是原项目视频教程,粉丝朋友可以自行下载学习。提前说明:资源链接内可能会存在引流广告信息,请自行甄别。
百度网盘:
