上个月有个朋友找我,说他做汽车科普号做了两个月,发了三十多条视频,最高播放没过五千。我让他把账号发我看看,翻完发现一个问题:他的每条视频都是网上那些讲烂了的内容,奔驰谁造的、福特怎么起家的,画面还是随便找的素材拼的。这种号现在起不来太正常了。
我去年开始跑这个方向,中间废过好几个号,也交过学费。目前用AI仿真人做汽车历史科普,从选题到成片一个人能跑通,单号稳定出量。今天把整个流程拆开讲,包括我踩过的坑和现在觉得最省钱的配置。
选题与文案
选题决定了这条视频能不能被推。汽车历史科普有两个大方向可以走,一个是讲品牌历史,比如第一个奔驰是谁造的、福特T型车怎么改变美国;另一个是讲车上小物件的发明史,转向灯谁做的、雨刷器谁发明的、安全气囊怎么来的。
我建议新手从零部件科普切入。历史类内容太多人做了,同质化严重,零部件类相对冷门,竞争小,而且观众有好奇心。
找选题的方法很简单。打开豆包,搜同类型视频,看别人在做什么方向,点开几个AI说车的视频看内容,确定哪种类型的数据好。然后把你觉得不错的同类型视频链接扔进豆包,跟它说“我也想做同类型视频,请帮我出选题并生成”。

我一般会让豆包一次出十个选题,自己筛。筛选标准就一条:这个选题扔出去,有没有让人想点进来的冲动。太冷门的也不行,比如“汽车点烟器是谁发明的”,观众根本没兴趣。我上次选的是“安全带预警器”,这个就刚好,大部分人不知道是什么,但一听跟安全有关就想看。
选好之后复制给GPT,让它按这个选题写剧本。
剧本生成
剧本环节是整个流程里最关键的。我用的提示词是从一个做了半年的朋友那拿的,核心逻辑是让GPT生成两人对话形式的剧本。中国发明的内容带中国味,外国发明带老外味。
把选题复制给GPT,先让它出大纲,看故事线通不通。大纲没问题再让它写完整剧本。

GPT生成历史内容之后,要再问豆包核对史实。这里有个细节:适当错两处可以引发评论区讨论,但别错太多,现在观众眼睛尖,错多了会被骂。流量和精度之间要平衡,我的做法是大方向尊重历史,小细节可以留点争议空间。
开头部分要自己改。GPT写不出那种冲突感,你得手动设计第一句话。第一句不能直接上对白,要留人、有冲突感、声音大。我一般会问GPT“帮我设计合作抖音短视频的爆款开头”,它给的方向可以参考,但具体那句话得自己想。比如“师傅前脸撞成这样了,架子舱点没动”这种就比平铺直叙好。

剧本审前期只抓两个指标:2秒跳出率和5秒完播。别追求完美,先把人留住再说。旁白尽量放最后升华,中途不要加旁白,会打断节奏。
剧本出来之后,扔给豆包检查一遍,问它“有没有不符合常识的地方、是否通顺”,没大错误就不用改。这一步花不了几分钟,但能避免很多低级错误。

分镜制作
剧本定了就进第二道工序,分镜。
把剧本扔给分镜提示词,按提示词要求生成。这里要注意的是每个节点的时长控制。白嫖用豆包的话,每个节点控制在10秒;用libTV或即梦默认15到30秒。新手预算低先用15秒起步,别一上来就30秒,浪费钱。

审分镜主要看一件事:台词能不能在节点时长内说完。语速太快会变形,一般3到5字每秒,你自己读一遍算算时间。比如10秒的镜头,台词控制在30到50字之间比较合适。
分镜里要包含登场角色、道具、风格约束、场景图替换、站位描述、声音和本场景别。景别看中景、反应景、过肩镜头这些。前两个镜头用中景或中近景,别远景别怼脸,胸以上带背景就行。
豆包生成前把文案拖给豆包甄别违规处,改人名、车标logo、字母。用libTV或即梦基本不用改,但需要资产:先生成图片再围绕图片生成视频。
资产制作
资产就是人物、场景、道具的图片。这一步决定了视频里人物长什么样、场景什么样。
资产提示词可以让AI根据故事罗列资产加禁令。比如“请根据以下剧本列出需要的人物、场景、道具资产,并说明每个资产的外观特征”。

GPT Plus一键出图,3点内最多50张,约20个场景。费用是GPT约130元/月,梯子30元/月,共约150元/月。如果想白嫖,用“小云雀”生成资产,每天赠积分,20个资产约60分够用。小云雀用4K、16比9,生成后下载再上豆包白嫖。
图片不用全用,只挑主要能用的,其余靠即梦生成。为保证人物一致性,只提供主要人物、车辆、主要道具及对话人物即可。素材不用追求美感,只要每个人长得不一样、能单独识别就行。
视频生成
资产准备好就进即梦生成视频。
点生成画布,选视频生成,模型用2.0费用,秒数拉满15秒。图片出现在画布后,复制分镜15秒内容,圈选所需图片。老张、小张分别圈定避免混淆。

可以添加参考声音,老张、小张分别圈对应音频,所有分镜同样操作。选全能参考,16比9、720分辨率,选一个即可,两个涨价。打折约90积分。

新建窗口发送文件查看内容,确认收到后开始生成。

操作顺序是:先发剧本,再发分镜。有GPT的用GPT,效果更好;没有的用豆包平替。

镜头衔接要注意。同一人物同一画面两个景别之间太小,画面会跳。影视里不行但非专业可接受,做好看要不跳。可以慢慢推进或换到去标,近景到特写,中间相邻景别不能硬接。同一人物同一景别切来切去会很突兀。
30秒视频不必连贯,可硬切或转场。不同人物切换不跳,同人物换景别如近景换中景避免跳。开头用近景或中近景特写,镜头语言压迫感强,适合说话或骂人。
分镜出问题自己改,比如85毫米焦距、中近景固定机位,不对就要求改近景。核心是懂镜头,知道景别出什么镜头,中景膝盖往上,近景胸前一站,对话常用中景和近景。
收益模式
单价与播放量相关。进阶选10万播放量单价三四十到四五十块;报几百万播放量单价约7块;明天选报几百万单价约1-2万,不报可能10块。新号有蜜月期单价会高一点。
目前看这个进阶选重全自动比较好整,基本不用费什么大脑。但两个月后会卷,吃个新鲜饭。
注意事项
豆包免费有额度,想做好需控制景别衔接,前期可直接拿提示词出视频看效果。
AI解释不了动作,会加时长,比如2秒给10秒。自己改秒数,如6秒改8秒。扔给豆包生成不管秒数,后期剪辑对付。描述变长如6秒变10秒,可能废视频,15秒只给10秒。
约束10秒内多少字保证读完,AI只会往少整。花积分要自己读检查。
先做第一节1秒,用提问做手针或加收尾针。豆包只有手针,多参模型参考图片。
检查镜头衔接,复制问AI会改。用2.0模型,三毛一个,买季卡便宜。前期豆包后期换2.5最好。
台词一大段一个镜头35秒画面不动,以前做漫剧这样要求,远景中景靠景会改但不好,可先不管,算起来4秒5秒。
AI不要太拉胯平台就推,只看剧本。刷到官方镜头烂照样1万多点赞,想做那水平直接TS拉近出,问GPT会改台词,豆包要检查有无改台词,镜头出来8秒合适但写10秒,改成8秒。
准备剧本提示词和分镜提示词,先拿剧本提示词给GPT或豆包找选题。用选题直接让分镜提示词出剧本。出大纲后自己改,再出剧本。开头打磨一下,后面看通顺、无历史性错误即可。
总结
这个项目适合宝妈、上班族、自由职业,也可以做工作室。核心成本就是GPT加梯子约150元/月,想省钱用豆包加小云雀也能跑,就是效果差一点、步骤麻烦一点。
我的建议是先按这个流程跑出两个作品,你就知道哪块需要改。提示词和素材不用到处找,自己选选题从头做,包括出三视图。跑通一遍之后,后面就是批量复制的事。
想做的今天就可以开始,先注册豆包和即梦,把选题这一步跑起来。
视频教程下载
文章可能无法完整分享清楚,下面是原项目视频教程,粉丝朋友可以自行下载学习。提前说明:资源链接内可能会存在引流广告信息,请自行甄别。
百度网盘:
