第一次做美食科普视频的时候,我直接拿别人的文案用AI配音,结果发到抖音上,播放量几百,还被判非真人内容限流。后来花了三个月,翻了好几个博主的教程,才算把这套流程啃下来。今天我把这个31W粉博主分享的全套操作拆开揉碎给你讲一遍,从文案到成片,每一步都有坑也有捷径。
文案获取与洗稿
先搞定文案,这是整条视频的地基。
去抖音搜”美食精选”频道,找那些点赞高的科普视频。比如讲皮蛋的、讲土豆的、讲早餐血糖的,这些都有固定套路。视频通常一分钟左右,刚好符合抖音精选计划的推荐时长。
找到视频后,复制链接。用文案提取工具扒出文字,注意豆包有时候提取不全,我是买了个99块钱终身用的网站,挺值。
拿到原始文案之后,重头戏来了——洗稿。
把文案保存成txt文档,去[claude.ai](这个网站(需要翻墙,怎么翻自己查一下)。把文档拖进去,再发一条改写指令。指令要求生成1800到2000字的新文案,保留原意但完全换掉表达方式。

点发送,等一两分钟,新文案就出来了。但这还没完,必须查重。
打开朱雀AI检测工具,把新文案贴进去点检测。看”人工特征”这一栏,必须大于60%,低于60%说明AI味太重,平台能识别出来,得重新用claude再生成一次。


这个环节我踩过最大的坑就是以为查重检测一次就完事。其实每次洗稿后都要测,有时候换了几个词就能从40%提升到70%。反复调几次,把分数怼上去再往下走。
AI配音与素材匹配
文案搞定,接下来要搞声音。
现在抖音对AI配音管得很严,直接拿普通TTS配出来的音频,平台一检测就限流。只有声音克隆这一条路走得通。
部署星空云配音模型。登录后选最便宜的配置,点部署等显存占用降到35%左右,就可以打开使用了。这个模型可以克隆你上传的一段真人声音,生成效果很自然。
但要注意,文案里的数字要手动改一下。比如”全球有13亿人”,AI读的时候可能读成”十三亿”或者”13亿”,断句不对。改成中文大写”十三亿”,配音才顺。

声音文件下来之后,用花生AI匹配视频素材。这个网站有个”音频审批”功能,别点成”文案审批”了。把音频传上去,再把对应的文稿粘进去,系统会自动给每句话配上视频片段。

匹配完要逐句检查。比如音频说”外国人看见皮蛋会选择转头跑”,系统匹配的是一个人在笑的画面,那肯定不对,得替换。点刷新素材,换个合适的界面再替换上去。这个环节很费眼睛,但必须做,偷懒的话观众一眼就能看出视频和配音不搭。

全部确认后,导出成片。导出时把水印和背景音乐关掉,因为后面要去剪映精修。
剪辑操作
最后一步,也是最需要耐心的步骤——剪辑。
把花生AI导出的视频拖进剪映。
前半分钟到一分钟,是展示剪辑功力的地方,也是过审的关键。把原视频做虚化处理,用剪映的”模糊”特效,调整参数让画面像背景一样模糊,别太抢镜。
然后加上文字特效。注意每种素材的开头一分钟,动画风格不能一模一样。比如第一个视频用文字从底部向上滑入,第二个视频就用从左向右移入,得换着花样来。这样平台审核才觉得你是在认真做内容,不是批量搬运。
要特别注意贴纸和文字的层级关系。视频里有人加了个土豆贴纸,结果贴纸挡住了下面的字。解决方法是右键点击贴纸,选”合成复合片段”,把它变成一个整体,再拖动到文字下方。


人物抠图是核心技能。比如你从AI绘图网站下载了一张有几个人物的图片,要一个个抠出来。选中图片,点抠像,选智能抠像,工具会自动识别人物。但如果是多个角色贴在一起,系统可能分不清。需要复制多个图层,每个图层保留一个人物,其他部分用橡皮工具擦掉。

抠完之后,给每段文字配上动画效果。入场动画选”上滑”、”弹入”或者”放大”,不要只用一种。动画时长控制在0.3到0.5秒,太快观众看不清,太慢拖节奏。
背景音乐也很关键。我一般选那个叫”朋克英”的音效,风格比较活泼,适合美食科普。音乐音量控制在-4到-6dB之间,不能超过-4。人声音量从原视频看,如果太小就拉大,如果太炸就压小,保持人声清晰但不刺耳。

整个前半分钟操作下来,第一回可能会花一两个小时,但做了几次之后,半小时就能搞定。后面剩下的部分直接用花生AI已经匹配好的素材就行,懒得替换的可以留,但明显不搭的必须换。
收益模式与注意事项
做这类视频,主要靠抖音精选计划的播放量分成。一万播放大概十几到五十块不等,具体看你视频的完播率和互动数据。一个爆款视频单条播放两百万,收益能到四五千。但这是少数,日常情况是几十到几百块的稳定收入。
有几点你必须要知道。
第一,封面和标题很重要。标题里要有争议性或者好奇心钩子,比如”为什么中国人不爱吃土豆?””早餐越吃越饿?90%的人都吃错了”。封面要白底红字或者夸张表情,吸引点击。
第二,不要只做一个账号。建议同时打理三到五个号,上架视频后每个号发一遍,哪个号自然跑起来就重点维护哪个。
第三,洗稿不是抄稿。很多人直接换几个近义词就发,被平台查出来直接封号。用claude生成的文案,朱雀AI的人工特征必须超过60%,这是及格线。如果检测出来全篇AI味,说明洗得不够,继续改。
第四,前视频特效不能完全照搬。每个作品之间动画、字体、配色都要有变化,不然运营一看就是批量机器发的,不给推流。
第五,做之前先了解自己的时间成本。新手做一个完整视频,前期至少两三个小时,熟练后压缩到一个小时。如果只打算一个小时发一条,更新频率跟不上,流量起不来。
总结
这套流程看着挺长,拆开看其实不复杂:洗稿文案——AI配音——匹配素材——剪映精修。每一步都有现成工具,关键是你愿不愿意动手。
文案难在洗稿查重,配音难在数字处理,素材匹配难在手动替换,剪辑难在抠图和动画变化。但这些东西做过三遍就熟了,跟学骑自行车一样,慢的时候摔几次,会了就是一辈子的事。
有想法的朋友,可以先从洗稿练起。找一篇爆款科普视频文案,用claude洗两遍,过朱雀检测,然后部署星空云配音,最后用花生AI匹配素材做成片。第一个视频不用追求完美,先走完一遍流程。只要把这一步走通了,后面的批量出片就是复制粘贴的事。

