分享
用AI做了一个月视频,想跟你分享这套没人讲的心法
输入“/”快速插入内容
用AI做了一个月视频,想跟你分享这套没人讲的心法
用户4242
用户4242
7月16日修改
🔗 原文链接:
https://x.com/bozhou_ai/status/2074...
最近刷到不少教 Codex + Remotion 做视频的教程,套路基本一样:装个插件,丢个 prompt,画面出来了,收工。
然后你照着做,发现做出来的东西根本没法发。只有画面没有声音,或者配了音但音画对不上,画面就是一页一页的 PPT 在翻,满屏都是字。教程里演示的那三十秒确实能跑通,但从能跑通到能发布,中间隔着的全是没人讲的细节。
我这一个月发的视频,全是用 AI 做的。口播视频、手绘故事视频都有,中间踩的坑不少,也攒出了一套自己的流程。今天把这套心法全部公开,包括我沉淀出来的三个 skill 直接开源。
先说一个前提。这篇不是技术教程,你不需要懂 Remotion 怎么写、React 是什么。活是 AI 干的,你要懂的是整体框架:每一步该做什么、该盯什么、坑在哪。框架对了,剩下的交给 AI 就行。
一. 一句话心法
整套流程压缩成一句话:
先写逐字稿,生成音频,拿到字幕文件,用字幕文件驱动所有动画,最后配音效和 BGM,低画质调试,确认没问题再出高画质。
那些教程做出来的视频为什么烂,原因就藏在这句话里。它们把视频当成"生成画面"来做,但视频其实是一条以声音为轴的时间线。字幕文件是整条视频的唯一基准,画面、动画、音效全部要对齐到它。没有这条轴,你做出来的就是一堆各自为政的画面。
后面每一节,都是这条流水线上的一环。
二. 工具怎么选
我主要用两个东西:HyperFrames 和 Remotion。
HyperFrames 快,出结果简单,适合做 PPT 式的演示、文章内容可视化这类东西。但复杂动画它撑不住。
Remotion 上手门槛高一点,它是用代码来定义视频,每一帧都可以精确控制。代码是 AI 写的,你不用管。要长期做视频,最后一定会走到它这里,因为它能沉淀模板,这条视频调好的东西,下条视频直接复用。
选择标准很简单:试水、赶时间、做个演示,用 HyperFrames。认真长期做,用 Remotion。
工具本身不展开讲了,教程到处都是。决定成片质量的不在工具,在后面这些细节。
三. 音频是整条视频的骨架
大部分人做 AI 视频,声音是最后才想起来配的。这个顺序就错了。声音应该是第一步。
一切从逐字稿开始
不管做什么视频,先把逐字稿写完,口语化的也行。它决定了整条时间线的长度和节奏,后面所有东西都从它推导。
配音的两条路线
第一条,自己录口播。录完以后把气口去掉,就是那些换气声和空白停顿,然后把音频转成字幕文件。我用的是火山的字幕 API,它能给到每一个字在音频里的时间点,精确到毫秒。