Codex + HyperFrames:拆解抖音爆款 - 吃上自媒体这碗饭!
Codex + HyperFrames:拆解抖音爆款 - 吃上自媒体这碗饭!
之前我尝试用 Codex 和 HyperFrames 拆解了抖音上一个图书号的爆款视频,其中声音效果得到了大家比较一致的好评。
今天我就来出一篇长文,教大家如何一步步拆解抖音爆款视频,并固定一套工作流,从而让自己也拥有用 AI 制作视频的能力。
1. 准备工作
1.1 核心工具安装
首先,大家一定要把工具装配好:你需要有一个像 Codex 这样的 Agent,之后去插件库安装两个核心工具:
- HyperFrames:用 HTML 的形式去制作视频,非常适合做企业宣讲、数据动效或者展示类视频。
- Remotion:用 React 写的,实现了视频代码化。当你固定一个主题风格后,非常适合通过代码化进行高度复制。我看到很多博主用 Remotion 制作类似「小 Lin 说」风格的动画,配合口播视频的效果非常好。
1.2 辅助 Skills 安装
另外,大家还可以安装一些 Skills(技能)来辅助拆解。如果你想了解一个爆款视频的结构——前几秒如何吸引观众、声音效果如何、旁白与画面的节奏是怎样的——可以通过以下 Skills 进行拆解和复刻:
- Cloud Video:用于拆解视频流程,方便下一步复刻。
- Video Use:我非常推荐剪辑小白安装。它就像一位「视频剪辑导演」,能够根据你的需求调用相应的工具。对于不知道什么时候该用什么工具的新手来说,它扮演了导演大师的角色。
以上就是我们要做的准备工作。
2. 视频制作流程
2.1 前期规划:规格、旁白与视觉风格
用 Codex + HyperFrames 做视频可以按照这个顺序来:
-
先定视频规格 — 比如:30 秒、9:16、中文、知识类、图书介绍、放 X / TikTok / 小红书
-
写旁白脚本 — 先让 Codex 写 30 秒中文旁白,不要急着做画面
-
确认视觉风格 — 比如:dark editorial knowledge video、高级知识类、深色背景、书封面主视觉、轻微镜头推进
-
做 timestamp 分镜 — 把旁白拆成 4-6 个画面段落,每段对应一句核心信息
-
准备素材 — 书封面、标题、关键词、logo、背景音乐、配音文本
2.2 制作与渲染:配音、字幕到输出
-
生成配音 — 可以用 Edge TTS、ElevenLabs,或者 HyperFrames media 相关流程
-
转写配音 — 用最终音频转
transcript,不手动猜字幕时间 -
创建 HyperFrames composition — 写
index.html,用正确的data-start/data-duration/data-track-index -
做字幕 — 根据
transcript自动同步字幕 -
preview— 先看预览,不直接渲染最终视频 -
validate / inspect— 检查报错、字体、布局溢出、字幕遮挡 -
render MP4— 确认没问题后再渲染
以上是一个大概的步骤。其实很多环节都不需要我们人工参与,所以大家了解一下这些大致步骤就好了,人工参与的部分其实不多。
3. 首次需要人工参与的部分:拆解视频与旁白稿生成
3.1 视频结构拆解
现在我们要来拆解视频。首先,我们需要用到 Cloud Video 去拆解视频的结构。我拆解的是一个图书号,所以它的结构非常简单:前几秒需要留住观众,然后对书籍进行介绍或者书评。
3.2 旁白稿生成与「去 AI 味」
接下来的旁白稿生成步骤如下:
-
收集信息:
- 用 Codex 收集图书信息
- 调用微信读书的 Skills 连接,查看大家经常划线的部分和评语
- 让 Codex 搜索一些著名的书评
-
生成介绍:让 Codex 基于书籍事实生成一份介绍。这份介绍在自媒体平台上一定要「去 AI 味」,具体要求包括:
- 不要出现「不是……而是……」这类典型的 AI 表达
- 避免排比感太强的句式
- 表达要流畅自然,平铺直叙地讲述书籍,而不是以一种傲慢的口吻去介绍
这部分需要我们基于拆解的视频结构来操作,同时我们自己也需要把关,审核文案是否可行。
生成好了之后,大家可以把这次用 Codex 从书籍收集到整理的内容形成一个 Skill。这样以后,旁白的文案都是可以复用的。
这一切都要让 Codex 基于事实去写。这样操作后,它会给我一份旁白稿,我们就完成了第一份整体旁白稿的制作。
4. 音频 TTS 文件处理:拥有自然磁性的声音
4.1 TTS 工具选择与中语音频方案
旁白好了之后,其实还有一大部分工作,我目前还没有做到自动化,还没来得及去连语音生成的 API。
但是我先写出来——如何去调节语音,让它变得更自然,产生更磁性、更有故事感的声音。
我之前使用了 Codex 推荐给我的 ElevenLabs,它里面的英文声音真的是很完美,各个国家的声音都可以找到。但是我在使用中文语音生成音频的时候,发现它不太能识别中文,读起来会有很多错字。这种情况下已经没法用了,所以最后就放弃了。
Codex 给到我的解决方案是:可以先用剪映或者是火山引擎的 API。因为我手里还没有火山引擎的 API,所以就先用了一下电脑目前有的剪映 App。
4.2 声音处理流程与复用
我的做法非常简单:
- 首先新建一个项目,然后找到文本选项。
- 使用「文本生成音频」功能,选一个我觉得还不错的声音。
- 直接把旁白文案复制进去,点击生成。
- 最后把语音导出来(剪映只能导出 MP4 文件)。
- 把这个 MP4 文件喂给 Codex,要求它帮我把声音处理得像对标视频一样自然、有故事感且富有磁性。
Codex 处理声音的流程如下:
- 自动分析:Codex 会先分析原视频的声音参数,并对照我提供的 MP4 文件进行更改。
- 参数设置:相关参数截图发给 Codex,它就会帮你处理出这种效果。
- 简单方法:直接放一段对标视频给它,告诉它「我想要处理成这样的声音」,Codex 就会帮你处理。
通过这种方式处理出来的声音非常完美。当你掌握了这种声音处理能力后,就可以复用到其他类型的视频制作中——电影讲解、生活哲理类视频、科普类账号等,都是完全适用的。
那就像我说的,其实这部分也应该用自动化的方式,这样会比较好一点。自媒体创作能不用人工就不要用人工,在这样「无痛」的情况下,你会非常容易坚持下去。所以后面我会尝试用火山引擎的 API,让 Codex 自动去做旁白和声音的 TTS 文件。
5. Hyperframes 处理画面、字幕与旁白对齐
5.1 自动化视频创作
接下来就是去做画面,然后让语音跟字幕进行匹配。这个时候我完全没有插手,因为 Codex 现在已经有了一个大概的方案。之前我已经喂给它一个对标视频,现在也有了旁白和对应的语音,Codex 会自己进行视频创作。
5.2 常见问题与反复调优
视频创作之后生成的版本一定不会是一次性到位的,可能会出现以下几种情况:
-
语音和字幕对不上:你需要跟 Codex 沟通好,让它自己去对齐。Codex 会自动抽帧,检查声音和字幕为什么对不上,这种情况可能需要调节两遍左右。
-
画面问题:包括画面内容、字幕位置以及产生的形态等。这些都可以跟 Codex 反复沟通,不断提醒它去靠近我们想要复刻的视频。
其实整个流程理顺之后,我们就可以生成复刻程度比较高的视频了。如果我们能把整个流程自动化,就可以批量地去跑号。无论是图书号还是其他类型的账号,都可以按照这个流程进行拆解和复刻。
6. 行动与展望
6.1 行动起来
最后,希望这篇文章对大家有用。其实我也是一个在边做边学的状态,希望我们可以多多沟通交流。很多时候不是我们做不出来,可能是我们还没有去行动。
对于使用 Codex 也是一样,只要我们开始行动,用自然语言去跟 Codex 聊天,一步一步地去找到这些解决办法。我相信只要大家开始动起手来,每个人都可以利用 AI 吃上自媒体这碗饭。
6.2 AI 时代的可能性
希望大家都可以在这个 AI 时代,在这个普通人也可以无限接近生产力的时代,去做自媒体,去创造,找到可复用的方法,让它可以在你睡觉的时候也能够产生财富,无限地靠近自由。