我把爆火的“巨手拯救小人国”视频,做成了一个可复用的Skill,批量出视频太方便了!

巨手拯救小人国视频封面

前几天刷到一条 69 秒的 AI 视频,看完直接给我看愣住了。

巨手拯救小人国爆款视频截图

一座微缩水坝裂了缝,泥水哗哗往外喷,坝上一排穿黄雨衣的小人急得抱头。

这时候一只真人的大手从天而降,拿着一把热熔胶枪,滋一下把裂缝封住了。

小人们瞬间欢呼。

紧接着,洪水淹了小镇,大手拿一块厨房海绵按下去,整条街的水被吸得干干净净。

渔港漏了石油,大手捏两根棉签把黑乎乎的油污全吸走。

油井着了大火,大手直接扣了一个西餐的银色餐盘罩上去,火,闷灭了。

这么一个视频,在 X 上获得了 500 多万的曝光,可以说是超级爆款了。

X 上 500 多万曝光数据截图

看完我脑子里就一个念头,这玩意的创意公式是可以拆的,拆完就能量产。

于是我花了一个下午,把它做成了一个 Skill。

今天把整个思路和成品都分享给大家,觉得有帮助的话帮忙一键三连一波~

1. 这类视频为什么让人上头

先说我拆出来的底层公式,就四个要素:宏大灾难 x 微缩降维 x 日常工具 x 情绪闭环

洪水、干旱、石油泄漏、极端天气,这些现实里让全人类头疼的灾难,被做成了桌面上精致的微缩模型。

然后用一块海绵、一根棉签、一滴水,轻松解决。

这种降维带来的治愈感,就是它最上头的地方。

现实越无力,视频里越轻松,反差越爽。

但真正有创意含量的,其实是灾难和工具之间的对应关系。

我们可以再仔细想一下,海绵本来就是吸水的,所以拿它吸洪水,秒懂。

棉签本来就是吸附液体的,拿它吸油污,秒懂。

餐盘罩本来就是盖住东西隔绝空气的,拿它闷灭大火,还是秒懂。

这种以小见大的规律,我把它叫做同构匹配

也就是说工具在日常生活里的原生功能,必须和解决灾难的物理逻辑一致。

反面例子就是拿灭火器去灭火,逻辑没错,但工具和灾难在同一个域里,没有跨尺度的巧思,观众看了毫无波澜。

我们用一句话总结判断标准,意料之外,情理之中

观众看到工具出现的瞬间会心一笑,并且在半秒内就理解它为什么有效。

那么这个视频的效果就出来了!

2. 把公式装进 Skill 里

想明白公式之后,做 Skill 就顺理成章了。

我给它起名叫 miniature-rescue-prompt,结构是一个主文件加三个参考文件。

主文件写的是五步工作流:

第一步,定主题。环保只是其中一个方向,同样的公式可以套健康(创可贴修断桥)、情感(针线缝合裂开的房子)、城市生活(拉链拉开堵车长龙),一条视频选 6 到 9 个灾难场景。

第二步,配工具。这是灵魂环节,每个匹配都必须写得出同构解释,写不出来的直接淘汰。

第三步,写分镜。每个片段固定三拍,总长 7 秒:灾难展示 2.5 秒,大手介入 3 秒,修复欢呼 1.5 秒。

这个节奏是完播率的保障,别贪长。

第四步,出提示词。默认中文输出,直接喂给 Seedance 这类模型。

第五步,自检。色彩不能连续重复,水后面不接水,火后面不接火;手部动作必须单一干净,因为 AI 模型做不好连续的手部精细操作。

在三个参考文件里,最值得关注的是那个灾难 x 工具对应库

我按五大主题域整理了三十多组验证过的组合,每组都附了同构解释。

剩下两个分别是微缩场景的视觉规范(移轴虚化、实体模型材质、比例锚定这些技术要点),和一个完整九段式范例,有范例来约束,防止有时候生成的提示词太过天马行空。

说白了,这个 Skill 的上限就由那个对应库决定。

库越厚,产出的创意越稳。

3. 实际跑一条看看

光说不练假把式,我用 Skill 生成了一条新组合:堵车长龙 x 拉链

同构解释是这样的:

拉链的原生功能是把咬合的两排齿分开,和把挤成一团的车流从中间疏导开,逻辑完全一致。而且拉开拉链这个动作本身就有强烈的ASMR快感。

生成的提示词长这样:

微距移轴摄影,固定机位单镜头。一条微缩城市街道被地震撕开一道贯穿画面的锯齿状深裂缝,裂缝两侧的沥青路面上下错位,干裂黏土质感的断面外露,一根微型路灯歪斜倾倒。手绘质感的 4 厘米小人偶散布在裂缝两侧,有的趴在裂缝边缘向深处张望,有的抱头后退,一辆约 3 厘米长的模型小汽车前轮悬在裂缝边缘摇摇欲坠。火车模型比例的建筑和植绒微缩树木沿街分布,正午明亮的棚拍光线,极浅景深,画面边缘移轴虚化。一只真人成年人的手从画面上方进入,握着一把真实尺寸的银色订书机,订书机比下方的小汽车大出数倍。手沿着裂缝从近端到远端依次下压三次,每一次下压,一枚银色钉书钉便钉入路面,将裂缝两侧咔嗒一声拉合对齐,错位的沥青路面随之复位,三枚钉书钉在合拢的裂缝上排成一条整齐的银线。手移出画面。大地完全合拢,路面平整如初,钉书钉像一排微型铁轨枕木镶在路上。悬在边缘的小汽车四轮落回地面缓缓驶过钉合处,小人偶们在钉书钉上蹦跳了两下确认牢固,随即高举双臂欢呼,歪斜的路灯重新亮起。风格:实体微缩模型的照片级微距摄影,鲜艳饱和的玩具感色调,移轴虚化,固定机位单镜头,无剪辑无转场。不要卡通渲染,不要 CG 感,不要光滑的 3D 渲染质感,镜头稳定无晃动。时长:7 秒。第一拍(0 至 2.5 秒)裂缝错位悬车惊慌,第二拍(2.5 至 5.5 秒)订书机三连钉合,第三拍(5.5 至 7 秒)路面复位蹦跳欢呼。

注意最后那句“固定机位单镜头”,这是我踩过的一个坑。

我一开始没在意,后来回看原视频才发现,人家每个小单元都是一镜到底的。

灾难、手进来、修复、欢呼,全在同一个画面里连续发生,中间不切任何镜头。

这么做因为这类视频的爽点就在于亲眼见证

泥水在你眼前被吸干,大火在你眼前被闷灭。

中间一切换镜头,观众潜意识就会怀疑剪辑点后面是不是换了东西,魔法感当场破功。魔术师从来不切镜头,一个道理。

还有个更实际的原因就是 AI 视频最大的软肋就是跨镜头一致性,切镜头几乎必然穿帮。

一镜到底反而把任务框在了模型最擅长的范围里。

所以这条规则我直接写进了 Skill 的默认行为,想要电影感多镜头的也留了选项,但会先弹风险提示。

最终复刻的视频效果如下,还不错吧。

复刻视频效果截图一

复刻视频效果截图二

最后只需要把多个视频片段用剪映拼接到一起即可,一个具有爆款潜质的视频就完成了。

https://x.com/zhouluobo/status/2075743849830592821

成品视频发布截图

4. 几个实操小技巧

分享几个我在写这批提示词时沉淀下来的细节,这些也都写进 Skill 里了,很多技巧都是通用的,可以应用到更多的场景和领域。

给每段配一个修复验证物。桥修好了,让第一辆小车驶过去;风车解冻了,让扇叶重新转起来。

观众看到验证物才真正相信修好了,比单纯欢呼有说服力得多。

小人偶全靠肢体语言。微缩人偶没有表情可用,惊慌就是抱头奔逃,欢呼就是高举双臂。

给他们穿高饱和的纯色衣服,黄雨衣蓝夹克,既是视觉焦点又方便模型保持一致性。

每条都要锁比例。这类视频最容易穿帮的就是尺度混乱,所以提示词里必须写具体参照:“4 厘米小人偶”“拉链头比汽车还大”“海绵盖住整条街”,用双重锚定把比例焊死。

准备降级方案。复杂动作生成不稳定时别硬刚。

比如缝纫这种动作,可以简化成“线已缝好三针,手做最后一次拉紧”,只保留一个动作,成功率立刻就上来了。

5. 写在最后

做完这个 Skill 我有个挺深的感触。

以前看到爆款视频,第一反应是收藏,然后就没有然后了。

现在我多了一个动作,把它拆开,看看里面的公式能提炼成什么。

一条爆款是运气,一个公式是资产。

而 Skill 这个东西,本质上就是把你拆出来的公式装进一个可以反复调用的容器里。

下次想做同类内容,一句话唤醒,创意、分镜、提示词一条龙出来,你只需要做最后的品味把关。

会用 AI 的人,未必比别人聪明,但一定更擅长把一次性的灵感变成可复用的系统。

别光顾着收藏不看,找一条你最近觉得牛的视频,试着拆一拆它的公式。

哪怕只拆出一条规律,你就已经跑赢绝大多数人了。

AI 时代从来不缺爆款,缺的是那个能把爆款变成流水线的你。

别犹豫了,赶紧动手吧。

https://github.com/zhouwei713/miniature-rescue-prompt

miniature-rescue-prompt 项目配图