一句提示词,模型写代码逐帧画出画面,再交给 ffmpeg 编码。这份 deck 收了英文区 82 条、中文区 44 条帖子:三支百万级爆款、十一个中文区案例细讲,以及可以直接点开播放的原片视频墙。








@claudeai 发布 Opus 5.5。晚上 @other__reality 贴出 P(Doom) 的 2 分 37 秒 MV,最后到了 241 万浏览。
riba2534 把「鹈鹕骑车」做成能玩的 3D 网页,19.1 万,中文区最高。WY 的线稿《中华五千年》《大气环流》分别 15.5 万、13.4 万。
kirill sh 让 Opus 和 GPT-6 Astra 做同一句,166 万。歸藏给 CodePilot 做宣传片 13.8 万,随后开源了 skill。
Livera 的 15 秒动效简历提示词 157 万;twoclipping 的 14 秒 UI 形变 92 万,中文搬运标题是「AE 动效设计师天塌了」。
宝玉 12 分钟的《什么是 Transformer》15.9 万;有人一句话烧掉 3 亿 token。halogen、Ding、Feicai 开始泼冷水。
“make a dynamic 15-second motion graphics video that shows what an incredible motion designer you are, like it's your showreel for a résumé. go all out.”
15 秒。够做四五个段落,又短到一次渲染几分钟就能看结果。
「简历样片」自带要求:快切、排版、炫技,不用讲故事,也不需要品牌素材。
go all out 加上 Max / xhigh 档。其余全部剪辑判断都交给模型。
没有分镜、没有配色、没有「用 Remotion」。它测的是模型自己的品味。
帮我用 js 制作一个视频,主题是:什么是 Transformer。要深入浅出,让高中生也能看得懂,不仅 high level 说的清楚,也要有细节,包括注意力机制,甚至一些数学概念。你可以用任何工具或者安装工具,可以联网检索。请给我惊喜。
给受众和深度,放开工具与联网。换个主题照抄,DINOv3 也能出 10 分钟。
做一个动画,快速回顾中华五千年的历史。风格轻松有趣,动画格式为线稿,添加合适的音乐,请务必做到引人入胜。
一句话定风格(线稿)。要配音就再加一句「解说用 TTS,文档在 TTS.md」。
请用 Manim 给我制作一个导数概念学习的视频,要求通俗易懂,并且有例子,引人思考。配音使用 edge-tts。
点名引擎和配音工具,其余交给模型。
帮我做一个原创的手游「高光时刻」动效:[开宝箱 / 段位晋升 / 成就解锁 / Boss 掉落]。做成一个可以直接打开的单文件网页,点一下就能完整播放,效果对标商业手游的结算演出……
长提示词:世界观、真 3D、五段演出节奏、光效、音效、交付前自检全写死。

15 秒上下的炫技片。英文区是 Livera 那一句,中文区是「AE 动效设计师天塌了」。

给网址或代码库,模型先去查产品再拍。歸藏把做法写成了 skill。

中文区最火的一类,宝玉、WY 的讲解片都在 13–16 万浏览,常超过 5 分钟。

P(Doom) 是母体。中文区有拼贴中秋片、论文说唱和 2.5D 分镜。

成片常是实机录屏:鹈鹕骑车、便利店、多米诺、蜘蛛侠。

没有模型、没有照片:无限城市、孟买日出。中文区几乎没有。

花絮、账单、同题对打、案例清单和反方意见。
归类说明
英文区 82 条、中文区 44 条分别归类。两边差别最大的是科普(中文区更火)和 shader 生成艺术(中文区几乎没有)。
帖子只有提示词和一段 15 秒成片,没有分镜、没有品牌色,也没说用什么库渲染。15 秒里塞了四五个段落,每段换一种手法,切点压在鼓点上。这种活平时要一个动效设计师做一两天。
两小时后他用同一句跑了 Grok 4.7 Fast(xhigh),那条 6.8 万浏览,和原帖差着一个数量级。Rob Hallam 在 xhigh 档上做出 4K 版,自己写「一开始不信这是一次生成」,但也在回复里承认 Opus 的节奏还能更好。
一天之后 halogen 发帖说,这些矢量动画长得都一样,而且大多不如那支爆款。同一句提示词跑几百遍,长相就开始趋同。
一句话里同时给时长、体裁和强度,effort 开满。别指望换个题材再跑一次还一样好。
条件写在回复里:Claude Code 跑 Opus 5.5,Codex 跑 GPT-6 Astra,都开 max reasoning、关 memory,同一句提示词,一次生成,零手改。机器上本来就装着 909/808 采样、Surge XT 合成器和一个 Blender MCP,他没让任何一边去用。
Opus 自己决定用 Blender 做一段 3D 镜头,2D 用 skia-python 画,音频用 Python 按节拍网格把采样排出来。Astra 有同样的通道,没用。代价是时间:渲染前 Codex 大约 35 分钟,Claude Code 大约 1.5 小时。
第二天他又用一句提示词让 Opus 把这次会话拍成 56 秒花絮:自写 Python 引擎、Blender、配乐、900 帧,1 小时 32 分,按 API 价 $81。有人回复「这是最贵的避免写更新日志的办法」。
工具先装好放在机器上,模型会自己决定用不用。另外提示词要 15 秒,交出来的文件是 32 秒。
9 月 22 日晚上的原帖只有一句「这是我测过视觉设计最好的模型」,两分半的 MV 里 Claude 的吉祥物 Clawd 跟着一首讲 AI 风险的歌跳。提示词和技术栈都在回复里:仓库 JohnHeibel/PDoomVideo,第二天又放出 ClaudeAnimationBase,给别人拿去做自己的角色动画。
后面三个人换的是画法,歌没换。Raphael Aubry 用 p5.brush 把前 35 秒做成纸艺杂志风,歌词是卡在拍子上的剪纸字,没有视频模型也没有 After Effects。Nate Sharpe 在底子上接 Suno 写了一支正向续作。Feiteng 用 EdgeSpeak 在笔记本上离线做逐字对齐,每个字落在唱到的那一拍。
把「画面是时间的函数」这层底子开源出去,别人就只需要换画风。一次出彩的片子能变成一套模板。
英文区的爆款多是 15 秒炫技样片。中文区浏览前十二里,一半是讲解片(宝玉、WY)和产品宣传片(歸藏),单条最高 19 万,比英文区低一个数量级,但收藏普遍比点赞多:大家是来抄提示词的。
提示词只有四行:用 js 做一个视频讲 Transformer,让高中生也能看懂,既要 high level 说清楚,也要讲注意力机制和数学;可以用任何工具、可以联网;最后一句「请给我惊喜」。模型自己选了 Remotion 排版、KaTeX 渲染公式、edge-tts 配旁白。
中文区科普片里,这条的浏览和收藏都是最高。第二天他把主题换成 DINOv3,同一句式又撑出一支近 10 分钟的讲解。
《中华文明史》走的是另一条路,提示词把规矩写满:配乐当时钟,乐器从骨笛、编钟演进到管弦,BPM 随年代加快;宣纸白描和玄底泥金两种画风交替,纹样从彩陶纹一路换到回纹;先定拍点网格和分镜表,再渲染。
讲解片用短提示词给目标和受众,再把工具和联网权限放开。要风格统一,就像《中华文明史》那样把画风、配乐、转场规则一次写清。
提示词:「做一个动画,快速回顾中华五千年的历史。风格轻松有趣,动画格式为线稿,添加合适的音乐,请务必做到引人入胜。」画面是原生 Canvas 2D 逐帧画,Playwright 无头 Chromium 截图,ffmpeg 编码。他订的是 Max 5x,这条用掉 5 小时额度的 3%、周额度的 1%。
《大气环流》在同一句后面加了三条:中英双语字幕、解说用 TTS、TTS 接口文档放在 TTS.md,key 和音色写在 .env。模型跑了 26 分钟,交出一支近 5 分钟、带解说的高中地理课。他还提醒在 Claude 设置里禁止读取 .env。
这条被当成「用上 Claude 的一线老师又领先了」的证据,收藏 808。之后他用同样的提示词给 OKX 的 AI 产品做了 4 分钟讲解。
外部接口写成文档放进项目,密钥放 .env 并禁止模型读取。这样一句提示词就能带出配音片。
输入是拿破仑·希尔《智胜恶魔》里的一句话:「魔鬼控制人类最简单的方法,就是让人保持漂流状态。98% 的人终其一生都在漂流。」要求围绕这个洞见做 1–3 分钟的 2D 讲解动画,有连贯的讲解、对白和声音,「震撼我」。
权限给得很大:最多 20 个 Agent 并行,可以安装和使用任何工具。模型跑了几个小时,作者说烧掉 3 亿多 token。
回复里有人用类似句式 30 分钟左右做出另一条。同样叫「一句话出片」,耗时和花费能差一个数量级。
放开并行度和工具权限能换来完成度,也会换来账单。先用小预算跑一版确认方向,再放量。
原片是他 83 秒的纯人像口播。要求三条:人像缩成右下角圆形画中画,能看清在讲话、不遮字幕;主画面换成跟着内容走的线稿动画,「我说到哪个概念,画面就画哪个概念」;原声、原字幕、时长都不变。
条件压得很干净:Claude Code 开 safe mode,effort high,不加载他自己的 skill,不给外部素材。模型按字幕切了大约 30 个镜头,用 Python 逐帧画线稿,28 分 53 秒做完。
126 条案例里,这是少有的「改已有视频」。手里有口播、课程录像的人拿来就能用。
存量口播最适合拿来改:声音和字幕已经定了,模型只需要配画面,结果也最可控。
LinearUncle 的提示词一句话:「请用 Manim 给我制作一个导数概念学习的视频,要求通俗易懂,并且有例子,引人思考。配音使用 edge-tts。」成片 7 分 37 秒。3Blue1Brown 那套老引擎被新模型接住了,教育作者对这一点最买账。
Yanhua 的 GPT 发展史是纯 JS 手绘画布,她把用到的 skill(hand-drawn-canvas-animation)放在回复里,这套画风可以直接复用。
Tz 让模型为《Attention Is All You Need》做说唱 MV,英文唱词、中英字幕。他看思考过程发现,模型改了 TTS 的源代码来做唱腔,女声是代码「唱」出来的。
公式推导用 Manim,历史脉络用手绘画布,想传播就做成 MV。先选画法,再写提示词。
9 月 24 日他让 Opus 5.5 给自家 CodePilot 做宣传片,一键生成,他说比前几天用 GPT-6 Astra 做的那版强。音乐和音效也是代码写的。随后他把经验收进开源的 guizang-product-video-skill。
第二天用迭代后的 skill 读 Zed 编辑器的代码库做片,镜头一直在编辑器里运动;再给播客 Next Token 做片,这次只给了官网地址,素材由模型自己找。
游戏结算动画是另一条线:先出 2D SVG 图标,再改成带厚度和光效的 3D 宝箱。来要提示词的人太多,他第二天公开了全文:单文件 HTML、Three.js 卡通分阶、GSAP、Canvas 粒子、Web Audio 合成音效,还规定了五段演出节奏和交付前自检。
满意的做法沉淀成 skill,下一个产品只换输入:代码库、官网、或者一句话。
提示词里写死了一条规矩:可以读本机代码、打开线上网站截图,但「网站功能、界面文字和案例效果必须有实际依据」。先核对线上网站和本地代码,再决定展示什么;开头 3 秒放最抓人的真实案例,结尾清楚展示网站名。最后一句:「用代码生成音乐就好」。
模型自报的做法:Remotion 写镜头,Playwright 实拍线上站,numpy/scipy 合成配乐,ffmpeg 编码,案例素材从网站公开 API 下载。没接任何 AI 视频、音乐或图像模型。
独立开发者 BigEye 给自己上架的 App 做了 42 秒竖屏宣传,一句话,不用 skill 也不用 MCP。他拿 Seedance 2.5 比了价格,问剪视频还有没有前途。
把「必须有真实出处」写进提示词,让模型自己去截线上页面,比用文字描述界面准得多。
原作者 zero(@twoclipping)要的是 Dribbble 级的 UI 动态:一个形状,全程不切镜,在 120 BPM 上从按钮变成播放器、图表、命令面板,再变回按钮。提示词第一步让模型先问他 8 到 12 个想要的 UI 状态。
做法写得很细:单个 HTML,画面是 seek(t) 的纯函数,运动用闭式弹簧;Playwright 每帧拍 4 个子帧,ffmpeg 的 tmix 叠成 60fps 动态模糊;numpy 分析音乐节拍。
小奇说的中文搬运配了一句「AE 动效设计师天塌了」和提示词中译,收藏 1165,成了中文区这场讨论的主帖。
动态模糊、弹簧曲线这些质感细节可以直接写进提示词,模型会照着实现。
艺术家海辛手头正在做一条中秋片,赶上 Opus 5.5 发布,就试了拼贴风动画。分工很清楚:脚本和音乐是她的,画面由模型用 JavaScript 逐帧画;手绘纹理用 p5.js + p5.brush,背景底稿和纸张材质用 Nano Banana Pro 生成,音效由 Node.js 程序合成。
另一条是把一年前用即梦做的像素短片《像素上海》交给 Opus 5.5,做成可玩网页游戏:主角小满在城里收集 42 段关于上海的记忆。角色和地图由 Opus 调 Nano Banana Pro 生成,音乐音效在网页里实时合成。9 月 27 日她又加了上海话配音和 8-bit 老歌。
艺术家把 Opus 当成会写代码的动画师:风格、脚本、音乐自己定,逐帧绘制和交互交给模型。
「鹈鹕骑自行车」原本是测模型画 SVG 的老题。riba2534 在发布当天把它做成能玩的 3D 网页:戴头盔、围红围巾的白鹈鹕沿海岸线骑车追鱼,黄昏、星空、海浪、路灯都是实时的,里面有双骨骼 IK 踩踏、Verlet 围巾、Gerstner 海浪、实时 BGM 和 14 个成就。他说从头到尾只说了一句话,后来又一句话做了 QQ 飞车和穿越火线运输船,代码开源。原帖只有截图,这里播的是 Alan Chen 录的试玩。
SuSu 的雨夜便利店是 Three.js 场景漫游:湿路面反光、路灯光锥、货架和躲雨的猫,1 分 44 秒。同一账号后来又用一句话复刻了《红猪》的日落空战。
可交互的网页比录好的视频更能说明完成度,发的时候附上可玩链接。
Ding 的原话:模型做视频牛,「那是人家的本事,跟你有什么关系」。他附了一条 15 秒示例,承认声音、踩点和创意都有,但没有提示词和参考素材,出来的就是 Claude 典型动效的廉价版。
Feicai 明确反对「Opus 终结了 AI 视频生成」:Seedance 2.5 仍有代码做不到的电影瞬间。他的《雨站》用了混合管线:GPT Image 2.5 画原画,Real-ESRGAN 放大,Depth Anything 估深度,自己写 Python 做 2.5D 渲染,Kokoro 配中文台词。
Gorden Sun 给了另一种分工:Grok 生成原始视频,Opus 5.5 负责剪。他的说法是「没想到杀死剪映的是 LLM」。
图形化、风格化的片子交给代码;要电影光影和真人表演还是用视频模型,让 Opus 做剪辑和包装。
放进 Claude Code,effort 开到 high / xhigh / Max。
产品片多一步:给网址或代码库,让模型先调研、自己截图。中文区常加一句「可以联网、可以装工具,请给我惊喜」。
单个 HTML、Canvas 2D、p5.js、skia-python、three.js、GLSL、Manim、Remotion、自写引擎。
作者多半不指定,由模型挑。
每帧是时间的纯函数,用虚拟时钟推进,1080p30 每一帧都可复现。
角色不会换脸,改一行代码重渲就行。
算出来:Web Audio 碰撞、芯片音乐、按节拍网格排采样、144 万个采样点。
外接:Suno、ElevenLabs、edge-tts、豆包 TTS。WY 把接口文档写进 TTS.md,key 放 .env。
无头 Chrome 或 Python 出帧,ffmpeg 合成。
Dx 开 8 个 Chrome 并行,Adorn 在 VPS 上 9 分钟渲完 4623 帧。
做得好的几条都多了这一环:模型渲出接触印样或静帧,自己找穿帮再改;导出后量响度、抽帧、跑 Whisper。Hamed 的经验是按 6–7 秒一块做,单块渲得快,意见来得及。歸藏的做法是把满意的流程写成 skill,下一条只换输入。
| 谁 | 怎么比 | 结论 |
|---|---|---|
| kirill sh 166 万浏览 | 对 GPT-6 Astra,同机同句,max reasoning | Opus 画面品味明显更好,还主动用了 Blender;但耗时约 1.5 小时,Astra 约 35 分钟。回复里有人说 Astra 没那么差。 |
| 知识猫 | 把 Opus 的做法写成 skill 交给 Astra,同一句 | Opus 效果、耗时、token 都更好。 |
| DreamStarter | 连用两天,项目里还掺了 Seedance 2.5 | Astra Opus 同样任务要更多人工,但便宜得多,可能当日常主力。Astra 看颜色更准,能不经 MCP 直接操作 DaVinci Resolve。 |
| 宝玉 5.7 万浏览 | 樱花山谷可游览 3D 网页,同一份长提示词对 Astra | Opus 并排放了四张截图让读者自己看,两个 HTML 都能打开。 |
| 歸藏 | CodePilot 宣传片,前几天用 Astra 做过一版 | Opus 他说一键生成,观感比 Astra 那版强。 |
| Feicai | 对 Seedance 2.5 这类视频模型 | 视频模型 风格化短片代码能做;电影瞬间和真人表演,Seedance 仍有代码做不到的地方。 |
| Gorden Sun | Grok 生成原片,Opus 5.5 剪辑 | 不比输赢,给了分工:「没想到杀死剪映的是 LLM」。 |
都是作者自报。横轴是对数刻度的美元;圆点颜色:■ 有明确金额,■ 只报了时间或额度。
All of the Opus 5.5 vector animation slop that people are rapturing over kinda looks the same.
yeah, Opus 5.5 could learn better on the timing
Hesam 的 Manim 片被评「动画好、音乐弱、该配旁白」。王也弱承认 HappyShrimp 还落后于最好的音乐模型。
那是人家的本事,跟你有什么关系?
Veee 15 分钟;火柴人 4.5 小时、$111;DiscusFish 几个小时烧 3 亿 token。都叫一次生成,比的不是同一件事。
Feicai:Seedance 2.5 仍有代码做不到的电影瞬间,风格化短片才是代码的地盘。
擅长的是几何、粒子、UI、卡点和可重复的角色。需要实拍光和演员的片子没有人拿出例子;KANA 的攻城游戏由 Opus 写,60 秒介绍片却交给了 Seedance 和 MiniMax。
采样器、Blender MCP、TTS 文档、字体。kirill 的对照说明模型会自己决定用不用,前提是它看得到。
细节留白给模型;但别指望换个题材再跑一遍还一样好。
虚拟时钟、逐帧确定,才能局部改、重渲、复现。P(Doom) 的底子就是这样被别人复用的。
歸藏一周用同一个 skill 出了四条片。长片按 6–7 秒一块做,每块看完再改。
接触印样找穿帮,导出后量 LUFS、抽帧、跑 Whisper。验的是 mp4,不是故事板。
讲解片接 TTS 或自己配,MV 用现成的歌。模型合成的音乐是被点名最多的弱项。
点任意一格播放原片(全长);标「截图」的没有视频,点开去原帖。
试玩录屏
12:12
2:38
0:50
4:48
1:44
2:37
2:55
0:14
4:00
截图
0:40
0:15
2:59
0:51点任意一格播放原片(全长);标「截图」的没有视频,点开去原帖。
0:30
0:18
1:24
0:32
4:02
1:30
0:32
7:37
3:37
0:28
0:10
3:43
0:42
0:24点任意一格播放原片(全长);标「截图」的没有视频,点开去原帖。
1:00
9:57
0:27
截图
0:15
0:15
0:30
0:25
1:03
0:14
0:15
0:34
2:48
13:39点任意一格播放原片(全长);标「截图」的没有视频,点开去原帖。
0:15
2:10
2:21
3:07
1:13
0:15
0:47
0:26
4:37
0:25
1:32
0:57
7:22
1:58
2:342026-09-27 用 Grok Build(grok-4.7)的 X 搜索做了两轮:英文区 82 条、中文区 44 条。随后逐条用 X 的公开嵌入接口回查,125 条原帖在、作者对得上,1 条已被作者删除(未引用)。浏览和赞是 09-27 的快照。deck 内播放的是原片的转码副本(最高 1080p),仅作评述引用,版权归原作者,请以原帖为准。