从一句灵感到一集 16 分钟的佛经电视剧 —— AI 电影导演的技能、工具链,与 E01 恒伽达尊者 的真实复盘。
E01《恒伽达尊者》—— 一集完整上线的佛经故事电视剧。一个人,借由一套 AI 工具链,扮演了整支剧组。
一部电视剧需要一整支剧组:制片、编剧、导演、摄影、美术、声音、后期。 AI 把每个工种都变成了「一句话 + 一个模型」——但谁来当那个统筹全局、对一致性和成本负责的人?
不是九个软件的快捷键,
是九个工种的判断力 —— 和把它们焊在一起的工程能力。
项目里这 9 顶帽子都落成了一份「角色说明书」(skill)——同一个人 + Claude,按阶段切换身份,各自有职责边界、交接物和验收标准 (DoD)。
如果只学三件事,是这三件 —— 它们决定你能不能从「做出一个镜头」走到「做完一整部剧」。
十个阶段,每个阶段都有专用模型与 CLI;
底下一条统一的工程总线把它们串成可追溯的流水线。
文本进 git、媒体落盘(按扩展名屏蔽);每一步产物可断点续跑、可回溯、可重建。
不是缩写,是戏剧化。八件交付物按顺序产出,先打地基再写剧本——杜绝「原典理解错乱」。工具:Claude 长链推理 + 大正藏溯源。
每个角色锁定「视觉身份」:base 定妆 + 表情库 + 服装变体 + face-lock 脸部锚 + 配色身份。一旦 publish,跨集不私改。




每个场景生成多视角概念图(定场 / 平视 / 仰拍)入库;跨镜的空间站位,用「白底线稿简笔画」当构图锚,既便宜又能过审。





从完整剧本拆成 100+ 镜。先写「场级 sheet」锁定全场共享的机位轴线/光线/位置,再逐镜定景别、运镜、戏核、声音 cue、转场。
不合成整张首帧喂模型,而是用多张参考图(脸锚 + 全身 + 场景 + 道具)做 multimodal2video,让模型自己调度更稳。每镜 1–3 take,选片定版。
| 通道 | 工具 | 用途 / 现状 |
|---|---|---|
| 即梦国际版 | video-dreamina-intl -seedance | CDP 半自动主力(E01 调用 114 次);无人脸镜全自动,人脸镜走多参考图过审闸 |
| 即梦 CN | video-dreamina | 备选稳定通道;对非名人脸更宽松 |
| libtv | libtv | 历史通道,额度用尽不新生 |
从白纸搭完整声音工程。配音音色跨集锁定,绝不换;Seedance 自带音轨按 A/B/C 三档显式处置。
这是把「玩具」变成「流水线」的关键。所有生成走同一个 wrapper,所有事实写 append-only 账本,所有资产引用当前发布版。
没有「一个模型搞定一切」。导演的工作之一,就是知道每个活儿该派哪个模型,以及它的脾气。
| 环节 | 工具 / 模型 | 说明 |
|---|---|---|
| 生图(默认) | img-openai | gpt-image-2 · ¥0.3/张 · 2k 16:9 |
| 图生图 i2i | img-dreamina-i2i | 即梦 · 确定性约束生图 |
| 生图保真兜底 | img-vertex | Nano Banana · 拒图/高保真 |
| 视频(主力) | video-dreamina-intl | Seedance 2.0 · ~¥0.7/秒 |
| 视频(备选) | video-dreamina | 即梦 CN _vip |
| 环节 | 工具 / 模型 | 说明 |
|---|---|---|
| 配音(主力) | tts-fish | 克隆 · 跨集锁定音色 |
| 配音(情绪备选) | tts-doubao | Seed-TTS 2.0 · 指令式情绪 |
| 配乐 | suno / music-vertex | 整曲挑窗 / Lyria 拼接 |
| 音效 | tts-eleven | ElevenLabs Sound FX · ¥0.05/条 |
| 3D 场景 | world-marble | 单图 → 高斯泼溅世界 |
| 剪辑 / 派发 | 剪映 · Resolve · ffmpeg | 装配 / 调色 / 多版本 |
| 上线 | bili-upload | B站投稿 → BV 号 |
前面讲的所有阶段,都汇进一个本地软件 ——
一个人指挥整支「模型剧组」的驾驶舱。
纯 Python 标准库后端 + vanilla JS 前端,零构建。不另存数据,直读流水线的五本账,把 122 个镜头的状态、成本、一致性实时聚合成 13 个视图。

按场景分层,每镜一张 16:9 卡片:缺 prompt / 仅 prompt / 有首帧 / 有 take 未选 / 已选片,五态色标。鼠标悬停,5 帧 strip 自动扫播预览。

每个角色:base 定妆 + 表情 + 服装矩阵 + 配色身份 + 出镜镜次追踪。按主角 / 反派 / 跨集 / 配角 / 群像分类,相貌漂移随时核查。



MX 配乐母带 + 逐镜 DX/旁白 + 音效,每个 shot 的音轨汇总成一处,点开即播。

¥1672.98 的真实拆解(账本实时聚合)。剧本推理、生图、配音、配乐——加起来不到一成。这把「AI 电影该把工程精力投在哪」说得很清楚。



点开任一镜头:参考图 → 首帧 → 多个 take → 选片 → 配音试听 → prompt 全文。
恒伽达尊者这一集,每一镜怎么来的,现场翻给你看。
BODHI 佛经故事电视剧 · E01 恒伽达尊者 制作分享
B站 BV1AKjA69E7p · 全 AI 制作 · 零真人配音