7 镜 / 7 个卫生间
一眼就是 AI 做的
纯生成没给参考图,每镜各画各的。自流平被画成冰淇淋。
视频产线 · 8 月 9 日改动
以前:先判断片子属于哪一类,整条按那一类走到底。
现在:一镜一镜看,这镜需要哪几件工具就取哪几件。
让主播坐在车里讲话——这个场景我们没拍过。
两样能力都有,就是拼不到一起。不是效果差,是排不出流程。
想做新形态,就得从头再开一条产线。三条变四条、五条,每条单独维护。
参数填错这类问题,本地拦不住,要等云端付款窗口报错才现形——而那时候钱已经扣了。
每件工具做成一张卡
过去这些工具的用法、价钱、忌讳散在文档、代码和各人脑子里。现在每张卡写死五件事:
| 零件 | 做什么 | 价钱 |
|---|---|---|
| 配音 | 文字转语音,克隆音色 | 按字 |
| 对口型 | 把嘴型对上配音 | $3.00 / 分钟 |
| 生图 | 文字生图,只用来出母图 | $0.03 / 张 |
| 图生图 | 母图派生,换场景首帧 | $0.03 / 张 |
| 图生视频 | 静态图变动态镜头 | $0.225 / 秒 |
| 动作参考生视频 | 拿原片片段驱动姿态 | $0.225 / 秒 |
| 真人底片裁窗 | 从实拍里裁可用画面 | 免费 |
| 擦字幕 | 去掉源片烧死的字幕 | 免费 |
| 找素材 | 检索自有素材库 | 免费 |
| 封面 | 生成并拼接封面帧 | $0.10 / 次 |
每一镜写一张施工单
不再判断「整条片子属于哪一类」,改成每镜声明五项:有人说话吗 / 场景是真拍、生成还是素材库 / 点哪几件零件 / 认人参考图 / 从原片抠的场景细节。
三条老路线没被推翻——它们变成这张点菜表上的三个预设。老片子照旧走老路。
付钱之前先跑校验
纯本地、不联网、不花钱,六条规则:
五个故意做坏的例子去撞它,五个全部本地拦下,花费 $0。
场景细节从原片自动抠出来
拆解时把每镜场景拆成格子:景别、环境物件清单、光线方向。生成照着填,审片照着核。「贴原片」从此不靠感觉。
同一句话、同一批参考图做 A/B:文字描述指挥动作 vs 直接拿原片片段当动作参考。 后者明显更好——构图自动贴向原片的紧凑胸上景,双手连续手势也被搬了过来。已定为默认做法。
视频产线 · 零件化装配层 · 2026-08-09