一条高播放的竞品视频链接进来,一条合规的 AI 成片出去。这页把整条产线画成一张持续运转的总控图:六个工位、三个人工卡口、一条重 roll 回路和一只成本表——盯着看一轮(16 秒),你就知道一条视频在里面经历了什么。模型选型依据见姊妹篇《AI 内容生成四件套》。
douyin-deconstruct
0 元 · ≈8 min
LLM 重写钩子/语序
防查重
即梦 Seedream
对比图组 ¥10-30
可灵 3.0 无声档
¥36-90
豆包 TTS 授权音色
≤¥2
ffmpeg 合成+AI 标识
≈0 元
← 左右滑动查看整条产线 →
高互动竞品链接 → douyin-deconstruct skill(取片 → TransNetV2 切镜头 → OCR+语音双轨互校 → 七要素分镜稿)→ 分镜稿 + 解说词 + pipeline_config.json。盲测验收过,别重做。
解说词的钩子、语序、核心词必须由 LLM 重写——平台查重看文本,画面全 AI 也救不了高重复文案。逻辑框架(第几秒切痛点、第几秒给方案)原样保留。
即梦 Seedream 按 config 逐镜出图:选区编辑改局部、不动全局(同一个厨房只改高低台)。竞品帧截图只作参考底图,不进成片。量大后降本走自托管 FLUX。
可灵 3.0 首尾帧/图生视频,全部走无声档(解说是画外音,不需要音画同出——省 2/3 的钱)。每镜 2-3 秒微动态,局部镜头比全景稳一个数量级。
豆包声音复刻 2.0 / MiniMax Speech:用自有授权音色库合成带情绪的解说。红线:克隆竞品博主声音是侵权,一次都不行。
Fly worker 上 ffmpeg 完成拼接、3 倍变速、字幕压制、红圈/画叉标注、aigc 元数据写入;发布时走平台「自主声明 AI 生成」。剪辑不依赖剪映,全程可脚本化。
解构稿 + 重写稿过目:选题值不值得做、重写后有没有丢掉原片的钩子逻辑。拦在这里的成本是 0 元,放过去的每一步都开始花钱。
逐镜看对比图组:结构一致性(瓷砖窗户没漂移)、对错关系表达清楚。图不过关,绝不进视频环节。
穿帮镜头挑片、AI 标识核对,按 1/10 抽样跑「反向重建盲测」质检;新账号前 3-5 条全量人审并走平台送审。
| 工位 | 工具 | 费用/条 | 主要耗时 | 失败处理 |
|---|---|---|---|---|
| ① 解构 | douyin-deconstruct skill | 0 元 | ≈8 分钟 | 无字幕视频启用 ASR 备选预案 |
| ② 重写 | LLM | 分钱级 | 分钟级 | 卡口①人工改稿 |
| ③ 生图 | 即梦 Seedream | ¥10-30 | 0.5-1 小时(含验收) | 换 prompt 模板重抽 |
| ④ 生视频 | 可灵 3.0 无声档 | ¥36-90 | 1-2 小时(含挑片) | 重 roll ≤3 → 熔断进人工队列 |
| ⑤ 配音 | 豆包 TTS / MiniMax | ≤¥2 | 分钟级 | 换音色重合成 |
| ⑥ 成片 | ffmpeg on Fly | ≈0 | 分钟级 | 确定性代码,失败即报错重跑 |
解构 skill 出稿 → 网页端手动出图出视频 → ffmpeg 脚本合成。产出 3-5 条样片送审,验证「不判搬运 + AI 标识通过」。审核过不过是 go/no-go,画质不是。
生图/生视频/TTS 切 API,n8n 串六个工位,任务状态落库。人退到三个卡口,prompt 模板与音色库开始沉淀成资产。
加熔断、双指标监控(产线心跳 + 日产出/成本/过审率)、1/10 抽样盲测。「工作流全绿但一周没出片」必须能被看见。