Agent · AI 工程 · 产线图解 · 2026-07

解构复刻产线

一条高播放的竞品视频链接进来,一条合规的 AI 成片出去。这页把整条产线画成一张持续运转的总控图:六个工位、三个人工卡口、一条重 roll 回路和一只成本表——盯着看一轮(16 秒),你就知道一条视频在里面经历了什么。模型选型依据见姊妹篇《AI 内容生成四件套》

形态 家装避坑科普 · 局部镜头 + 前后对比 单条成本 ¥50-120(1 分钟成片) 数据 2026-07-13 · 定价 30 天后须重核

← 左右滑动查看整条产线 →

黄圈 = 人工卡口(盖章放行) 红色虚线 = 重 roll 回路与熔断 芯片 = 一条正在生产的视频
SEC 01
六个工位:每一站进什么、出什么、花多少
上半段(①②)已定案并包成团队 skill,直接复用;下半段(③-⑥)是本次产线新增的生成侧。

① 解构 · 竞品变文字稿

人挑选题 + 机器解构

高互动竞品链接 → douyin-deconstruct skill(取片 → TransNetV2 切镜头 → OCR+语音双轨互校 → 七要素分镜稿)→ 分镜稿 + 解说词 + pipeline_config.json。盲测验收过,别重做。

费用 0 元耗时 ≈8 分钟/条详见 解构调研

② 重写 · 逻辑保留话术重生

自动

解说词的钩子、语序、核心词必须由 LLM 重写——平台查重看文本,画面全 AI 也救不了高重复文案。逻辑框架(第几秒切痛点、第几秒给方案)原样保留。

费用 分钱级耗时 分钟级

③ 生图 · 出「翻车 vs 正确」对比图

人验帧

即梦 Seedream 按 config 逐镜出图:选区编辑改局部、不动全局(同一个厨房只改高低台)。竞品帧截图只作参考底图,不进成片。量大后降本走自托管 FLUX。

费用 ¥10-30约 24 张定稿 · 含抽卡

④ 生视频 · 让对比图动 3 秒

自动 + 人挑片

可灵 3.0 首尾帧/图生视频,全部走无声档(解说是画外音,不需要音画同出——省 2/3 的钱)。每镜 2-3 秒微动态,局部镜头比全景稳一个数量级。

费用 ¥36-90≈12 镜 × 5s × 2-3 倍重 roll

⑤ 配音 · 授权音色念稿

自动

豆包声音复刻 2.0 / MiniMax Speech:用自有授权音色库合成带情绪的解说。红线:克隆竞品博主声音是侵权,一次都不行。

费用 ≤¥2音色年费 ≈¥150/个

⑥ 成片发布 · 确定性代码收尾

人抽检

Fly worker 上 ffmpeg 完成拼接、3 倍变速、字幕压制、红圈/画叉标注、aigc 元数据写入;发布时走平台「自主声明 AI 生成」。剪辑不依赖剪映,全程可脚本化。

费用 ≈0耗时 分钟级
为什么先生图再生视频 · 图是分钱级、视频是块钱级。所有「长什么样」的决策(构图、对错对比、风格)都在便宜的图片环节定死,人验过帧才放行进付费的视频环节——先审图,再花钱,这是整条产线的成本护栏。
SEC 02
三个卡口一条回路:人只做判断,不做搬运
机器跑全程,人守三个「盖章点」。判断之外的一切体力活都不该出现人。
GATE ①

选题 / 脚本准入

解构稿 + 重写稿过目:选题值不值得做、重写后有没有丢掉原片的钩子逻辑。拦在这里的成本是 0 元,放过去的每一步都开始花钱。

GATE ②

关键帧验收

逐镜看对比图组:结构一致性(瓷砖窗户没漂移)、对错关系表达清楚。图不过关,绝不进视频环节。

GATE ③

成片抽检 + 送审

穿帮镜头挑片、AI 标识核对,按 1/10 抽样跑「反向重建盲测」质检;新账号前 3-5 条全量人审并走平台送审。

重 roll 回路与熔断 · 生视频每镜最多重 roll 3 次,单条成本触到 ¥150 上限即熔断——任务转入人工修复队列,而不是静默烧钱。难做的镜头由人改方案(换角度、拆成静态对比 + 红圈标注),不是让机器死磕。
SEC 03
一条 1 分钟成片的钱花在哪
按 12 镜、每镜 5 秒原片、2-3 倍重 roll、可灵无声档估算;取区间中值画图。
¥50-120/ 条 · 1 分钟成片 · 全算力成本
生图(含抽卡)¥10-30 生视频(含重 roll)¥36-90 解构 + 配音 + 合成 ≤¥2
条形按中值比例绘制(¥20 / ¥63 / ¥2)。生视频占七成以上——这就是「无声档 + 先审图 + 重 roll 熔断」三个机制都压在这一段的原因。别做 3 分钟长片:拆成 3 条 1 分钟单点成片,单条成本 ÷3、更新频率 ×3。

每工位速查

工位工具费用/条主要耗时失败处理
① 解构douyin-deconstruct skill0 元≈8 分钟无字幕视频启用 ASR 备选预案
② 重写LLM分钱级分钟级卡口①人工改稿
③ 生图即梦 Seedream¥10-300.5-1 小时(含验收)换 prompt 模板重抽
④ 生视频可灵 3.0 无声档¥36-901-2 小时(含挑片)重 roll ≤3 → 熔断进人工队列
⑤ 配音豆包 TTS / MiniMax≤¥2分钟级换音色重合成
⑥ 成片ffmpeg on Fly≈0分钟级确定性代码,失败即报错重跑
SEC 04
M1 → M3:先证明能活,再让它自己跑
「全自动化」是终点不是起点——第一批样片过审之前,自动化没有意义。
M1 · 半自动样片

证明合规能过

解构 skill 出稿 → 网页端手动出图出视频 → ffmpeg 脚本合成。产出 3-5 条样片送审,验证「不判搬运 + AI 标识通过」。审核过不过是 go/no-go,画质不是。

M2 · API 串联

机器接管流水

生图/生视频/TTS 切 API,n8n 串六个工位,任务状态落库。人退到三个卡口,prompt 模板与音色库开始沉淀成资产。

M3 · 稳态运行

日产 5-10 条

加熔断、双指标监控(产线心跳 + 日产出/成本/过审率)、1/10 抽样盲测。「工作流全绿但一周没出片」必须能被看见。

四条红线(比画质优先验证)

  • 文案查重:解说词逻辑可保留,钩子/语序/核心词必须重写——高重复文本会被判低质搬运限流
  • 竞品素材不入成片:帧截图只做生图参考,任何竞品原始画面与音频不得出现在输出里
  • AIGC 主动声明:发布走「自主声明」+ aigc 元数据;被动检测打「疑似 AI」标的伤害远大于主动声明
  • 音色与肖像:只用自有授权音色;若投千川,科普形式不做「虚构人设推荐证明」
模型负责生成,机制负责稳定——卡口、回路和熔断才是这条产线能一直跑下去的原因。