第 74 章 Agentic 审计与项目复盘:把一次试播变成组织能力

第十四部 全流程实战:《逆光收购》第一集生产档案

第 74 章 Agentic 审计与项目复盘:把一次试播变成组织能力#

本章目录
74.1 生产追踪、成本偏差与尝试数据74.2 人工决策、反馈速度与扩产闸门74.3 系统改动、事故复盘与复用边界74.4 复盘会议、全程检查与最终交付

第一集发布后,项目并未以“交片成功”结束。团队用事件、预算、人工决定和质量数据重建整条生产链,判断哪些方法可进入前十集,哪些只是这一次碰巧成功。

74.1 生产追踪、成本偏差与尝试数据#

一条可追溯的生产链。

本次工作流的根追踪 ID 为 trace_ep001_pilot_001。它连接绿灯决定、Episode Pack 锁定、资产版本、166 次模型调用、38 个视频候选、18 个批准镜头、4 个剪辑版本、27 条 QC 问题、权利快照和最终发布记录。

任意成片时间码都能反查:使用哪个 take、由哪个任务生成、输入哪些身份与状态、采用哪个提示版本、谁批准、花费多少、修过什么。不能反查的资产即使画面正确,也不进入规模化模板。

实际成本与最初预算。

类别 预算 USD 实际 USD 偏差原因
研究与编剧 620 690 增加一次认知锁复核
视觉资产 980 1120 身份侧脸多一轮压力测试
视频生成 1240 1018 animatic 提前删除镜头
声音与音乐 510 548 增加手机外放混音修订
剪辑与图形 520 566 合同 OCR 修复
QC 与交付 330 358 增加权利快照整理
合计 4200 4300 超 2.4%,由管理储备覆盖

只看模型调用,项目似乎很便宜;加入研究、审批、返工、权利与交付后才是真实成本。视频生成低于预算不是因为模型更稳定,而是前期 animatic 删除了无效镜头。

Attempt 数据告诉了什么。

38 个视频候选中,18 个进入成片,7 个因身份失败淘汰,5 个因动作状态失败,3 个因空间漂移,2 个因表演意图错误,3 个可作为备用。高风险文件交接尝试 4 次;简单插入镜平均 1.3 次;带口型近景平均 2.8 次。

因此前十集预算模型不再用“每镜统一两次”,而是按镜头类型配置先验尝试数。动作失败集中在同时要求转头、说话和递物的镜头,规则库新增:关键交接默认不与长对白共镜。

74.2 人工决策、反馈速度与扩产闸门#

人工推翻自动建议的地方。

自动评估更偏好林夏入场候选 B,因为脸部相似度高 0.03;视觉总监选择 A,因为 A 的停步和目光更符合“掌握程序优势”,且身份仍超过门槛。这个决定没有被标记为“人类主观例外”,而是进入评估校准集:门槛以上的身份小差异不应压倒表演目标。

音乐评估器认为全程铺底版本情绪连续,人类选择三段留白版。后续自动评测增加“关键拟音可辨”和“对白下音乐遮蔽”指标,但没有试图自动判断所有音乐审美。

两速反馈回路。

快速回路在下一批立即执行:修正镜头 Packet 的手部字段;增加合同 OCR 自动检查;把手机外放作为混音必测设备;为关键交接提供默认拆镜模板。

慢速回路需要更多集证据:半写实路线是否能稳定承受哭戏;顾舟声线在亲密场景是否过于冷;两音动机是否随重复产生疲劳;首卡应落在第 6 集还是第 8 集。这些不因一集数据就写成永久规则。

前十集 Scale Gate。

scale_gate:
  scope: episodes_002_010
  decision: approve_batch_2_with_limits
  evidence:
    narrative_clarity_test: pass
    identity_closeup_pass_rate: 0.91
    approved_seconds_per_workday: 19.4
    traceability: 1.0
    rights_blockers: 0
  limits:
    max_parallel_episodes: 3
    max_unapproved_video_spend_usd: 900
    freeze_character_identity_version: lin_v03
  required_experiments:
    - rain_exterior_identity_test
    - three_character_argument_previs
    - long_narration_audio_test

团队没有一次性批准整季。前三集并行能暴露跨集状态和资产瓶颈,同时把返工半径控制在可承受范围。

74.3 系统改动、事故复盘与复用边界#

工作流系统的改动。

试播暴露三个系统缺陷。第一,资产批准后没有自动使旧上下文失效,导致一次任务引用了已退役服装图;新增依赖失效事件。第二,预算服务只记录调用成本,没有记录人工修复时间;新增 labor_minutes。第三,审批界面只显示候选,不显示状态终点;新增前后帧与 State Diff。

每项系统改动都有负责人、测试、上线批次和回滚方案。复盘不能只写“加强沟通”,那不是可验证改进。

事故复盘:错误 take 为什么差点发布。

文件持有者错误源于剪辑代理按画面评分选中 take_015_02,而它的资产元数据标记 action_state: fail。选择器只过滤 review_status,没有过滤验收维度。人工 QC 拦住了错误,但系统门禁存在缺口。

修复包括:批准状态改为按维度记录;剪辑候选查询强制 identity=pass AND action=pass AND continuity=pass;用该错误候选加入回归测试;历史项目扫描同类问题。责任不归咎于最后操作的人,而是修复让错误可穿透的接口。

可复用与不可复用。

可复用的是 Episode Pack 结构、身份压力测试、机位区、Attempt Log、五层 QC、权利快照和发布 Runbook。可以参数化复用的是会议室空间、林夏身份、服装基础层和音乐主题。不能机械复用的是第一集节拍速度、顾舟尾句长度、文件交接次数和本集配乐留白位置。

模板的价值是保存约束与检查,不是复制表面节奏。若每集都用“递文件、抬眼、切黑”,系统会稳定生产疲劳。

74.4 复盘会议、全程检查与最终交付#

一次完整复盘会议。

会议先看绿灯假设与证据,再看预算偏差和质量逃逸,之后讨论被推翻的自动建议,最后决定进入规则库、实验池或废弃列表。发言顺序从事实到解释,避免最高职位先定性。

每条结论必须属于以下之一:立即流程修改;需要更多证据的实验;只适用于本集的决定;已证伪并停止;尚无结论。会议结束时,所有修改都进入任务系统,而不是只留在幻灯片。

全流程复演检查表。

  • 商业模式与受众假设有证据和停止条件。
  • Episode Contract 定义本集兑现和新债务。
  • 事实、角色认知和观众认知分别锁定。
  • 人物、场景、服装、道具通过压力测试。
  • 每镜有职责、状态接口、风险和回退路线。
  • 生成尝试只改变受控变量并记录成本。
  • 声线、音乐主题和声音空间跨镜头连续。
  • 剪辑、字幕、图形与调色均有事实来源。
  • QC 问题回到最早错误层,修复后按影响回归。
  • 发布包含权利、技术、审批与校验和证据。
  • 成片任意镜头可追溯到任务和输入版本。
  • 复盘结论进入规则、实验或停止清单。

最终交付物。

本次实战最终形成:完整 E001 Episode Pack;锁定资产库;镜头与声音工程文件;五层 QC 和权利快照;平台发布包;成本账本;事件日志;人工决定日志;评估校准样本;前十集 Scale Gate;系统改进任务。

读者复演时,不必复制《逆光收购》的题材,但必须能交付同样完整的证据链。真正的 AI 商业短剧能力,不是偶然得到一条好片,而是知道它为何成立、怎样复现、哪里会失败,以及失败后如何回到正确工位。