第十四部 全流程实战:《逆光收购》第一集生产档案
第 74 章 Agentic 审计与项目复盘:把一次试播变成组织能力#
第一集发布后,项目并未以“交片成功”结束。团队用事件、预算、人工决定和质量数据重建整条生产链,判断哪些方法可进入前十集,哪些只是这一次碰巧成功。
74.1 生产追踪、成本偏差与尝试数据#
一条可追溯的生产链。
本次工作流的根追踪 ID 为 trace_ep001_pilot_001。它连接绿灯决定、Episode Pack 锁定、资产版本、166 次模型调用、38 个视频候选、18 个批准镜头、4 个剪辑版本、27 条 QC 问题、权利快照和最终发布记录。
任意成片时间码都能反查:使用哪个 take、由哪个任务生成、输入哪些身份与状态、采用哪个提示版本、谁批准、花费多少、修过什么。不能反查的资产即使画面正确,也不进入规模化模板。
实际成本与最初预算。
| 类别 | 预算 USD | 实际 USD | 偏差原因 |
|---|---|---|---|
| 研究与编剧 | 620 | 690 | 增加一次认知锁复核 |
| 视觉资产 | 980 | 1120 | 身份侧脸多一轮压力测试 |
| 视频生成 | 1240 | 1018 | animatic 提前删除镜头 |
| 声音与音乐 | 510 | 548 | 增加手机外放混音修订 |
| 剪辑与图形 | 520 | 566 | 合同 OCR 修复 |
| QC 与交付 | 330 | 358 | 增加权利快照整理 |
| 合计 | 4200 | 4300 | 超 2.4%,由管理储备覆盖 |
只看模型调用,项目似乎很便宜;加入研究、审批、返工、权利与交付后才是真实成本。视频生成低于预算不是因为模型更稳定,而是前期 animatic 删除了无效镜头。
Attempt 数据告诉了什么。
38 个视频候选中,18 个进入成片,7 个因身份失败淘汰,5 个因动作状态失败,3 个因空间漂移,2 个因表演意图错误,3 个可作为备用。高风险文件交接尝试 4 次;简单插入镜平均 1.3 次;带口型近景平均 2.8 次。
因此前十集预算模型不再用“每镜统一两次”,而是按镜头类型配置先验尝试数。动作失败集中在同时要求转头、说话和递物的镜头,规则库新增:关键交接默认不与长对白共镜。
74.2 人工决策、反馈速度与扩产闸门#
人工推翻自动建议的地方。
自动评估更偏好林夏入场候选 B,因为脸部相似度高 0.03;视觉总监选择 A,因为 A 的停步和目光更符合“掌握程序优势”,且身份仍超过门槛。这个决定没有被标记为“人类主观例外”,而是进入评估校准集:门槛以上的身份小差异不应压倒表演目标。
音乐评估器认为全程铺底版本情绪连续,人类选择三段留白版。后续自动评测增加“关键拟音可辨”和“对白下音乐遮蔽”指标,但没有试图自动判断所有音乐审美。
两速反馈回路。
快速回路在下一批立即执行:修正镜头 Packet 的手部字段;增加合同 OCR 自动检查;把手机外放作为混音必测设备;为关键交接提供默认拆镜模板。
慢速回路需要更多集证据:半写实路线是否能稳定承受哭戏;顾舟声线在亲密场景是否过于冷;两音动机是否随重复产生疲劳;首卡应落在第 6 集还是第 8 集。这些不因一集数据就写成永久规则。
前十集 Scale Gate。
scale_gate:
scope: episodes_002_010
decision: approve_batch_2_with_limits
evidence:
narrative_clarity_test: pass
identity_closeup_pass_rate: 0.91
approved_seconds_per_workday: 19.4
traceability: 1.0
rights_blockers: 0
limits:
max_parallel_episodes: 3
max_unapproved_video_spend_usd: 900
freeze_character_identity_version: lin_v03
required_experiments:
- rain_exterior_identity_test
- three_character_argument_previs
- long_narration_audio_test
团队没有一次性批准整季。前三集并行能暴露跨集状态和资产瓶颈,同时把返工半径控制在可承受范围。
74.3 系统改动、事故复盘与复用边界#
工作流系统的改动。
试播暴露三个系统缺陷。第一,资产批准后没有自动使旧上下文失效,导致一次任务引用了已退役服装图;新增依赖失效事件。第二,预算服务只记录调用成本,没有记录人工修复时间;新增 labor_minutes。第三,审批界面只显示候选,不显示状态终点;新增前后帧与 State Diff。
每项系统改动都有负责人、测试、上线批次和回滚方案。复盘不能只写“加强沟通”,那不是可验证改进。
事故复盘:错误 take 为什么差点发布。
文件持有者错误源于剪辑代理按画面评分选中 take_015_02,而它的资产元数据标记 action_state: fail。选择器只过滤 review_status,没有过滤验收维度。人工 QC 拦住了错误,但系统门禁存在缺口。
修复包括:批准状态改为按维度记录;剪辑候选查询强制 identity=pass AND action=pass AND continuity=pass;用该错误候选加入回归测试;历史项目扫描同类问题。责任不归咎于最后操作的人,而是修复让错误可穿透的接口。
可复用与不可复用。
可复用的是 Episode Pack 结构、身份压力测试、机位区、Attempt Log、五层 QC、权利快照和发布 Runbook。可以参数化复用的是会议室空间、林夏身份、服装基础层和音乐主题。不能机械复用的是第一集节拍速度、顾舟尾句长度、文件交接次数和本集配乐留白位置。
模板的价值是保存约束与检查,不是复制表面节奏。若每集都用“递文件、抬眼、切黑”,系统会稳定生产疲劳。
74.4 复盘会议、全程检查与最终交付#
一次完整复盘会议。
会议先看绿灯假设与证据,再看预算偏差和质量逃逸,之后讨论被推翻的自动建议,最后决定进入规则库、实验池或废弃列表。发言顺序从事实到解释,避免最高职位先定性。
每条结论必须属于以下之一:立即流程修改;需要更多证据的实验;只适用于本集的决定;已证伪并停止;尚无结论。会议结束时,所有修改都进入任务系统,而不是只留在幻灯片。
全流程复演检查表。
- 商业模式与受众假设有证据和停止条件。
- Episode Contract 定义本集兑现和新债务。
- 事实、角色认知和观众认知分别锁定。
- 人物、场景、服装、道具通过压力测试。
- 每镜有职责、状态接口、风险和回退路线。
- 生成尝试只改变受控变量并记录成本。
- 声线、音乐主题和声音空间跨镜头连续。
- 剪辑、字幕、图形与调色均有事实来源。
- QC 问题回到最早错误层,修复后按影响回归。
- 发布包含权利、技术、审批与校验和证据。
- 成片任意镜头可追溯到任务和输入版本。
- 复盘结论进入规则、实验或停止清单。
最终交付物。
本次实战最终形成:完整 E001 Episode Pack;锁定资产库;镜头与声音工程文件;五层 QC 和权利快照;平台发布包;成本账本;事件日志;人工决定日志;评估校准样本;前十集 Scale Gate;系统改进任务。
读者复演时,不必复制《逆光收购》的题材,但必须能交付同样完整的证据链。真正的 AI 商业短剧能力,不是偶然得到一条好片,而是知道它为何成立、怎样复现、哪里会失败,以及失败后如何回到正确工位。