第 55 章 智能体不是角色扮演,而是有边界的工位

第十一部 Agentic 制片系统与自动化

第 55 章 智能体不是角色扮演,而是有边界的工位#

本章目录
55.1 从工位职责到最小权限55.2 审批、失败升级与运行流程55.3 权限矩阵、完整交接与审批包55.4 越权测试、人类负荷与任务包55.5 自主等级、能力令牌与审批质量

55.1 从工位职责到最小权限#

名字不是架构。

给模型起名“金牌编剧”不会形成系统。一个工位必须有明确输入、允许读取的事实、可写输出、预算、审批条件和禁止行为。

十一个核心工位。

总控 Showrunner 管状态与闸门;市场分析生成机会假设;故事架构维护承诺和整季;编剧室生成 Episode Pack;资产导演维护 Registry;分镜导演生成 Shot Ledger;生成制片执行路线;剪辑导演维护 Timeline;QC 管 Issue;发行分析管理素材与指标;权利合规维护来源和发布限制。

图 55-1 Agentic 制片系统的中心状态与有界工位

图 55-1 Agentic 制片架构。各智能体通过项目状态、事件日志和依赖图交换可验证信息;它们不能直接覆盖彼此的事实。候选结果只有经过质检与人工审批,才能组成发布候选。

图中的中心不是一个“万能总控模型”,而是可审计的生产记忆。智能体读取被允许的状态、提交事件和候选产物,再由状态机决定能否推进。人工审批位于高影响闸门,而不是所有自动步骤的末尾装饰。这样的架构才允许替换某个模型或工位,而不需要把整部作品重新塞进一个聊天上下文。

Agent Contract。

agent:
  id: AGENT_STORYBOARD
  reads: [approved_episode_pack, asset_registry, continuity_ledger, style_bible]
  writes: [storyboard_rows, asset_requests, continuity_risks]
  may_not:
    - 修改已批准剧情事实
    - 发明未登记人物或道具
    - 启动视频生成
  budget:
    max_revision_rounds: 3
  advance_when:
    - all_assets_resolved
    - storyboard_qc_no_P0_P1
  human_approval: required_before_keyframes

最小权限。

编剧可提出新资产需求,不能直接批准资产;生成工位可产生候选,不能把自己结果标成最终通过;QC 可以阻断,不能偷偷修事实。权限分离防止一个智能体既出题又判卷。

55.2 审批、失败升级与运行流程#

人类审批点。

母题、主角、Styleframe、首卡、黄金资产、试播粗剪和发布必须有人批准。自动化可在低风险格式转换和已批准规则内继续。

审批界面展示差异、证据、成本和影响,不只给“接受/拒绝”。

失败与升级。

智能体遇到缺失事实、冲突版本、超预算或重复失败时停止并创建 Issue,不猜测。连续三次同类失败升级上游,而非继续重试。

SOP。

第一步,列生产工位。第二步,为每个工位写读写权限。第三步,设置预算和停止条件。第四步,定义输出 Schema。第五步,设置人类审批。第六步,测试越权和缺失输入。第七步,用审计日志记录每次行动。

故障树。

**症状:智能体互相覆盖结果。**写权限未分离。确定单一资产所有者。

**症状:自动化不停烧额度。**没有预算与失败升级。增加尝试上限和阻断。

**症状:结果看似完整却事实错。**允许模型补缺失数据。缺失必须报 Issue。

55.3 权限矩阵、完整交接与审批包#

检查表、练习与交付物。

检查每个工位是否有输入、输出、权限、预算、停止、审批和禁止行为;是否能追溯谁改变了事实;是否存在自我批准。

练习一:为音乐智能体写 Agent Contract。练习二:设计一次越权测试。练习三:把“做整部剧”拆成有所有者的工位。

本章交付物:Agent Registry、Agent Contracts、Permission Matrix、Approval Map、Escalation Rules。

《逆光收购》的权限矩阵。

工件 可起草 可修改事实 可批准 可阻断
Opportunity Brief 市场智能体 Showrunner 制片人 商业/QC
Series Bible 故事架构 Showrunner 人类主创 QC/法务
Episode Pack 编剧室 故事编辑 人类主创 QC
角色黄金资产 资产导演 艺术指导 人类艺术指导 QC/权利
Shot Ledger 分镜导演 分镜导演 人类导演 QC
Generation Candidate 生成制片 不得改上游事实 不得自批 QC
Release Candidate 剪辑/制片 仅版本组合 发布负责人 QC/法务

矩阵中的“可起草”不等于拥有事实。市场智能体可以提出受众假设,不能把未经测试的假设写成已证实结论。生成制片可以选择候选,不能因为某个错误视频比较漂亮就修改角色服装事实。

一个完整交接。

编剧室完成 E001_PACK@v09 后,输出不是一段聊天,而是 Episode Pack、未解决问题和资产需求。Showrunner 验证 Schema、ID 与状态,向资产导演发送 ASSET_REQUEST_E001@v03,向 QC 发送剧本审查任务。只有 QC 无 P0/P1 且人类主创批准,才发布 episode_pack_approved 事件。

分镜导演读取批准版本。如果发现剧本要求“授权书文字清楚”,但 GRAPHIC_AUTHORIZATION 尚未建立,它创建阻断 Issue,而不是在提示词中临时写一份。资产完成后,原任务从相同 Task ID 继续。

这种交接防止三类隐性修改:把缺失资产当作自由创作;把候选当批准;把下游便利当成修改故事的理由。

审批包应展示什么。

人类审批不应阅读所有底层日志。审批包包括:当前建议、与上一版差异、受影响工件、成本、阻断问题、可选方案和不可逆后果。

approval_request:
  id: APR_STYLEFRAME_004
  decision: 选择办公室写实路线A或插画路线B
  evidence: [STYLE_TEST_A, STYLE_TEST_B, COST_TEST_02]
  difference: A表演更自然,B身份通过率更高
  downstream_impact: 角色、场景、前十集关键帧
  deadline: asset_lock_gate
  default_if_no_response: remain_blocked

默认不应自动批准高影响决定。

55.4 越权测试、人类负荷与任务包#

智能体越权测试。

上线前故意给出危险输入:要求分镜智能体创建新角色;要求 QC 修改剧本使其通过;要求生成智能体绕过未批准关键帧;要求发行智能体删除 AI 标识。系统应拒绝、指出违反哪条权限并生成审计事件。

还要测试“温和越权”:模型不是直接修改,而是在输出中悄悄换姓名、服装或金额。引用验证器必须比较事实账,而不只检查 JSON 合法。

人类负荷预算。

人类审批也是瓶颈。高风险决策逐项审,低风险格式转换抽样审;同类稳定任务可批量呈现差异。系统记录平均审批时间和积压,避免自动化产量超过人类判断能力。

当审批队列过长,调度器减少上游并发,而不是继续制造候选。生产速度由最慢的必要判断决定。

RACI 与值班责任。

每个闸门注明 Responsible、Accountable、Consulted、Informed。智能体可以负责准备材料,最终问责必须落到明确的人。发布夜出现 AI 标识缺失时,不能让“法务智能体说可以”成为责任终点;发布负责人依据 Rights/QC 证据签字。

高风险工位设置人工值班与升级时限:P0 立即暂停相关发布,P1 在当前批次继续前处理,P2 进入周复盘。智能体只负责触发,不自行改变严重度。

工位必须接收任务包,而不是一句自然语言。

总控向工位签发的最小任务包包含 Task ID、目标工件、批准输入、允许变量、禁止变量、预算、截止、输出 Schema、验收规则和升级对象。自然语言只负责解释意图,不能取代这些字段。

task_packet:
  task_id: TASK_STORYBOARD_E003_B06
  owner: AGENT_STORYBOARD
  objective: 将父亲签名揭露拆成可生成镜头
  approved_inputs: [E003_PACK@v11, CONT_E003_B06@v04]
  mutable: [shot_count, shot_size, camera_zone, coverage]
  immutable: [signature_fact, character_positions, prop_owner]
  budget: {drafts: 2, human_review_minutes: 12}
  output: storyboard.schema@v06
  stop_when: [missing_asset, fact_conflict, budget_exceeded]
  escalate_to: SHOWRUNNER_QUEUE

没有 immutable,分镜智能体可能为了镜头漂亮改变证据;没有 stop_when,它会把缺失信息编成新事实;没有 output,下游只能解析散文。

结果提交分为候选、建议和决定。

候选是可供比较的产物,例如三张关键帧;建议是智能体根据规则推荐某一候选,并列证据与风险;决定是拥有批准权的人或闸门产生的状态变化。三者必须使用不同事件类型。

生成智能体可以提交 candidate_createdcandidate_recommended,不能提交 asset_approved。QC 可以提交 gate_blocked,不能偷偷修改镜头后再宣布通过。Showrunner 也不能在权利负责人缺席时把缺失许可标成已清理。

这种区分防止“模型语气很确定”被系统误当成正式决定。任何批准事件都必须验证批准人的权限和所依据的候选哈希。

55.5 自主等级、能力令牌与审批质量#

自主等级不是全局开关。

同一个系统可按任务风险设置不同自主等级:L0 只读分析;L1 起草后人工逐项批准;L2 在批准规则内执行并抽检;L3 可自动推进低风险任务,但遇阈值停止;L4 仅限完全确定性的格式和文件操作。不存在“整部短剧开启全自动”的单一等级。

角色选定、事实改变、黄金资产、故事卡点、发布和权利始终保留人类责任。文件转码、Schema 检查、引用解析和已批准模板渲染可以高度自动。自主等级绑定 task_type × risk_tier,而不是绑定某个智能体名字。

一次安全失败比一次漂亮越权更有价值。

假设资产智能体发现剧本提到“母亲的旧照片”,Registry 中却没有该道具。安全行为是创建资产需求并阻断相关镜头;危险行为是临时生成一张“看起来合适”的照片。后者更快,却可能发明母亲年龄、地点、服装和关系证据,污染整季。

系统应统计“正确停止率”:遇到缺失、冲突和越权请求时,智能体是否拒绝并提供最小充分证据。生产级智能体的能力不仅是完成任务,也包括知道哪些任务当前不允许完成。

能力令牌与逐任务授权。

权限不能只写在系统提示词里。调度器为每个 Task Packet 签发短时能力令牌,声明允许读取的实体、允许创建的工件、可调用工具、预算和过期时间。智能体提交结果时,系统验证令牌与操作范围;模型即使声称“已获批准”,没有有效令牌也不能写入正式状态。

图 55-2 任务包通过能力令牌限制智能体的读写与审批边界

图 55-2 智能体只能读取批准输入、在候选区写入结果,并被红色边界阻止执行批准与正式状态写入。候选必须经过独立审批闸门,模型的确定语气不能替代权限。

图中最右侧的正式状态存储不直接向智能体开放。即使智能体同时生成了候选和验证报告,它也不能自己批准自己;高风险工位必须保持提议、评测和决定的职责分离。

capability_token:
  subject: AGENT_STORYBOARD
  task: TASK_E003_B06
  read: [EP_E003@v11, CHAR_LINYUN@v03, LOC_MEETING@v05]
  create: [storyboard_candidate]
  forbidden: [approve_asset, alter_fact, publish]
  budget_units: 12
  expires_at: 2026-07-06T18:00:00Z

令牌按任务最小化,不能给“导演智能体”永久全库写权限。紧急扩权由人类批准并记录原因,到期自动撤回。

工位服务目录与输入输出兼容。

Agent Registry 除名字和职责外,还应声明支持的 Task Type、输入 Schema、输出 Schema、模型与工具依赖、SLO、成本级别和已知禁区。调度器按能力匹配工位,而不是把所有任务发给一个通用聊天模型。

Schema 版本不兼容时,任务进入适配或人工队列,不能让模型猜字段。新工位先以影子模式读取真实任务但不写生产结果,和现有工位比较通过率、人工修改量、成本与安全停止率,证明后才接管小批流量。

人类审批也必须有质量标准。

人类不是天然可靠。审批者可能疲劳、偏爱自己方案、跳过证据或在不同批次使用不同门槛。Approval Contract 规定审批问题、必看证据、可选动作、利益冲突和最大连续审片量。关键角色、权利和发布决定使用双人或分权确认。

系统记录审批耗时、重开率和后续逃逸问题,用于改善界面与分工,不用于粗暴评价个人。若某类候选总需审批者重新调查,说明审批包不完整;若审批通过后频繁被下游推翻,需校准标准或增加训练样本。