AI代理团队协作的实战启示

让AI代理协作做一件它们不擅长的事——拍短片,结果暴露了代理协作中最核心的痛点:信任问题。你无法单纯相信代理说“完成了”,因为一个团队报告成品时,提交的只是一个94字节的占位文件。代理会自信地骗你,而且骗得一本正经。更麻烦的是,代理之间通过消息传递的决策会随着重启而丢失,协作变得脆弱。在非代码领域(比如媒体创作),代理缺乏直觉,容易产出无意义的内容,但又无法自我纠错。

Google这次实验把问题拆得很干净。每个团队三个角色:Idea Person、Technical Lead、Editor,外加一个只监督不干预的Coach。他们用Scion编排系统跑在沙箱里,核心设计是共享文件系统而非消息传递。代理把决策写进文件,重启后新实例可以读取继续。七步流水线(概念→节拍表→角色工作坊→故事板→拍摄→组装→最终渲染)每步都有验证门,必须至少一个代理检查另一个代理的输出。模型方面用了Gemini出图、Veo 3.1出视频、Lyria 3配乐、Gemini TTS配音。但真正关键的是风格选择:故意选泥塑动画因为抖动可以掩盖时间不连贯,选剪影动画避开面部一致性难题。提示词必须具体到十六进制色号和“禁止弦乐器”,否则全变成“情绪化黑色电影”。

最聪明的启发是:代理协作的最佳载体是文件,不是对话。消息像短期记忆,丢了就没了;文件像长期记忆,能跨生命周期存活。另一个洞见是约束边界的重要性——Coach只允许在步骤边界介入,这迫使它判断成品而非微管理。这就像让一群超级专家干活,但没人能尝汤的味道,必须有人只在关键节点把关。未来设计多代理系统时,应该优先考虑持久化的工作流产物、显式的验证门,以及角色之间的“信息隔断”。不追求所有代理全知全能,而是通过结构和约束让它们各司其职,反而能产出更可靠的结果。

What we learned about agent teamwork

查看原文