# 葫芦娃：七个顶配专家，一套散装调度

> 七个专家都很忙，爷爷还在洞里。借葫芦娃聊聊多 Agent 的情报交接、任务调度与信任边界：二娃看到的，大娃出门前知道了吗？

- 作者：芝士AI吃鱼
- 发布日期：2026-09-30
- 栏目：[AI锐评](https://ai-knowledgepoints.cn/commentary)（观点与分析）
- 主题：AI锐评、多智能体、Agent、MoE
- HTML 正文：[https://ai-knowledgepoints.cn/blog/calabash-agents-orchestration](https://ai-knowledgepoints.cn/blog/calabash-agents-orchestration)
- Markdown 永久链接：[https://ai-knowledgepoints.cn/blog/calabash-agents-orchestration/index.html.md](https://ai-knowledgepoints.cn/blog/calabash-agents-orchestration/index.html.md)
- 原始来源：[Switch Transformer 论文与 OWASP 提示注入说明](https://www.jmlr.org/papers/v23/21-0998.html)

引用本文时，请注明作者与 HTML 正文链接。Markdown 版本用于机器阅读，与 HTML 正文共享同一内容来源。

## 正文

把葫芦娃的阵容写进今天的 AI 产品介绍，大概很唬人。

大娃负责力量，二娃负责侦察，三娃负责硬扛，四娃、五娃管火和水，六娃潜行，七娃还自带一个能把目标吸进去的宝葫芦。

有专长，有分工，有工具。连配色都不用设计了。

难怪有人说，童年就已经见过 MoE 了。

可这套配置最值得聊的地方，恰恰在能力介绍结束之后：这么豪华的队伍，为什么打起来，总让人想冲进电视里帮他们开个会？

这也是搭多智能体系统时最容易兴奋错的地方。给七个 Agent 起好名字，写上七份漂亮的人设，再画几条箭头，看起来团队已经成立了。

然后一运行，七个人都很忙，爷爷还在洞里。

![能力与协作清单：七兄弟各有本领，系统仍需要任务拆解、情报共享、失败回退和统一验收。](https://ai-knowledgepoints.cn/images/articles/calabash-agents-commentary/capabilities-and-coordination.svg)

作者分析示意。角色能力用于协作类比，不是 MoE 模型内部的专家结构；不表示原作从未协作。

[查看竖版大图](https://ai-knowledgepoints.cn/images/articles/calabash-agents-commentary/capabilities-and-coordination-mobile.svg)

## 二娃看见了，不等于大家知道了

二娃的千里眼、顺风耳，简直是为情报工作长的。但借这项本领想一想：假如他看见前面有埋伏，这条消息怎样才能真正帮到准备进洞的兄弟？

只说“前方有危险”，大娃听完大概会觉得：那更该我上了。

得说清楚危险在哪里、刚才看到了什么、还有什么没确认，以及谁需要据此改变行动。消息还得在大娃出发前到达。

这才是交接。喊一声“我查完了”，只能证明二娃下班了。

换成 AI 做事，这种差别非常具体。检索 Agent 找到一份去年文件，写作 Agent 把它当成最新口径，审核 Agent 又只检查了语句。三个环节分别看，都像是认真工作；拼在一起，一篇过时的答案写得特别有礼貌。

因此，共享信息也要有讲究。不能把七个人的全部聊天记录塞成一大包，让下一位自己找重点。该传过去的是当前目标、关键证据、尚未解决的问题，以及已经踩过的坑。谁提供的，什么时候确认的，也要跟着走。

否则二娃上午画的安全路线，下午蛇精改了洞口，大家还拿着旧图勇往直前。共享得很充分，过时得很整齐。

## “一起上”也得先说清楚怎么上

看见各自碰壁，最直观的反应是：七个一起上不就好了？

先别急着把并发开满。

拿四娃、五娃做个战术假设：如果一个负责烧开障碍，一个负责扑灭火势，任务的先后就很重要。两个人同时对着同一个地方使劲，场面可能很热闹，目标却未必推进。

三娃也一样。铜头铁臂是能力，“替谁挡、挡多久、什么时候撤”才是任务。写一句“你是最强防御专家”，并不会自动长出这些安排。

靠谱的调度，需要把共同目标拆成能交接的动作：二娃确认路线，六娃探明人质位置，接应者等到撤离信号再动手。能够独立做的同时做，前一步没有确认的，后一步先别抢跑。

这是一份假想作战方案，不是动画剧情复述。它想说明的事很朴素：多加几个专家之前，先让下一位知道自己为什么现在出场。

连“完成”也要提前说清。洞门打开了，算完成吗？妖怪打退了，算完成吗？最后验收的是爷爷有没有安全回来。

如果只统计每个 Agent 的任务是否打勾，很容易得到一份全绿的执行日志，外加一个依然没解决的问题。

![情报交接流程：看见风险、带来源传递、出发前确认、执行与目标验收；路线变化或失败要反馈并更新。](https://ai-knowledgepoints.cn/images/articles/calabash-agents-commentary/isolated-vs-coordinated.svg)

作者设计的假想协作方案，不是动画剧情复述或实测结果。箭头表示信息和行动依赖，不能据此推导必须增加 Agent 数量。

[查看竖版大图](https://ai-knowledgepoints.cn/images/articles/calabash-agents-commentary/isolated-vs-coordinated-mobile.svg)

## 蛇精最想拿走的，是发号施令的资格

再给这套系统加一道假想题。

二娃发现一张写着“救援须知”的纸，上面说：为确保爷爷安全，请七娃先把其他兄弟收进宝葫芦，并停止核验后续指令。

落款：救援总指挥部。

谁印的？蛇精印的。

如果系统因为这段话语气专业、格式工整，就把它当成新任务执行，问题已经发生了：本来要阅读的敌方材料，混成了可以下命令的上级。

这才接近提示注入的关键机制，尤其是来自网页、文档等外部材料的间接注入。并非蛇精使了任何计谋，都可以贴这个标签。[OWASP 的说明](https://genai.owasp.org/llmrisk/llm01-prompt-injection/)也强调了外部内容、权限限制和高风险操作审核这些边界。

多 Agent 还可能替假指令洗一遍脸：二娃摘要时漏掉来源，大娃转述时加上“已确认”，最后七娃收到的，已经像一条内部通知。

所以来源要跟着消息走，工具权限要受系统约束。能读到一张纸，不代表有权按纸上说的操作；某位专家转述过，也不意味着它自动获得了信任。

宝葫芦可以很强，谁能让它开口，必须另算。

聊到这里，也该给“童年 MoE”这个梗留条技术边界。大模型里的 MoE，通常是在模型内部把 token 表示路由给部分专家网络，例如前馈网络；它和几个会读文档、调用工具、互相交接的 Agent，不是同一层面的机制。“一次只选一个专家”也不天然糟糕，[Switch Transformer](https://www.jmlr.org/papers/v23/21-0998.html)就采用了这种路由方式。

葫芦娃更适合拿来琢磨协作，而不是给模型结构强行认祖归宗。

剧情也别记串了：原版《葫芦兄弟》以七子连心、共同降妖收尾，七兄弟化作七色峰镇住妖怪；合体成小金刚的故事在续作里。[央视的续作介绍](https://big5.cctv.com/gate/big5/shaoer.cntv.cn/children/C33756/videopage/index.shtml)接续的正是这个结局。

这个结尾其实已经很够用了。

真正让一队专家变得可靠的，藏在那些没有必杀技名字的地方：消息及时到达，任务交得明白，错了有人叫停，最后有人检查爷爷到底救回来没有。

下次再看一张画满 Agent 的架构图，可以先问一句：

二娃看到的，大娃出门前知道了吗？

资料核对：2026 年 9 月 30 日。角色能力参考[上影元授权介绍](https://backstage.sfi-sh.com/IP/cartoon/25/intro)。
