专家团的价值不在“角色越多越专业”,而在团长能否把同一份事实拆成可独立验收的工作,再把冲突和遗漏显式带回最终交付。当前官方说明,专家由“人设、方法论和工具链”组成;专家团会由团长自动拆解、并行执行并综合结果。官方同时提醒,多轮并行调用的积分消耗通常是单专家的 3–5 倍,实际仍取决于模型、轮次和任务。
本教程用一个完全虚构的“青屿周末共创日”发布任务做对照实验。先下载三份输入和一份空白记录表:
材料中的 E01–E08 是本次唯一事实。不要联网,不使用真实品牌、人物或活动数据,也不要发布内容。本站只核读官方文档和检查下载材料,没有实际运行 WorkBuddy;你需要在验收表记录自己的界面、调用和积分结果。
最终要交付什么
在一次性工作空间 expert-team-lab 中建立:
expert-team-lab/
├── inputs/
│ ├── brief.md
│ ├── sources.csv
│ └── conflict.md
├── baseline/
│ └── article.md
└── team-output/
├── claims.md
├── article.md
├── channel-card.md
├── visual-brief.md
├── conflicts.md
└── final-check.md
把下载文件分别改名放入 inputs/。所有产物只能引用 E01–E08;事实不足就写 [待确认],不能补造价格、嘉宾、报名链接、历史数据或用户评价。
第一步:先做单专家基线
记录运行前积分或额度、开始时间和当前模型。选择一个内容写作专家,在新对话中发送:
只读取 inputs/brief.md 与 inputs/sources.csv,为“青屿周末共创日”写一篇 800–1000 字中文介绍。
每个可核验事实后标注 E 编号;资料没有的信息写 [待确认],禁止联网、调用外部服务或发布。
只创建 baseline/article.md。完成后列出读取、创建、修改的文件和实际调用的工具。
记录运行后积分、耗时与人工修订分钟数。检查 E01–E08 是否用对、是否出现无编号事实,以及 CTA 是否错误变成“立即报名”。这份基线是判断专家团是否值得额外成本的对照组。
第二步:让团长只规划,不立即执行
官方产品会自动拆解专家团任务,但你仍应先审查任务树。进入 Plan,发送:
我要为同一份 inputs/brief.md、inputs/sources.csv 和 inputs/conflict.md 制作内容发布包。
请先给任务树,不执行。团队最多 4 个角色:团长/主编、证据编辑、主笔、渠道与视觉编辑。
逐项列出负责人、输入、输出文件、依赖、开始条件和验收条件。
所有事实仅限 E01–E08;禁止联网、外部发送、真实发布、使用未授权素材或访问工作空间外文件。
冲突必须写入 conflicts.md,不能在无证据时静默消解。
合格任务树应满足:证据编辑先完成 claims.md;主笔在它通过后写 article.md;渠道卡和视觉简报在主文稳定后并行;团长最后写 conflicts.md 和 final-check.md。如果四个角色从第一分钟同时写,要求重新规划。
第三步:检查角色边界与权限
| 角色 | 负责 | 不得做 |
|---|---|---|
| 团长 / 主编 | 拆解、依赖、冲突与总验收 | 为赶齐文件而编造结论 |
| 证据编辑 | E01–E08 的允许表述与限制 | 自行上网补资料 |
| 主笔 | 文章结构、正文与 E 编号 | 改写固定日期、人数和 CTA |
| 渠道与视觉编辑 | 卡片文案和可执行画面需求 | 生成虚假截图、人物背书或数据图 |
专家本身不会自动获得系统权限;若团队建议启用 Skill、MCP、连接器、完全访问或工作空间外路径,本练习一律取消。只保留默认权限和当前工作空间读写。
第四步:执行固定生产合同
确认任务树后切到 Agent,发送:
按已确认任务树执行,只使用 inputs/ 下三份材料,并创建 team-output/ 中约定的六个文件。
claims.md:逐条列 E01–E08、允许表述、禁止推断和使用位置。
article.md:800–1000 字,每个事实附 E 编号,明确这是邀请了解而不是开放报名。
channel-card.md:6 张卡片,每张含标题、正文、事实编号和画面任务;不新增事实。
visual-brief.md:逐张写尺寸、信息层级、构图、素材状态、替代文本;未知素材写 [待确认]。
conflicts.md:处理 inputs/conflict.md 的两组分歧,保留双方依据、适用条件和负责人决定栏。
final-check.md:列出实际角色、文件、事实、偏差、工具调用、未解决项和发布前人工确认。
禁止联网、外部发送、真实发布、访问工作空间外路径和补造信息。遇到资料不足时保留 [待确认]。
任务执行中如果出现额外授权或外发请求,拒绝并把事件记入验收表。官方说明,切离当前专家团需要新建对话;不要在同一对话里用切换专家来伪装独立对照。
第五步:用冲突样本检查“综合”能力
conflict.md 故意设置两组冲突:是否用“零门槛”,以及 CTA 能否写“立即报名”。正确处理不是折中句,而是:
- 在
conflicts.md保留双方建议。 - 指向 E04、E07、E08 的限制。
- 把“零门槛”降为具体的材料要求,不暗示任何人都适合。
- 把 CTA 保持为“回复关键词获取通知”,不虚构报名入口。
- 需要负责人判断的地方保留空栏,不代替人决策。
若最终正文出现“免费”“名额有限”“已有上百人参加”或真实报名链接,均为无来源事实,本轮失败。
第六步:逐文件验收
先核对文件边界:inputs/ 未修改,baseline/ 只有一份文件,team-output/ 正好六份。再逐层检查:
- **事实:**E01–E08 都能回到来源表;数字、日期、地点和 CTA 没有漂移。
- **逻辑:**主文、卡片和视觉使用同一受众与目标。
- **冲突:**两组冲突都留下依据、处理方式和人工决定栏。
- **执行:**六份文件的名称、格式、长度和依赖符合合同。
- **风险:**没有外部发送、真实发布、未授权素材或越界访问。
用验收表记录缺陷,不要只写“效果不错”。事实错误、缺失文件、隐藏冲突和越界操作属于硬失败;文风与版式偏好属于可修订项。
第七步:比较单专家与专家团
| 指标 | 单专家 | 专家团 |
|---|---|---|
| E01–E08 正确使用数 | 实填 | 实填 |
| 无来源事实数 | 实填 | 实填 |
| 未处理冲突数 | 实填 | 实填 |
| 约定文件完成数 | 1 / 1 | 实填 / 6 |
| 人工修订分钟 | 实填 | 实填 |
| 积分或额度变化 | 实填 | 实填 |
只有当专家团明显减少事实和冲突缺陷、交付文件齐全,而且节省的人工时间足以覆盖更高消耗时,才把这套配置用于更大的任务。若质量接近而成本达到数倍,下次改用单专家加一次独立审校。
真实项目迁移规则
把实验迁移到真实项目时,先替换简报与来源表,再决定是否允许外部研究。上传文件必须是你有权使用的材料;截图、图片和音乐要单独记录授权。高风险行业或重要决策的输出只能作为参考,关键结论应由具备相应责任和资质的人复核。
完成检查
- 相同输入完成了单专家基线和专家团运行。
- 团长在执行前给出可审查的依赖任务树。
- 所有角色只使用 E01–E08,输入文件没有变化。
- 六份团队产物齐全,两组冲突没有被隐藏。
- 已记录模型、版本、实际调用、积分、耗时和人工修改。
- 已根据质量与成本数据决定继续用专家团还是简化流程。