上篇说我那套多Agent是假的:一个模型,精分三个角色。这篇说怎么修,以及修的时候又翻了一次车。
先修第一层:让每个角色能绑自己的模型。代码加了模型槽,角色执行带各自的模型,任一步失败,汇总就显式 failure,那行「模拟(研究员):已处理」删掉。
修完我挺满意:注册了两个模型槽,回归 502 个用例全过。
9月5号复查,盯着角色映射表看了半天,人又麻了:研究员绑一号模型,分析师绑二号模型,撰稿人呢?还绑在一号上。三个角色,两个槽,第三个角色还在精分。我以为修好了,其实只修好了两个角色。
补上第三个模型槽,撰稿人归位。然后做真验证:三个不同模型真实 API 联跑,51.6 秒出完整协作稿——分析师真在消费研究员的结果,质检员还挑出成稿的毛病。再注入一次故障:模型一挂,整条链立刻 failure。
修多Agent,别信演示,查三处:一数模型槽,角色几个、模型几个;二看执行循环,传的是自己的模型还是共用的回调;三注入故障跑一遍,挂了还报 success 就是假的。 #AI测试 #测试开发 #多Agent #软件测试 #howto实现一万种vibecoding #AI测试开发 #AI测试工程师 #大模型 #vibecoding大赏 #AI人工智能


