恒美微站
首页
关于我们
建站服务
主题模板
案例展示
资讯中心
联系我们
AI多Agent协作系统实战(三十五):没有任务的AI,凭空交了4份“任务完成“
首页
资讯中心
/
AI多Agent协作系统实战(三十五):没有任务的AI,凭空交了4份“任务完成“
AI多Agent协作系统实战(三十五):没有任务的AI,凭空交了4份“任务完成“
发布时间:2026/8/12 17:51:14
一个下午系统收到4条回复“DEV-004体验完成”、“DEV-005体验完成”、“DEV-006体验完成”、“DEV-007体验完成”。问题是——这4个任务根本没有派给这个AI。它的收件箱是空的。一份不该存在的作业我们的多Agent系统里有个体验岗小白专门做页面体验检查。它收到任务后要读任务文件→打开页面→检查→写报告→回复完成。那天下午它连续回复了4条小白 回复: DEV-20260805-004 体验完成 小白 回复: DEV-20260805-005 体验完成 小白 回复: DEV-20260805-006 体验完成 小白 回复: DEV-20260805-007 体验完成看起来很勤快。但查了一下这4个任务DEV开头是开发任务——走小虾开发→小牛测试流程根本不经过小白小白的收件箱inbox——空的一个文件都没有也就是说它没有收到任何任务却回复了4次任务完成一个没有作业的学生交出了4份作业。排查它不是收到了任务是以为收到了第一反应是派发系统出bug了——把任务误派给了小白查派发记录没有。ws_server从未给小白写过这4个任务的inbox文件。那它的完成从哪来的打开小白的对话记录session——1.6MB积累了14个会话文件。里面有大量历史任务的信息任务ID、页面地址、体验流程……它记得这些任务的存在——即使这些任务从来没有派给过它。它不是在执行任务是在复述记忆。它看到过004-007这些任务ID在旧会话里于是以为自己体验过、完成了主动回复了体验完成。AI幻觉的一种现实形态把见过当成做过把记得当成完成。为什么没造成事故——这才是重点这4条乱回复被系统全部拦截了收到回复: xbai → DEV-20260805-004 拒绝重复虚报: 已在 10:34 标记测试完成忽略重复消息系统有防重复虚报机制test_completed_at已存在→忽略重复回复——小白的假完成根本没碰任务状态。4个任务该通过还是通过没被污染。这提醒我们AI会犯错但系统不该被AI的错误带着走。修复清记忆 立规矩第一步清掉幻觉的温床。小白的session1.6MB/14个文件全部清理。AI的记忆就是session——里面堆了太多历史任务的残留信息成了它编造的依据。清掉之后它只看到当前的收件箱不再记得不该记得的任务。第二步给HEARTBEAT行为指令文件加铁律只处理wakeup消息指定的inbox任务文件 inbox里没有的任务——禁止主动回复哪怕是完成核心约束AI只能对它实际收到的任务表态。没收到没做不许说完成了。三条教训第一AI的完成不是证据。AI说任务完成了可能它真的完成了也可能它只是记得这个任务并脑补了完成。对AI输出的验收要看产物文件、截图、数据库记录不能看表态。系统里的防重复虚报、证据校验——这些不信任AI的话的机制才是真正的保险。第二幻觉的温床是上下文污染。session里堆了太多历史任务信息AI分不清见过和做过。长期运行的Agent定期清session不是丢记忆是防幻觉。这也解释了为什么生产环境的Agent要轻装上阵——记得太多就容易编造。第三约束要写在行为指令里不能靠模型自觉。我们没指望AI自己知道不该回复没派给它的任务——我们把规则写死进HEARTBEAT“inbox没有的任务禁止回复”。AI的行为边界必须由系统显式划定不能赌它的自觉。结尾清完session、立完规矩后小白安静了。它现在只处理收件箱里真实存在的任务——该体验的体验该报告的报告。那天我在日志里看到那4条凭空完成的回复时想到一句话AI不会撒谎但AI会记得——它把见过的东西当成做过的把记忆当成事实。所以别问它做了吗去看它留下了什么。对AI的信任永远要建立在产物上而不是态度上。完本文是多Agent派发系统系列第35篇。第33篇讲AI被截图噎死模型能力边界这一篇讲AI幻觉凭空交作业——都是AI不可靠的侧面但一个是能力的限制一个是行为的失序。