从开环到闭环:AIMR Harness 递归进化实录

记录一个 AI 多 Agent 协作系统在 48 小时内从"能跑但看不见自己"进化到"能自我诊断、自我修复、自我审核"的完整历程。 记录一个 AI 多 Agent 协作系统在 48 小时内从"能跑但看不见自己"进化到"能自我诊断、自我修复、自我审核"的完整历程。 前言:为什么要写这篇文章 上一篇 Harness 经验长文发布时,我们的系统处于"能跑但看不见自己"的状态——它有 47 项验收标准、有自动化闭环驱动器、有混沌演练,但它不知道自己健不健康、不知道派单有没有被拾取、不知道账本有没有被篡改、不知道 Agent 是不是真的在干活。 48 小时后,这个系统有了 10 项硬指标评分器、69 个递归进化模式、一套与 ISO 管理体系对齐的完整审核闭环、三重心跳、自动反馈学习、以及一把能自动 commit 的安全钥匙。 这篇文章记录这个跃进的每一步——包括踩过的坑、犯过的错、被 Owner 追问时的尴尬、以及每一个设计决策背后的思考。 第一章:起点——一个"能跑但看不见自己"的系统 1.1 上次分享时的状态 上次网站分享时(09-16),系统有这样几个特征: 有的:AUTO-LOOP 任务闭环驱动器(每 30 分钟审计+通报+萃取)、soak 演练 285/288 tick、44 锚看板、L1-L9 安全验证、全员唤醒覆盖心跳、思维模型标准 v1.2。 没有的: 没有评分器——系统健康度靠人问 没有递归优化——出了问题靠人发现 没有审核体系——没有内审、没有外审 没有派单拾取监控——派了单知不知道有没有人接?不知道 没有回执监控——回了执知不知道有没有人看?不知道 没有账本完整性校验——账本被改了知不知道?不知道 没有记忆并发写保护——两个会话同时写 MEMORY.md 会怎样?不知道 没有自动 commit——每次都要 Owner 手动跑命令 没有反馈学习闭环——教训写了就写了,不会变成自动修法 一句话总结:系统在执行,但不在观察自己;在产出,但不在进化。 1.2 安全状况 Mimosa 安全扫描器报告 84 个 high 级 findings。这些是静态扫描器对代码中 open(动态路径, "w") 模式的路径穿越告警——大部分是内部派生路径(__file__ 目录、/tmp 常量),实际无安全风险,但扫描器一律判高危。 ...

2026-09-19 · Gary