CONCEPT
迭代合约
基本定义
迭代合约是Harness架构下生成与评估分离模式的核心协作规则,是Generator智能体与Evaluator智能体在每轮迭代正式启动前、代码开发工作开展前协商一致的工作契约,是AI自主开发软件开发范式中保障开发质量、降低协作沟通成本的核心机制。
适用语境
迭代合约仅适用于Harness架构的多智能体协作开发流程,是多代理协作模式区别于单代理模式的典型规则之一,配套迭代拆分机制使用,覆盖从需求拆解到最终交付的全开发周期的每一轮迭代环节。
核心构成
每一份迭代合约必须包含4类可落地、可验证的明确约定,禁止使用模糊表述:
- 实现细节:明确本轮迭代需要开发的具体功能的技术实现要求,比如功能的交互逻辑、技术栈选型、兼容要求等;
- 功能目标:明确本轮迭代需要交付的具体功能范围,以及需要达成的产品价值,例如某轮迭代的功能目标为「实现关卡编辑器的矩形填充工具」;
- 测试标准:明确Evaluator智能体开展评估的具体测试步骤、验证逻辑,例如针对矩形填充工具的测试标准为「拖拽起点和终点之间,所有区域都应被tile填满,无遗漏、无重复」;
- 完成定义:明确本轮迭代判定为通过的硬阈值,只要任意一项测试标准未达标,即判定迭代失败。
运行机制
- 合约生成:每轮迭代启动前,Generator智能体与Evaluator智能体基于Planner智能体输出的产品规格文档,协商确定本轮迭代的全部合约条款,双方确认一致后生效;
- 开发执行:Generator智能体全程围绕合约要求开展开发工作,不得偏离合约约定的功能范围与实现要求;
- 评估执行:Evaluator智能体严格按照合约约定的测试标准开展评估工作,不得超出合约范围增加额外评估要求,也不得降低合约约定的评估阈值;
- 迭代闭环:若评估达标,本轮迭代结束,进入下一轮迭代的合约协商环节;若评估不达标,Generator智能体需基于Evaluator智能体的反馈重新优化开发,直到符合合约要求为止。
边界与注意事项
- 迭代合约仅对当前单轮迭代生效,每轮迭代启动前都需要重新协商制定,不得跨迭代复用;
- 合约条款必须全部可量化、可验证,避免出现「体验良好」「代码优质」等模糊表述,确保评估环节有明确的判断依据;
- 合约一旦双方确认生效,无特殊情况不得中途变更,避免因标准变动导致的资源浪费与认知分歧。