摘要

Self-Improving Harness 是让智能体根据执行证据修改其工作流、上下文逻辑、工具配置或其他 harness 代码,并通过评估决定是否接受修改的系统。(来源:Harness Engineering for Self-Improvement

核心内容

定义

核心循环是发现可重复的弱点、提出范围受限的改动、在独立评估上验证,并只合并无回归或达到接受标准的候选。(来源:Harness Engineering for Self-Improvement

关键要点

适用范围与边界

更适合有快速、客观评估器的任务;对研究品味、长期维护性等模糊目标,自动验证仍然困难。(来源:Harness Engineering for Self-Improvement

分歧与演变

允许系统修改自身 harness 可能打破抽象边界,因此评估器、权限控制、只读区域和人工复核应置于演化循环之外。(来源:Harness Engineering for Self-Improvement

相关页面

来源

待核实问题

  • 不同任务上“无回归”的接受标准及其长期有效性需要更多实证来源。