摘要
Meta-Harness 是让 coding-agent proposer 从完整候选代码、分数与执行轨迹历史中搜索任务专用 harness 的外层优化系统。
核心内容
基本信息
- 实体类别:Agent harness optimizer 与论文方法。
- 关键名称或版本:arXiv:2603.28052v1。
- 时间范围:首次公开于 2026-03-30。
重要事实
- proposer 通过文件系统选择性读取全量历史并直接编辑 harness 代码;固定目标模型不更新。(来源:Meta-Harness: End-to-End Optimization of Model Harnesses,pp.2-5)
- 论文在文本分类、数学检索和 Terminal-Bench 2 报告改进;不同实验的 held-out 强度不同,Terminal-Bench 2 没有独立 test split。(来源:Meta-Harness: End-to-End Optimization of Model Harnesses,pp.6-9)
关系与影响
Meta-Harness 把 Context Engineering 扩展为完整机制搜索,也为 Harness Optimization 提供“可查询全历史优于压缩摘要”的实证。它使用外部 Meta-Agent 改进目标 harness。
分歧与变化
论文为 v1 预印本;完整搜索代码、统一成本比较和独立 coding test 尚待确认。
相关页面
- 概念:Harness Engineering、Context Engineering、Harness Optimization、Self-Improving Harness、Recursive Self-Improvement、Meta-Agent
- 实体:Self-Harness、Agentic Harness Engineering
- 主题:LLM Agent Self-Improvement
来源
待核实问题
- 不同 proposer、搜索预算与安全边界如何影响泛化和可复现性。