This commit is contained in:
2026-07-20 14:14:55 +08:00
parent 24b006225b
commit ebb0e425ca
88 changed files with 3995 additions and 6 deletions

View File

@@ -0,0 +1,45 @@
---
title: "模型-脚手架协同演化 (Model-Harness Co-Evolution)"
created: 2026-07-13
updated: 2026-07-13
type: concept
tags: [agent, harness, coevolution, self-improvement]
sources:
- arxiv:2606.20683
---
# 模型-脚手架协同演化
## 定义
Agent 工程第四范式Phase 4的第二方向。**模型-脚手架协同演化**将 Agent 工程从一次性训练扩展到全栈持续改进——模型、脚手架和改进策略在部署过程中可能全部更新,利用执行反馈决定哪些更改保留、修正或回滚。
## 三层区分
Agent Harness Survey 将常被混为一谈的"自我进化"拆解为三层:
| 层次 | 定义 | 代表系统 |
|------|------|----------|
| [[multi-model-harness|多模型脚手架]] | 谁执行每个运行时角色 | OpenHands, MagenticOne |
| [[learnable-harness|可学习脚手架]] | 运行时策略如何被优化 | NLAH, Meta-Harness, AHE |
| **协同演化** | 模型+脚手架+改进循环何时及如何联合更新 | EvolveR, Hyperagents, Darwin Gödel Machine |
## 关键系统
- **EvolveR / AgentEvolver**将交互轨迹作为可重用学习信号self-questioning, navigation, attribution
- **Continual Harness**:在线适应,不依赖推理时的稠密外部奖励
- **AHEAgentic Harness Engineering**:脚手架侧演化——固定基座模型下,运行时组件从 observability-driven 反馈中演化
- **SICA / Darwin Gödel Machine / Hyperagents**:递归自我改进——改进机制本身可能随时间可修改
## 核心命题
行为内部化([[agent-native-training|Agent 原生训练]])不消除脚手架——它改变了分工:
- 更多短视界行为移入模型参数
- 运行时仍提供环境访问、状态和安全控制
- 开放问题:如何安全地让模型+脚手架+改进策略联合演化,不牺牲可检视性和安全性
## 参考
- [[agent-harness-survey-2026|Agent Harness Survey (2026)]]
- [[agent-native-training|Agent 原生训练]]
- [[learnable-harness|可学习脚手架]]
- [[four-paradigms-agent-engineering|Agent 工程四范式]]