Files
myWiki/concepts/model-harness-coevolution.md
2026-07-20 14:14:55 +08:00

46 lines
2.0 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

---
title: "模型-脚手架协同演化 (Model-Harness Co-Evolution)"
created: 2026-07-13
updated: 2026-07-13
type: concept
tags: [agent, harness, coevolution, self-improvement]
sources:
- arxiv:2606.20683
---
# 模型-脚手架协同演化
## 定义
Agent 工程第四范式Phase 4的第二方向。**模型-脚手架协同演化**将 Agent 工程从一次性训练扩展到全栈持续改进——模型、脚手架和改进策略在部署过程中可能全部更新,利用执行反馈决定哪些更改保留、修正或回滚。
## 三层区分
Agent Harness Survey 将常被混为一谈的"自我进化"拆解为三层:
| 层次 | 定义 | 代表系统 |
|------|------|----------|
| [[multi-model-harness|多模型脚手架]] | 谁执行每个运行时角色 | OpenHands, MagenticOne |
| [[learnable-harness|可学习脚手架]] | 运行时策略如何被优化 | NLAH, Meta-Harness, AHE |
| **协同演化** | 模型+脚手架+改进循环何时及如何联合更新 | EvolveR, Hyperagents, Darwin Gödel Machine |
## 关键系统
- **EvolveR / AgentEvolver**将交互轨迹作为可重用学习信号self-questioning, navigation, attribution
- **Continual Harness**:在线适应,不依赖推理时的稠密外部奖励
- **AHEAgentic Harness Engineering**:脚手架侧演化——固定基座模型下,运行时组件从 observability-driven 反馈中演化
- **SICA / Darwin Gödel Machine / Hyperagents**:递归自我改进——改进机制本身可能随时间可修改
## 核心命题
行为内部化([[agent-native-training|Agent 原生训练]])不消除脚手架——它改变了分工:
- 更多短视界行为移入模型参数
- 运行时仍提供环境访问、状态和安全控制
- 开放问题:如何安全地让模型+脚手架+改进策略联合演化,不牺牲可检视性和安全性
## 参考
- [[agent-harness-survey-2026|Agent Harness Survey (2026)]]
- [[agent-native-training|Agent 原生训练]]
- [[learnable-harness|可学习脚手架]]
- [[four-paradigms-agent-engineering|Agent 工程四范式]]