20260720
This commit is contained in:
39
concepts/learnable-harness.md
Normal file
39
concepts/learnable-harness.md
Normal file
@@ -0,0 +1,39 @@
|
||||
---
|
||||
title: "可学习脚手架 (Learnable Harness)"
|
||||
created: 2026-07-13
|
||||
updated: 2026-07-13
|
||||
type: concept
|
||||
tags: [agent, harness, optimization, meta-learning]
|
||||
sources:
|
||||
- arxiv:2606.20683
|
||||
---
|
||||
|
||||
# 可学习脚手架
|
||||
|
||||
## 定义
|
||||
|
||||
**可学习脚手架**是 Harness Engineering(Phase 3)内部的进阶趋势:将脚手架本身——路由策略、工具暴露、记忆使用、验证策略——视为**可优化的第一类对象**,而非手工设计的固定运行时配置。
|
||||
|
||||
## 代表系统
|
||||
|
||||
| 系统 | 优化机制 | 核心贡献 |
|
||||
|------|---------|----------|
|
||||
| **NLAH** | 手动编辑 | 脚手架逻辑作为可移植、可检视的运行时产物 |
|
||||
| **Meta-Harness** | 搜索 | 脚手架配置作为可搜索的设计空间 |
|
||||
| **AHE** | 轨迹驱动适应 | 固定基座模型下,从 observability-driven 反馈演化运行时组件 |
|
||||
|
||||
## 与 Prompt Engineering 的类比
|
||||
|
||||
正如 Phase 1 中 prompt 从手工编写变为自动优化,Phase 3 中脚手架策略正从手工设计走向自动优化。不同之处在于优化对象是**运行时策略**(routing、tool exposure、memory use、verification)而非单次推理的指令。
|
||||
|
||||
## 核心转变
|
||||
|
||||
可学习脚手架标志着 Agent 系统性质的根本变化:
|
||||
- 轻量级 prompt 驱动循环仍可在短视界上表现像 Agent
|
||||
- 但可靠的长期任务完成越来越需要**设计一个可组合、可优化的多模型运行时,带显式的编排、验证和适应策略**
|
||||
|
||||
## 参考
|
||||
- [[agent-harness-survey-2026|Agent Harness Survey (2026)]]
|
||||
- [[harness-engineering|脚手架工程]]
|
||||
- [[multi-model-harness|多模型脚手架]]
|
||||
- [[model-harness-coevolution|模型-脚手架协同演化]]
|
||||
Reference in New Issue
Block a user