1.8 KiB
1.8 KiB
title, created, updated, type, tags, sources
| title | created | updated | type | tags | sources | ||||
|---|---|---|---|---|---|---|---|---|---|
| 模型-脚手架透镜 (Model-Harness Lens) | 2026-07-13 | 2026-07-13 | concept |
|
|
模型-脚手架透镜
定义
模型-脚手架透镜是将 LLM-based Agent 理解为基础模型(M)与执行脚手架(H)耦合体的分析框架。形式化定义:
A_{LLM} = \langle M, H \rangle = \langle M, I_{obs}, C, L, I_{act}, S, V \rangle
其中 M 是模型层(可为单模型或模型集合 {M₁, ..., Mₖ}),H 是包含六个运行时组件的执行脚手架。
核心主张
传统的"The larger the model, the better the agent"假设在 Agent 任务上失效。脚手架透镜的核心主张:Agent 质量(成功率、效率、安全性、泛化)不是模型能力的线性函数,而是模型能力、运行时基础设施、任务结构、评估设计四者之间交互的 emergent property。
证据来源:
- SWE-agent:仅重新设计 agent-computer interface(ACI),固定模型下 SWE-bench 显著提升
- NLAH:脚手架模块作为便携式可编辑产物,贡献可测量且可加和
- Meta-Harness:脚手架配置搜索可超越手工设计基线
与传统框架的差异
| 框架类型 | 组织逻辑 | 局限 |
|---|---|---|
| 模块化分类(记忆/规划/行动) | 功能模块清单 | 未解释模块间运行时耦合 |
| 脑-感知-行动框架 | 认知层次 | 忽略执行基础设施 |
| 模型-脚手架透镜 | 运行时责任解耦 | 强调执行层面瓶颈 |