1.3 KiB
1.3 KiB
title, created, updated, type, tags, sources
| title | created | updated | type | tags | sources | ||||||
|---|---|---|---|---|---|---|---|---|---|---|---|
| 推理强度调优 (Reasoning Effort Tuning) | 2026-07-13 | 2026-07-13 | concept |
|
|
推理强度调优
定义
GPT-5.6 Prompt 指南中关于 Reasoning Effort 参数的调优原则:不是越高越好。 在不必要的推理上花费 Token 是一种隐性成本。
调优流程
- 保留当前档位作为基线
- 测试相同档位和更低档位
- 只有评测结果证明 high/xhigh 确实带来收益,才承担更高的推理成本
- max 仅用于难度最高、质量优先的任务
前置检查
在提升 Reasoning Effort 之前,先检查 Prompt 是否写清了:
- 成功标准
- 依赖关系
- 工具使用条件
- 验证要求
"如果这些信息不明确,单纯提高 Reasoning Effort 未必能解决问题。"
与 Prompt 简化的关系
这呼应了 prompt-simplification 的核心论点:瓶颈往往不在模型推理能力,而在 Prompt 质量。提高 Reasoning Effort 之前应先优化 Prompt。