# 研究发现精简 Agent 框架提示词与工具最多可降低 3 倍成本

一项在 SWE-bench Verified 上使用相同模型对比 Claude Code、mini-SWE-agent 与 OpenCode 的研究发现，精简框架提示词和工具定义可在不降低准确率的前提下，将成本最高降低 3 倍。

Language: zh-CN
Time zone: Asia/Shanghai

HTML: https://didcodexreset.com/zh/news/4170bf189ce541aa9635194f.html

Content language: zh-CN
Localization state: translated

来源：DAIR.AI · 发布于 2026/10/8 04:03:16

一篇[研究论文](https://academy.dair.ai/papers/what-does-a-harness-buy-tokens-mostly-2610.04433)评估了在底层模型保持不变的情况下，更换 Agent 运行框架对性能的影响，测试涵盖了 Claude Code、mini-SWE-agent 和 OpenCode 在 SWE-bench Verified 上的 447 个任务。Claude Code 与 mini-SWE-agent 的成绩差距在 5 分以内；更换框架对结果的影响幅度与重复运行同一框架大致相当，两者在包含 45 个任务的高难度子集中均改变了 13% 任务的结果。

研究结果表明，保持框架系统提示词和工具定义精简，可在不降低准确率的情况下将 Token 成本最高削减 3 倍。成本差异的主要原因在于系统提示词和工具定义会在每一步中被重复发送，随着 Agent 运行轨迹变长，累积的 Token 使用量成倍增加。

Tags: SWE-bench, AI Agent, Claude Code, 基准测试

[查看主帖原文](https://x.com/dair_ai/status/2107920656788767098)
