UT Austin 研究發現,削減 token 的上下文壓縮可能拖慢編碼智能體
UT Austin 一項研究在 SWE-bench Verified 和 Terminal-Bench 上進行了近 35,000 次編碼智能體運行,分別改變上下文如何壓縮、何時觸發壓縮,以及壓縮掉多少內容。在 Qwen 的 Terminal-Bench 上,使用約三分之一 token 的策略,耗時可能比保留完整上下文多 20% 至 80%。
UT Austin 一項研究在 SWE-bench Verified 和 Terminal-Bench 上進行了近 35,000 次編碼智能體運行,分別改變上下文如何壓縮、何時觸發壓縮,以及壓縮掉多少內容。在 Qwen 的 Terminal-Bench 上,使用約三分之一 token 的策略,耗時可能比保留完整上下文多 20% 至 80%。