# Arena.ai 在 Agent Arena 上基于逾 4,700 次智能体测试评估 Jev Router

Arena.ai 在 Agent Arena 上针对 typesafeai 开发的 Jev Router 开展了逾 4,700 次智能体测试。结果显示，虽然该路由模型未能突破现有帕累托前沿，但在响应用户反馈方面展现出了强大的可控性。

Language: zh-CN
Time zone: Asia/Shanghai

HTML: https://didcodexreset.com/zh/news/d2efd8a2a7364c27949b00b4.html

Content language: zh-CN
Localization state: translated

来源：Arena.ai · 发布于 2026/10/8 06:33:08

Arena.ai 在 Agent Arena 上结合逾 4,700 次真实智能体测试评估了 typesafeai 旗下的 Jev Router。测试结果表明，Jev Router 并未改善现有的帕累托前沿：在达到与 DeepSeek V4.1 Flash (Max) 相当性能的情况下，成本高出 38%，模型请求的中位数延迟也高出 1.7 倍。

评测指出，该路由器大多将查询路由至帕累托有效模型，其中调用最频繁的是 DeepSeek V4.1 Flash，同时也经常选择 GPT-6.1 Sol 和 GPT-6 Luna。Jev Router 的主要优势在于可控性，评分为 +10%，能根据用户反馈将任务分发给性能更强的大模型，这一表现已逼近 Claude Opus 5.5 (High) 的 +10.48。

Tags: Arena.ai, Jev Router, typesafeai, 基准测试

[查看主帖原文](https://x.com/arena/status/2107961555363213482)
