Perplexity 称,在一次线上 A/B 测试中,较晚的 Computer 检查点将工具调用失败减少了 21.2%Perplexity 对 Computer 模型进行了后训练,使其通过提示引导的自蒸馏从自身错误中学习。该公司表示,21.2% 的降幅是相对于较早检查点而言。