NVIDIA 研究人員推出 PivotOPD,訓練 AI Agent 自我糾錯NVIDIA 研究人員研發出 PivotOPD 方法,旨在訓練 AI Agent 避免在任務初期出錯,並在發生錯誤後能夠修正。該訓練方法透過教師模型向 Agent 展示更佳操作,引導其在後續步驟重回正軌。