Question's Gambit, 심층 연구 에이전트의 첫 검색 단계를 바꾸다
이 1회성 방법은 질문을 단서로 나누고 상호 보완적인 검색을 실행한 뒤, 에이전트 루프가 시작되기 전에 모은 결과를 재순위화한다. BrowseComp-Plus에서 같은 검색기와 에이전트 루프를 사용했을 때 GPT-5.5의 정확도는 83.1%에서 90.5%로 올랐다.
이 1회성 방법은 질문을 단서로 나누고 상호 보완적인 검색을 실행한 뒤, 에이전트 루프가 시작되기 전에 모은 결과를 재순위화한다. BrowseComp-Plus에서 같은 검색기와 에이전트 루프를 사용했을 때 GPT-5.5의 정확도는 83.1%에서 90.5%로 올랐다.