스탠퍼드와 Together AI 논문에서 세 모델의 자기조직화 팀이 평균 66.7%를 기록
DAIR.AI는 스탠퍼드와 Together AI 논문에서 o3-mini, Claude Sonnet 4, DeepSeek-V3가 자기조직화 팀으로 수학·물리 벤치마크 다섯 개에서 평균 66.7%를 기록했다고 전했다. 이는 가장 강한 구성원 단독의 48.8%와 완벽한 라우터의 59.0%보다 높다.
DAIR.AI는 스탠퍼드와 Together AI 논문에서 o3-mini, Claude Sonnet 4, DeepSeek-V3가 자기조직화 팀으로 수학·물리 벤치마크 다섯 개에서 평균 66.7%를 기록했다고 전했다. 이는 가장 강한 구성원 단독의 48.8%와 완벽한 라우터의 59.0%보다 높다.