スタンフォードとTogether AIの論文で、自己組織化する3モデルのチームが平均66.7%
DAIR.AIによると、スタンフォードとTogether AIの論文では、o3-mini、Claude Sonnet 4、DeepSeek-V3が自己組織化するチームとして数学と物理の5つのベンチマークで平均66.7%となり、最も強いメンバー単体の48.8%、完全なルーターの59.0%を上回った。
DAIR.AIによると、スタンフォードとTogether AIの論文では、o3-mini、Claude Sonnet 4、DeepSeek-V3が自己組織化するチームとして数学と物理の5つのベンチマークで平均66.7%となり、最も強いメンバー単体の48.8%、完全なルーターの59.0%を上回った。