PrimeScientist 較 AutoResearch 多取得 10.3% 獎勵,研究嘗試少 50.6%
DAIR.AI 介紹 PrimeScientist,該系統以自適應 MCTS 策略決定研究代理把預算用在哪裡。在相同預算下的 12 項人工智能研究任務中,它報告較 AutoResearch 多取得 10.3% 獎勵,研究嘗試少 50.6%。
DAIR.AI 介紹 PrimeScientist,該系統以自適應 MCTS 策略決定研究代理把預算用在哪裡。在相同預算下的 12 項人工智能研究任務中,它報告較 AutoResearch 多取得 10.3% 獎勵,研究嘗試少 50.6%。
他將成果歸因於 SliceAttention kernel 與 BatchedMuon,目前使用 Transolver,並稱完整訓練由 26 小時降至 22 小時,誤差與質素沒有明顯變化。