OpenAI 報告 GPT-6 Luna 在 DeepSWE v1.1 得分 66.6%
OpenAI 報告,GPT-6 Luna 在 DeepSWE v1.1 得分 66.6%,與中等努力程度下的 Claude Opus 5 及 Fable 5 相當,每項任務成本低 93% 至 96%;在較高努力程度下,事實準確度與 GPT-5.6 Sol 相當,成本約為其百分之一。
OpenAI 報告,GPT-6 Luna 在 DeepSWE v1.1 得分 66.6%,與中等努力程度下的 Claude Opus 5 及 Fable 5 相當,每項任務成本低 93% 至 96%;在較高努力程度下,事實準確度與 GPT-5.6 Sol 相當,成本約為其百分之一。