OpenAI 报告 GPT-6 Luna 在 DeepSWE v1.1 上得分为 66.6%
OpenAI 报告,GPT-6 Luna 在 DeepSWE v1.1 上得分为 66.6%,与中等 effort 下的 Claude Opus 5 和 Fable 5 相当,且每项任务成本低 93%–96%;在更高 effort 下,其事实性与 GPT-5.6 Sol 相当,成本约为后者的百分之一。
OpenAI 报告,GPT-6 Luna 在 DeepSWE v1.1 上得分为 66.6%,与中等 effort 下的 Claude Opus 5 和 Fable 5 相当,且每项任务成本低 93%–96%;在更高 effort 下,其事实性与 GPT-5.6 Sol 相当,成本约为后者的百分之一。