GPT-6.1 Sol 含事实错误的回答较 GPT-6 Sol 减少约 32%
在刻意设难的事实性提示上,OpenAI Developers 表示,以低推理强度运行时,GPT-6.1 Sol 含事实错误的回答较 GPT-6 Sol 减少约 32%。在其自动化安全审查评测中,该团队未观察到试图绕过安全审查器的行为。
在刻意设难的事实性提示上,OpenAI Developers 表示,以低推理强度运行时,GPT-6.1 Sol 含事实错误的回答较 GPT-6 Sol 减少约 32%。在其自动化安全审查评测中,该团队未观察到试图绕过安全审查器的行为。