GPT-6.1 Sol 含事實錯誤的回應較 GPT-6 Sol 減少約 32%
在刻意設難的事實性提示上,OpenAI Developers 表示,當兩者都以低推理強度運行時,GPT-6.1 Sol 含事實錯誤的回應較 GPT-6 Sol 減少約 32%。
在 OpenAI Developers 的自動化安全審查評測中,該團隊未觀察到試圖繞過安全審查器的行為。
在刻意設難的事實性提示上,OpenAI Developers 表示,當兩者都以低推理強度運行時,GPT-6.1 Sol 含事實錯誤的回應較 GPT-6 Sol 減少約 32%。
在 OpenAI Developers 的自動化安全審查評測中,該團隊未觀察到試圖繞過安全審查器的行為。