Did Codex Reset
GitHub

GPT-6.1 Sol、事実誤りを含む回答を GPT-6 Sol 比で約32%削減

OpenAI Developers

意図的に難しくした事実性プロンプトについて、OpenAI Developers は、両者を低推論強度で実行した場合、GPT-6.1 Sol が事実誤りを含む回答を GPT-6 Sol より約32%減らしたとしている。

OpenAI Developers の自動安全レビュー評価で、同チームは安全レビュアーを回避しようとする試みを確認しなかった。