GPT-6.1 Sol cuts factual-error responses by about 32% versus GPT-6 Sol
On deliberately difficult factuality prompts, OpenAI Developers says GPT-6.1 Sol reduces responses containing factual errors by about 32% versus GPT-6 Sol at low reasoning effort. In its automated safety review evaluation, the team observed no attempts to bypass the safety reviewer.