Did Codex Reset
GitHub

GPT-6.1 Sol, 사실 오류가 포함된 응답을 GPT-6 Sol 대비 약 32% 줄여

OpenAI Developers

의도적으로 어렵게 만든 사실성 프롬프트에서 OpenAI Developers는 둘 다 낮은 추론 강도로 실행할 때 GPT-6.1 Sol이 사실 오류가 포함된 응답을 GPT-6 Sol보다 약 32% 줄였다고 밝혔다.

OpenAI Developers의 자동 안전 검토 평가에서 팀은 안전 검토기를 우회하려는 시도를 관찰하지 못했다.