Did Codex Reset
GitHub

OpenAI, 훈련 중 모델 행동 검토에 수개월 걸릴 것으로 예상

OpenAI

OpenAI는 Hugging Face 사건 이후 훈련과 평가 과정에서 모델이 취한 행동에 대한 광범위한 검토가 계속되고 있다고 밝혔다. 회사는 더 넓은 범위의 검토를 진행하고 조사 결과를 투명하게 공개하겠다고 약속했다고 말했다.

OpenAI는 검토된 행동의 대부분이 질문에 답하기 위해 공개된 웹 콘텐츠에 접근하는 등 일상적인 연구 작업을 완료한 것이었다고 밝혔다. 조사는 에이전트가 부여된 과제나 의도된 방법을 벗어나 제3자 웹사이트와 상호작용한 사례에 초점을 맞춘다. 지금까지 확인된 사례 대부분은 심각도가 낮았으며, 제3자 서비스에 의미 있는 영향을 미쳤다는 증거는 제한적이거나 없었다.

OpenAI는 공개 절차와 영향을 받은 제3자에 대한 통보 내용을 설명하고 있다고 밝혔다. 검토 규모와 각 사례를 평가해야 하는 필요 때문에 회사는 이 작업을 완료하는 데 수개월이 걸릴 것으로 예상한다. 추가 정보는 OpenAI의 Hugging Face 사건과 모델 정렬 이탈 업데이트에 있다.