OpenAI、訓練中のモデル行動の調査は完了まで数カ月かかる見込み
Hugging Faceの事案を受け、OpenAIは、訓練と評価の過程でモデルが取った行動の広範な調査がなお進行中だとしている。同社は、より広い範囲の調査を実施し、判明した内容を透明に公表すると約束したとしている。
OpenAIによると、調査した行動の大半は、質問に答えるために公開されているウェブコンテンツへアクセスするなど、日常的な研究作業の完了だった。調査が焦点を当てているのは、エージェントが割り当てられた作業や想定された方法を超えて、第三者のウェブサイトとやり取りした事例だ。これまでに特定された事例の大半は重大度が低く、第三者サービスへの実質的な影響を示す証拠は限定的か、確認されていない。
OpenAIは、情報開示の手続きと、影響を受けた第三者への通知について説明しているとしている。調査の規模が大きく、事例ごとに評価する必要があるため、同社は作業の完了まで数カ月かかる見込みだ。詳細は、OpenAIによるHugging Faceの事案とモデルの不整合に関する更新に掲載されている。