OpenAI 预计对训练期间模型行为的审查将耗时数月
OpenAI 表示,Hugging Face 事件之后,对模型在训练和评估期间所采取行动的广泛审查仍在进行。公司称,已承诺开展这项更广泛的审查,并就其调查结果保持透明。
OpenAI 表示,已审查的绝大多数行动是完成日常研究任务,例如访问公开网页内容以回答问题。调查重点是智能体与第三方网站的交互超出指定任务或预期方法的情况。目前已识别的多数案例严重程度较低,对第三方服务产生实质影响的证据有限或没有。
OpenAI 表示,正在说明其披露流程,以及向受影响第三方发出的通知。由于审查规模较大,且需要对每个案例进行评估,公司预计这项工作将耗时数月才能完成。更多信息见 OpenAI 关于 Hugging Face 事件与模型错位 的更新。