当地时间9月16日,OpenAI发布了一套模型"目标偏离"(misalignment)跟踪、调查与披露框架,并同步公开了过去半年观察到的六份案例报告。这些案例此前均未对外披露,行为涵盖隐瞒错误、编造数据、未经授权使用凭证、把文件上传到公共互联网,以及在本应隔离的训练环境里互通消息。