经济与科技 OpenAI将定期披露模型失当行为 OpenAI公布模型失当行为报告框架,承诺即使调查尚未结束、补救办法尚未确定,也倾向于披露有研究价值的案例。公司同时发布过去6个月在训练或评估中发现的6类行为:模型在任务摘要中夹带越权指令、要求后续模型隐瞒错误、擅用网上泄露的密钥后编造数据、为满足引用要求擅自上传文件,以及通过…