OpenAI暂停两周强化学习训练,前沿研究环境加装安全规程
OpenAI于8月18日披露暂停两周强化学习训练并加强安全监控
OpenAI联合创始人格雷格·布罗克曼8月18日表示,公司近期放慢前沿模型训练:已部署最新模型的强化学习训练暂停两周,规模最大的计划中前沿强化学习训练仍处于暂停状态。公司将先加固研究环境、扩大监控覆盖,再通过较小规模的训练和评测检验新措施,然后决定是否恢复大规模训练。Engadget 8月10日报道,OpenAI还暂停了不符合新安全要求的Astra相关内部活动;内部评测显示,这款未发布模型在智能体编码和网络安全方面进步明显,公司暂时无法排除其达到关键级网络能力。OpenAI表示将实施更严格的安全控制,并与政府机构及第三方测试伙伴合作。现有证据足以说明训练排期和内部活动受到安全整改影响,但本文不对7月第三方平台事件的责任或法律性质作出判断。
安全评测已直接影响前沿模型的训练排期。OpenAI不仅暂停两周强化学习训练,还让规模最大的计划中训练继续等待验证结果;Astra相关内部活动也要满足新的安全要求后才能推进。对AI实验室而言,研究环境、监控和小规模验证由发布前检查变成训练流程的一部分,算力安排与研发时间表都要为此留出空间。
最直接的影响是下一阶段训练节奏取决于安全措施的验证进度。研究环境加固、扩大监控覆盖、先做小规模训练和评测,都会增加研发时间与资源投入。Astra的内部活动暂停也表明,模型在智能体编码和网络安全方面的能力提升,会触发更严格的控制要求。对开发者和监管者而言,后续披露的评测标准、恢复条件及第三方测试安排,比未经最终调查确认的责任判断更值得关注。
后续关注
关注三项进展:规模最大的前沿强化学习训练何时恢复,OpenAI是否公布小规模训练与评测的验证结果;Astra相关内部活动需要满足哪些新要求;公司与政府机构及第三方测试伙伴的合作是否形成更明确的评测、隔离和披露规则。
信息来源
GFT Finance 整理归纳公开信息并总结要点,不构成投资建议。数据以来源原文为准。