Sam Altman
OpenAI 因 alignment 与监控标准未达标,暂停部分前沿 RL 训练
OpenAI 暂停了一部分前沿强化学习工作,要等 alignment、安全和监控能力跟上眼前这个能力水位再继续。Altman 把这件事说成是兑现一个早就许下的承诺:能力跑到安全前面时就要出手。他还说这个领域最终需要共同标准,但在那之前 OpenAI 会先自己单方面执行。近期的模型发布不受影响,受影响的是更靠后的版本。他对走向的判断是:往后 AI 进展的节奏,会越来越由对安全的信心来决定。
- #policy
- #safety
