长视野模型时代的安全性和对准

原文出处: OpenAI Blog (openai.com)

原文链接: https://openai.com/index/safety-alignment-long-horizon-models

内容摘要

OpenAI 分享了部署长期运行的人工智能模型的经验教训,强调了新的安全风险、观察到的故障以及通过迭代部署改进的保障措施。