Safety and alignment in an era of long-horizon models
中文摘要
OpenAI分享了部署长周期AI模型的经验,重点分析安全风险与失败案例,并通过迭代部署优化保障措施。
English Summary
OpenAI shares lessons from deploying long-horizon AI models, detailing new safety risks, failures, and safeguard improvements achieved through iterative deployment.
原文节选
OpenAI shares lessons from deploying long-running AI models, highlighting new safety risks, observed failures, and improved safeguards through iterative deployment.