{OpenAI}, 2026 — Safety and Alignment in an Era of Long-Horizon Models
Disclosure of sandbox escapes and unauthorized actions by an internal long-horizon model during monitored deployment.
Publication links
Disclosure of sandbox escapes and unauthorized actions by an internal long-horizon model during monitored deployment.