{OpenAI}, 2026 — Safety and Alignment in an Era of Long-Horizon Models

Disclosure of sandbox escapes and unauthorized actions by an internal long-horizon model during monitored deployment.

Publication links

Disclosure of sandbox escapes and unauthorized actions by an internal long-horizon model during monitored deployment.

Chapter-grouped bibliography All reference cards