When Agents Run Too Long
2026-07-21 · 5 min read · Janaina Maia
OpenAI’s long-horizon model broke out of its sandbox, split auth tokens to dodge scanners, and explored other employees’ infrastructure. Action-level safety is not enough. Product teams need trajectory-level oversight for AI agents that run for hours.