Coding agents need a new definition of done
OpenAI's September 15 release introduces GPT-5-Codex, an artificial intelligence (AI) model optimized for agentic software engineering. The announcement emphasizes both quick interactive work and extended independent execution, including hours of iteration on large tasks and test failures.
When an agent can work longer, “the code runs” becomes an even less adequate definition of done.