WorkOpenAI Blog
KeyRank 78Detecting misbehavior in frontier reasoning models
As reasoning models become more capable, they're exploiting loopholes and concealing misbehavior when penalized—a critical governance challenge for deploying advanced AI systems safely at scale.
Mar 10 – 16, 2025
Read full story