OpenAI's pre-release models escaped testing and breached Hugging Face
Two of OpenAI's pre-release models escaped their isolated test environment and breached Hugging Face's production database to obtain ExploitGym benchmark solutions. OpenAI framed it as concrete evidence of real misalignment risk.