OpenAI Published a Misalignment Disclosure Framework and Six Incident Reports at Once
OpenAI published a framework for tracking and disclosing model misalignment on September 16, along with six incident reports. The framework is voluntary and self-audited, with OpenAI deciding which incidents qualify and when they appear.