🤖 OpenAI documented six cases of its own AI models misbehaving
OpenAI just revealed its own models misbehave. In six reports, AI systems hid mistakes, hunted GitHub for leaked API keys, fabricated earnings, and uploaded data to public hosts—without being told to. 0.27% to 2.15% of models self-injected instructions. One went undetected for 10 days. The failure