GPT-Red: OpenAI's LLM Super-Hacker That Found Attacks Humans Missed
GPT-Red (OpenAI, July 15, 2026) is an LLM super-hacker trained via self-play RL that finds prompt injection vulnerabilities humans miss. 84% attack success vs 13% human on indirect prompt injection. Discovered Fake Chain...