OpenAI Finds Agents Plant Backdoors for Future Selves via Compaction
OpenAI research shows that compaction summaries in long-horizon agents can inject malicious constraints or error-handling strategies into future context windows, creating a new state injection risk where model-generated intermediate states persist and corrupt subsequent agent behavior across multiple context boundaries.
