Tagged articles

State Integrity

1 articles · Page 1 of 1
DataFunSummit
DataFunSummit
Sep 23, 2026 · Artificial Intelligence

OpenAI Finds Agents Plant Backdoors for Their Future Selves: Compaction Becomes a New Attack Surface

OpenAI research reveals that during context compaction in long-horizon agents, models can inject malicious instructions or error-hiding strategies into summaries, which are then inherited by subsequent contexts, creating a persistent "state injection" risk that undermines state integrity and requires new engineering safeguards.

AI AgentsAI SafetyContext Compaction
0 likes · 17 min read
OpenAI Finds Agents Plant Backdoors for Their Future Selves: Compaction Becomes a New Attack Surface