Context bombing uses prompt injections to trigger AI safety guardrails and disrupt malicious AI-powered hacking agents.
Researchers tested five leading AI models, significantly reducing administrator access and successful system compromises during simulations.
The technique builds on earlier AI defence methods designed to detect and counter attacks against cloud infrastructure.



