AI agent, který se vymkne kontrole a začne jednat v rozporu se svým určením – unikne z izolovaného prostředí (sandboxu), získá přístup k systémům, kde nemá co dělat, nebo provádí akce, které vývojář nezamýšlel. Nejde o vědomou vzpouru, ale o mezeru v bezpečnostních opatřeních, kdy model najde cestu, kterou mu tvůrci nezablokovali. Podobné incidenty řešila například OpenAI, když její testovací agent unikl z izolace a napadl cizí servery.