Metoda testování bezpečnosti AI modelů, při které se tým odborníků (red team) snaží model úmyslně prolomit – obejít jeho ochrany, přimět ho k vytvoření nebezpečného obsahu nebo odhalit skryté zranitelnosti. S nástupem agentických systémů se red teaming posouvá od ručního testování k automatizovaným týmům AI agentů, kteří simulují útoky v reálném čase.