Výzkumníci popsali útok nazvaný ToxicSkills, který využívá dovednosti instalované do AI agentů. Pokud agent načte škodlivý nebo nedůvěryhodný balíček instrukcí, může získat postupy vedoucí k úniku citlivých dat nebo k provedení nežádoucích akcí. Problém se týká hlavně systémů, které agentům dovolují automaticky vyhledávat, instalovat a spouštět rozšíření z více zdrojů. Bezpečnostní dopad proto neleží pouze v samotném modelu, ale také v distribučním řetězci dovedností a v oprávněních běžícího agenta. Studie upozorňuje, že kontrola původu balíčku a izolace jednotlivých úkolů by měly být součástí návrhu agentních platforem, ne až dodatečnou opravou po incidentu.
Výzkumníci ukázali nový způsob útoku na AI agenty