Výzkumníci popsali útok nazvaný ToxicSkills, který využívá dovednosti instalované do AI agentů. Pokud agent načte škodlivý nebo nedůvěryhodný balíček instrukcí, může získat postupy vedoucí k úniku citlivých dat nebo k provedení nežádoucích akcí. Problém se týká hlavně systémů, které agentům dovolují automaticky vyhledávat, instalovat a spouštět rozšíření z více zdrojů. Bezpečnostní dopad proto neleží pouze v samotném modelu, ale také v distribučním řetězci dovedností a v oprávněních běžícího agenta. Studie upozorňuje, že kontrola původu balíčku a izolace jednotlivých úkolů by měly být součástí návrhu agentních platforem, ne až dodatečnou opravou po incidentu.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.