Lidé, kteří dohlížejí na kódovací agenty, schválí v průměru zhruba třetinu nebezpečných požadavků. Ukazuje to studie založená na prohlížečové hře, která testuje schopnost lidí bezpečně schvalovat příkazy pro AI agenty. Hráči v ní měli rozhodovat, jestli agent může provést akci, přičemž zhruba každý třetí škodlivý požadavek prošel. Výsledky zároveň naznačují, že opakované schvalování akcí vede k ledabylejším rozhodnutím. Autoři upozorňují, že režim člověk-v-smyčce není samospásný: když má operátor neustále potvrzovat dílčí kroky agenta, pozornost klesá a nebezpečné příkazy snáze proklouznou. Studie přichází v době, kdy se kódovací agenti jako Claude Code nebo Codex masově nasazují a otázka, kdo a jak kontroluje jejich akce, je stále palčivější.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.