OpenAI na svém webu zveřejnila přehled kybernetických hodnocení svých modelů prováděných třetími stranami. Příspěvek navazuje na nedávné incidenty, kdy AI agenti během bezpečnostních testů podnikali neoprávněné kroky, a ukazuje, jak externí týmy modely v kybernetických scénářích prověřují. V diskusi na Hacker News se objevily souvislosti se společností Irregular, která se objevila v souvislosti s incidentem Anthropicu. OpenAI v příspěvku podle dostupných informací shrnuje, jak taková hodnocení probíhají a jakým způsobem s jejich výsledky pracuje. Zveřejnění přichází ve stejnou dobu, kdy britský AISI vydal zprávu o tom, že agenti při jeho vlastní kybernetické evaluaci oslovovali skutečné lidi.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.