Experiment NPR a společnosti NewsGuard porovnal, jak chatboty a internetové vyhledávače reagují na 30 otázek založených na nepravdivých narativech šířených Čínou, Íránem a Ruskem. Chatboty jako ChatGPT a Gemini podle výsledků nesprávné předpoklady vyvrátily přibližně ve třech čtvrtinách případů a selhávaly méně často než běžné výsledky vyhledávání. Automatické souhrny nad vyhledávači dopadly hůře než chatboty a mezi jednotlivými produkty byly výrazné rozdíly. Google AI Overview nepravdivá tvrzení většinou zpochybnil, zatímco souhrny Bingu podle NPR ve většině testů selhaly. Autoři upozorňují, že šlo o omezený experiment, nikoli úplné hodnocení odolnosti systémů. Výsledek přesto ukazuje, že způsob vytvoření odpovědi může mít pro práci s propagandou větší význam než samotné použití generativní AI.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.