Výzkumníci z Flinders University testovali, jestli nová generace modelů s pokročilým uvažováním omezila stereotypy v medicínských výstupech. Modely o3-mini a DeepSeek-R1 vygenerovaly 36 tisíc klinických vinět s fiktivními pacienty a vědci je porovnali s dřívějším GPT-4. Výsledky ukazují, že novější modely stereotypy neomezily, naopak: o3-mini významně zkreslil zastoupení ras u 78 procent diagnóz a pohlaví u 56 procent, DeepSeek-R1 u 89, respektive 67 procent. Oba modely nadměrně přiřazovaly černošské populaci choroby jako sarkoidózu nebo preeklampsii, a to výrazně častěji než GPT-4. Autoři upozorňují, že vyšší schopnost uvažování automaticky neznamená spravedlivější výstupy, a doporučují modely v klinickém nasazení průběžně monitorovat. Studie vyšla v časopise Journal of Medical Internet Research.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.