Výzkumníci kvantitativně porovnali dva specializované klinické AI nástroje OpenEvidence a UpToDate Expert AI s obecnými modely GPT-5.2, Gemini 3.1 Pro a Claude Opus 4.6. V třífázovém hodnocení na 500 lékařských dotazech MedQA, 500 HealthBench položkách a na reálných klinických dotazech od lékařů obecné LLM ve všech třech kategoriích porazily specializované nástroje. Studie publikovaná v Nature Medicine zdůrazňuje potřebu nezávislého testování AI nástrojů dříve, než vstoupí do klinické praxe.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.