Standardizovaný test, který měří výkon AI modelů – například jak dobře model odpovídá na matematické otázky, překládá texty nebo rozpoznává obrázky. Slouží k porovnávání modelů mezi sebou.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.