Společnost Prime Intellect zveřejnila dosud nejrozsáhlejší veřejný experiment s autonomním výzkumem umělé inteligence. Na optimalizační úloze nanoGPT spustila 153 běhů osmnácti předních modelů, každý trval až osm dní a využil osm akcelerátorů H200. Výsledky ukazují výrazné rozdíly mezi modely: nejlépe si vedly Claude Fable 5 a Opus 5, které se přiblížily lidskému rekordu, řada dalších modelů výrazně zaostala. Žádný z běhů nepřišel se zásadně novou metodou, vítězné postupy se podobaly známým technikám z literatury. Podle autorů jde o první experiment tohoto rozsahu, který ukazuje rozdíly ve volbě experimentů, pečlivosti provedení i interpretaci výsledků.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.