Společnost Prime Intellect zveřejnila dosud nejrozsáhlejší veřejný experiment s autonomním výzkumem umělé inteligence. Na optimalizační úloze nanoGPT spustila 153 běhů osmnácti předních modelů, každý trval až osm dní a využil osm akcelerátorů H200. Výsledky ukazují výrazné rozdíly mezi modely: nejlépe si vedly Claude Fable 5 a Opus 5, které se přiblížily lidskému rekordu, řada dalších modelů výrazně zaostala. Žádný z běhů nepřišel se zásadně novou metodou, vítězné postupy se podobaly známým technikám z literatury. Podle autorů jde o první experiment tohoto rozsahu, který ukazuje rozdíly ve volbě experimentů, pečlivosti provedení i interpretaci výsledků.
Prime Intellect otestoval autonomní výzkum osmnácti modelů, nejlépe uspěly Fable 5 a Opus 5