HackerRank zveřejnil jako open-source svůj AI nástroj pro hodnocení životopisů a hned první testování odhalilo závažný problém. Jeden vývojář spustil nástroj na svém vlastním životopisu stokrát a výsledné skóre se pohybovalo od 66 do 99 bodů ze 100, přestože se jednalo o naprosto stejný dokument. AI v pozadí používá LLM k extrakci informací a jejich vyhodnocení, ale výsledek je natolik nestabilní, že by stejný kandidát u jedné firmy uspěl a u jiné ne, aniž by se cokoliv změnilo. Případ vyvolává otázky o spolehlivosti AI při rozhodování o lidských osudech v náboru.