Anthropic zveřejnil rozsáhlou zprávu o rizicích, která hodnotí, do jaké míry jeho systémy představují katastrofické nebezpečí. Dokument o 186 stranách vychází z verze 3.4 firemní politiky odpovědného škálování a pokrývá rizika včetně vychýlení modelů v kritických situacích, automatizovaného výzkumu a vývoje a produkce chemických či biologických zbraní. Firma v něm posuzuje všechny své modely, včetně dosud nevydaného interního modelu, a hodnotí nejen schopnosti systémů, ale i účinnost bezpečnostních opatření. Součástí jsou i aktualizované prahové hodnoty pro automatizaci AI výzkumu a vývoj nových biologických a chemických zbraní. Zprávu chce Anthropic vydávat každých tři až šest měsíců jako doplněk k systémovým kartám jednotlivých modelů.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.