OpenAI 16. června popsala metodu Deployment Simulation, která před vydáním nového modelu přehrává reálné, deidentifikované konverzační kontexty s kandidátním modelem a měří, jak často se objeví nežádoucí chování. Firma uvádí, že techniku použila u nasazení modelů řady GPT-5 Thinking a že jí pomohla lépe odhadovat produkční rizika než úzce připravené testovací prompty. Pro trh je to důležité hlavně proto, že bezpečnost frontier modelů se posouvá od jednorázového red-teamingu k měřitelnějšímu přednasazovacímu provoznímu testování. Pokud se podobné postupy stanou standardem, budou mít vliv na tempo releasů, audity i regulaci.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.