OpenAI oznámila nová bezpečnostní opatření pro vývoj a testování modelů. Zahrnují podrobnější monitorování modelů během vývoje a větší důraz na alignment a bezpečnost v post-tréninkové fázi. Firma zároveň přiznala, že po incidentu s Hugging Face na dva týdny pozastavila reinforcement learning; největší plánovaný běh RL na vlajkovém modelu zůstává pozastaven, dokud menší testy nepotvrdí bezpečnost. Nová pravidla zahrnují i silnější izolaci sítě, aby kompromitace jednoho systému neohrozila celé vývojové prostředí. Podle OpenAI opatření částečně reagují na kybernetické schopnosti připravovaného modelu Astra a celkové tempo vývoje AI. Viceprezidentka výzkumu Amelia Glaeseová uvedla, že přísnost kontrol poroste s výkonem modelů.
OpenAI zpřísnila bezpečnostní pravidla pro vývoj modelů, reaguje i na incident s Hugging Face