Fáze vývoje modelu, která následuje po předtrénování. Zatímco předtrénování naučí model jazyk a fakta z obřího množství textu, post-training z něj dělá užitečného asistenta — doladění na konkrétní úkoly, sladění s lidskými preferencemi přes RLHF a bezpečnostní pravidla. U dnešních modelů to bývá nejdražší část vývoje, protože právě tady se rozhoduje, jestli model odpovídá přesně, slušně a bezpečně.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.