Způsob tréninku robotů, při kterém se model učí nejdřív v počítačové simulaci a hotová politika se pak nasadí do skutečného stroje, aniž by se musela znovu trénovat. Cílem je překlenout takzvanou sim-to-real mezeru — rozdíl mezi ideálním virtuálním světem a nepředvídatelnou realitou, kde fouká vítr, klouže podlaha a senzory lžou. Typicky se kombinuje s posilovaným učením a obměňováním podmínek v simulaci, aby se model naučil chovat robustně.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.