Jazykový model, který negeneruje text tak, že by předpovídal další token, ale postupným čištěním šumu z náhodného výchozího stavu — podobně jako difuzní modely u obrázků. Text tak může vznikat paralelně a často výrazně rychleji než u klasických LLM. Zástupcem je třeba model Celeris-1, který dosahuje rychlosti kolem dvou tisíc výstupních tokenů za sekundu.