Společnost ngrok, známá tunelováním lokálních služeb, vydala obsáhlou esej Compression is prediction. Autorka Annie Sexton v ní vysvětluje, že kompresory a jazykové modely se v jádru snaží vyřešit stejný problém, a provádí čtenáře základy komprese až k tomu, jak souvisí s predikcí dalšího tokenu. Text názorně ukazuje, jak funguje redundance dat, minifikace nebo kvantizace, a propojuje je s tím, co se modely učí při tréninku. Esej navazuje na sérii článků o zmenšování modelů a prompt cache. Na Hacker News se text stal nejsledovanější technickou diskusí dne. Pro vývojáře jde o srozumitelný úvod do toho, proč dnešní jazykové modely fungují tak, jak fungují.