Komunitní projekt ukázal, že model DeepSeek V4 Flash lze rozjet na jediném akcelerátoru AMD MI300X. Repozitář na GitHubu obsahuje konfiguraci a návod pro inference modelu s architekturou mixture of experts, která má stovky miliard parametrů a aktivuje jen část z nich. V praxi to znamená, že náročný model nemusí běžet na obřích serverových sestavách s osmi GPU, ale zvládne ho i jeden akcelerátor se 192 gigabajty paměti. Vývojář v diskusi upozorňuje, že výkon zatím zaostává za oficiálními servery DeepSeek, které na GPU H800 dosahují řádově vyšší propustnosti. I tak jde o další krok k tomu, aby si špičkové otevřené modely mohly provozovat i menší firmy a výzkumné týmy na dostupnějším hardwaru. Projekt vznikl teprve dnes a rychle získal pozornost komunity.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.