Komunitní projekt ukázal, že model DeepSeek V4 Flash lze rozjet na jediném akcelerátoru AMD MI300X. Repozitář na GitHubu obsahuje konfiguraci a návod pro inference modelu s architekturou mixture of experts, která má stovky miliard parametrů a aktivuje jen část z nich. V praxi to znamená, že náročný model nemusí běžet na obřích serverových sestavách s osmi GPU, ale zvládne ho i jeden akcelerátor se 192 gigabajty paměti. Vývojář v diskusi upozorňuje, že výkon zatím zaostává za oficiálními servery DeepSeek, které na GPU H800 dosahují řádově vyšší propustnosti. I tak jde o další krok k tomu, aby si špičkové otevřené modely mohly provozovat i menší firmy a výzkumné týmy na dostupnějším hardwaru. Projekt vznikl teprve dnes a rychle získal pozornost komunity.