Google uvedl do všeobecné dostupnosti Gemini Omni Flash, výkonný multimodální model určený pro generování a editaci videa. Model zpracovává současně text, obraz, zvuk i video, což umožňuje soudržnější a konzistentnější výstupy než u předchozích generací. Hlavní předností je možnost iterativního vylepšování videa prostřednictvím konverzace v přirozeném jazyce – uživatel popíše, co chce změnit, a model úpravu provede při zachování původního obsahu. Gemini Omni kombinuje porozumění fyzice s historickým, vědeckým a kulturním kontextem, což má podle Googlu posunout generované video od fotorealismu ke smysluplnému vyprávění.