Meta představila Muse Voice Transcribe, první model pro zvukové vnímání v reálném čase od týmu Meta Superintelligence Labs. Novinka spojuje průběžný převod řeči na text, rozlišování více než dvaceti mluvčích a rozpoznávání konce jednotlivých promluv. Podporuje přes 25 jazyků a dokáže v jedné větě plynule přecházet mezi jazyky. Přepis lze zpřesnit seznamem očekávaných jazyků, klíčových slov a kontextových výrazů, například jmen kontaktů nebo míst. Meta ukazuje živé demo s osmi lidmi v jedné místnosti a tvrdí, že model vede žebříček Artificial Analysis pro streamovaný převod řeči a veřejné benchmarky diarizace. Jde však o výsledky vybrané výrobcem k datu uvedení. Firma technologii staví jako základ budoucích osobních hlasových asistentů a zařízení, která musí zvládat překryvy řeči, přízvuky i běžné přerušování rozhovoru.
Meta představila Muse Voice Transcribe pro živý přepis více mluvčích