La Cina accelera sui modelli del mondo fisico con PhiZero

PhiZero riduce i token per i video del mondo fisico
La Chinese Academy of Sciences (CASIA) ha pubblicato PhiZero, un world model progettato per ragionare in un linguaggio discreto prima di generare video.
Secondo le informazioni disponibili, questo approccio riduce di circa 175 volte il numero di token necessari per produrre un clip della durata di quattro secondi. Il modello separa quindi la fase di ragionamento dalla successiva generazione del contenuto video.
Il risultato segnala una possibile direzione per rendere più efficienti i modelli capaci di rappresentare e simulare il mondo fisico, senza aggiungere oltre i dati disponibili valutazioni sulle prestazioni o sugli impieghi futuri di PhiZero.