Ricerca
Suona un accordo: tipografia cinetica modale
Presentiamo la tipografia cinetica modale, che anima un glifo vettoriale per esprimere un concetto semantico senza comprometterne la leggibilità. L’idea centrale è costruire il movimento a partire dai

- arXiv
- 2609.38325
- Pubblicato
- 2026-09-29
- Autori
- Maham Tanveer, Jiyeon Han, Nanxuan Zhao, Hao Zhang
Abstract degli autori
Presentiamo la tipografia cinetica modale, che anima un glifo vettoriale per esprimere un concetto semantico senza comprometterne la leggibilità. L’idea centrale è costruire il movimento a partire dai modi naturali di vibrazione del glifo. In particolare, un problema agli autovalori agli elementi finiti, costruito dal contorno vettoriale, individua i modi di vibrazione a minore rigidezza dell’intera lettera e di ciascuna delle sue parti, consentendo loro di flettersi. Le soluzioni a energia nulla del problema, cioè le traslazioni e le rotazioni rigide, vengono applicate in forma chiusa a ciascuna parte, consentendo alle parti di muoversi anche come blocchi. Per animare il glifo, un modello di diffusione video con parametri congelati supervisiona soltanto le ampiezze e le fasi dei modi. Il nostro approccio modale affronta due limiti dei lavori precedenti. Nell’ottimizzazione libera dei punti mediante distillazione dello score video (SDS), ogni punto e ogni fotogramma si muovono indipendentemente seguendo gradienti rumorosi: il contorno si lacera e il movimento risulta a scatti. I nostri modi, invece, variano in modo regolare lungo il contorno e sono guidati da poche armoniche che coprono l’intero ciclo: i gradienti vengono così vincolati a produrre un movimento fluido e ciclico, senza discontinuità. Le alternative strutturate, d’altra parte, si basano su scheletri o punti chiave derivati da informazioni a priori specifiche per categoria, mentre i nostri modi provengono dal glifo stesso. L’unica informazione a priori è un elenco delle parti mobili di ciascuna lettera, generato una sola volta per l’intero alfabeto da un modello linguistico. Nella tipografia cinetica modale, forma e movimento sono disaccoppiati per costruzione: un unico contorno di base viene modellato per rappresentare il concetto e l’azionamento modale non può modificarlo. Una lettera può quindi anche essere animata senza cambiarne la forma. Il nostro metodo produce un movimento più articolato e fluido rispetto a Dynamic Typography e AniClipart, con un’aderenza al concetto pari o superiore e meno lacerazioni del glifo rispetto a Dynamic Typography. È inoltre preferito dai valutatori umani, anche quando la forma è fissa e il concetto deve essere espresso dal solo movimento. I valutatori umani hanno preferito i nostri risultati anche a quelli di Astra (GPT-6).
Il riassunto di questo paper è disponibile solo in inglese: leggilo nella pagina inglese.
Leggi il paper originale su arXiv