Ricerca
Srijika: restyling dei font per nove scritture indiane mediante il riutilizzo del layout OpenType
Presentiamo Srijika, un sistema per produrre font OpenType installabili per nove scritture brahmiche: Devanagari, Tamil, Bengali, Telugu, Kannada, Malayalam, Gujarati, Gurmukhi e Odia. Anziché generar

- arXiv
- 2609.05661
- Pubblicato
- 2026-09-04
- Autori
- Anil Pai
Abstract degli autori
Presentiamo Srijika, un sistema per produrre font OpenType installabili per nove scritture brahmiche: Devanagari, Tamil, Bengali, Telugu, Kannada, Malayalam, Gujarati, Gurmukhi e Odia. Anziché generare font da zero, Srijika modifica lo stile dei contorni dei glifi di font modello completi per lo shaping. Conserva la cmap e la chiusura GSUB del font modello, nonché i suoi dati GPOS secondo una politica documentata per le metriche: ogni risultato è così, per costruzione, un font completo. Il sistema affronta una sfida centrale nella generazione di font per le scritture indiane: da centinaia a migliaia di legature consonantiche, forme dimezzate e varianti delle matra devono restare coerenti tra loro durante lo shaping OpenType. Srijika produce 66 TTF: 57 preset selezionati e nove font dimostrativi a vocabolario aperto. Tutti superano l’OpenType Sanitizer, mentre HarfBuzz e CoreText riproducono le sequenze di ID dei glifi del font modello nei test che includono numerose legature consonantiche. Una verifica dell’intera chiusura, su 80.915 glifi e 54.812 ancore, quantifica le variazioni delle metriche. La selezione dello stile in linguaggio naturale si avvale di Lipika, un indice di ricerca che comprende circa 650 famiglie di font con licenza aperta. Un modello di diffusione latente condizionato da un riferimento ridisegna i glifi del font modello nello stile selezionato; seguono un controllo selettivo del contenuto, un’armonizzazione e una verifica dei cluster dopo lo shaping, con ricorso ai contorni del font modello quando necessario. Valutiamo il sistema rispetto a baseline senza apprendimento. Nei test basati su soglie SSIM, con famiglie escluse dall’addestramento del modello di diffusione, la copia del font modello supera la generazione per 50 delle 56 varianti di font. La variazione stilistica è misurabile soltanto con un embedding interno ottenuto dallo stesso modello, il cui corpus di addestramento comprende le famiglie escluse: questi risultati richiedono quindi cautela. Una baseline basata sull’apprendimento, una metrica stilistica indipendente e uno studio con partecipanti umani esulano dall’ambito di questo rapporto. I nostri contributi sono la formulazione e la pipeline basate sul riutilizzo del layout, la verifica e il benchmark per nove scritture, e un catalogo di risultati negativi relativo ai tentativi di condizionamento non riusciti, alle scelte della funzione obiettivo e ai limiti dell’inviluppo dei dati nel restyling guidato da riferimenti.
Il riassunto di questo paper è disponibile solo in inglese: leggilo nella pagina inglese.
Leggi il paper originale su arXiv