Ricerca
Le parti del discorso come categorie emergenti nello spazio latente degli SAE
Gli autoencoder sparsi (SAE) offrono un modo promettente per esaminare le rappresentazioni dei modelli linguistici, ma non è ancora chiaro quale tipo di struttura linguistica rendano accessibile i lor

- arXiv
- 2609.29362
- Pubblicato
- 2026-09-24
- Autori
- Alessandro Bondielli, Lucia Passaro, Serena Auriemma, Alessandro Lenci
Abstract degli autori
Gli autoencoder sparsi (SAE) offrono un modo promettente per esaminare le rappresentazioni dei modelli linguistici, ma non è ancora chiaro quale tipo di struttura linguistica rendano accessibile i loro latenti. Usiamo le categorie grammaticali (parti del discorso, PoS) come caso di prova controllato per studiare se le informazioni morfosintattiche siano codificate da singoli latenti o da gruppi strutturati di caratteristiche. Rileviamo che le distinzioni tra categorie grammaticali sono altamente recuperabili dalle attivazioni degli SAE, ma non corrispondono a mappature uno a uno tra latenti e categorie. Questa recuperabilità non si riduce alla memorizzazione lessicale e le classi aperte e chiuse delle parti del discorso differiscono sostanzialmente. Le categorie sono rappresentate da gruppi compatti di latenti sparsi, con variazioni significative tra i diversi tag. Questi gruppi rimangono stabili sui dati di test, mostrando al contempo sovrapposizioni tra categorie affini. I nostri risultati mostrano che gli SAE localizzano le informazioni morfosintattiche in forma distribuita e dipendente dalla categoria, anziché attraverso caratteristiche grammaticali atomiche.
Il riassunto di questo paper è disponibile solo in inglese: leggilo nella pagina inglese.
Leggi il paper originale su arXiv