Vai al contenuto
AI.info

Ricerca

Le parti del discorso come categorie emergenti nello spazio latente degli SAE

Gli autoencoder sparsi (SAE) offrono un modo promettente per esaminare le rappresentazioni dei modelli linguistici, ma non è ancora chiaro quale tipo di struttura linguistica rendano accessibile i lor

Le parti del discorso come categorie emergenti nello spazio latente degli SAE
arXiv
2609.29362
Pubblicato
2026-09-24
Autori
Alessandro Bondielli, Lucia Passaro, Serena Auriemma, Alessandro Lenci

Abstract degli autori

Gli autoencoder sparsi (SAE) offrono un modo promettente per esaminare le rappresentazioni dei modelli linguistici, ma non è ancora chiaro quale tipo di struttura linguistica rendano accessibile i loro latenti. Usiamo le categorie grammaticali (parti del discorso, PoS) come caso di prova controllato per studiare se le informazioni morfosintattiche siano codificate da singoli latenti o da gruppi strutturati di caratteristiche. Rileviamo che le distinzioni tra categorie grammaticali sono altamente recuperabili dalle attivazioni degli SAE, ma non corrispondono a mappature uno a uno tra latenti e categorie. Questa recuperabilità non si riduce alla memorizzazione lessicale e le classi aperte e chiuse delle parti del discorso differiscono sostanzialmente. Le categorie sono rappresentate da gruppi compatti di latenti sparsi, con variazioni significative tra i diversi tag. Questi gruppi rimangono stabili sui dati di test, mostrando al contempo sovrapposizioni tra categorie affini. I nostri risultati mostrano che gli SAE localizzano le informazioni morfosintattiche in forma distribuita e dipendente dalla categoria, anziché attraverso caratteristiche grammaticali atomiche.

Il riassunto di questo paper è disponibile solo in inglese: leggilo nella pagina inglese.

Leggi il paper originale su arXiv