Ricerca
Campi di interazione baricentrica di Wasserstein per modelli fattoriali spaziali: evidenze dalle rappresentazioni dei modelli linguistici
I modelli spaziali di determinazione dei prezzi delle attività finanziarie assumono come data la struttura delle interazioni tra imprese. Noi la ricaviamo dagli ambienti informativi delle imprese usan

- arXiv
- 2608.29669
- Pubblicato
- 2026-08-30
- Autori
- Marcus Gawronsky, Chun-Sung Huang
Abstract degli autori
I modelli spaziali di determinazione dei prezzi delle attività finanziarie assumono come data la struttura delle interazioni tra imprese. Noi la ricaviamo dagli ambienti informativi delle imprese usando rappresentazioni dei modelli linguistici. Ogni impresa è rappresentata come una distribuzione di embedding di articoli di notizie; una ricostruzione baricentrica di Wasserstein ancorata all’impresa bersaglio seleziona, per ciascuna impresa, la combinazione ponderata di altre imprese le cui impronte informative, insieme, ricostruiscono la sua. Il campo diretto di imprese comparabili così ottenuto entra in un modello quadratico di aggiustamento delle esposizioni, nel quale il coefficiente spaziale misura l’allineamento con le imprese comparabili sul piano informativo rispetto all’esposizione considerata isolatamente. Usando campi costruiti a partire dalle notizie del 2018-2022 e fissati prima dei rendimenti del 2023-2026, riscontriamo che il campo costruito organizza la dipendenza tra i rendimenti delle diverse imprese oltre quanto spiegato dai cinque fattori di Fama-French e dal momentum, e aumenta il punteggio quasi-logaritmico gaussiano medio sui dati tenuti da parte rispetto a un modello comparabile basato sui soli fattori. Poiché i beta dei fattori restano invariati, il miglioramento riguarda la covarianza residua. Il campo supera sia la ponderazione basata sulla distanza a coppie sia la ponderazione uniforme delle stesse imprese comparabili e, nella specificazione principale condizionata ai fattori, fornisce informazioni aggiuntive accanto alle co-menzioni persistenti nelle notizie. Il trasporto lineare e quello quadratico producono segnali dei rendimenti delle imprese comparabili pressoché identici e prestazioni predittive equivalenti sui dati tenuti da parte. L’ordinamento per prossimità baricentrica persiste con modelli di embedding alternativi e un encoder del periodo precedente conserva il vantaggio sui dati tenuti da parte nella specificazione principale. Le rappresentazioni dei modelli linguistici fungono quindi da strumento di misurazione della struttura informativa latente tra imprese nei mercati dei capitali.
Il riassunto di questo paper è disponibile solo in inglese: leggilo nella pagina inglese.
Leggi il paper originale su arXiv