AI.info
Latest Research — Page 6
Sfoglia Ricerca recente su AI.info.
In inglese
- Ripensare le tracce complete di ragionamento per il post-training
- Post-addestramento dei modelli linguistici per prestazioni da medaglia d’oro nelle competizioni di programmazione
- Realizzare un sistema di riconoscimento vocale greco-inglese per l’uso in produzione
- VeriPhy: ragionamento fisico agentico per la valutazione e il perfezionamento dei modelli del mondo
- CORE: migliorare il ragionamento composizionale negli embedding dei MLLM tramite distillazione del reranker
- PARSER: leggere in parallelo, ragionare in profondità per agenti LLM con contesti lunghi
- Occamy-1.0: intelligenza aperta da 35B sulla frontiera di Pareto per il lavoro collaborativo
- UrbanGround: dalla percezione locale alla capacità di agire nello spazio in una città a scala reale
- Rufus-Air: una ricetta aperta di post-addestramento per LLM
- La fedeltà della chain-of-thought nei modelli di ragionamento varia a seconda di dove e come vengono presentati i segnali di preferenza
- Calibrare la discrepanza tra docente e studente per la distillazione on-policy
- Il repository di codice di Schrödinger: gli LLM hanno imparato SWE-bench o l’hanno memorizzato?
- DF26: non riusciamo più a distinguere il falso dal vero
- Misurare il trasferimento linguistico nelle policy robotiche: aggiungere il greco a una policy visione-linguaggio-azione Cosmos3
- Selezionare, comprimere, reinvestire: uno studio controllato sull’allocazione dei token visivi nei MLLM per video lunghi
- Valutazione della generalizzazione di nnU-Net tra diverse popolazioni con tumore cerebrale in BraTS-GoAT 2026
- Principia: test di fisica relazionale per i modelli video
- OpenWAM: un’esplorazione aperta e modulare verso il pretraining sistematico dei modelli mondo-azione
- Ignoranza o incompetenza? Costruire compiti verificabili vincolati all’accesso alle conoscenze per agenti basati su LLM
- Ultimo benchmark di traduzione
- ReGround: collegare i commenti dei revisori alle evidenze multimodali
- Decoy Direction Optimization: una difesa a posteriori contro l’abliterazione degli LLM
- Tri-PvP: mettere in luce il bias di modalità nei modelli linguistici di grandi dimensioni omni-modali attraverso conflitti tra evidenze percettive e proposizionali
- RGBD20K: un benchmark su larga scala per la segmentazione semantica RGB-D
- Agensh: scalare l’intelligenza organizzativa fino a 1.024 agenti
- JEPA-Anything: apprendere modelli predittivi in mondi diversi
- RSIAgent: esplorazione autonoma per l’auto-miglioramento ricorsivo in nuovi ambienti
- Recursive Code World Models: costruire mondi complessi attraverso programmi di scena ricorsivi
- L’1% dei token può bastare: sulla stima del gradiente nella distillazione on-policy
- ActionPiece: ripensare la tokenizzazione delle azioni per i modelli autoregressivi visione-linguaggio-azione
- HyQuant: quantizzazione a precisione ibrida per l’attenzione degli LLM
- La competizione PNPL del 2026: classificazione delle parole e generalizzazione efficiente tra soggetti in LibriBrain100
- UniMate: un modello unificato per animare scheletri diversi
- Piccoli modelli linguistici come giudici nell’apprendimento per rinforzo basato su rubriche di valutazione
- La catena linguistica nell’allineamento: ottimizzazione delle preferenze mediante ranking interlinguistico
- Separazione tra flusso di controllo e flusso di dati: ottimizzazione stabile dei prompt negli LLM multiagente
- X-Planner: pianificazione dei compiti strutturata per eventi per l’intelligenza incarnata
- ImIR: addestramento con istruzioni per immagini per il ripristino di immagini con un unico modello
- AV-GRPO: apprendimento per rinforzo con diffusione e disaccoppiamento ancorato alla modalità per la generazione congiunta di audio e video
- EventEgoHands++: ricostruzione della mesh 3D delle mani da una prospettiva egocentrica basata su eventi con un dataset reale