AI.info
Latest Research — Page 5
Sfoglia Ricerca recente su AI.info.
In inglese
- Revisione silenziosa: misurare i cambiamenti non dichiarati nei framework di sicurezza degli sviluppatori di IA di frontiera
- Il tuo Transformer può tenere a mente due pensieri contemporaneamente: prove della sovrapposizione lineare negli LLM
- DeformSmith: generazione gerarchica di asset deformabili guidata da un ambiente di prova fisico, per la manipolazione robotica
- Sintesi di competenze ancorate al codice su larga scala per un’intelligenza agentica
- ScienceIDE: trasformare il codice scientifico del mondo in ambienti di apprendimento per agenti
- JEV-as-a-judge: accetta quando è sicuro, passa a una valutazione superiore quando è incerto
- ALPINE: localizzazione adattiva per un apprendimento a pochi esempi efficiente in termini di parametri e campioni
- MemBodied: memoria associativa ricorrente per modelli visione-linguaggio-azione
- RULER: ricompense basate su rubriche consapevoli dell’istanza per la generazione di SVG
- Fidarsi o non fidarsi: verifica dei fatti basata sul recupero di informazioni nel parlato
- AgentRouter: instradamento eterogeneo dei modelli per workflow agentici multi-step a costo ottimale
- Da uno a molti, da molti a uno: addestramento iterativo di esperti consapevole delle categorie per agenti di ingegneria del software
- Un’analisi retrospettiva dell’uso degli LLM per studiare l’apprendimento della sintassi nei bambini
- JarvisGUI: verso agenti GUI per più dispositivi con composizione dinamica delle attività
- Auto-miglioramento ricorsivo degli agenti di ricerca nell’IA
- PACT: dall’assegnazione del credito all’allineamento del critico
- RecreationWorld: ambienti scalabili e verificabili per agenti ibridi per l’uso del computer
- Capacità spettrale neurale: misurare e progettare architetture dalla sola specifica della rete
- LatentPort: oltre la cache KV - trasferimento tra modelli della memoria ricorrente nei modelli linguistici ibridi: passaggio di stato ibrido da 4B a 9B senza ripetere il prefisso nel modello ricevente
- Norme a un prezzo: perché l’allineamento basato sull’apprendimento per rinforzo può promettere, al massimo, una conformità condizionale
- CVSS-X: un corpus multilingue di traduzione vocale da voce a voce per 28 lingue
- Un benchmark in continua evoluzione per il recupero delle informazioni dalle cartelle cliniche elettroniche
- Verifiable Hidden Dynamics Play: generare ambienti di RL per agenti a partire da meccanismi risolti
- StudentBench: il tutoraggio con l’IA e quello umano producono progressi equivalenti nella preparazione al GRE
- The Functionalizer: decomposizione funzionale senza perdita per la tokenizzazione in sottoparole
- Non mascherare l’ambiente: la supervisione delle osservazioni cambia il modo in cui gli agenti esplorano durante l’apprendimento per rinforzo
- FLEET: dall’entropia dei logit a traiettorie potenziate nella generazione del testo
- Verso una curatela partecipativa dei dataset vocali: un caso di studio queer e un quadro concettuale
- OmniVChat: sintesi, benchmarking e addestramento per il dialogo audiovisivo nativo
- Manipolazione di oggetti lineari deformabili mediante il controllo Model Predictive Path Integral con apprendimento basato su reti Long Short-Term Memory bidirezionali
- RRSI: auto-miglioramento ricorsivo regolarizzato dei sistemi di supporto agli agenti
- BRIDGE-EEG: un ponte tra il preaddestramento autosupervisionato e l’impiego efficiente nella classificazione EEG tra dataset
- GraphSkillEvo: ottimizzazione evolutiva delle abilità strutturate in forma di grafo
- Integrare i prior fisici nell’apprendimento robotico: una rassegna
- L’ottimalità per singola matrice non basta: ottimizzazione a tre livelli per la compressione a basso rango degli LLM
- Harness-Zero: distillazione dell’harness tramite l’agente come harness
- PIC: Ripensare l’INR per la codifica delle immagini, con codifica rapida e decodifica in meno di un millisecondo
- Misurare lo stack di serving invece del modello: confondenti nascosti nella valutazione locale dell’uso degli strumenti
- FRAUDSkill: ottimizzazione strutturata delle competenze a pesi congelati per il rilevamento delle frodi audio
- Codifica sparsa convoluzionale adattiva tramite collo di bottiglia informativo per una rappresentazione robusta dei segnali visivi