AI.info
Latest Research — Page 9
Sfoglia Ricerca recente su AI.info.
In inglese
- Gricea: una piattaforma di scienza aperta per la ricerca sull’IA conversazionale
- BLARM: animare oggetti 3D a partire da video combinando primitive latenti di movimento rigido
- NOAH: apprendere l’intero percorso del paziente. Un modello longitudinale multimodale che tiene conto del tempo per la rappresentazione e la previsione
- Agenti su larga scala: un’architettura incentrata sulla percezione per agenti persistenti
- Discovery Foundation Models: verso un’intelligenza della scoperta aperta
- Quanto vale un diritto umano? ECtHR-NPD: un benchmark per prevedere i risarcimenti per danno non patrimoniale
- RealSWE: una valutazione composizionale degli agenti di programmazione alle prese con richieste realistiche degli utenti
- SpeakerMem-R1: memoria a doppio binario incentrata sui parlanti per il dialogo tra più partecipanti
- Tenere o scartare? Un tokenizer adattivo per una rappresentazione compatta dei video
- SpatialBlock: potenziare l’intelligenza spaziale nei LVLM attraverso un problema sintetico di impilamento di blocchi
- Bloccati all’ingresso, liberi all’interno: dove RLVR restringe lo spazio delle soluzioni
- WanPE: verso un miglioramento cinematografico dei prompt per la moderna generazione di video da testo
- GeoPair: fattorizzazione interstrato che preserva la geometria per la compressione dei transformer senza addestramento
- Cadence: compressione con perdita e limite d’errore delle serie temporali della domanda con un modello di base per serie temporali
- I team di agenti auto-organizzati imparano a ragionare insieme
- Far progredire i grandi modelli di ragionamento oltre la supervisione umana: un percorso verso la superintelligenza
- RelightFormer: transformer generativo feed-forward per la ri-illuminazione di oggetti da più viste
- Modello del mondo programmabile
- Zero-WAM: modellazione in contesto del mondo e delle azioni a partire da video di persone per la generalizzazione a compiti aperti
- Codificata presto, usata tardi: dove i transformer iniziano ad agire in base alla competenza dedotta dell’interlocutore
- Individuare qualsiasi cosa nei video: ripensare la localizzazione spazio-temporale generativa efficiente
- L’illusione dell’allineamento nei grandi modelli linguistici multimodali
- Ring Forcing: verso una memoria a lungo termine precisa per la diffusione video autoregressiva
- Ottimizzazione della politica di Bellman
- Un test della macchina della verità per i modelli linguistici: leggere le conoscenze che un modello non rivela
- EvoHarnessBench: i tuoi agenti riescono a tenere il passo con un harness in evoluzione?
- DeepSeek-V4.1-Flash: spingere la compressione della cache KV al limite
- Rapporto tecnico su StepAudio 3 Gen
- Imparare a scoprire matematica interessante
- L’agente di buon gusto: misurare e migliorare il gusto nei compiti a lungo termine
- Blindspot: un benchmark per la calibrazione della sicurezza e dei rifiuti negli agenti che usano strumenti su orizzonti lunghi
- Quando i modelli modificano troppo: la fedeltà delle modifiche minime al codice
- WorldCrafter: modello video del mondo coerente con memoria implicita consapevole del 3D
- Ordinamento equo dei feed per il bilancio partecipativo
- Uno studio empirico sulla progettazione degli harness per agenti di coding
- Qwen-Planner-Agent: un framework di IA per l’IA a ciclo chiuso per agenti di pianificazione mobile nel mondo reale
- Rifiutare senza rifiuto: un’analisi strutturale delle risposte nell’addestramento alla sicurezza per ridurre i falsi rifiuti nei modelli linguistici
- Creazione agentica di artefatti: sistemi, valutazione, principi e opportunità
- Smussamento e validazione basati sulle previsioni per la valutazione disaggregata dell’IA
- Il router interno: far emergere l’instradamento nativo delle skill da un LLM congelato