Ricerca
Occamy-1.0: intelligenza aperta da 35B sulla frontiera di Pareto per il lavoro collaborativo
Gli agenti per il lavoro collaborativo eseguono flussi di lavoro complessi che combinano raccolta di informazioni, uso di strumenti, programmazione e manipolazione di file attraverso numerose chiamate

- arXiv
- 2609.11977
- Pubblicato
- 2026-09-14
- Autori
- Wenhui Chen, Shiwen Cheng, Hao Dong, Chenda Duan, Ruixiang Feng, Zhong Guan, Boqiang Guo, Xueyuan Han, Haojie Hao, Liangmeng Huang, Zhelong Huang, Xinke Kong, Hongyu Li, Jiazheng Li, Junbo Li, Qingchuan Li, Yukun Lian, Chang Liu, Tianyu Liu, Zicheng Liu, Shuyi Ouyang, Yijun Pan, Kunyu Shi, Xiaojun Tang, Bingquan Wang, Kesu Wang, Yuchen Wang, Sibo Wei, Sicong Xie, Xiaoying Xing, Yi Xu, Zhijun Xu, Hongwei Xue, Qingcheng Zeng, Di Zhang, Guannan Zhang, Haochen Zhang, Tianlong Zhang, Tianyu Zhao, Tianyu Zhao, Yanjun Zheng, Jialong Zhu, Zijian Zou
Abstract degli autori
Gli agenti per il lavoro collaborativo eseguono flussi di lavoro complessi che combinano raccolta di informazioni, uso di strumenti, programmazione e manipolazione di file attraverso numerose chiamate al modello. Poiché costi e tempi di risposta si accumulano nell’arco dell’intero processo, il loro valore pratico dipende non solo dalla capacità massima, ma anche dall’efficienza con cui questa viene messa a disposizione. Eppure, molte fasi del lavoro quotidiano richiedono soprattutto di tenere traccia dello stato delle attività, coordinarsi, riprendersi dagli errori e portare a termine i compiti, più che capacità di ragionamento da modello di frontiera. Presentiamo Occamy-1.0, un modello efficiente in termini di costi per il lavoro collaborativo, ottenuto proseguendo l’addestramento del checkpoint Qwen3.6-35B-A3B già sottoposto a post-training. Costruiamo dati e ambienti basati sull’esecuzione, registriamo traiettorie riproducibili di lunga durata in diverse infrastrutture di esecuzione e usiamo un post-training per fasi per sviluppare e consolidare capacità di esecuzione complementari. Su un’ampia serie di benchmark per il lavoro collaborativo, Occamy-1.0 si colloca stabilmente tra i modelli più performanti di dimensioni comparabili e rimane competitivo con sistemi di frontiera molto più grandi in diversi compiti. Secondo il protocollo di valutazione e di determinazione dei prezzi da noi indicato, le sue prestazioni aggregate su quattro benchmark rappresentativi lo collocano nel punto di flesso a basso costo della frontiera di Pareto osservata tra costi e prestazioni. Valutazioni aggiuntive sulla chiamata agli strumenti, sulla programmazione e sul rispetto delle istruzioni mostrano inoltre che questa specializzazione preserva ampie capacità agentiche. Rendiamo disponibili i pesi del modello e un sottoinsieme dei dati di addestramento per sostenere la ricerca sugli agenti pratici per il lavoro collaborativo e sul post-training agentico.
Il riassunto di questo paper è disponibile solo in inglese: leggilo nella pagina inglese.
Leggi il paper originale su arXiv