The Pulse
Tencent presenta Hy-Image 3.5 con editing in più turni in 4K
Tencent Cloud ha documentato Hy-Image-3.5-Preview, un nuovo modello di immagini che supporta la generazione da testo a immagine, da immagine a immagine e la modifica in più turni. Il servizio può generare immagini fino a 4096×4096 pixel e a

AI.info Team ·
Tencent documenta un modello Hunyuan per immagini più grande
Tencent Cloud ha pubblicato la documentazione di Hy-Image-3.5-Preview, un modello Hunyuan per la generazione di immagini, pensato per creare immagini da testo, generarle a partire da altre immagini e modificarle in più turni. La documentazione, aggiornata il 21 settembre 2026, descrive il modello come un servizio in anteprima disponibile tramite la piattaforma TokenHub di Tencent.
A differenza di Hy-Image-3.0, che usa una richiesta convenzionale con prompt e dimensioni, il nuovo modello accetta una conversazione messages in stile OpenAI. Questa struttura permette a un’applicazione di inviare un prompt iniziale, ricevere un’immagine e poi trasmettere un’istruzione successiva insieme alla cronologia della conversazione precedente, per un’altra modifica. Tencent afferma che il servizio restituisce il risultato in modo sincrono, senza richiedere l’invio di un’attività separata e un ciclo di verifica dello stato.
Il modello è identificato nell’API come hy-image-v3.5-preview. L’endpoint documentato è un’interfaccia POST ospitata da Tencent: https://tokenhub.tencentmaas.com/v1/wand/hunyuan-image/v35-generation. Per accedervi servono un account Tencent Cloud, l’attivazione di TokenHub e una chiave API.
Per generare immagini in 4K occorre specificare le dimensioni
Hy-Image-3.5-Preview supporta dimensioni di output da 256 a 8.192 pixel per lato, entro un limite di 16.777.216 pixel per l’area totale. Questo limite consente un output quadrato massimo di 4096×4096, che Tencent definisce 4K.
Per richiedere la risoluzione massima, gli utenti devono indicare un valore specifico per size. L’esempio di Tencent usa 4096x4096. Se il parametro viene omesso, il servizio sceglie le dimensioni in base al prompt e a un’impostazione separata per il budget di pixel. La documentazione di Tencent afferma che le modalità automatiche basate sul budget di pixel arrivano a 2K, mentre per generare direttamente in 4K è necessario specificare il parametro delle dimensioni.
La distinzione è importante per le applicazioni che richiedono risorse di produzione con dimensioni prevedibili. Uno strumento di progettazione può imporre un’area di lavoro fissa, mentre un flusso di lavoro conversazionale può lasciare le dimensioni al modello quando la velocità o la flessibilità della composizione contano più di una dimensione di output prestabilita.
La cronologia della conversazione diventa l’interfaccia di modifica
Nel flusso di lavoro in più turni, la richiesta successiva conserva il messaggio originale dell’utente, la risposta del modello e i record delle immagini generate. Tencent fornisce nella risposta una struttura assembled_history, così gli sviluppatori possono aggiungere il contesto restituito senza dover ricostruire i messaggi interni del servizio trasmessi in streaming.
Per il turno successivo, l’applicazione aggiunge una nuova istruzione dell’utente ai messaggi precedenti. L’ultimo messaggio dell’utente diventa il comando attivo per la generazione dell’immagine, mentre quelli precedenti forniscono il contesto per modifiche come cambiare un soggetto, ritoccare uno stile o rivedere una composizione.
Tencent documenta anche il supporto a testo e immagini di riferimento nello stesso messaggio. Hy-Image-3.5-Preview accetta URL pubblici di immagini o immagini codificate in Base64; ogni immagine può avere una dimensione massima di 20MB e il numero totale di immagini è limitato a 20. La tabella delle immagini di riferimento indica il supporto per PNG, JPEG e JPG.
Più input e più controlli rispetto a Hy-Image-3.0
Il modello in anteprima accetta fino a 100.000 token in input, rispetto al limite di 8.192 caratteri per i prompt indicato per Hy-Image-3.0. La documentazione di Tencent elenca inoltre, tra le funzionalità disponibili, il potenziamento tramite ricerca esterna, la riscrittura del prompt o del ragionamento, dimensioni personalizzate, controlli sull’area, seed casuali e note a piè di pagina sulla filigrana delle immagini.
Gli sviluppatori possono usare un seed compreso tra zero e 263-1. Tencent afferma che, quando un’applicazione deve riprodurre lo stesso risultato, è necessario mantenere invariati seed, prompt e dimensioni. Se non vengono specificate dimensioni precise, il servizio può anche scegliere la dimensione di output in base al prompt.
Entrambe le versioni di Hy-Image operano in modo sincrono tramite TokenHub. Tencent afferma che Hy-Image-3.5-Preview esegue sul server il ragionamento interno basato su SSE e restituisce il fotogramma finale dell’immagine al termine dell’elaborazione. L’applicazione non deve assemblare autonomamente l’output SSE incrementale.
Gli URL temporanei delle immagini affidano agli sviluppatori la responsabilità di conservarle
Gli URL delle immagini generate sono temporanei e scadono dopo 12 ore. Tencent invita gli sviluppatori a scaricare e conservare tempestivamente l’immagine finale. Per le modifiche in più turni, le applicazioni devono inoltre conservare gli URL delle immagini intermedie contenuti nella cronologia assemblata, se intendono riutilizzare quel contesto in un’altra richiesta.
La documentazione di Tencent presenta Hy-Image-3.5-Preview come uno strumento per attività visive professionali, tra cui poster, progettazione di interfacce utente e modifica di immagini di prodotto. Il cambiamento pratico riguarda meno un nuovo formato di prompt e più l’idea di trattare la creazione di immagini come una conversazione in corso: immagini di riferimento, risultati precedenti e nuove istruzioni possono restare nella cronologia di un’unica richiesta, mentre un parametro delle dimensioni preciso può portare l’immagine finale in 4K.
La guida di Tencent Cloud alla generazione di immagini Hy contiene gli schemi delle richieste, gli esempi e i dettagli dei campi di output per Hy-Image-3.0 e Hy-Image-3.5-Preview.