login LOGIN
CHIUDI chiudi
Il mio profilo

mostra
Hai dimenticato la password?
Inserisci l'indirizzo email di registrazione per reimpostare la password.
Segui le istruzioni che ti abbiamo inviato per posta elettronica.

Alibaba lancia Qwen3.8-Flash, la nuova AI che punta a competere con Claude nel coding

Ascolta l'articolo

Alibaba presenta Qwen3.8-Flash, un nuovo modello AI ottimizzato per coding e attività agentiche che in alcuni benchmark supera anche Claude Opus 4.6.

intelligenza artificiale Koupei Studio / Shutterstock

In Breve (TL;DR)

  • Alibaba ha presentato Qwen3.8-Flash, versione commerciale di Qwen3.8-Flash-Next, modello open-weight con 125 miliardi di parametri principali e 6 miliardi attivati per token.
  • Nei benchmark ufficiali, Qwen3.8-Flash-Next supera Claude Opus 4.6 in diversi test di coding, tra cui SWE-bench Pro e LiveCodeBench v6.
  • Il modello supporta fino a 1 milione di token di contesto, può essere utilizzato anche attraverso Claude Code e punta su costi API particolarmente contenuti.

Alibaba accelera ancora nello sviluppo dell’intelligenza artificiale con Qwen3.8-Flash, un nuovo modello pensato per offrire elevate prestazioni nel coding, nelle attività agentiche e nei compiti professionali mantenendo costi di utilizzo contenuti.

Il modello commerciale disponibile attraverso QwenCloud deriva da Qwen3.8-Flash-Next, versione open-weight pubblicata dal team Qwen su Hugging Face e ModelScope. La sua architettura utilizza 125 miliardi di parametri principali, ma ne attiva soltanto 6 miliardi per ogni token elaborato, con l’obiettivo di ridurre sensibilmente le risorse necessarie durante l’inferenza.

Proprio l’efficienza rappresenta uno degli elementi centrali della nuova release. Secondo Alibaba, rispetto a Qwen3.7-Plus, Qwen3.8-Flash-Next richiede circa un nono del costo di addestramento e inferenza, pur migliorando le prestazioni soprattutto nel coding e nelle attività di produttività.

Qwen3.8-Flash sfida Claude nel coding

Uno degli aspetti più interessanti riguarda le prestazioni nella generazione e gestione del codice. Nei benchmark pubblicati dal team Qwen, Qwen3.8-Flash-Next ha ottenuto 62,5 punti su SWE-bench Pro, contro 53,4 di Claude Opus 4.6 Max. Su SWE-bench Multilingual ha raggiunto 81 punti contro 77,5 di Claude, mentre su LiveCodeBench v6 il risultato è stato 91,9 contro 88,8.

Anche sul benchmark NL2Repo-Bench, dedicato alla generazione di codice a livello di repository, il modello Alibaba ha ottenuto 48,1 punti, leggermente sopra i 47,6 di Claude Opus 4.6.

Naturalmente questi risultati non significano che Qwen3.8-Flash sia superiore a Claude in qualsiasi attività. I benchmark misurano capacità specifiche e le prestazioni reali possono cambiare in base al tipo di richiesta, agli strumenti disponibili e alla configurazione utilizzata.

Il confronto mostra però quanto i modelli Qwen stiano diventando competitivi proprio in uno degli ambiti nei quali Claude è particolarmente utilizzato: coding, agenti AI e automazione dello sviluppo software.

Come funziona Qwen3.8-Flash

Qwen3.8-Flash-Next utilizza una nuova architettura Mixture of Experts, progettata anche come anticipazione di alcune tecnologie che Alibaba intende portare nella futura famiglia Qwen4.

Il modello dispone di 125 miliardi di parametri principali, ai quali si aggiungono 51 miliardi di parametri dedicati agli N-gram embedding, ma per ogni token ne vengono attivati soltanto 6 miliardi. Questo permette di contenere la quantità di calcolo necessaria rispetto a modelli che utilizzano tutti i propri parametri contemporaneamente.

Il modello supporta inoltre input testuali, immagini e video e integra capacità di function calling e utilizzo di strumenti.

Particolarmente ampia è anche la finestra di contesto: la versione open supporta nativamente 262.144 token, estendibili fino a un milione attraverso YaRN. La versione Qwen3.8-Flash disponibile tramite QwenCloud utilizza invece direttamente una context window da 1 milione di token.

Qwen3.8-Flash può essere utilizzato anche con Claude Code

Un dettaglio interessante riguarda la compatibilità con gli strumenti già utilizzati dagli sviluppatori. Le API di Qwen supportano infatti il protocollo API di Anthropic, rendendo possibile utilizzare Qwen3.8-Flash direttamente con Claude Code modificando il modello e l’indirizzo del servizio a cui viene inviata la richiesta.

Il modello supporta inoltre il protocollo OpenAI Responses e può essere configurato per funzionare con Codex.

Questo non significa che Qwen3.8-Flash diventi Claude o un modello OpenAI: è il servizio Alibaba a rendere le proprie API compatibili con protocolli già utilizzati dagli strumenti di sviluppo, facilitando così il passaggio da un modello all’altro.

Quanto costa utilizzare Qwen3.8-Flash

Alibaba punta anche sul prezzo per rendere il nuovo modello competitivo. Qwen3.8-Flash tramite QwenCloud viene indicato a 0,16 dollari per un milione di token in input e 0,47 dollari per un milione di token in output, con l’accesso API previsto in arrivo.

Allo stesso tempo, la disponibilità dei pesi di Qwen3.8-Flash-Next su Hugging Face e ModelScope permette a sviluppatori e organizzazioni di eseguire la versione open-weight sulla propria infrastruttura, evitando necessariamente di dipendere da un servizio API esterno.

È proprio questa combinazione tra prestazioni, costi contenuti e disponibilità open-weight a rendere il nuovo modello interessante. Alibaba sta cercando di ridurre la distanza tra modelli aperti e sistemi proprietari avanzati, soprattutto nel coding e nelle attività agentiche.

Qwen3.8-Flash non rende quindi improvvisamente superflui Claude o gli altri grandi modelli commerciali, ma conferma una tendenza sempre più evidente: anche modelli aperti ed efficienti possono ormai raggiungere, e in alcuni test superare, sistemi proprietari di fascia alta.

Per saperne di più: Intelligenza Artificiale: cos'è e cosa può fare per noi

Alibaba lancia Qwen 3.8-Max, l’azienda cinese punta sull'AI open-weight

Qwen 3.8-Max è il nuovo modello AI di Alibaba che punta su prestazioni di alto livello e distribuzione open-weight per accelerarne l'adozione. Ecco cosa cambia

Domande frequenti (FAQ)

  • È un nuovo modello AI di Alibaba disponibile attraverso QwenCloud. Deriva dalla versione open-weight Qwen3.8-Flash-Next ed è ottimizzato soprattutto per coding, utilizzo di strumenti e attività agentiche.
    È un nuovo modello AI di Alibaba disponibile attraverso QwenCloud. Deriva dalla versione open-weight Qwen3.8-Flash-Next ed è ottimizzato soprattutto per coding, utilizzo di strumenti e attività agentiche.
  • Qwen3.8-Flash è un modello da 27 miliardi di parametri?
    No. Qwen3.8-Flash-Next utilizza 125 miliardi di parametri principali, più 51 miliardi dedicati agli N-gram embedding, con 6 miliardi di parametri attivati per token.
  • Qwen3.8-Flash è migliore di Claude per programmare?
    In alcuni benchmark ufficiali di coding ottiene risultati superiori a Claude Opus 4.6, ma questo non significa che sia migliore in qualsiasi attività o scenario.
  • Qwen3.8-Flash funziona con Claude Code?
    Sì. Alibaba supporta il protocollo API di Anthropic, quindi Qwen3.8-Flash può essere configurato come modello utilizzato all’interno di Claude Code.
  • Qwen3.8-Flash è open source?
    La versione Qwen3.8-Flash-Next è open-weight ed è disponibile su Hugging Face e ModelScope. Qwen3.8-Flash è invece la versione di produzione servita attraverso QwenCloud.
A cura di Cultur-e
Addestramento IA non consentito: É assolutamente vietato l’utilizzo del contenuto di questa pubblicazione, in qualsiasi forma o modalità, per addestrare sistemi e piattaforme di intelligenza artificiale generativa. I contenuti sono coperti da copyright.
Whatsapp
Segui le ultime notizie sul nostro canale Whatsapp
Immagine principale del blocco
Segui le ultime notizie sul nostro canale Whatsapp
Fda gratis svg
Iscriviti al canale gratuito

Iscriviti
all'area personale

Per ricevere Newsletter, scaricare eBook, creare playlist vocali e accedere ai corsi della Fastweb Digital Academy a te dedicati.