Alibaba ha rivisto il suo più grande modello linguistico: l’aggiornamento „0902“, rilasciato il 2 settembre, offre risultati migliori in tutti gli otto test di codifica che l’azienda ha eseguito – con architettura inalterata e prezzi.
Solo il post-formazione è cambiato
Tecnicamente, poco è nuovo. Il modello funziona ancora su circa 2,4 trilioni di parametri in un design misto di esperti con una finestra di contesto di un milione di tonnellate. Anche il prezzo è invariato: due dollari per milione di gettoni di ingresso e sei per milione di gettoni di uscita. Secondo il team Qwen, solo il post-allenamento è stato migliorato, il che significa la fine-tuning che segue il percorso di base.
Gains focalizzato sulla programmazione
Il salto più chiaro viene in attività di codifica e ufficio. Sulla classifica indipendente Code Arena WebDev, che segna il lavoro di web-sviluppo, la versione 0902 si colloca prima con 1.691 punti – appena davanti a Claude Opus 5 Max di Anthropic e al precedente rilascio. Diversi benchmark di codifica più che raddoppiato i loro punteggi, la società dice. Queste figure provengono principalmente dalle misurazioni di Alibaba e dovrebbero essere lette in mente.
- Rank 1 su Code Arena WebDev (1,691 punti)
- Tutti gli otto test di codifica migliorati
- Prezzo e contesto finestra invariata
Claude conduce ancora su diversi agenti e benchmark ragionanti. Per gli sviluppatori in Germania, Qwen3.8-Max rimane principalmente un’alternativa competitiva al prezzo.
Fonti: OpenRouter · DataC · Wikipedia



















