Abstrakte KI-Visualisierung fuer ein neues Sprachmodell

Alibaba rafraîchit Qwen3.8-Max: même prix, compétences de codage plus précises

Alibaba a révisé son plus grand modèle de langue : la mise à jour « 0902 », publiée le 2 septembre, offre de meilleurs résultats sur les huit tests de codage que l’entreprise a effectués – avec une architecture et des prix inchangés.

Seul le post-formation a changé

Techniquement, peu est nouveau. Le modèle fonctionne toujours sur environ 2,4 billions de paramètres dans une conception de mélange d’experts avec une fenêtre contextuelle d’un million. Le prix est également inchangé – deux dollars américains par million de jetons d’entrée et six par million de jetons de sortie. Selon l’équipe de Qwen, seul le post-entraînement a été amélioré, c’est-à-dire le réglage fin qui suit la course d’entraînement de base.

Gains axés sur la programmation

Le plus clair saut vient dans le codage et les tâches de bureau. Sur le classement indépendant Code Arena WebDev, qui marque le travail de développement web, la version 0902 se classe en premier avec 1691 points – juste devant Claude Opus 5 Max d’Anthropic et la version précédente. Plusieurs points de repère de codage ont plus que doublé leurs scores, dit l’entreprise. Ces chiffres proviennent principalement des propres mesures d’Alibaba et doivent être lus dans cet esprit.

  • Classement 1 sur Code Arena WebDev (1 691 points)
  • Amélioration des huit tests de codage
  • Prix et contexte fenêtre inchangé

Claude est toujours à la tête de plusieurs critères d’agent et de raisonnement. Pour les développeurs en Allemagne, Qwen3.8-Max reste principalement une alternative concurrentielle sur les prix.

Sources : OuvrirRouter · Base de données · Wikipédia

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *

Mastodon
Retour en haut