Alibabaは、9月2日にリリースされた「0902」アップデートを最大の言語モデルに修正しました。変更されていないアーキテクチャと価格設定で、すべての8つのコーディングテストでより良い結果を提供します。
ポストトレインのみ変更
技術的に、少しは新しいです。 モデルは、まだ約2.4兆のパラメータを1千万の文脈ウィンドウで混合したエキスパート設計で実行します。 価格も変更されていません。 – 百万の入力トークンあたり2ドルと、百万の出力トークンあたり6ドル。 Qwenチームによると、ポストトレインのみが改善され、ベーストレーニングが続く微調整が改善されました。
プログラミングに焦点を合わせる利益
最も明確なジャンプは、コーディングとオフィスのタスクで来ます。 独立したコードアリーナWebDevリーダーボードでは、Web開発作業をスコアする、0902バージョンは1,691ポイントで最初にランク付けされます。 AnthropicのClaude Opus 5 Maxと以前のリリースのすぐ先です。 複数のコーディングベンチマークは、そのスコアを倍増させるよりも、同社は言う。 これらの数字は、主にAlibaba独自の測定値から来ており、そのことを念頭に置いて読むべきです。
- コードアリーナWebDev(1,691ポイント)でランク1
- 全8つのコーディングテストが改善されました
- 価格とコンテキストウィンドウが変更されていない
クロードはまだいくつかのエージェントと推論ベンチマークにつながります。 ドイツの開発者にとって、Qwen3.8-Maxは価格競争力のある代替品を主に残しています。
ソース: オープンロイター ・ データキャンプ ・ ウィキペディア



















