2026年7月20日

AlibabaがQwen3.8-Max-Preview発表、世界2位と主張もベンチマーク非公開に疑問符

Qwen3.8-Max-Preview登場:2.4兆パラメータでマルチモーダル対応

室谷室谷代表取締役
今日はAlibabaが上海の世界人工知能会議(WAIC)で発表したQwen3.8-Max-Previewについて深掘りしていきます。まずは基本情報から。

2.4兆パラメータのモデルで、テキストに加えて画像、動画、ドキュメントも処理できるマルチモーダル対応なんですよね。
テキトー教師テキトー教師DotAI 認定講師
そうですね。Qwenシリーズとしては初めて1兆パラメータを超え、かつマルチモーダルになった点が大きな飛躍です。

AlibabaはこのモデルがAnthropicのClaude Fable 5に次ぐ世界2位の性能だと主張していますが、肝心のベンチマークスコアは一切公開されていません。
室谷室谷代表取締役
そこが最大のポイントですね。前世代のQwen3.7-Maxはリリース時にArtificial Analysis Intelligence Indexで56.6というスコアを公表していたのに、今回はモデルカードも、活性化パラメータ数も、ベンチマークデータもない。

AlibabaのQwenチームはXで「Fable 5に次ぐ2位」とポストしたものの、独立した評価による裏付けはありません。
テキトー教師テキトー教師DotAI 認定講師
単に性能をアピールしたいだけならともかく、数値を出さないのには何か理由がありそうです。例えば、まだモデルが完成していない可能性や、ベンチマークで思うようなスコアが出なかった可能性も考えられます。

プレビュー版という位置づけですから、正式リリースまでに改善するつもりなのかもしれません。
室谷室谷代表取締役
ただ、企業ユーザーが導入を検討する際にはベンチマークスコアは重要な判断材料ですからね。Alibabaとしては「Claude Fable 5に次ぐ」という主張だけで十分なアピールになると見ているのか、あるいは数値を出せない事情があるのか。

いずれにせよ、この非公開は市場に疑問符を投げかけています。

「Claude Fable 5に次ぐ世界2位」の主張、根拠は?

まとめ
「世界2位」主張の根拠不足
  • 具体的な比較データなし
  • LMArenaランキングで低順位
  • 外部の客観的評価がない
  • 前世代とのタスク比較を行っていない
  • オープンウェイトの公開日未定
テキトー教師テキトー教師DotAI 認定講師
では、この主張の根拠について考えてみましょう。AlibabaはXでそうポストしただけで、具体的な比較データは一切ありません。

また、LMArenaのランキングでは、前世代のQwen3.7-Maxはかなり下位に位置しており、Fable 5が1位であるのとは対照的です。
室谷室谷代表取締役
そう。LMArenaのようなクラウドソースのリーダーボードでスコアが出ていない段階で「世界2位」と言われても、正直説得力に欠けるんですよね。

Alibaba自身が運営するリーダーボードではないので、外部の客観的な評価が欲しいところです。
テキトー教師テキトー教師DotAI 認定講師
しかも、Alibabaは前世代のQwen3.7-Maxとのタスクレベルの比較も行っていません。単に「継続的に進化している」と述べるにとどまっています。

Open Weights(オープンウェイト)の公開も「近日中」と約束しているものの、具体的な日付やライセンス条件は未発表です。
室谷室谷代表取締役
つまり、今のところAlibabaの主張を検証する手段がないわけです。それでいて「世界2位」と大々的に宣伝するのは、マーケティング戦略としてはアリかもしれませんが、技術コミュニティからは厳しい目で見られるでしょうね。

前世代Qwen3.7-Maxとの違い:初の1兆超え、ベンチマーク非公開の謎

Qwen3.7-Max vs Qwen3.8-Max-Preview
Qwen3.7-Max
  • パラメータ数: 1兆未満(非公表)
  • マルチモーダル: テキストのみ
  • ベンチマーク公開: あり(AAI Index 56.6)
  • モデルカード: あり
  • 提供形態: 正式リリース
Qwen3.8-Max-Preview
  • パラメータ数: 2.4兆
  • マルチモーダル: 画像、動画、ドキュメント対応
  • ベンチマーク公開: なし
  • モデルカード: なし
  • 提供形態: プレビュー版
テキトー教師テキトー教師DotAI 認定講師
ここで整理しましょう。Qwen3.7-MaxとQwen3.8-Max-Previewの主な違いは以下の通りです。
項目Qwen3.7-MaxQwen3.8-Max-Preview
パラメータ数1兆未満(非公表)2.4兆
マルチモーダルテキストのみ画像、動画、ドキュメント対応
ベンチマーク公開あり(AAI Index 56.6)なし
モデルカードありなし
提供形態正式リリースプレビュー版
室谷室谷代表取締役
なるほど、3.8ではパラメータ数が大幅に増えてマルチモーダルになった反面、透明性が大きく後退している。これは不思議な戦略ですね。

前モデルではベンチマークを公開して信頼を得ていたのに、今回なぜ非公開にしたのか。
テキトー教師テキトー教師DotAI 認定講師
講座でよく言うんですが、ベンチマーク非公開にはいくつかの理由が考えられます。一つは、まだモデルが完成しておらず、プレビュー版のスコアが低いため公表を控えている。

もう一つは、競合に戦略を読まれたくないという意図。ただ、後者の場合でも、ある程度のスコアは出すのが普通ですからね。
室谷室谷代表取締役
あと、パラメータ数2.4兆というのも気になります。GPT-4の推定1.8兆を超える規模ですが、単純にパラメータ数が多ければ性能が高いとは限らない。

活性化パラメータ数も非公開ですし、効率的なアーキテクチャなのかどうかも不明です。
テキトー教師テキトー教師DotAI 認定講師
MoE(Mixture of Experts)モデルであれば、総パラメータ数は大きくても活性化されるのは一部です。AlibabaはQwen3.8のアーキテクチャを詳しく説明していないので、DenseモデルなのかMoEなのかさえわかりません。

利用方法と料金:トライアル期間は通常の10%

室谷室谷代表取締役
利用方法についても見ていきましょう。Qwen3.8-Max-Previewは、Alibabaのサブスクリプションサービス「Token Plan」、および開発者プラットフォーム「Qoder」「QoderWork」から利用可能です。

トライアル期間中は通常料金の10%という破格の価格設定になっています。
テキトー教師テキトー教師DotAI 認定講師
これはかなり積極的なマーケティングですね。低価格で多くの開発者に試してもらい、フィードバックを得たいという意図がありそうです。

ただし、トライアル期間がいつまでかは明記されていませんし、通常料金も発表されていません。
室谷室谷代表取締役
実際に使ってみたい方にとっては、今がチャンスかもしれません。ただし、プレビュー版なので安定性や性能は保証されていません。

商用利用には向かないでしょう。
テキトー教師テキトー教師DotAI 認定講師
あと、Open Weightsの公開も予告されていますが、まだ日付未定です。もしオープンウェイトが公開されれば、Ollamaなどのローカル環境でも実行できる可能性があります。

ただ、2.4兆パラメータのモデルをローカルで動かすにはかなりのリソースが必要ですから、現実的にはクラウドAPI経由での利用がメインになるでしょう。
室谷室谷代表取締役
そうですね。企業が導入する場合も、まずはAPIで性能を評価してから、必要に応じて自社環境にデプロイするという流れになるでしょう。

その点、トライアル価格で試せるのは大きなメリットです。

中国AI競争加速:Kimi K3との直接対決

テキトー教師テキトー教師DotAI 認定講師
この発表のタイミングも興味深いです。わずか3日前に、中国のAIスタートアップMoonshot AIが2.8兆パラメータのモデル「Kimi K3」をリリースしています。

両社とも複数兆パラメータのモデルを相次いで投入しており、中国のAI開発競争が激化していることを示しています。
室谷室谷代表取締役
これまでは米国の大手ラボ(OpenAI、Anthropic、Googleなど)が大規模モデルの主戦場でしたが、中国勢も確実に追い上げています。AlibabaはQwenを自社のクラウド戦略の中核に位置づけており、中国のデフォルトAIサプライヤーになることを目指している。
テキトー教師テキトー教師DotAI 認定講師
実際、Alibabaは過去1年間にわたり、オープンウェイトのモデルを安定してリリースし、クラウドインフラやカスタムチップの開発も進めてきました。その結果、Qwenは中国のモデルファミリーとしては最大級の開発者コミュニティを獲得しています。
室谷室谷代表取締役
今回のQwen3.8でそのコミュニティをいかに取り込むかが勝負ですね。ただし、ベンチマーク非公開という不透明さが逆効果にならないか心配です。

開発者は性能を数値で確認したいはずですから。

よくある質問(FAQ):Qwen3.8のAPI料金や日本語対応は?

まとめ
Qwen3.8 FAQ 要点
  • API料金:トライアル期間中は通常の10%(通常料金は未発表)
  • 日本語対応:明言なしだが、シリーズの多言語対応からおそらく可能(正式情報はリリースノート待ち)
  • ベンチマークスコア:公開予定未発表、正式版リリース時に可能性あり
  • ローカル実行:Open Weights未公開で不可(近日公開予定)、2.4兆パラメータのため高性能ハードウェアが必要
  • 全体:中国AIの躍進と透明性の課題が浮き彫りに
テキトー教師テキトー教師DotAI 認定講師
最後に、読者からよく寄せられそうな質問に答えていきましょう。
室谷室谷代表取締役
はい。まず、API料金ですが、現時点ではトライアル期間中は通常料金の10%とだけ発表されています。

通常料金の具体的な金額はまだ明らかにされていません。今後の正式リリースを待つ必要があります。
テキトー教師テキトー教師DotAI 認定講師
Q: 日本語対応はしていますか?
室谷室谷代表取締役
これに関してはAlibabaが公式に日本語対応を明言しているわけではありません。ただし、Qwenシリーズは多言語対応が進んでおり、Qwen2.5やQwen3.7-Maxでも日本語を含む複数言語に対応していました。

おそらくQwen3.8でも日本語での入出力が可能だと思われますが、正式な情報を確認するにはリリースノートを待つ必要があります。
テキトー教師テキトー教師DotAI 認定講師
Q: ベンチマークスコアはいつ公開されますか?
室谷室谷代表取締役
Alibabaはベンチマークスコアの公開予定について何も発表していません。「プレビュー版」なので、正式版のリリース時に公開される可能性はありますが、確約はできません。
テキトー教師テキトー教師DotAI 認定講師
Q: ローカル環境で実行できますか?
室谷室谷代表取締役
現時点ではOpen Weightsが未公開ですので、ローカル実行はできません。ただし、Alibabaが「近日中に公開する」と約束しているため、それが実現すればOllamaなどを介して実行できるようになる可能性があります。

ただし、2.4兆パラメータのモデルですから、相当なハードウェアが必要になるでしょう。詳しくはQwenの公式GitHubをチェックしてみてください。
テキトー教師テキトー教師DotAI 認定講師
では、最後にQiitaや. AI TIMESでの関連記事をご紹介します。この記事ではChatGPT長期記憶のすべてソフトバンクでChatGPTは無料?代わりに使えるPerplexity Proの魅力なども解説していますので、興味があれば併せてご覧ください。
室谷室谷代表取締役
今回のQwen3.8発表は、中国AIの躍進を象徴する一方、透明性の課題も浮き彫りにしました。今後のOpen Weights公開やベンチマーク結果に注目が集まります。

.AI TIMESでは引き続き追跡していきます。

Related

関連記事

New Articles

新着記事

ニュース

GoogleがGemini 3.8 Flashとサイバー特化版Cyberを発表

2026年9月3日
室谷テキトー教師
ニュース

カサール議員、OpenAIとAnthropicの情報開示は不十分

2026年9月3日
室谷テキトー教師
ニュース

OpenAI調査:AI-native企業は「実行力」で8.3倍差

2026年9月2日
室谷テキトー教師
ニュース

OpenAIが「強力すぎる次期モデル」に安全対策の強化を警告

2026年9月2日
室谷テキトー教師
ニュース

war.gov、ChatGPT MilをGenAI.milで公開

2026年9月1日
室谷テキトー教師
ニュース

国防総省の生成AIポータルにGrokとChatGPT追加、Geminiと並ぶ

2026年9月1日
室谷テキトー教師
ニュース

Anthropic、Claudeの不正行動でAI訓練を一時停止

2026年9月1日
室谷テキトー教師
ニュース

Gemini、破綻Earn巡る仲裁で勝訴 利用者の請求退ける

2026年8月31日
室谷テキトー教師
ニュース

WSJ報道:ソフトバンク、OpenAI確保に55億ドル特典

2026年8月31日
室谷テキトー教師
ニュース

Anthropicが政府取引で「条件提示権」を認めさせる判決をReason Magazineが報道

2026年8月31日
室谷テキトー教師

Join

AIプレナーになる。

入会は審査制です。いまの事業と、AIで何を動かしたいのかを聞かせてください。

参加を申請する