AI News JAPAN

世界のAIニュースを最速で把握できるメディア

Advertisement

中国Alibaba「Qwen3.8-Max」発表、2.4兆パラメータで一部GPT・Claude超えを主張

30秒サマリー

  • Alibaba Cloudが2.4兆パラメータの大規模AIモデル「Qwen3.8-Max」を2026年8月3日に正式リリース
  • 一部ベンチマークでOpenAI「GPT-5.6 Sol」やAnthropic「Claude Fable 5」を上回るスコアを記録
  • 来週にはモデルの重み(オープンウェイト)を公開予定。API料金は入力2ドル/出力6ドル(100万トークンあたり)

何が起きたか

Alibaba Cloud(中国アリババ傘下)は2026年8月3日、AIモデル「Qwen3.8-Max」を正式リリースした。パラメータ数は2.4兆で、同社がこの規模のモデルをオープン化するのは今回が初となる。モデルの重みは来週公開予定で、中規模モデル「Qwen3.8-27B」とあわせて提供される。

性能面では、コーディングベンチマーク「Terminal Bench 2.1」でAnthropicの「Claude Fable 5」を、「SWE-bench Pro」ではOpenAIの「GPT-5.6 Sol」をそれぞれ上回ったとしている。一方、コーディングエージェント向けベンチマーク「DeepSWE 1.1」などでは両モデルのスコアを下回っており、優位性はベンチマークによって異なる。

デモでは10日以上にわたり自律的にコーディング作業を継続したほか、研究論文の改善、企業法務タスク、Webデザインなど幅広い業務への適用も示された。提供チャネルはAlibaba Cloudの「Qwen Studio」および「QwenCloud」で、API料金は100万トークンあたり入力2ドル・出力6ドル。

原典ハイライト

原文によれば、Alibaba Cloudがこの規模(2.4兆パラメータ)のモデルをオープン化するのは初。一部ベンチマークでは最先端の米国製モデルを上回る結果を示す一方、ベンチマークによっては下回る場面もあり、性能の優劣は用途次第とみられる。

出典: ITmedia AI+(報道)

So What?(なぜ重要か)

2.4兆パラメータ級のモデルが来週にも無償でオープン化されることで、GPUリソースさえあれば企業が自社環境で最高水準に近いLLMを運用できる現実的な選択肢が増える。中国製LLMの実用性能が米国製主要モデルに肉薄しつつあることは、AIインフラの調達・選定戦略に直接影響する。

日本企業への示唆

オープンウェイトが公開されれば、自社クラウドやオンプレミス環境へのローカル展開が可能になり、データを外部送信せずに済む点で機密性の高い業務(法務・研究開発など)での活用が検討しやすくなる。API料金(入力2ドル・出力6ドル/100万トークン)の水準は競合比較の際の参考値として押さえておきたい。一方、ベンチマーク結果はタスク種別により差があるため、自社ユースケースでの評価を必ず行うことが重要。中国製モデルの採用に際してはデータガバナンスやサプライチェーンリスクの社内審査も必要になるとみられる。

背景・経緯

Alibabaは「Qwen」シリーズを継続的にリリースしており、原文中の関連記事には「Qwen3.6-27B」がClaude Opus 4.5に迫る性能をうたった事例や、DL数10億超という普及実績への言及がある。今回の「3.8-Max」は同シリーズの最上位モデルに位置付けられる。