Qwen 3.8 vs Kimi K3: 二大中国製オープンウェイト巨人、直接対決
Guides & Insights

Qwen 3.8 vs Kimi K3: 二大中国製オープンウェイト巨人、直接対決

著者

jinhao song

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Qwen 3.8 Max が比較されるすべてのモデルの中で、Kimi K3 Moonshot からのものが最も自然なライバルである:両方とも巨大な中国の Mixture-of-Experts モデルであり、両方ともオープンウェイトクラスであり、両方とも有名なほど冗長で、徹底的で、遅い。実際、それらは中国のオープンウェイト世界の二大巨人であり、そして異常なことに、それらがどう比較されるかを推測する必要はない。なぜなら誰かが同じタスクでそれらを対決させたからだ。これにより、このシリーズで最も豊かな比較となる:ベンダーの主張と監査された数字ではなく、真の直接対決である。

詳細に入る前に、ビルダーへの注意事項です。これほど僅差の競争を決着させる誠実な方法は、両方を自分のワークロードで実行し、網羅性と速度のトレードオフを観察することです。OrcaRouterは、200以上のモデルを1つのOpenAI互換エンドポイントの背後に配置しているため、あなたは対決させることができますQwen 3.8をKimi K3と、同じプロンプトで、2つのSDKを接続する必要はありません。

TL;DRの結論。 唯一の直接対決 (Trilogy AI, アーキテクチャ理解タスク) では、 Kimi K3 は 83/100、Qwen 3.8 Max は 80/100 を獲得 — わずか3ポイント差でKimiに軍配。しかしQwenの方がより*徹底的*でした: 354 リポジトリ引用 vs 274、22 ゲートウェイリクエスト vs 53、および 0 の失敗したツール呼び出し vs 2、 より高いレイテンシとより多くのトークンの代償を伴いました。両者とも90%のキャッシュヒットを達成し、同じ中核的なアーキテクチャ判断に到達しました。現在、Kimi K3 はより安全なオープンウェイトの選択肢です — 監査済みスコア (57.1、Artificial Analysis で #3) を持ち、Arena フロントエンドクラウン、そして実質的にここにある重みを持っています。Qwen 3.8 は注目すべきものです:野心はより大きく、探索はより徹底的ですが、公開ボードではスコアがなく、重みは「近日公開」のみ

重要なポイント

Qwen 3.8 Max2.4TパラメータMoE プレビュー; Kimi K32.8T MoE 1Mコンテキストとネイティブビジョンを備えた — つまりQwenは約 400Bパラメータ小さい、 より多くのパラメータ数が優れているとは限らないという教訓。

• 唯一の直接テスト(Trilogy AI)では、 Kimi K3がQwenを80対83で僅差で上回った全体的に — しかしQwenはより多くのリポジトリ引用(354対274), より少ないゲートウェイリクエスト(22対53)、そして ツール呼び出しの失敗ゼロ(vs 2)

• Kimi K3には監査済みのAA Intelligence Index(57.1、#3) — Fable 5とGPT-5.6 Solに次いで、他のすべてに先行している。Qwen 3.8は独立したベンチマークがまったくない

• Kimi K3はLMArena frontend-code 1位 (1679)も保持しています; Qwen 3.8は公開リーダーボードでスコアが付けられていません。

• 開放性はほぼ同等だが、タイミングが異なる:Kimi K3の重みは公開済み/公開予定で、ほぼ準備が整っている。一方、Qwen 3.8の重みは「近日公開」とされているが、日付、ライセンス、リポジトリはまだない。

Qwen 3.8の数値はベンダーの主張または初期の制御されていないハンズオンの印象 — 独立して監査されていない 。Kimi K3の指数と価格の数値はArtificial Analysisに帰属しており、Moonshot自身の報告とは異なる可能性があります。Trilogy AIの直接比較は単一のタスクであり、完全なベンチマークスイートではありません。Qwen 3.8のプレビュー価格は一時的な割引です。予算を組む前に料金を確認してください。

スペックと価格、並べて比較

こちらが確かなデータで、各競合他社の数値はそれぞれの出典が明記されています。

•  メーカー / ステータス — Qwen 3.8 Max: Alibaba; プレビュー (2026年7月19日); Kimi K3: Moonshot; オープンウェイト公開

• アーキテクチャ — Qwen 3.8 Max: 合計約2.4T、スパースMoE(アクティブパラメータ非公開); Kimi K3: 2.8T MoE、ネイティブビジョン(出典: Artificial Analysis)

• コンテキストウィンドウ — Qwen 3.8 Max: 報告されている約100万トークン(公式には未確認); Kimi K3: 100万トークン(出典:Artificial Analysis)

• AA Intelligence Index — Qwen 3.8 Max: まだなし — 未評価; Kimi K3: 57.1 — #3 (Artificial Analysis)

• アリーナ / リーダーボード — Qwen 3.8 Max: 公開スコア未評価; Kimi K3: フロントエンドコード #1, 1679 (LMArena)

• 価格(入力/出力)— Qwen 3.8 Max: プレビューのみ(約90%オフ;トークンごとのAPIは未公開);Kimi K3: $3 / $15 100万トークンあたり (AAブレンド 約$2.31)

• オープンウェイト — Qwen 3.8 Max: 「近日公開」と約束(未リリース); Kimi K3: オープンウェイト; ウェイト準備完了/間近

• 速度 — Qwen 3.8 Max: テストした中で最も遅いモデル (ハンズオン); Kimi K3: 冗長で遅い (~34秒 TTFT, per AA)

全体の比較を枠付ける2つの点があります。まず、Qwen 3.8の空の"AA Intelligence Index"セルが物語っています。Kimi K3の57.1は中立的な審判の判定であり、世界で第3位、Fable 5とGPT-5.6 Solに次ぐものです。Qwen 3.8の立場はベンダーの枠組みと少数の実運用に依存しています。第二に、サイズの逆転に注目してください — Qwen 3.8(2.4T)は実際には約4000億パラメータ小さいKimi K3(2.8T)に比べて。Alibabaのモデルは人々が"bigger in ambition"と表現するものですが、生のパラメータ数ではKimiの方が大きな巨人であり、それを裏付ける監査済みスコアを持っています。両モデルは冗長で遅いことで有名であり、レイテンシは互角です。本当の差別化要因は実証と重みの入手可能性であり、現時点では両方ともKimiに有利です。

私たちが持っている唯一の本当の直接対決

これは推測する必要がない珍しいマッチアップです。Trilogy AIは両モデルを単一のアーキテクチャ理解タスク(実際のコードベースを読み取り、推論する)で実行し、その結果を比較公開しました。Kimi K3が見出しスコアで勝利しましたが、その根底にある振る舞いはより興味深いストーリーを物語っています。

• 総合スコア — Qwen 3.8 Max: 80 / 100; Kimi K3: 83 / 100

• リポジトリ引用 — Qwen 3.8 Max: 354; Kimi K3: 274

• ゲートウェイリクエスト — Qwen 3.8 Max: 22; Kimi K3: 53

• 失敗したツール呼び出し — Qwen 3.8 Max: 0; Kimi K3: 2

• ツール使用評価 — Qwen 3.8 Max: 9 / 10; Kimi K3: 8 / 10

• キャッシュヒット率 — Qwen 3.8 Max: >90%; Kimi K3: >90%

列全体を読んでください。最上行だけではありません。Kimi K3は3点差の勝利を収めましたが、Qwen 3.8はより緻密な作業者でした:それが引用したのはリポジトリ内のさらに80か所(354対274)であり、その結論に達したのははるかに少ないゲートウェイリクエスト(22対53)、行い、Kimiの2回に対してツール呼び出しの失敗がゼロ、ツール使用評価ではKimiをわずかに上回り(9対8)、このトレードオフはまさにQwenの他の場面での性格から予想される通りのものです。つまり、それは徹底的に探索し、その結果、高いレイテンシとより多くの総トークンが必要になります。重要なのは、両モデルが同じ中核的なアーキテクチャ決定に達したことであり、これは一方が正しく他方が間違っているという話ではありません。Kimiがわずかに高い評価の回答により早く到達し、Qwenはより多くの証拠とよりクリーンなツール規律をもってそこに至ったということです。あなたの仕事が徹底的でよく引用された探索を評価するなら、Qwenのプロフィールは魅力的です。実績があり、より早い回答を求めるなら、Kimiがそのラウンドを制しました。

よくある質問

Qwen 3.8はKimi K3より優れていますか?

今日存在する証拠に基づいてはいません。直接の一騎打ち(Trilogy AI)では、Kimi K3が83/100を獲得し、Qwenは80/100でした。また、Kimiは監査済みのArtificial Analysis Indexで57.1(第3位)を記録し、さらにArena frontend-codeの王座を保持しています。一方、Qwen 3.8には独立したスコアがまったくありません。Qwenの強みは徹底性にありました——リポジトリ引用の多さ(354対274)、ゲートウェイリクエストの少なさ、ツールコールの失敗ゼロ——しかし、それはスタイル上の利点であり、実証された能力のリードではありません。

Qwen 3.8はより大きいですが、それがより良いということでしょうか?

いいえ、実際にはサイズの点では逆です。Qwen 3.8は~2.4Tパラメータであるのに対し、Kimi K3は~2.8Tパラメータで、Kimiの方が約400B大きいです。パラメータ数が多いからといって優れているわけではありません。Kimiはより大きく、かつスコアも高いですが、これはアーキテクチャ、トレーニング、チューニングが単純なパラメータ総数よりも重要であることを示す明確な例です。

価格はどのように比較されますか?

Kimi K3は公開され、耐久性のある$3 / $15 100万トークンあたり(Artificial Analysisはそれを約2.31ドルに調整している)。 Qwen 3.8のプレビューは大幅に割引されています(約90%オフ)が、公開されたトークンあたりのAPI価格はなく、割引は一時的なため、安定した価格比較はまだできません。 今日の予算計画では、Kimiが実際の数値を持つものです。

オープンウェイトの選択肢として、どちらがより良いですか?

両者ともオープンウェイトクラスですが、タイミングが異なります。Kimi K3のウェイトは公開されており、実質的に準備が整っています。一方、Qwen 3.8のウェイトは「近日公開予定」と約束されているものの、日付、ライセンス、リポジトリは公開されていません。オープンウェイトが選択の理由であれば、Kimiは今すぐ行動できる選択肢です。

今日はどちらを使うべきですか?

Kimi K3 はより安全なデフォルトです。スコアは (#3) で、ウェイトは準備済み、そして直接対決に勝利しました。網羅的で引用のしっかりした探索とクリーンなツール使用を速度よりも重視する場合は Qwen 3.8 を手に取ってください。また、そのウェイトが公開され、独立したスコアが届くのを待つべきモデルとして扱ってください。

結論

Qwen 3.8 vs Kimi K3は、このシリーズにおいて最も公平な戦いに近いものです。中国製のオープンウェイトの二大巨頭であり、どちらも冗長で、徹底的で、遅い。Kimi K3は本ラウンドで勝利します。なぜなら、採用を左右する要素——監査済みの第3位ランキング、Arenaのフロントエンド王冠、公表された価格、そして準備済みのウェイト——を獲得し、唯一の直接対決ではQwenを80対83で上回ったからです。しかし、その直接対決は、なぜQwen 3.8が注目に値するかも示しています。それは、より細心のモデルであり、より多くのコードベースを引用し、より少ないリクエストを使用し、ツール呼び出しの失敗がゼロでした。もしあなたの仕事が徹底的な探索を報いるのであれば、そしてAlibabaがウェイトをリリースし、独立したスコアがトップ近くに位置すれば、この競争は逆転する可能性があります。それまでは、Kimi K3がより安全なオープンウェイトの選択肢であり、Qwen 3.8は自分でプロンプトをテストすべき挑戦者です。


© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

お問い合わせ

コミュニティに参加

DiscordEmailXGitHubYouTube