Qwen3.7 Flash

qwen/qwen3.7-flash
新着注目
ビジョンツールJSON推論
提供 Qwen · 2026-07-27

Qwen3.7 Flashは、AlibabaのQwen3.7ファミリーに属する、高速で非常にコスト効率の高いモデルです。Qwen3.7-PlusやQwen3.7-Maxの下位に位置し、高スループット層として機能します。入力側ではネイティブにマルチモーダル対応(テキスト、画像、動画を受け付け、テキスト出力)で、1Mトークンのコンテキストウィンドウと最大64Kの出力トークンを提供するため、Flash層の価格帯でも長文ドキュメント、スクリーンショット、動画フレームを扱えます。 基本ティアで100万入力トークンあたり約0.03ドルと、1Mコンテキスト対応のマルチモーダルモデルとしては最安級のひとつであり、分類、抽出、ルーティング、要約、軽量エージェント、そして非常に高いボリュームで実行されるパイプラインに自然に適合します。推論モード、ネイティブのツール呼び出し、response_formatによる構造化出力、通常のサンプリング制御(temperature / top_p / seed / logprobs)をサポートしています。 なお、価格はプロンプトの長さに応じて段階的設定となっており、32Kを超えると、さらに256Kを超える入力トークンでコストが上がります。そのため、短いリクエストをバッチ処理する方が、長いリクエストをパディングするよりも実質的に安価です。Flashを大量処理の主力として使用し、タスクに本当に高い能力が必要な場合にQwen3.7-PlusまたはMaxにエスカレーションしてください。

エンドポイント:/v1/chat/completions/v1/responses
コンテキスト1M トークン
最大出力65K
入力text + image + video
出力text
p50 TTFT2.83 s
入力$0.03/ 100万 tokens
出力$0.13/ 100万 tokens
p50 TTFT2.83 s7日
p95 TTFT9.64 s7日
トラフィック13.5Mtokens / 7日

Qwen3.7 Flashは、Qwenチームによって開発され、OrcaRouterを通じて提供されるマルチモーダル大規模言語モデルです。テキスト、画像、動画の入力を処理し、100万トークンのコンテキストウィンドウと最大65,536トークンの出力をサポートします。「Flash」という名称は、Qwenファミリーのより大規模なモデルと比較して、低レイテンシと高スループットに最適化されていることを示唆して…

Qwen3.7 Flashとは何ですか、また誰が使用すべきですか?

Qwen3.7 Flash はどのような入力モダリティをサポートしていますか?

Qwen3.7 Flashのコンテキストウィンドウサイズはいくつですか?

Qwen3.7 FlashはOrcaRouterを通じてどのようにアクセスされますか?

コードサンプル

あらゆる SDK から呼び出し

OpenAI 互換——今お使いの SDK のまま

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

対応パラメータ

  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

料金

階層入力 / 1M tokens出力 / 1M tokensキャッシュ読み取り / 1Mキャッシュ書き込み / 1M
32K$0.030$0.130$0.0060$0.038
256K$0.100$0.400$0.020$0.125
$0.200$0.800$0.040$0.250
階層はリクエストごとの入力トークン数で決定されます

料金計算ツール

月間トークン数10MM
入力の割合70%%
月額見積もり $0.600 · プロンプトキャッシュ利用時 $0.516

表示価格に基づく概算

段階制料金 — この見積もりは基本ティアの料金を使用しています。

トークン・コスト見積もり

入力トークン: 8リクエストあたりのコスト: $0.000065

見積もりのみ — 実際のトークン数はプロバイダーのトークナイザーに依存します。

パフォーマンス

p50 TTFT
2.83 s
出力速度
333 tok/s
p95 TTFT
9.64 s
エラー率
0%

公開ベンチマーク

ソース: Design Arena

コミュニティの話題

今週の開発者の声

Hacker News0 件の言及 · 7日間

比較

Qwen3.7 Flashqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
入力 $/100万$0.03$0.86$0.17$0.12
出力 $/100万$0.13$3.44$1.03$0.69
コンテキスト1.0M262K33K1.0M
品質7/108/108/108/10
並べて比較並べて比較並べて比較並べて比較

よくある質問

OrcaRouterでのQwen3.7 Flashの料金はいくらですか?
利用可能な事実には、Qwen3.7 Flashの具体的な価格は示されていません。OrcaRouterは通常、入力と出力に対してトークンごとに課金します。Flashモデルであるため、フラッグシップモデルよりも低価格である可能性があります。最新の料金については、OrcaRouterの価格ページを参照するか、サポートにお問い合わせください。
Qwen3.7 Flashのコンテキストウィンドウサイズはいくつですか?
コンテキストウィンドウは1,000,000トークンです。これにより、モデルは非常に長いドキュメント、長時間の会話、または大量の画像/動画を1つのプロンプトで処理できます。
Qwen3.7 Flashの強みは何ですか?
その強みとして、100万トークンのコンテキスト、マルチモーダル入力対応(テキスト、画像、動画)、最大65k出力トークン、そして速度とコストを両立する最適化された「Flash」アーキテクチャを備えています。長文書分析やマルチモーダル理解に適しています。
Qwen3.7 FlashはGPT-4o-miniと比較してどうですか?
Qwen3.7 Flashは、大幅に大きなコンテキストウィンドウ(1M対128k)と高い最大出力(65k対16k)を提供します。GPT-4o-miniは、より広範なエコシステムサポートを提供する可能性があります。直接比較するための価格設定やベンチマークは提供されていません。
OrcaRouterはコスト削減のためにプロンプトをキャッシュしますか?
OrcaRouterはプロンプトキャッシングを提供する可能性がありますが、Qwen3.7 Flashに関する具体的なポリシーは事実に詳述されていません。キャッシュヒット指標と割引情報については、OrcaRouterのドキュメントをご確認ください。
OpenAI互換のAPIを使用してQwen3.7 Flashを呼び出すにはどうすればよいですか?
ベースURLを https://api.orcarouter.ai/v1 に設定し、モデルIDとして "qwen/qwen3.7-flash" を使用します。OrcaRouter APIキーを含めてください。チャット補完エンドポイントは標準のOpenAIパラメータで動作します。マルチモーダル入力の場合は、メッセージコンテンツ配列に画像またはビデオオブジェクトを追加します。
Qwen3.7 Flash はどのような入力モダリティをサポートしていますか?
テキスト、画像、動画の入力をサポートします。これにより、テキストと画像の分析、動画の要約、複数のメディアタイプを単一のプロンプトで組み合わせるなどのタスクが可能になります。
Qwen3.7 Flash を自分のデータでファインチューニングできますか?
利用可能な事実にはファインチューニング機能についての言及はありません。OrcaRouter経由でAPIからアクセスするモデルとしては、ファインチューニングはサポートされていない可能性が高いです。カスタムファインチューニングの場合は、オープンソースの代替手段を検討してください。
Qwen3.7 Flashの最大出力長は何ですか?
最大出力は65,536トークンです。これにより、1回のAPI呼び出しで非常に長い応答、レポート、またはコードを生成できます。
Qwen3.7 Flashでビデオ入力を処理するにはどうすればよいですか?
具体的な動画の取り扱いの詳細は提供されていません。通常、動画の入力はフレームのシーケンスとして処理されます。動画を一連の画像に前処理し、画像URLまたはbase64データとして渡す必要がある場合があります。正確なフォーマットについては、OrcaRouterのドキュメントを参照してください。

このバッジを埋め込む

Qwen: Qwen3.7 Flash$0.03/M in2828ms p50OrcaRouter 経由
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg" alt="OrcaRouter の Qwen: Qwen3.7 Flash" /> </a>
Markdown [![Qwen: Qwen3.7 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-flash)

モデルカードをデータで取得

GET /api/public/models/qwen/qwen3.7-flash開く