qwen/qwen3.5-flash

qwen/qwen3.5-flash
ビジョンツールJSON推論
提供 qwen

Qwen3.5 Flash — マルチモーダルチャット(テキスト/画像/動画)コスト最適化、100万トークンのコンテキスト

エンドポイント:/v1/chat/completions
コンテキスト1M トークン
最大出力65K
入力text + image + video
出力text
p50 TTFT2.71 s
入力$0.10/ 100万 tokens
出力$0.40/ 100万 tokens
p50 TTFT2.71 s7日
p95 TTFT10.00 s7日
トラフィック1.3Mtokens / 7日

Qwen3.5 Flashは、Qwenファミリーに属するマルチモーダル言語モデルで、高速な推論と低コストを実現しています。テキスト、画像、動画の入力を受け付け、テキスト応答を生成します。コンテキストウィンドウは1,048,576トークンで、非常に長いドキュメントや複数の動画フレームを一度に処理できます。1回の生成で最大65,536トークンを出力します。OrcaRouterのAPIでモデルID「qw…

Qwen3.5 Flashとは何ですか?

このモデルは誰向けですか?

主要仕様一覧

コードサンプル

あらゆる SDK から呼び出し

OpenAI 互換——今お使いの SDK のまま

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

対応パラメータ

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

料金

入力 / 1M tokens$0.100
出力 / 1M tokens$0.400
通貨USD

料金計算ツール

月間トークン数10MM
入力の割合70%%
月額見積もり $1.90

表示価格に基づく概算

トークン・コスト見積もり

入力トークン: 8リクエストあたりのコスト: $0.000201

見積もりのみ — 実際のトークン数はプロバイダーのトークナイザーに依存します。

パフォーマンス

p50 TTFT
2.71 s
出力速度
206 tok/s
p95 TTFT
10.00 s
エラー率
7.3%

公開ベンチマーク

ソース: Design Arena

コミュニティの話題

今週の開発者の声

Hacker News0 件の言及 · 7日間

比較

qwen/qwen3.5-flashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
入力 $/100万$0.10$2.00$0.86$0.17
出力 $/100万$0.40$6.00$3.44$1.03
コンテキスト1.0M1.0M262K33K
品質6/109/108/108/10
並べて比較並べて比較並べて比較並べて比較

よくある質問

OrcaRouterでQwen3.5 Flashを使用するのにかかる費用はいくらですか?
コストは、入力トークン100万トークンあたり$0.10、出力トークン100万トークンあたり$0.40です。これはOrcaRouterによるマークアップなしのプロバイダー料金です。プロバイダーが請求する金額をそのまま支払い、追加料金は発生しません。
コンテキストウィンドウサイズとは何ですか?
コンテキストウィンドウは1,048,576トークン(約100万トークン)です。これには、会話履歴全体における入力トークンと出力トークンの両方が含まれます。1回の生成における最大出力トークン数は65,536トークンです。
Qwen3.5 Flashの強みは何ですか?
強みとして、マルチモーダル入力(テキスト、画像、動画)、非常に大きな1Mコンテキストウィンドウ、65Kトークンの長い出力、トークンあたりの低コスト、そして大型のQwenモデルと比較して高速な推論が挙げられます。これは、高負荷またはリアルタイムのマルチモーダルタスクに最適です。
より大きなQwenモデルと比較してどうですか?
大規模なQwenモデル(Qwen3.5-72Bなど)は複雑な推論において高い精度を提供しますが、速度が遅くコストが高くなります。Qwen3.5 Flashは、速度とコスト効率を優先して精度を一部犠牲にする一方、同じマルチモーダル機能と長文コンテキスト対応能力を維持しています。
OrcaRouterはプロバイダーの価格をマークアップしますか?
いいえ。価格はプロバイダーレートでそのまま反映され、マークアップはゼロです。Qwen3.5 FlashをOrcaRouter経由で利用する場合、入力トークン100万トークンあたり正確に$0.10、出力トークン100万トークンあたり$0.40をお支払いいただきます。
Qwen3.5 Flash を OpenAI 互換の API で呼び出すことはできますか?
はい。OrcaRouterはhttps://api.orcarouter.ai/v1でOpenAI互換のエンドポイントを提供しています。モデルID「qwen/qwen3.5-flash」をあなたのOrcaRouter APIキーと共に使用してください。リクエストとレスポンスの形式はOpenAIのChat Completions APIと一致しています。
OrcaRouterでのデータ処理はどのように機能しますか?
データ取り扱いポリシーはOrcaRouterとQwenによって決定されます。カタログエントリには具体的な詳細は記載されていません。ユーザーは機密データを送信する前に、OrcaRouterのプライバシーポリシーとQwenのデータ利用規約を確認する必要があります。
モデルはどのモダリティをサポートしていますか?
テキスト、画像、および動画の入力をサポートしています。画像は、ユーザーメッセージ内でURLまたはbase64データとして提供できます。動画の入力は通常、フレーム(画像)のシーケンスとして送信されます。モデルはテキスト出力のみを生成します。
トークンの最小数または最大数は必要ですか?
最小トークン数はありません。最大入力トークン数(会話履歴を含む)は1,048,576トークンです。応答あたりの最大出力トークン数は65,536です。出力長を制御するにはmax_tokensパラメータを使用してください。
OrcaRouter を使用してこのモデルを呼び出すには、どうすればよいですか?
OrcaRouterにサインアップしてAPIキーを取得してください。コード内でベースURLをhttps://api.orcarouter.ai/v1に設定してください。モデルID "qwen/qwen3.5-flash"を使用し、マルチモーダルコンテンツを伴う標準のチャット完了リクエストを送信してください。例についてはOrcaRouterのドキュメントを参照してください。

このバッジを埋め込む

qwen/qwen3.5-flash$0.10/M in2705ms p50OrcaRouter 経由
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg" alt="OrcaRouter の qwen/qwen3.5-flash" /> </a>
Markdown [![qwen/qwen3.5-flash](https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-flash)

モデルカードをデータで取得

GET /api/public/models/qwen/qwen3.5-flash開く