Qwen3.8 Flash

qwen/qwen3.8-flash
新着注目
ビジョンツールJSON推論
提供 Qwen · 2026-08-26

Qwen3.8 Flashは、アリババが開発したマルチモーダル推論モデルです。コーディング支援、エージェント型ワークフロー、視覚理解、ドキュメントおよびコードベース解析、デスクトップ操作、チャート分析、長尺動画分析に適しています。

エンドポイント:/v1/chat/completions
コンテキスト1M トークン
最大出力131K
入力text + image + video
出力text
p50 TTFT4.25 s
入力$0.15/ 100万 tokens
出力$0.47/ 100万 tokens
p50 TTFT4.25 s7日
p95 TTFT10.00 s7日
トラフィック1.0Mtokens / 7日

コードサンプル

あらゆる SDK から呼び出し

OpenAI 互換——今お使いの SDK のまま

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

対応パラメータ

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

料金

入力 / 1M tokens$0.150
出力 / 1M tokens$0.470
キャッシュ読み取り / 1M$0.018
キャッシュ書き込み / 1M$0.230
通貨USD

料金計算ツール

月間トークン数10MM
入力の割合70%%
月額見積もり $2.46 · プロンプトキャッシュ利用時 $2.00

表示価格に基づく概算

トークン・コスト見積もり

入力トークン: 8リクエストあたりのコスト: $0.000236

見積もりのみ — 実際のトークン数はプロバイダーのトークナイザーに依存します。

パフォーマンス

p50 TTFT
4.25 s
出力速度
119 tok/s
p95 TTFT
10.00 s
エラー率
0%

公開ベンチマーク

ソース: Design Arena

コミュニティの話題

今週の開発者の声

Hacker News9 件の言及 · 7日間先週比 9 増加

比較

Qwen3.8 FlashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
入力 $/100万$0.15$2.00$0.86$0.17
出力 $/100万$0.47$6.00$3.44$1.03
コンテキスト1.0M1.0M262K33K
品質7/109/108/108/10
並べて比較並べて比較並べて比較並べて比較

よくある質問

Qwen: Qwen3.8 FlashはOrcaRouterでいくらですか?
Qwen: Qwen3.8 FlashはOrcaRouter経由で、1M入力トークンあたり$0.15、1M出力トークンあたり$0.47の価格設定です。料金はルーティングレイヤーからリアルタイムで取得されます。
Qwen: Qwen3.8 Flashのコンテキストウィンドウは何ですか?
Qwen: Qwen3.8 Flash は 1M トークンのコンテキストウィンドウをサポートします。その制限まで長文コンテキスト機能(RAG、要約)を使用してください。
OpenAI SDK を介して Qwen: Qwen3.8 Flash を呼び出すにはどうすればよいですか?
OpenAIのbase_urlをhttps://api.orcarouter.ai/v1に設定し、OrcaRouter APIキーを指定して、chat.completions.createの呼び出し時にmodel="qwen/qwen3.8-flash"を渡してください。
OrcaRouterはQwen: Qwen3.8 Flashをレート制限しますか?
モデルごとのレート制限は、OrcaRouterのプランに準じます。無料ティアには控えめな上限が設定されていますが、有料ティアでは上限が引き上げられます。現在の割り当て量については/pricingをご確認ください。

このバッジを埋め込む

Qwen: Qwen3.8 Flash$0.15/M in4250ms p50OrcaRouter 経由
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="OrcaRouter の Qwen: Qwen3.8 Flash" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

モデルカードをデータで取得

GET /api/public/models/qwen/qwen3.8-flash開く