Qwen3.7 Flash

qwen/qwen3.7-flash
精選
視覺工具JSON推理
來自 Qwen · 2026-07-27

Qwen3.7 Flash 是阿里巴巴在 Qwen3.7 系列中快速且極具成本效益的模型,定位於 Qwen3.7-Plus 和 Qwen3.7-Max 之下,屬於高吞吐量層級。它在輸入端原生支援多模態——接受文字、圖片和影片,並以文字輸出——提供 1M token 的上下文視窗,最多可輸出 64K tokens,因此即使採用 Flash 層級的定價,長文件、螢幕截圖和影片畫面仍可輕鬆處理。 在基本層級,每百萬個輸入 token 約為 $0.03,是市面上最便宜的 1M 上下文多模態模型之一,因此非常適合分類、提取、路由、摘要、輕量級代理以及任何高流量的管道。它支援推理模式、原生工具呼叫、透過 response_format 的結構化輸出,以及常見的取樣控制(temperature / top_p / seed / logprobs)。 請注意,定價按提示長度分級:超過 32K 以及再次超過 256K 輸入 token 時成本會逐步增加,因此批次處理短請求比填充長請求實質上便宜得多。將 Flash 作為高流量主力,並在任務確實需要更強能力時升級至 Qwen3.7-Plus 或 Max。

上下文1M tokens
最大輸出65K
輸入模態text + image + video
輸出模態text
p50 首字節2.83 s
輸入$0.03/ 百萬 tokens
輸出$0.13/ 百萬 tokens
p50 首字節2.83 s7 天
p95 首字節9.64 s7 天
流量13.5Mtokens / 7 天

Qwen3.7 Flash 是由 Qwen 團隊開發、並透過 OrcaRouter 提供的一款多模態大型語言模型。它能處理文字、圖片與影片輸入,支援 1,000,000 個 token 的上下文視窗,最大輸出為 65,536 個 token。「Flash」這個名稱暗示它相較於 Qwen…

什麼是 Qwen3.7 Flash,誰應該使用它?

Qwen3.7 Flash支援哪些輸入模態?

Qwen3.7 Flash 的上下文視窗大小是多少?

如何通過 OrcaRouter 存取 Qwen3.7 Flash?

程式碼範例

用任意 SDK 呼叫

相容 OpenAI——沿用你現有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支援的參數

  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

價格

階梯輸入 / 1M tokens輸出 / 1M tokens快取讀取 / 1M快取寫入 / 1M
32K$0.030$0.130$0.0060$0.038
256K$0.100$0.400$0.020$0.125
$0.200$0.800$0.040$0.250
階梯依每次請求的輸入 token 數確定

費用計算器

每月 token 數10MM
輸入占比70%%
預計每月 $0.600 · 啟用提示快取後 $0.516

基於標價的估算

階梯定價——此估算使用基礎級距費率。

Token 與費用估算器

輸入 Token: 6每次請求費用: $0.000065

僅為估算——實際 Token 數取決於供應商的分詞器。

效能

p50 首字節
2.83 s
輸出速度
333 tok/s
p95 首字節
9.64 s
錯誤率
0%

公開基準測試

來源: Design Arena

社群熱度

本週開發者的討論

Hacker News0 次提及 · 近 7 天

比較一覽

Qwen3.7 Flashqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
輸入 $/百萬$0.03$0.86$0.17$0.12
輸出 $/百萬$0.13$3.44$1.03$0.69
上下文1.0M262K33K1.0M
品質7/108/108/108/10
並排比較並排比較並排比較並排比較

常見問題

在 OrcaRouter 上,Qwen3.7 Flash 的費用是多少?
在現有資料中,並未提供 Qwen3.7 Flash 的具體定價。OrcaRouter 通常按輸入和輸出的 token 數收費。作為 Flash 模型,其價格可能低於旗艦模型。請造訪 OrcaRouter 的定價頁面或聯絡客服支援以獲取最新費率。
Qwen3.7 Flash 的上下文視窗大小是多少?
上下文窗口大小為1,000,000個令牌。這使得模型能夠在單一提示中處理非常長的文檔、長時間的對話,或大量的圖片/影片。
Qwen3.7 Flash 的優勢是什麼?
其優勢包括100萬個符元的上下文、多模態輸入支援(文字、圖片、影片)、6.5萬個最大輸出符元,以及最佳化的「Flash」架構,能夠平衡速度與成本。它非常適合長篇文件分析與多模態理解。
Qwen3.7 Flash 與 GPT-4o-mini 相比如何?
Qwen3.7 Flash 提供顯著更大的上下文窗口(1M 對比 128k)和更高的最大輸出(65k 對比 16k)。GPT-4o-mini 可能擁有更廣泛的生態系統支援。兩者均未提供定價或基準測試以進行直接比較。
OrcaRouter是否缓存提示以降低成本?
OrcaRouter 可能提供提示快取,但其針對 Qwen3.7 Flash 的具體政策在事實中並未詳細說明。請查閱 OrcaRouter 的文件,以了解快取命中指標和折扣資訊。
如何使用兼容OpenAI的API调用Qwen3.7 Flash?
將基礎URL設置為https://api.orcarouter.ai/v1,並使用模型ID "qwen/qwen3.7-flash"。包含您的OrcaRouter API金鑰。聊天完成端點使用標準的OpenAI參數。對於多模態輸入,在訊息內容陣列中添加圖像或視頻物件。
Qwen3.7 Flash支援哪些輸入模態?
它支援文字、圖片和影片輸入。這使得能夠執行如分析圖文結合、摘要影片,以及在同一提示中結合多種媒體類型等任務。
我可以在自己的數據上微調 Qwen3.7 Flash 嗎?
現有的事實並未提及微調功能。作為透過 OrcaRouter 存取的 API 模型,可能不支援微調。如需自訂微調,請考慮開源替代方案。
Qwen3.7 Flash 的最大輸出長度是多少?
最大輸出為65,536個token。這允許在單次API調用中生成非常長的回應、報告或代碼。
如何處理 Qwen3.7 Flash 的影片輸入?
未提供具体的视频处理细节。通常,视频输入会被处理为帧序列。您可能需要将视频预处理为一系列图像,并以图像URL或base64数据的形式传递。请参阅OrcaRouter的文档以了解确切的格式要求。

嵌入此徽章

Qwen: Qwen3.7 Flash$0.03/M in2828ms p50透過 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg" alt="Qwen: Qwen3.7 Flash 於 OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.7 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-flash)

以資料形式取得模型卡

GET /api/public/models/qwen/qwen3.7-flash開啟