Qwen3.7 Flash

qwen/qwen3.7-flash
ใหม่แนะนำ
การมองเห็นเครื่องมือJSONการให้เหตุผล
โดย Qwen · 2026-07-27

Qwen3.7 Flash คือโมเดลที่รวดเร็วและคุ้มค่าด้านต้นทุนอย่างยิ่งของ Alibaba ในตระกูล Qwen3.7 โดยอยู่ต่ำกว่า Qwen3.7-Plus และ Qwen3.7-Max ในระดับที่ให้ปริมาณงานสูง (high-throughput tier) โดยรองรับหลายรูปแบบข้อมูล (multimodal) ทางฝั่งอินพุตโดยธรรมชาติ — รองรับข้อความ รูปภาพ และวิดีโอ พร้อมเอาต์พุตเป็นข้อความ — และมีหน้าต่างบริบท (context window) ขนาด 1M โทเค็น โดยสามารถสร้างเอาต์พุตได้สูงสุดถึง 64K โทเค็น ทำให้เอกสารยาว ๆ ภาพหน้าจอ และเฟรมวิดีโอยังคงอยู่ในขอบเขตที่เข้าถึงได้ แม้ในระดับราคา Flash ด้วยราคาประมาณ $0.03 ต่ออินพุต 1 ล้านโทเค็นในระดับพื้นฐาน ถือเป็นหนึ่งในโมเดล multimodal ที่มีบริบท 1M โทเค็นที่ถูกที่สุดที่มีในตลาด เหมาะอย่างยิ่งสำหรับงานจำแนกประเภท (classification) การแยกข้อมูล (extraction) การจัดเส้นทาง (routing) การสรุป (summarization) เอเจนต์น้ำหนักเบา (lightweight agents) และไปป์ไลน์ใด ๆ ที่ทำงานในปริมาณสูงมาก โดยรองรับโหมดการใช้เหตุผล (reasoning mode) การเรียกใช้เครื่องมือโดยธรรมชาติ (native tool calling) เอาต์พุตแบบมีโครงสร้างผ่าน response_format และการควบคุมการสุ่มตามปกติ (temperature / top_p / seed / logprobs) หมายเหตุ: ราคาจะถูกแบ่งตามระดับตามความยาวของพรอมต์ โดยต้นทุนจะเพิ่มขึ้นเมื่ออินพุตเกิน 32K และเพิ่มขึ้นอีกเมื่อเกิน 256K โทเค็น ดังนั้นการรวมคำขอสั้น ๆ เป็นชุด (batching) จะประหยัดกว่าการเติมคำขอที่ยาวอย่างเห็นได้ชัด ใช้ Flash เป็นตัวขับเคลื่อนปริมาณงานหลัก และเลื่อนไปใช้ Qwen3.7-Plus หรือ Max เมื่องานต้องการความสามารถมากขึ้นอย่างแท้จริง

เอนด์พอยต์:/v1/chat/completions/v1/responses
ctx1M โทเค็น
เอาต์พุตสูงสุด65K
อินพุตtext + image + video
เอาต์พุตtext
p50 TTFT2.83 s
INPUT$0.03/ 1M โทเค็น
OUTPUT$0.13/ 1M โทเค็น
p50 TTFT2.83 s7 วัน
p95 TTFT9.64 s7 วัน
ทราฟฟิก13.5Mโทเค็น / 7วัน
รับ API ของ Qwen3.7 Flash ลองใน playground</> ใช้ผ่าน API

Qwen3.7 Flash เป็นโมเดลภาษาขนาดใหญ่แบบมัลติโมดัลที่สร้างโดยทีม Qwen และนำเสนอผ่าน OrcaRouter โดยประมวลผลอินพุตข้อความ รูปภาพ และวิดีโอ รองรับหน้าต่างบริบท (context window) ขนาด 1,000,000 โทเคน…

Qwen3.7 Flash คืออะไร และใครควรใช้

Qwen3.7 Flash รองรับรูปแบบอินพุตใดบ้าง?

ขนาดหน้าต่างบริบทของ Qwen3.7 Flash คือเท่าไหร่?

Qwen3.7 Flash สามารถเข้าถึงผ่าน OrcaRouter ได้อย่างไร?

ตัวอย่างโค้ด

เรียกใช้จาก SDK ใดก็ได้

เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

พารามิเตอร์ที่รองรับ

  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

ราคา

ระดับอินพุต / 1M โทเค็นเอาต์พุต / 1M โทเค็นอ่านแคช / 1Mเขียนแคช / 1M
32K$0.030$0.130$0.0060$0.038
256K$0.100$0.400$0.020$0.125
$0.200$0.800$0.040$0.250
เลือกระดับชั้นตามจำนวนโทเค็นอินพุตของแต่ละคำขอ

เครื่องคำนวณค่าใช้จ่าย

โทเค็น / เดือน10MM
สัดส่วนอินพุต70%%
ประมาณ / เดือน $0.600 · เมื่อใช้แคชพรอมป์ต์ $0.516

ประมาณการจากราคาตั้ง

ราคาแบบขั้นบันได — การประเมินนี้ใช้อัตราขั้นพื้นฐาน

เครื่องมือประเมิน token และค่าใช้จ่าย

token อินพุต: 13ค่าใช้จ่ายต่อคำขอ: $0.000065

เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ

ประสิทธิภาพ

p50 TTFT
2.83 s
ความเร็วเอาต์พุต
333 tok/s
p95 TTFT
9.64 s
อัตราข้อผิดพลาด
0%

เกณฑ์มาตรฐานสาธารณะ

แหล่งที่มา: Design Arena

กระแสในชุมชน

สิ่งที่นักพัฒนาพูดถึงในสัปดาห์นี้

Hacker News0 การกล่าวถึง · 7 วัน

การเปรียบเทียบ

Qwen3.7 Flashqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
อินพุต $/ล้าน$0.03$0.86$0.17$0.12
เอาต์พุต $/ล้าน$0.13$3.44$1.03$0.69
บริบท1.0M262K33K1.0M
คุณภาพ7/108/108/108/10
เปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกัน

เพิ่มเติมจาก Qwen

FAQ

Qwen3.7 Flash บน OrcaRouter ราคาเท่าไหร่?
ไม่มีข้อมูลราคาเฉพาะสำหรับ Qwen3.7 Flash ในข้อเท็จจริงที่มีอยู่ โดยทั่วไป OrcaRouter จะคิดค่าบริการต่อ token สำหรับ input และ output ในฐานะที่เป็นโมเดล Flash ราคาน่าจะต่ำกว่าโมเดลระดับเรือธง เยี่ยมชมหน้าราคาของ OrcaRouter หรือติดต่อฝ่ายสนับสนุนเพื่อดูอัตราปัจจุบัน
ขนาดหน้าต่างบริบทของ Qwen3.7 Flash คือเท่าไหร่?
หน้าต่างบริบทมีโทเค็น 1,000,000 โทเค็น ซึ่งช่วยให้โมเดลสามารถประมวลผลเอกสารที่ยาวมาก สนทนาที่ยาว หรือชุดภาพ/วิดีโอขนาดใหญ่ในพรอมต์เดียว
อะไรคือจุดแข็งของ Qwen3.7 Flash?
จุดแข็งของมันรวมถึงบริบทของโทเค็น 1M, การรองรับอินพุตแบบมัลติโมดัล (ข้อความ, รูปภาพ, วิดีโอ), โทเค็นเอาต์พุตสูงสุด 65k, และสถาปัตยกรรม 'Flash' ที่ปรับให้เหมาะสมซึ่งสร้างสมดุลระหว่างความเร็วและต้นทุน มันเหมาะสำหรับการวิเคราะห์เอกสารยาวและการเข้าใจมัลติโมดัล
Qwen3.7 Flash เปรียบเทียบกับ GPT-4o-mini อย่างไร?
Qwen3.7 Flash มีหน้าต่างบริบทที่ใหญ่กว่าอย่างมีนัยสำคัญ (1M เทียบกับ 128k) และผลลัพธ์สูงสุดที่สูงกว่า (65k เทียบกับ 16k) GPT-4o-mini อาจมีการสนับสนุนระบบนิเวศที่กว้างขวางกว่า ไม่มีข้อมูลราคาหรือเกณฑ์มาตรฐานสำหรับการเปรียบเทียบโดยตรง
OrcaRouter แคชพรอมต์เพื่อลดต้นทุนหรือไม่?
OrcaRouter อาจเสนอการแคชพรอมต์ แต่นโยบายเฉพาะสำหรับ Qwen3.7 Flash ยังไม่ได้ระบุรายละเอียดในข้อเท็จจริง ตรวจสอบเอกสารของ OrcaRouter สำหรับตัวบ่งชี้การเข้าถึงแคชและข้อมูลส่วนลด
ฉันจะเรียกใช้งาน Qwen3.7 Flash โดยใช้ API ที่เข้ากันได้กับ OpenAI ได้อย่างไร?
ตั้งค่า base URL เป็น https://api.orcarouter.ai/v1 และใช้รหัสรุ่นโมเดล "qwen/qwen3.7-flash" รวมถึง API key ของ OrcaRouter ของคุณด้วย จุดสิ้นสุด chat completions ทำงานกับพารามิเตอร์มาตรฐานของ OpenAI สำหรับอินพุตแบบ multimodal ให้เพิ่มวัตถุรูปภาพหรือวิดีโอในอาร์เรย์เนื้อหาข้อความ
Qwen3.7 Flash รองรับรูปแบบอินพุตใดบ้าง?
รองรับอินพุตที่เป็นข้อความ รูปภาพ และวิดีโอ ซึ่งช่วยให้สามารถทำงานต่างๆ เช่น การวิเคราะห์รูปภาพควบคู่กับข้อความ การสรุปวิดีโอ และการรวมสื่อหลายประเภทในพรอมต์เดียว
ฉันสามารถปรับแต่ง Qwen3.7 Flash ด้วยข้อมูลของตัวเองได้ไหม?
ข้อเท็จจริงที่มีอยู่ไม่ได้กล่าวถึงความสามารถในการปรับแต่งละเอียด (fine-tuning) เนื่องจากเป็นโมเดลที่เข้าถึงผ่าน API โดยใช้ OrcaRouter จึงมีแนวโน้มว่าไม่รองรับการปรับแต่งละเอียด สำหรับการปรับแต่งละเอียดแบบกำหนดเอง ให้พิจารณาทางเลือกแบบโอเพนซอร์ส
ความยาวเอาต์พุตสูงสุดของ Qwen3.7 Flash คือเท่าใด?
จำนวนผลลัพธ์สูงสุดคือ 65,536 โทเค็น ซึ่งช่วยให้สามารถสร้างคำตอบ รายงาน หรือโค้ดที่ยาวมากได้ในการเรียก API เพียงครั้งเดียว
ฉันจะจัดการกับอินพุตวิดีโอด้วย Qwen3.7 Flash ได้อย่างไร
ไม่มีรายละเอียดการจัดการวิดีโอเฉพาะ โดยทั่วไปแล้ว การป้อนวิดีโอจะถูกประมวลผลเป็นลำดับของเฟรม คุณอาจต้องประมวลผลวิดีโอล่วงหน้าเป็นชุดของภาพและส่งเป็น URL ของภาพหรือข้อมูล base64 ดูเอกสารประกอบของ OrcaRouter สำหรับรูปแบบที่แน่นอน

ฝังป้ายนี้

Qwen: Qwen3.7 Flash$0.03/M in2828ms p50ผ่าน OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg" alt="Qwen: Qwen3.7 Flash บน OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.7 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-flash)

ข้อมูลโมเดลแบบ data

GET /api/public/models/qwen/qwen3.7-flashเปิด
อ่านได้ด้วยเครื่อง:/llms.txt/llms-full.txt