qwen/qwen3.5-flash

qwen/qwen3.5-flash
การมองเห็นเครื่องมือJSONการให้เหตุผล
โดย qwen

Qwen3.5 Flash — แชทแบบหลายรูปแบบ (ข้อความ/รูปภาพ/วิดีโอ) ที่ปรับให้เหมาะสมในด้านต้นทุน, บริบท 1M

เอนด์พอยต์:/v1/chat/completions
ctx1M โทเค็น
เอาต์พุตสูงสุด65K
อินพุตtext + image + video
เอาต์พุตtext
p50 TTFT2.71 s
INPUT$0.10/ 1M โทเค็น
OUTPUT$0.40/ 1M โทเค็น
p50 TTFT2.71 s7 วัน
p95 TTFT10.00 s7 วัน
ทราฟฟิก1.3Mโทเค็น / 7วัน
รับ API ของ qwen/qwen3.5-flash ลองใน playground</> ใช้ผ่าน API

Qwen3.5 Flash เป็นโมเดลภาษาหลายรูปแบบจากตระกูล Qwen ออกแบบมาเพื่อการอนุมานที่รวดเร็วและต้นทุนต่ำ รองรับอินพุตทั้งข้อความ รูปภาพ และวิดีโอ และสร้างเอาต์พุตเป็นข้อความ หน้าต่างบริบทขนาด 1,048,576…

Qwen3.5 Flash คืออะไร

โมเดลนี้เหมาะสำหรับใคร?

ข้อมูลจำเพาะหลักโดยสังเขป

ตัวอย่างโค้ด

เรียกใช้จาก SDK ใดก็ได้

เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

พารามิเตอร์ที่รองรับ

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

ราคา

อินพุต / 1M โทเค็น$0.100
เอาต์พุต / 1M โทเค็น$0.400
สกุลเงินUSD

เครื่องคำนวณค่าใช้จ่าย

โทเค็น / เดือน10MM
สัดส่วนอินพุต70%%
ประมาณ / เดือน $1.90

ประมาณการจากราคาตั้ง

เครื่องมือประเมิน token และค่าใช้จ่าย

token อินพุต: 13ค่าใช้จ่ายต่อคำขอ: $0.000201

เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ

ประสิทธิภาพ

p50 TTFT
2.71 s
ความเร็วเอาต์พุต
206 tok/s
p95 TTFT
10.00 s
อัตราข้อผิดพลาด
7.3%

เกณฑ์มาตรฐานสาธารณะ

แหล่งที่มา: Design Arena

กระแสในชุมชน

สิ่งที่นักพัฒนาพูดถึงในสัปดาห์นี้

Hacker News0 การกล่าวถึง · 7 วัน

การเปรียบเทียบ

qwen/qwen3.5-flashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
อินพุต $/ล้าน$0.10$2.00$0.86$0.17
เอาต์พุต $/ล้าน$0.40$6.00$3.44$1.03
บริบท1.0M1.0M262K33K
คุณภาพ6/109/108/108/10
เปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกัน

เพิ่มเติมจาก qwen

FAQ

ค่าใช้จ่ายในการใช้ Qwen3.5 Flash บน OrcaRouter คือเท่าไร?
ค่าใช้จ่ายคือ $0.10 ต่อ 1 ล้าน input tokens และ $0.40 ต่อ 1 ล้าน output tokens นี่คืออัตราของผู้ให้บริการโดยไม่มีมาร์กอัปจาก OrcaRouter คุณจ่ายตามที่ผู้ให้บริการเรียกเก็บเท่านั้น โดยไม่มีค่าธรรมเนียมเพิ่มเติม
ขนาดหน้าต่างบริบทคือเท่าไร?
หน้าต่างบริบทมีขนาด 1,048,576 โทเคน (ประมาณ 1 ล้านโทเคน) ซึ่งรวมทั้งโทเคนอินพุตและเอาต์พุตตลอดประวัติการสนทนาทั้งหมด เอาต์พุตสูงสุดต่อการสร้างครั้งคือ 65,536 โทเคน
ข้อดีของ Qwen3.5 Flash มีอะไรบ้าง
ข้อดีรวมถึงการรับข้อมูลหลายรูปแบบ (ข้อความ รูปภาพ วิดีโอ) หน้าต่างบริบทขนาดใหญ่ถึง 1M ผลลัพธ์ยาว 65K โทเค็น ต้นทุนต่อโทเค็นต่ำ และการอนุมานที่รวดเร็วเมื่อเทียบกับโมเดล Qwen ที่ใหญ่กว่า เหมาะสำหรับงานหลายรูปแบบที่มีปริมาณมากหรือแบบเรียลไทม์
มันเปรียบเทียบกับโมเดล Qwen ที่ใหญ่กว่าอย่างไร
โมเดล Qwen ขนาดใหญ่ เช่น Qwen3.5-72B ให้ความแม่นยำสูงกว่าในการให้เหตุผลที่ซับซ้อน แต่ทำงานช้ากว่าและมีราคาแพงกว่า Qwen3.5 Flash แลกความแม่นยำบางส่วนเพื่อความเร็วและประสิทธิภาพด้านต้นทุน ในขณะที่ยังคงความสามารถแบบมัลติโมดัลและบริบทยาวเท่าเดิม
OrcaRouter ทำการบวกเพิ่มราคาจากผู้ให้บริการหรือไม่?
ไม่. ราคาจะถูกส่งผ่านตามอัตราของผู้ให้บริการโดยไม่มีกำไรส่วนเพิ่ม คุณจ่าย $0.10 ต่อ 1M token ขาเข้า และ $0.40 ต่อ 1M token ขาออกสำหรับ Qwen3.5 Flash ผ่าน OrcaRouter
ฉันสามารถเรียกใช้ Qwen3.5 Flash โดยใช้ API ที่เข้ากันได้กับ OpenAI ได้ไหม?
ใช่ OrcaRouter มีเอนด์พอยต์ที่เข้ากันได้กับ OpenAI ที่ https://api.orcarouter.ai/v1 ใช้ model ID "qwen/qwen3.5-flash" กับคีย์ API ของ OrcaRouter ของคุณ รูปแบบคำขอและการตอบกลับตรงกับ API การแชทของ OpenAI
การจัดการข้อมูลทำงานอย่างไรกับ OrcaRouter?
นโยบายการจัดการข้อมูลถูกกำหนดโดย OrcaRouter และ Qwen รายการในแค็ตตาล็อกไม่ได้ให้รายละเอียดเฉพาะเจาะจง ผู้ใช้ควรตรวจสอบนโยบายความเป็นส่วนตัวของ OrcaRouter และข้อกำหนดการใช้งานข้อมูลของ Qwen ก่อนส่งข้อมูลที่ละเอียดอ่อน
โมเดลรองรับรูปแบบใดบ้าง?
รองรับการป้อนข้อมูลที่เป็นข้อความ รูปภาพ และวิดีโอ รูปภาพสามารถระบุเป็น URL หรือข้อมูล base64 ในข้อความผู้ใช้ การป้อนข้อมูลวิดีโอโดยทั่วไปจะส่งเป็นลำดับของเฟรม (รูปภาพ) โมเดลจะสร้างเอาต์พุตที่เป็นข้อความเท่านั้น
จำเป็นต้องมีจำนวนโทเคนขั้นต่ำหรือสูงสุดหรือไม่?
ไม่มีจำนวนโทเค็นขั้นต่ำ จำนวนโทเค็นอินพุตสูงสุด (รวมประวัติการสนทนา) คือ 1,048,576 โทเค็น จำนวนโทเค็นเอาต์พุตสูงสุดต่อการตอบกลับคือ 65,536 โทเค็น ใช้พารามิเตอร์ max_tokens เพื่อควบคุมความยาวเอาต์พุต
ฉันจะเริ่มต้นเรียกใช้โมเดลนี้ผ่าน OrcaRouter ได้อย่างไร?
ลงทะเบียนสำหรับ OrcaRouter เพื่อรับ API key. ตั้งค่า base URL เป็น https://api.orcarouter.ai/v1 ในโค้ดของคุณ. ใช้ model ID "qwen/qwen3.5-flash" และส่งคำขอ chat completion มาตรฐานพร้อมกับเนื้อหา multimodal ของคุณ. ดูเอกสารของ OrcaRouter สำหรับตัวอย่าง.

ฝังป้ายนี้

qwen/qwen3.5-flash$0.10/M in2705ms p50ผ่าน OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg" alt="qwen/qwen3.5-flash บน OrcaRouter" /> </a>
Markdown [![qwen/qwen3.5-flash](https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-flash)

ข้อมูลโมเดลแบบ data

GET /api/public/models/qwen/qwen3.5-flashเปิด
อ่านได้ด้วยเครื่อง:/llms.txt/llms-full.txt