กระดานจัดอันดับโมเดล AI

จัดอันดับจากทราฟฟิกการใช้งานจริงของ OrcaRouter และคะแนนโหวตจากชุมชนใน Battle Mode ไม่ใช่จากเกณฑ์มาตรฐานที่ผู้ให้บริการรายงานเอง

วัดจากทราฟฟิกจริง
100.0%
อัตราสำเร็จสูงสุด (7 วัน)
OpenAI: GPT-5 Mini
399 ms
ค่าหน่วง p50 เร็วที่สุด
DeepSeek: DeepSeek V3
80.1%
อัตราการชนะจากชุมชนสูงสุด
Qwen3.7 Max (2026-05-20)

ภาพรวม — อัตราการชนะจากชุมชน

คะแนนโหวต Battle Mode แบบปิดตา จัดอันดับด้วยโมเดล Bradley–Terry (Elo) จุดแสดงคะแนน แท่งแสดงช่วงความเชื่อมั่น 95% โมเดลในแถบเดียวกันถือว่าเสมอกันทางสถิติ

การควบคุมสไตล์
เร็ว ๆ นี้ — ต้องการข้อมูลการประลองเพิ่มเติม

⚔️ ศึกปิดตา

โมเดลนิรนามสองตัวตอบพรอมป์เดียวกัน อ่านทั้งสองฝั่ง โหวตผู้ชนะ แล้วดูว่าใครเขียนอะไร — คะแนนโหวตของคุณจะถูกนับรวมในอันดับด้านบน

อันดับโมเดลคะแนนอารีนาวิธีการคะแนนโหวตชนะ·แพ้·เสมอ
#1Qwen3.7 Max (2026-05-20)1746±140
ปิดตา · BT
168129·32·7
#2DeepSeek: DeepSeek V4 Pro1526±76
ปิดตา · BT
250161·77·12
OpenAI: GPT-5.4 Pro1523±81
ปิดตา · BT
281158·111·12
OpenAI: GPT-5.51521±81
ปิดตา · BT
230109·109·12
Qwen: Qwen3.5-35B-A3B1519±88
ปิดตา · BT
310149·149·12
Qwen3.7 Max1519±125
ปิดตา · BT
22484·130·10
Anthropic: Claude Opus 4.71518±103
ปิดตา · BT
247117·117·13
Qwen: Qwen3.6 35B A3B1518±91
ปิดตา · BT
260124·124·12
Anthropic: Claude Opus 4.81516±96
ปิดตา · BT
245116·116·13
Google: Gemma 4 26B A4B1516±91
ปิดตา · BT
242114·116·12
Qwen: Qwen3.6 Plus1515±125
ปิดตา · BT
278108·158·12
#12MoonshotAI: Kimi K2.7 Code1301±69
ปิดตา · BT
224119·93·12
MiniMax: MiniMax M31300±59
ปิดตา · BT
265127·126·12
Google: Gemma 4 31B1300±58
ปิดตา · BT
273112·149·12
OpenAI: GPT-5.5 Pro1299±68
ปิดตา · BT
29495·187·12
Qwen: Qwen3.5-27B1298±63
ปิดตา · BT
213100·101·12
Z.ai: GLM 5.21298±67
ปิดตา · BT
235141·82·12
#18MiniMax: MiniMax M2.71081±66
ปิดตา · BT
22681·133·12
Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)1079±105
ปิดตา · BT
281151·118·12
OpenAI: GPT-5.41078±73
ปิดตา · BT
245117·116·12
Google: Gemini 3.1 Flash Lite Preview1078±98
ปิดตา · BT
285137·136·12
MiniMax M2.7 highspeed1077±106
ปิดตา · BT
246117·117·12
OpenAI: GPT-5.4 Nano1077±102
ปิดตา · BT
308196·100·12
Qwen: Qwen3.7 Plus1076±90
ปิดตา · BT
248118·118·12
Z.ai: GLM 5.11076±78
ปิดตา · BT
220104·104·12
Kling: Kling 3.0 Turbo1074±91
ปิดตา · BT
256121·123·12
Qwen: Qwen3.6 Flash1073±70
ปิดตา · BT
18871·105·12
#28Gemini 3.5 Flash852±123
ปิดตา · BT
28596·177·12
OpenAI: GPT-5.4 Mini851±123
ปิดตา · BT
20675·122·9
DeepSeek: DeepSeek V4 Flash850±128
ปิดตา · BT
12861·61·6

การดวลแบบตัวต่อตัว

อัตราชนะแบบจับคู่ใน Battle Mode — แต่ละโมเดลเอาชนะคู่แข่งแต่ละรายในการดวลตรงบ่อยเพียงใด

ผู้นำในแต่ละหมวดหมู่

โมเดลที่แข็งแกร่งที่สุดในแต่ละความสามารถ — การเขียนโค้ด คณิตศาสตร์ การให้เหตุผล และอื่น ๆ — พร้อมโปรไฟล์รายแกนเทียบกับค่ามัธยฐานของกลุ่ม

เกณฑ์มาตรฐาน — ความฉลาดเทียบกับราคา

คะแนนความฉลาดอิสระเทียบกับราคาอินพุต เส้นประคือเส้นพรมแดนพาเรโตของราคา/ความฉลาด

ความน่าเชื่อถือและต้นทุน

วัดจากทราฟฟิกการใช้งานจริงของ OrcaRouter ในช่วง 7 วันที่ผ่านมา

โมเดล
สำเร็จ % (7 วัน)
p50
p99
ข้อผิดพลาด %
$/ล้าน (เข้า→ออก)
tok/s
OpenAI: GPT-5 Mini100.0%10.00 s10.00 s
0.0%
$0.25 → $2.00189
OpenAI: GPT-5 Nano100.0%4.31 s10.00 s
0.0%
$0.05 → $0.40835
openai/gpt-5.2-chat-latest100.0%1.57 s10.00 s
0.0%
$1.75 → $14.00112
Qwen: Qwen3.7 Plus100.0%3.96 s10.00 s
0.0%
$0.35 → $1.4258
MiniMax M2.5 highspeed100.0%2.12 s2.12 s
0.0%
$0.60 → $2.40
openai/gpt-3.5-turbo-1106100.0%1.80 s4.15 s
0.0%
$1.00 → $2.00143
OpenAI: GPT-4o (2024-11-20)100.0%1.83 s4.34 s
0.0%
$2.50 → $10.00177
Qwen: Qwen3 VL 235B A22B Instruct100.0%10.00 s10.00 s
0.0%
$0.40 → $1.6074
OpenAI: GPT-4o100.0%902 ms10.00 s
0.0%
$2.50 → $10.0098
Qwen: Qwen3.5-122B-A10B100.0%5.00 s10.00 s
0.0%
$0.12 → $0.9289
google/gemini-3.1-flash-lite100.0%986 ms4.90 s
0.0%
$0.25 → $1.50285
OpenAI: GPT-3.5 Turbo 16k100.0%5.00 s7.07 s
0.0%
$3.00 → $4.00103
openai/gpt-5-2025-08-07100.0%10.00 s10.00 s
0.0%
$1.25 → $10.00363
qwen/qwen3.5-plus100.0%3.96 s10.00 s
0.0%
$0.12 → $0.6952
openai/gpt-5.4-2026-03-05100.0%1.40 s2.18 s
0.0%
$5.00 → $22.50196
OpenAI: GPT-5.4 Nano100.0%1.35 s10.00 s
0.0%
$0.20 → $1.25161
Z.ai: GLM 4.5 Air100.0%6.67 s10.00 s
0.0%
$0.20 → $1.1065
OpenAI: GPT-5100.0%10.00 s10.00 s
0.0%
$1.25 → $10.001504
OpenAI: GPT-4.1 Nano100.0%1.36 s5.00 s
0.0%
$0.10 → $0.4099
Qwen: Qwen3 VL 8B Thinking100.0%7.50 s10.00 s
0.0%
$0.18 → $2.1067
Z.ai: GLM 5.1100.0%4.59 s10.00 s
0.0%
$1.40 → $4.4067
openai/gpt-5-chat-latest100.0%2.00 s3.40 s
0.0%
$1.25 → $10.00135
OpenAI: GPT-5.1100.0%2.43 s4.63 s
0.0%
$1.25 → $10.00108
OpenAI: GPT-5.4 Pro100.0%2.67 s4.72 s
0.0%
$60.00 → $270.006
Qwen: Qwen3.6 35B A3B100.0%4.54 s10.00 s
0.0%
$0.25 → $1.49205
แสดงรายการ 1 - 25 จาก 133

ปริมาณ — ทราฟฟิกการใช้งานจริง

โมเดลใดที่รองรับทราฟฟิกการใช้งานจริงของ OrcaRouter จริง ๆ จัดอันดับตามอัตราการประมวลผลโทเค็นในช่วงที่เลือก

อันดับโมเดลสัดส่วนแนวโน้ม
#1deepseek-v4-flash
#2deepseek-v4-pro
#3glm-5.2
#4claude-opus-4.8
#5deepseek-chat
#6deepseek-reasoner
#7minimax-m3
#8claude-sonnet-5
#9claude-opus-4.7
#10gpt-image-2-medium
#11qwen3.7-max
#12gemini-3.5-flash
#13qwen3.7-plus
#14qwen3.5-35b-a3b
#15gpt-5.4-nano
#16gemini-2.5-flash-lite
#17gemini-3-flash-preview
#18kimi-k2.7-code
#19gemini-embedding-2-preview
#20glm-5.1
#21grok-4.5
#22claude-haiku-4.5
#23qwen3.6-plus
#24qwen3.6-35b-a3b
#25claude-sonnet-4.6
แสดงรายการ 1 - 25 จาก 141

มีอีก 17 โมเดลที่ต่ำกว่าเกณฑ์การจัดอันดับสำหรับช่วงนี้

การตรวจสอบ — ความสอดคล้องกับการจัดอันดับภายนอก

การจัดอันดับของชุมชนสอดคล้องกับการจัดอันดับภายนอกที่เป็นอิสระมากเพียงใด วัดด้วยสหสัมพันธ์อันดับ Spearman ρ และ Kendall τ

กระแส — ความนิยมและความรู้สึก

สิ่งที่ชุมชนกำลังพูดถึง — ปริมาณการกล่าวถึง โมเมนตัม 14 วัน และความรู้สึก เป็นเพียงบริบทเท่านั้น ไม่ใช่สัญญาณการจัดอันดับ