ไม่บวกราคา · ความพร้อมใช้งานสูงขึ้น · ราคาดีกว่า

หนึ่งเกตเวย์ ทุกโมเดล กำหนดเส้นทางฉลาดขึ้น ส่งมอบปลอดภัยขึ้น ใช้จ่ายน้อยลง

OrcaRouter ให้คะแนนทุกพรอมต์และกำหนดเส้นทางอย่างชาญฉลาด AI คุณภาพระดับแนวหน้าด้วยต้นทุนที่ต่ำลงสูงสุดถึง 40% การกำหนดเส้นทางแบบปรับตัว การกระจายโหลด guardrail ไฟร์วอลล์สำหรับเอเจนต์ การสังเกตการณ์ และการกำกับดูแล — ทั้งหมดผ่านเอนด์พอยต์เดียวที่เข้ากันได้กับ OpenAI

ไม่ต้องใช้บัตรเครดิต · เริ่มใช้งานใน 60 วินาที

- client = OpenAI(api_key="sk-...")
+ client = OpenAI(
+ base_url="https://api.orcarouter.ai/v1",
+ api_key="sk-orca-..."
+ )
 
# Everything else stays the same.
response = client.chat.completions.create(
model="orcarouter/auto", # router picks the best model per request
messages=[{"role": "user", "content": "..."}]
)
# → orcarouter/auto grades the prompt → frontier or open-source, zero token markup ✓

บรรทัดเดียว เราให้คะแนนแต่ละพรอมต์ กำหนดเส้นทางไปยังโมเดลแนวหน้าหรือ OSS และเพิ่ม $0

200+
โมเดล หนึ่งเอนด์พอยต์
0%
การบวกเพิ่มค่าโทเค็น ตลอดกาล
75.5%
ความแม่นยำในการกำหนดเส้นทาง
<50ms
การสำรองข้อมูลกลางสตรีม
การผสานรวม

ใช้งานร่วมกับเครื่องมือที่คุณใช้อยู่แล้ว

ใช้งานแบบ drop-in ที่เข้ากันได้กับ OpenAI หรือเชื่อมต่อเอเจนต์ผ่านเซิร์ฟเวอร์ MCP ของ OrcaRouter — คง SDK เฟรมเวิร์ก และเอดิเตอร์ของคุณไว้

เซิร์ฟเวอร์ MCP ของ OrcaRouterOpenAI SDKGoogle GenAI SDKAnthropic SDKLangChainLlamaIndexVercel AI SDKCamelAIDifyCursorOpenCodePromptfooOpenClawOpenHumanGitHubcURLและอื่น ๆ
กำลังสร้างจากสิ่งนี้อยู่หรือ? คุยกับเราXDiscordGitHub
เกตเวย์ AI สำหรับการใช้งานจริง

การกำหนดเส้นทางอัจฉริยะและการสำรองอัตโนมัติในทุกคำขอ

การกำหนดเส้นทางที่แม่นยำขึ้นอย่างวัดผลได้

ทุกพรอมต์จะถูกเอ็มเบ็ดและกำหนดเส้นทางโดยโมเดลที่เรียนรู้อย่างต่อเนื่องแบบออนไลน์จากทราฟฟิกจริง บนลีดเดอร์บอร์ดสาธารณะ RouterArena (มิ.ย. 2026) โมเดลนี้นำหน้าด้านความแม่นยำ — เหนือกว่า GPT-5, Azure, Martian และ NotDiamond — ที่ 75.5%

contextual embeddingsonline learning<1ms overheadRouterArena
* อ้างอิงจากข้อมูลลีดเดอร์บอร์ด RouterArena เดือนมิถุนายน 2026

ผู้ให้บริการล่ม แต่ไม่มีใครสังเกตเห็น

เมื่อผู้ให้บริการจำกัดอัตราหรือเกิด 5xx OrcaRouter จะลองคำขอใหม่กับโมเดลที่ทำงานปกติจากตัวเลือกกว่า 200+ ก่อนที่การตอบกลับจะเริ่มต้น — ดังนั้นการล่มชั่วคราวของต้นทางจึงไม่ปรากฏต่อผู้ใช้ของคุณ

200+ modelsauto-failoverno 429

กำหนดเส้นทางตามเงื่อนไขของคุณ

orcarouter/auto เป็นค่าเริ่มต้นอัจฉริยะ ไม่ใช่กล่องดำ ตั้งเป้าหมายที่คุณต้องการให้แต่ละพื้นที่ทำงาน — โมเดลที่ถูกที่สุดที่ผ่านเกณฑ์คุณภาพของคุณ, คุณภาพสูงสุด หรือความสมดุลของทั้งสอง — หรือปล่อยให้มันเรียนรู้การแลกเปลี่ยนจากทราฟฟิกของคุณเอง คุณไม่เคยถูกล็อกไว้กับพฤติกรรมเดียว

per-workspaceno markup either way<1ms overhead

ต้องการมากกว่าโหมด? เขียนกฎเอง

เมื่อค่าเริ่มต้นไม่เพียงพอ ให้แสดงการกำหนดเส้นทางเป็นโค้ด — ควบคุมเวอร์ชัน, ตรวจสอบได้ และใช้งานได้ในไม่กี่วินาที ไม่ต้องดีพลอยใหม่ ไม่ต้องเปลี่ยนไคลเอนต์

YAML + CELversion-controlledlive in seconds
routing.yaml
version: 1
rules:
- id: hard_agent_task
when: task_class == "agent" && difficulty >= 0.6
use:
model: "claude-opus-4-7"
reasoning_effort: high # spend where it matters
- id: short_prompts
when: request.input_tokens < 500
use: { delegate: cheapest }
default:
delegate: balanced # fall back to the chosen mode

เห็นและพิสูจน์ทุกการเรียกใช้ — ต้นทุน โมเดล ความหน่วง และเหตุผล

เห็นทุกอย่าง พิสูจน์ได้ทุกสิ่ง

เห็นได้ชัดเจนว่าแต่ละคำขอมีต้นทุนเท่าไร โมเดลใดให้บริการ ใช้เวลานานเท่าใด และเหตุใดจึงล้มเหลว — บันทึกแบบมีโครงสร้างที่สมบูรณ์ซึ่งคุณสามารถกรอง เล่นซ้ำ และคัดลอกเป็น cURL ที่รันได้ เส้นทางไม่เคยเป็นกล่องดำ

Per-request logsgrade · model · costcopy-as-cURL

ไม่มีบวกราคา ไม่มีกล่องดำ

คุณจ่ายแต่ละผู้ให้บริการตามราคาที่แน่นอนของพวกเขา — เราเพิ่ม $0 ต่อโทเค็น ตลอดไป ทุกคำขอแสดงคะแนน โมเดลที่เลือก ผู้ให้บริการ ความหน่วง และราคา ดังนั้นต้นทุนจึงเป็นกล่องแก้ว ไม่ใช่อัตราผสมที่ทึบแสง

$0 / tokenprovider costglass-box receipt

พรอมต์ที่มีเวอร์ชันและการแคช — โดยไม่ต้องดีพลอยใหม่

เปลี่ยนพรอมต์ ไม่ใช่โค้ด

ทำเวอร์ชันพรอมต์ภายใต้เลเบลที่ตั้งชื่อด้วยการแบ่งทดสอบ A/B และการย้อนกลับด้วยคลิกเดียว ย้ายเลเบลแล้วทุกคำขอจะรับไปใช้ทันที — ไม่ต้องดีพลอยใหม่ ไม่ต้องเปลี่ยนโค้ด ไม่ต้องอัปเดตไคลเอนต์

VersionedA/BInstant rollbackNo deploy

จ่ายครั้งเดียว ใช้ซ้ำได้ฟรี

โทเค็นพรอมต์ที่ใช้ซ้ำและถูกแคชจะคิดค่าบริการตามอัตราแคชของผู้ให้บริการ — มักเป็นเศษเสี้ยวของราคาอินพุต — ทั้งในหน้าต่างชั่วคราวแบบ 5 นาทีและ 1 ชั่วโมง คำตอบเหมือนเดิม ใช้จ่ายน้อยลง พร้อม cached_tokens ในทุกใบเสร็จ

cache_controlcached_tokens5m / 1h windows

Guardrail งบประมาณ และไฟร์วอลล์สำหรับเอเจนต์ที่บังคับใช้ได้จริง

Guardrail ที่หยุดสิ่งต่าง ๆ ได้จริง

PII Shield และนโยบายเนื้อหาทำงานก่อนที่จะมีการเรียกต้นทางและคิดเงิน คำขอที่ถูกบล็อกจะส่งคืน 400 ที่สะอาดและไม่ถูกเรียกเก็บเงิน — guardrail บังคับใช้แบบอินไลน์ ไม่ใช่บันทึกหลังจากเกิดเหตุ

PII Shieldenforced pre-billingclean 400

ปลอดภัยสำหรับทีมของคุณ และเอเจนต์ของคุณ

งบประมาณและบทบาทสำหรับคน ไฟร์วอลล์ที่ให้คะแนนความเสี่ยงสำหรับเอเจนต์ ทุกการเรียกใช้เครื่องมือและ MCP จะถูกให้คะแนนเป็น ALLOW, REVIEW หรือ BLOCK ก่อนทำงาน และการตรวจจับความผิดปกติจะแจ้งเตือนการพุ่งสูงของอัตราและต้นทุนเทียบกับเส้นฐานชั่วโมงต่อสัปดาห์ที่เรียนรู้ไว้

ALLOW · REVIEW · BLOCKMCP gatinganomaly detection
สร้างมาเพื่อยุคของเอเจนต์ ก่อนที่คุณจะต้องใช้

การตั้งค่า

ใช้งานได้ใน 60 วินาที

เปลี่ยน URL เพียงครั้งเดียว SDK ชื่อโมเดล และสตรีมมิงที่มีอยู่ของคุณทั้งหมดทำงานเหมือนเดิมทุกประการ

ขั้นตอนที่ 1

ชี้ SDK ของคุณมาที่เรา

ตั้ง base_url เป็น api.orcarouter.ai/v1 และเปลี่ยน API key ของคุณ ไม่ต้องเปลี่ยนโค้ดอื่นใด

ขั้นตอนที่ 2

เรากำหนดเส้นทาง ป้องกัน และสังเกตการณ์

ทุกการเรียกจะถูกกำหนดเส้นทางไปยังโมเดลที่ดีที่สุด ตรวจสอบกับ guardrail ของคุณ และวัดปริมาณ — จัดเกรดในไม่ถึง 1ms พร้อมการสำรอง, การแคช และบันทึกครบถ้วนในตัว

ขั้นตอนที่ 3

คุณส่งมอบ บนเอนด์พอยต์เดียว

ทราฟฟิกไปตรงยัง first-party API ของผู้ให้บริการแต่ละรายที่อัตราที่ประกาศไว้ — เราเพิ่ม $0 ต่อโทเค็น หนึ่งเอนด์พอยต์ที่เข้ากันได้กับ OpenAI สำหรับการกำหนดเส้นทาง observability และการกำกับดูแล


ทุกโมเดล รายการราคาเดียว

200+ โมเดลพร้อมราคาแบบเรียลไทม์เทียบกันเคียงข้าง — เท่ากับที่คุณจ่ายผู้ให้บริการโดยตรง เราเพิ่ม $0 ด้านบน

ดูโมเดลทั้งหมด 200+ ตัว →
โมเดลกำหนดเส้นทางไปยังอินพุต /Mเอาต์พุต /Mบริบทคุณภาพ
deepseek/deepseek-v4-flash-0731NEWDeepSeek$0.147$0.2951M6.0
qwen/qwen3.7-flashNEWAlibaba Cloud$0.030$0.1301M7.0
orca/dubNEW$0.600 /call5.0
anthropic/claude-opus-5NEWAnthropic Direct$5.00$25.001M10.0
google/gemini-3.6-flashNEWGoogle Direct$1.50$7.501M8.0
google/gemini-3.5-flash-liteNEWGoogle Direct$0.300$2.501M6.0
meta/muse-spark-1.1NEW$1.25$4.251M8.0
kimi/kimi-k3NEWMoonshot$3.00$15.001M9.0
+ อีก 194 โมเดล · ราคาอัปเดตทุก 60 วินาที

ราคา

การกำหนดเส้นทางฟรี
จ่ายสำหรับฟีเจอร์

เราไม่เคยหักส่วนแบ่งจากการใช้จ่ายโทเค็นของคุณ รายได้ของเรามาจากฟีเจอร์ทีมที่เป็นทางเลือก

การรับประกันไม่มีส่วนต่างราคา
คุณจ่ายผู้ให้บริการโดยตรงที่อัตราที่ประกาศไว้ เราไม่เพิ่มอะไรบนต้นทุนโทเค็น การกำหนดเส้นทางฟรี; แพ็กเกจ Team ที่เป็นทางเลือกเป็นเงินทุนให้แพลตฟอร์ม
$0.00ค่าธรรมเนียมการกำหนดเส้นทาง

Hacker

ฟรี
ตลอดไป ไม่มีส่วนต่างราคาในทุกโทเค็น
✓ Route — 200+ โมเดล, การสลับสำรองอัตโนมัติ
✓ สังเกตการณ์ — แดชบอร์ดพื้นฐาน
✓ จัดการ — การจัดเวอร์ชันพรอมต์
✓ 3 API คีย์ · บวกเพิ่มโทเค็น 0%
เริ่มใช้งานฟรี

Enterprise

กำหนดเอง
ข้อผูกพัน SLA + การปรับใช้แบบส่วนตัว
✓ ทุกอย่างใน Team
✓ การปรับใช้แบบส่วนตัว / on-prem
✓ SLA ความพร้อมใช้งาน 99.99%
✓ โครงสร้างพื้นฐานเฉพาะ
✓ การสนับสนุนเฉพาะและราคากำหนดเอง
ความน่าเชื่อถือและการปฏิบัติตามข้อกำหนด
ตรวจสอบโดยอิสระ ปฏิบัติตามข้อกำหนดต่อเนื่อง — ขอรายงานได้ภายใต้ NDA

จากบล็อก

อัปเดตล่าสุดจากห้องเครื่อง

เรากำลังสร้างอะไรและทำไม — บทความล่าสุดของเรา

บทความทั้งหมด →
Engineering & ResearchGemini Robotics ER 2: อธิบายสมองหุ่นยนต์แบบ Embodied-Reasoning ของ Google DeepMindอธิบาย Gemini Robotics ER 2 ของ Google DeepMind: VLM ที่ให้เหตุผลเชิงกายภาพ (embodied-reasoning) ซึ่งวางแผน ให้เหตุผลเกี่ยวกับพื้นที่ ประสานงานหุ่นยนต์ และสตรีมข้อมูลแบบเรียลไทม์Jul 31, 2026

คำถามที่พบบ่อย

AI router, LLM gateway, การกำหนดเส้นทางแบบปรับตัว — ตอบครบ

คำตอบสั้นและอิงข้อเท็จจริง — ชุดเดียวกับที่เสิร์ชเอนจินเห็นใน structured data ของหน้านี้

AI router คืออะไร?

AI router อยู่ระหว่างแอปของคุณกับโมเดลจำนวนมาก และเลือกโมเดลที่เหมาะที่สุดให้แต่ละคำขอ OrcaRouter ให้คะแนนทุกพรอมป์ตในเวลาไม่ถึง 1 มิลลิวินาทีแล้วกำหนดเส้นทาง — โมเดลระดับแนวหน้าสำหรับการใช้เหตุผลยาก โอเพนซอร์สสำหรับงานทั่วไป — ครอบคลุมกว่า 200 โมเดล โดยไม่บวกราคาโทเคน

LLM router คืออะไร ทำงานอย่างไร?

LLM router จำแนกแต่ละพรอมป์ตแล้วจับคู่กับโมเดลที่มีแนวโน้มตอบได้ดีที่สุดในต้นทุนต่ำสุด OrcaRouter ใช้ contextual embeddings พร้อมการเรียนรู้ออนไลน์จากทราฟฟิกจริง — ความแม่นยำ 75.5% บนลีดเดอร์บอร์ดสาธารณะ RouterArena

OrcaRouter เป็น AI gateway หรือไม่?

ใช่ OrcaRouter คือ AI gateway ระดับโปรดักชัน: เอนด์พอยต์เดียวที่เข้ากันได้กับ OpenAI พร้อมการกำหนดเส้นทางแบบปรับตัว โหลดบาลานซ์ เฟลโอเวอร์อัตโนมัติ การ์ดเรล ไฟร์วอลล์เอเจนต์ แคชพรอมป์ต และการสังเกตการณ์รายคำขอ

AI CDN คืออะไร?

เช่นเดียวกับที่ CDN เสิร์ฟคอนเทนต์จากเอดจ์ที่ดีที่สุด AI CDN เสิร์ฟการอนุมานจากผู้ให้บริการที่ดีที่สุด: กำลังประมวลผลที่แข็งแรง เร็ว ราคาถูก แคชพรอมป์ตซ้ำ และเฟลโอเวอร์เมื่อขัดข้อง OrcaRouter ทำหน้าที่นี้ครอบคลุมกว่า 200 โมเดล

การกำหนดเส้นทางแบบปรับตัว (adaptive routing) คืออะไร?

การกำหนดเส้นทางแบบปรับตัวเรียนรู้สมดุลคุณภาพ/ต้นทุนจากทราฟฟิกของคุณเอง ตั้งแต่ละเวิร์กสเปซให้ชี้ไปที่ "ถูกที่สุดที่ผ่านเกณฑ์" คุณภาพสูงสุด หรือสมดุล — หรือให้ orcarouter/auto ปรับจูนการเลือกทีละคำขอ

ต้องมีทั้ง AI gateway และ LLM router ไหม?

ทั้งสองแก้ปัญหาคนละอย่าง — ธรรมาภิบาลกับการเลือกโมเดล — แต่คุณไม่จำเป็นต้องมีสองระบบ: OrcaRouter กำหนดเส้นทางรายคำขอ พร้อมบังคับใช้งบประมาณ การ์ดเรล และการสังเกตการณ์ในฮ็อปเดียวกัน

การกำหนดเส้นทางเพิ่มความหน่วงไหม?

การให้คะแนนพรอมป์ตใช้เวลาไม่ถึง 1 มิลลิวินาที และความหน่วงเพิ่มรวมต่ำกว่า 50 มิลลิวินาที — โดยปกติได้คืนหลายเท่าจากผู้ให้บริการที่เร็วขึ้นและโทเคนพรอมป์ตที่แคชไว้

OrcaRouter บวกราคาโทเคนไหม?

ไม่ คุณจ่ายตามราคาประกาศของแต่ละผู้ให้บริการ OrcaRouter บวก $0 ต่อโทเคน และหารายได้จากฟีเจอร์เสริม Team และ Enterprise

ใช้โค้ด OpenAI SDK เดิมต่อได้ไหม?

ได้ — เปลี่ยน base_url เป็น https://api.orcarouter.ai/v1 แล้วโค้ด SDK ของ OpenAI, Anthropic หรือ Google ก็ทำงานต่อได้ทันที: Chat Completions, Responses, Embeddings, Images, Audio และสตรีมมิง

จะเกิดอะไรขึ้นเมื่อผู้ให้บริการล่ม?

OrcaRouter จะลองใหม่กับกำลังสำรองที่แข็งแรงของโมเดลเดิมหรือเทียบเท่าก่อนการตอบกลับเริ่มต้น ความขัดข้องต้นทางจึงไม่ไปถึงผู้ใช้ของคุณ

ฉลาดขึ้น ปลอดภัยขึ้น คุ้มค่ายิ่งขึ้น

สลับเพียงบรรทัดเดียว นั่นคือการย้ายระบบ

สมัครด้วย GitHub — ไม่ต้องใช้บัตรเครดิต ใช้งานได้ภายในไม่ถึงหนึ่งนาที

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

ติดต่อเรา

เข้าร่วมคอมมูนิตี้ของเรา

DiscordEmailXGitHubYouTube