การ์ดฮีโร่ที่สร้างขึ้นชื่อ 'Claude Haiku 4.5 vs PPLX 27B' พร้อมคำโปรย 'ไม่ฟรี $0.30 ต่อโทเคน' และชิป ไม่มีฮาร์ดแวร์เทียบกับ $4,500, 1M เทียบกับบริบท 262K, และเทียบกับบนอุปกรณ์
Guides & Insights

Claude Haiku 5.5 vs PPLX 27B: $0.00 ต่อโทเค็นไม่ได้แปลว่าฟรี

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

PPLX 27B ไม่มีค่าใช้จ่ายต่อโทเคนเลย มันรันในเครื่อง บนฮาร์ดแวร์ที่คุณเป็นเจ้าของ และเมื่อซื้อฮาร์ดแวร์แล้ว ต้นทุนส่วนเพิ่มของโทเคนถัดไปก็เป็นศูนย์จริง ๆ Claude Haiku 5.5 มีค่าใช้จ่าย $0.10 ต่อล้านโทเคนอินพุต และ $0.50 ต่อล้านโทเคนเอาต์พุต — ซึ่งเป็นตัวเลขที่เล็กพอจนคุ้มค่าที่จะลบให้ถูกต้อง มากกว่าจะยอมรับข้อสรุปที่เห็นได้ชัด เครื่องที่สามารถรัน PPLX 27B ได้ดีคือ DGX Spark ราคาประมาณ $4,500 หรือเดสก์ท็อปที่มีการ์ด RTX 24GB ขึ้นไป และ $4,500 ของโทเคนเอาต์พุต Claude Haiku 5.5 นั้นประมาณเก้าพันล้านโทเคน ดังนั้นคำถามที่การจับคู่นี้ถามจริง ๆ ไม่ใช่ว่าอันไหนถูกกว่า มันคือคุณคาดว่าจะใช้โทเคนไปกี่โทเคน และคำตอบนั้นเปลี่ยนไปหรือไม่เพราะโทเคนวางอยู่บนโต๊ะของคุณ

Claude Haiku 5.5 เป็นโมเดลขนาดเล็กของผู้ให้บริการ เปิดตัวเมื่อวันที่ 7 ตุลาคม 2026 PPLX 27B ถูกประกาศโดย Perplexity เมื่อวันที่ 25 สิงหาคม 2026 ควบคู่กับ Portable Computer ซึ่งสร้างขึ้นร่วมกับ NVIDIA และเป็นเวอร์ชันที่ผ่านการฝึกหลังการฝึก (post-trained) ของ Qwen 3.8 27B แบบเปิดน้ำหนัก ที่ปรับแต่งสำหรับฮาร์เนสของ Perplexity เอง ทั้งสองไม่ได้ใช้แทนกันได้แบบทันที และไม่มีตัวใดอยู่ในแค็ตตาล็อกของ OrcaRouter

สองโมเดล และเหตุใดหนึ่งในนั้นจึงอยู่บนโต๊ะทำงานของคุณ

Claude Haiku 5.5 — ID claude-haiku-5-5 รับข้อความและรูปภาพเข้า ส่งออกเป็นข้อความ คอนเท็กซ์ 1 ล้านโทเคน เอาต์พุตสูงสุด 128,000 โทเคน พร้อมเส้นทางเบต้า 300,000 โทเคนบน Batch API จุดตัดการฝึกอบรมเดือนมิถุนายน 2026 และคำมั่นว่าจะไม่ปลดระวางก่อนวันที่ 7 ตุลาคม 2027 ระดับ Effort ตั้งแต่ Low ถึง Max โดยมี Medium เป็นค่าเริ่มต้น การคิดแบบปรับตัวเปิดเป็นค่าเริ่มต้น การอ่านแคชมีค่าใช้จ่าย $0.01 ต่อล้านโทเคน และ Batch ลดราคาลงครึ่ง เป็นผลิตภัณฑ์แบบโฮสต์: คุณส่งโทเคนเข้า คุณได้โทเคนออก คุณไม่เคยเห็น GPU

PPLX 27B — โมเดลแบบ dense ขนาด 27 พันล้านพารามิเตอร์ พัฒนามาจาก Qwen 3.8 27B และผ่านการฝึกหลังการอบรม (post-trained) สำหรับ agent harness ของ Perplexity เอง ทำงานอยู่ภายใน Portable Computer บน DGX Spark หรือบนเครื่อง Linux ที่มีการ์ด NVIDIA RTX ขนาด 24GB ขึ้นไป และไม่ส่งข้อมูลออกจากเครื่องนั้น โหมดไฮบริดที่เพิ่มเข้ามาเมื่อวันที่ 1 กันยายน 2026 จะจับคู่กับโมเดลบนคลาวด์สำหรับงานที่หนักกว่า โดยผ่าน Privacy Gate บนอุปกรณ์ ส่วนการรองรับ RTX บน Linux มาในวันที่ 3 กันยายน และการรองรับการ์ด RTX ขนาด 24GB ขึ้นไปบน Windows มาในวันที่ 14 กันยายน พร้อมกับ MCP ภายในเครื่องและงานตามกำหนดเวลา เวตหลังการฝึกเป็นทรัพย์สินเฉพาะและอยู่ภายใต้การสมัครสมาชิก Perplexity Pro หรือ Max

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs PPLX 27B — the scoreboard'. Claude Haiku 5.5 reads marginal price $0.10 / $0.50 per million tokens, no upfront hardware, 1M-token context, 128K max output, AA Index 43, vendor-cloud data path; PPLX 27B reads marginal price $0.00 per token, about $4,500 upfront hardware, about 262K tokens of context, max output not published, no published independent score, on-device-only data path. A footer notes the Claude figures are per Artificial Analysis and the PPLX 27B figures are vendor-reported.

• ขนาดต่าง ๆ บรรทัดละหนึ่งช่อง

• ต้นทุนส่วนเพิ่มต่อโทเค็น — Claude Haiku 5.5 $0.10 ต่อล้านโทเค็นขาเข้า และ $0.50 ขาออก จนถึงพรอมป์ต 100K โทเค็น จากนั้น $0.50 และ $2.50; PPLX 27B ไม่มีค่าใช้จ่าย เมื่อจ่ายค่าฮาร์ดแวร์ไปแล้ว

• ค่าใช้จ่ายเริ่มต้น — ไม่มีอะไรนอกจากคีย์ API สำหรับ Claude Haiku 5.5; ประมาณ $4,500 สำหรับ DGX Spark หรือคอมพิวเตอร์เดสก์ท็อปที่มีการ์ด NVIDIA RTX ขนาด 24GB ขึ้นไป สำหรับ PPLX 27B

• หน้าต่างบริบท — 1,000,000 โทเค็นสำหรับ Claude Haiku 5.5 เมื่อเทียบกับประมาณ 262,144 ที่สืบทอดมาจาก Qwen 3.8 27B

• เอาต์พุตสูงสุด — 128,000 โทเค็นสำหรับ Claude Haiku 5.5 พร้อมเฮดเดอร์เบต้า 300,000 โทเค็นบน Batch; ไม่เผยแพร่สำหรับ PPLX 27B

• ข้อมูลไปที่ไหน — คลาวด์ของ Anthropic เทียบกับเครื่องของคุณเอง โดยที่ Privacy Gate ของโหมดไฮบริดเป็นตัวตัดสินว่าอะไรจะออกจากเครื่องไป

• คะแนนอิสระ — ดัชนีความฉลาด Artificial Analysis ได้ 43 สำหรับ Claude Haiku 5.5 การกำหนดค่า Max 43.40 เป็นอันดับสองจาก 182; ยังไม่มีการเผยแพร่ข้อมูลสำหรับ PPLX 27B ซึ่ง Artificial Analysis ไม่ได้ติดตาม

• ความเร็วเอาต์พุต — 243.4 โทเค็นต่อวินาทีสำหรับ Claude Haiku 5.5; สำหรับ PPLX 27B ขึ้นอยู่กับ GPU ของคุณ และไม่สามารถเปรียบเทียบได้หากไม่มีตัวเลขที่เผยแพร่

• รูปแบบอินพุต — ข้อความและรูปภาพเทียบกับข้อความ สืบทอดมาจากฐานมัลติโมดัล

• เวต — เป็นกรรมสิทธิ์ในทั้งสองกรณี แต่ด้วยเหตุผลที่แตกต่างกัน: ไม่มีการปล่อยเวต ตรงข้ามกับการปรับแต่งหลังการฝึกแบบจำกัดที่ต้องสมัครสมาชิกเพื่อให้ได้มา

ฮาร์ดแวร์คือราคา และราคาคือบททดสอบความซื่อสัตย์

คำว่า "ฟรี" เป็นคำที่ไม่ถูกต้องสำหรับการรันโมเดลแบบภายในเครื่อง และผู้ขายก็รู้ดี นั่นคือเหตุผลว่าทำไมตัวเลขที่ถูกอ้างถึงจึงเป็นต้นทุนส่วนเพิ่มเสมอ การเปรียบเทียบที่ถูกต้องคือจุดคุ้มทุน: เครื่องราคา $4,500 เมื่อเทียบกับ Claude Haiku 5.5 ที่ราคา $0.50 ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคน จะเท่ากับโทเคนเอาต์พุตเก้าพันล้านโทเคนก่อนที่ฮาร์ดแวร์จะคืนทุน ทีมที่สร้างโทเคนเอาต์พุตหนึ่งร้อยล้านโทเคนต่อเดือนจะไปถึงจุดนั้นในประมาณเจ็ดปีครึ่ง ซึ่งกว่าจะถึงตอนนั้น GPU ก็ล้าสมัยแล้ว ทีมที่สร้างห้าพันล้านต่อเดือนจะไปถึงจุดนั้นในไม่ถึงสองเดือน

คำตอบทั้งสองถูกต้อง และถูกต้องสำหรับบริษัทที่แตกต่างกัน นั่นคือเหตุผลทั้งหมดที่การเปรียบเทียบนี้ไม่อาจตัดสินได้จากสเปกชีต และยังเป็นเหตุผลว่าทำไมการคำนวณข้างต้นจึงมองข้ามทุกสิ่งทุกอย่างที่ทำให้การทำอินเฟอเรนซ์ในเครื่องมีค่าใช้จ่ายสูงในทางปฏิบัติ ได้แก่ ค่าไฟฟ้า พื้นที่ในแร็ก คนที่รับผิดชอบการอัปเดตไดรเวอร์ และความจริงที่ว่าเครื่องหนึ่งเครื่องบนโต๊ะเป็นจุดล้มเหลวจุดเดียว เว้นแต่คุณจะซื้อสองเครื่อง พอเพิ่มสิ่งเหล่านั้นเข้าไป จุดคุ้มทุนก็จะเลื่อนออกไปไกลขึ้นอีก

สิ่งที่การประมวลผลภายในเครื่องให้ได้มาด้วยเงินจำนวนนั้นไม่ใช่เรื่องต้นทุนเลยแม้แต่น้อย แต่เป็นการรับประกันว่าพรอมป์ต์จะไม่ถูกส่งออกไปนอกองค์กร ซึ่งมีค่ามากกว่าอัตราค่าบริการต่อโทเคนใด ๆ สำหรับทีมด้านกฎหมาย การแพทย์ หรือทีมที่เกี่ยวเนื่องกับงานด้านกลาโหม และไม่มีส่วนลดใดที่ Anthropic เสนอจะทดแทนสิ่งนี้ได้ ในทางกลับกัน คอนเท็กซ์ 1M-token และเพดานเอาต์พุต 128,000-token ของ Claude Haiku 5.5 เป็นสิ่งที่คุณซื้อไม่ได้ไม่ว่าจะจ่ายราคาเท่าใดบนการ์ด 24GB และเครื่องราคา $4,500 ก็ไม่ได้เปลี่ยนข้อนั้น

85.4% วัดอะไรกันแน่

ตัวเลขที่ Perplexity เผยแพร่สำหรับ PPLX 27B อยู่ที่ 85.4% บน Local Knowledge Work Bench จำนวน 53 งานของตัวเอง เทียบกับ 82.6% สำหรับฮาร์เนสเดียวกันที่รันบน Qwen 3.8 27B base ที่ยังไม่ได้ปรับแต่ง, 77.6% สำหรับ Pi และ 74.0% สำหรับ Hermes มีสามเรื่องเกี่ยวกับเรื่องนี้ที่ควรพูดให้ตรงไปตรงมา เพราะการรายงานข่าวการเปิดตัวโดยทั่วไปไม่ได้พูดถึงเรื่องเหล่านี้

มันเป็นข้อมูลที่ผู้ขายรายงานเองและยังไม่มีการทำซ้ำอย่างอิสระ มันเป็นการเปรียบเทียบบนฮาร์เนสของผู้ขายเอง ซึ่งเป็นแบบทดสอบที่ยุติธรรมที่สุดเท่าที่เป็นไปได้สำหรับโมเดลที่ผ่านการฝึกหลังการเทรนบนฮาร์เนสนั้น — การได้เปรียบเหนือโมเดลฐานส่วนหนึ่งมาจากการปรับให้เข้ากับแบบทดสอบ และมันวัดงานองค์ความรู้ภายในเครื่องโดยเฉพาะ: การค้นคืน การสรุป การจัดการเอกสาร งานที่ Portable Computer ถูกสร้างขึ้นมาเพื่อรองรับ มันไม่ใช่คะแนนความสามารถทั่วไปและไม่ควรถูกตีความเช่นนั้น

โมเดลฐานเป็นอีกเรื่องหนึ่ง Qwen 3.8 27B เป็นโมเดลแบบ dense ได้รับสัญญาอนุญาต Apache-2.0 เป็นมัลติโมดัล และเปิดตัวเมื่อวันที่ 14 สิงหาคม 2026 พร้อมหน้าต่างบริบทเนทีฟขนาด 262,144 โทเคน และ Artificial Analysis ให้คะแนนคอนฟิกการให้เหตุผลของมันไว้ที่ Intelligence Index 44 — มากกว่าคะแนน 43.40 ของ Claude Haiku 5.5 อยู่หนึ่งจุด ในราคาที่แตกต่างกัน PPLX 27B คือโมเดลนั้นบวกกับ post-training ของ Perplexity ดังนั้นการตีความอย่างซื่อตรงก็คือ น้ำหนักพื้นฐานอยู่ในช่วงความสามารถของ Claude Haiku 5.5 และการปรับแต่งได้ผลักดันมันไปสู่ภาระงานของผู้ขายรายหนึ่ง คุณกำลังซื้อสิ่งใดในสองสิ่งนั้น คือคำถามที่ 85.4% ถูกออกแบบมาเพื่อไม่ตอบ

จุดที่ Claude Haiku 5.5 ชนะโดยไม่ต้องมีเบนช์มาร์ก

บริบทแบบยาว เป็นข้อแรก: 1M โทเคน เทียบกับประมาณ 262K และเอาต์พุตสูงสุด 128,000 โทเคน เทียบกับตัวเลขที่ยังไม่เปิดเผย การป้อนข้อมูลเป็นรูปภาพ เป็นข้อที่สอง ซึ่งสายตระกูล Qwen 3.8 รองรับ แต่ฮาร์เนสของ Perplexity ไม่ได้โฆษณาไว้ การควบคุมความพยายาม เป็นข้อที่สาม และเป็นข้อที่ถูกประเมินต่ำเกินไป — การตั้งค่า Low มีอยู่โดยเฉพาะเพื่อให้คุณหยุดจ่ายสำหรับโทเคนการให้เหตุผลในการเรียกใช้งานที่ไม่ต้องการมัน ซึ่งเป็นคันโยกด้านต้นทุนที่โมเดลโลคัลไม่มีให้ เพราะไม่มีบิลให้ลด

และความพร้อมใช้งาน เป็นข้อที่สี่ Claude Haiku 5.5 เป็นสตริงโมเดลบน API และตัวเลขที่เป็นอิสระก็มีอยู่จริง: Intelligence Index 43 โดยรวม และ 43.40 ที่ Max effort เป็นอันดับสองจาก 182 ที่ $0.21 ต่องาน index และ 243.4 โทเคนเอาต์พุตต่อวินาที โดยใช้เวลาประมาณ 0.3 วินาทีถึงโทเคนแรก เมื่อคุณกำลังตัดสินใจว่าภาระงานหนึ่งพร้อมจะย้ายหรือยัง คะแนนที่เผยแพร่ซึ่งคุณไม่ได้คำนวณเองมีค่ามากกว่าตัวเลขที่เร็วกว่าซึ่งคุณเป็นคนคำนวณเอง

A capture of Anthropic's Claude Platform models documentation showing the current Claude lineup — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 — with each model's context window, maximum output and per-million input and output pricing.

จุดที่ PPLX 27B ชนะโดยไม่ต้องใช้เกณฑ์มาตรฐาน

ความเป็นส่วนตัวมาเป็นอันดับแรกและสำคัญที่สุด: โทเคนไม่เคยออกจากเครื่อง ซึ่งไม่มีโมเดลแบบโฮสต์ใดเทียบได้ ต้นทุนเมื่อใช้ในปริมาณมากเป็นอันดับที่สอง และมันเป็นเรื่องจริงเมื่อเกินหลักพันล้านโทเคนเอาต์พุตต่อเดือน การทำงานแบบออฟไลน์เป็นอันดับที่สาม — แล็ปท็อปในห้องใต้ดินที่ไม่มีการเชื่อมต่อก็ยังตอบได้ แต่ Claude Haiku 5.5 ทำไม่ได้ และโหมดไฮบริดที่เพิ่มเข้ามาเมื่อวันที่ 1 กันยายนเป็นดีไซน์ที่น่าสนใจที่สุดในผลิตภัณฑ์: โมเดลโลคัลทำงานทั่วไป โดยมีโมเดลคลาวด์อยู่หลังเกตบนอุปกรณ์สำหรับงานยาก ๆ นั่นแหละคือวิธีที่คุณจะได้ทั้งความเป็นส่วนตัวและความสามารถ และมันเป็นสถาปัตยกรรมที่ทีมส่วนใหญ่ควรลอกเลียนแบบ ไม่ว่าพวกเขาจะซื้อจากผู้ขายรายใด

สิ่งที่ PPLX 27B ไม่ได้มอบให้คือคำตอบที่พกพาได้ มันผูกติดกับ Portable Computer ต้องสมัครสมาชิกเพื่อให้ได้เวต และเวตเหล่านั้นเป็นสิ่งที่ต่อยอดมาจากโมเดลของคนอื่น ดังนั้นสัญญาอนุญาตที่คุณถืออยู่จริงจึงเป็นของ Perplexity ไม่ใช่ Apache-2.0 หากเป้าหมายคือโมเดลที่คุณสามารถ fork และนำไปเผยแพร่ได้ Qwen 3.8 27B ตัวฐานคือตัวที่มีสัญญาอนุญาตแบบผ่อนปรน แต่นั่นเป็นคนละโมเดลกับตัวที่บทความนี้พูดถึง

A capture of the OrcaRouter model page for qwen/qwen3.8-27b showing the Qwen3.8-27B listing with its Vision, Tools, JSON and Reasoning badges, its per-million pricing and the description noting it is released under Apache-2.0 and self-hosted on OrcaRouter's own infrastructure.

การรันอย่างใดอย่างหนึ่งจากปุ่มเดียว และจุดที่การรันนั้นหยุดลง

PPLX 27B ไม่ได้ให้บริการผ่าน API เลย: มันทำงานอยู่ภายใน Portable Computer บนฮาร์ดแวร์ของคุณเอง และโหมดไฮบริดจะเชื่อมต่อไปยังโมเดลบนคลาวด์ที่ Perplexity เลือกไว้ที่อีกฟากหนึ่งของ Privacy Gate ส่วน Claude Haiku 5.5 มีให้ใช้งานผ่าน API ของ Anthropic เอง และจากตรงนั้น ก็มีให้ใช้ในทุกที่ที่มีการจำหน่ายโมเดลของ Anthropic ต่อ ทั้งสองรายการไม่ได้อยู่ในแคตตาล็อกของ OrcaRouter และเราจะไม่บอกเป็นอย่างอื่น — สิ่งที่เรานำมาให้บริการผ่านเราเตอร์จากสองตระกูลนี้คือ anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 และ anthropic/claude-fable-5.1 และแยกต่างหากคือฐาน Qwen 3.8 27B ที่ PPLX 27B ถูก post-train มาจาก ซึ่งอยู่ในแคตตาล็อกที่ qwen/qwen3.8-27b และโฮสต์เองบนโครงสร้างพื้นฐานของเราเอง

ประเด็นสุดท้ายนั่นคือประเด็นที่ปฏิบัติได้จริง หากเหตุผลที่คุณพิจารณา PPLX 27B คือน้ำหนัก Qwen 3.8 27B ที่อยู่ข้างใต้ แทนที่จะเป็นการรันในเครื่อง คุณสามารถใช้โมเดลพื้นฐานผ่าน API เดียวสำหรับโมเดลกว่า 200 โมเดล คีย์เดียวและบิลเดียว โดยราคาตามรายการของผู้ให้บริการถูกส่งผ่านโดยไม่มีส่วนเพิ่ม 0% และมีการสลับไปยังผู้ให้บริการรายอื่นโดยอัตโนมัติเมื่อเกิดข้อขัดข้อง หากสิ่งที่คุณต้องการจริงๆ คือพรอมต์ไม่เคยออกจากเครื่อง คำตอบคือไม่มีเกตเวย์ และ Portable Computer คือคำตอบ

การตัดสินใจ โดยไม่แสร้งทำเป็นว่าตัวเลขชี้ขาด

หากพรอมต์ของคุณไม่สามารถออกจากโครงสร้างพื้นฐานของคุณได้ PPLX 27B คือตัวเดียวในสองตัวนี้ที่คุณใช้ได้ และ $4,500 ไม่ใช่การเปรียบเทียบต้นทุน — มันคือราคาของข้อจำกัดที่คุณไม่อาจต่อรองให้หลุดพ้นไปได้ หากคุณใช้โทเคนเอาต์พุตมากกว่าสองสามพันล้านโทเคนต่อเดือน เส้นทางแบบภายในเครื่องจะคืนทุนภายในหนึ่งไตรมาส และหลังจากนั้นก็สร้างผลตอบแทนต่อไปเรื่อย ๆ

หากไม่มีข้อใดในสองข้อนั้นเป็นจริง Claude Haiku 5.5 คือตัวเลือกที่คุ้มค่ากว่าที่จะซื้อในแทบทุกปริมาณการใช้งาน: ไม่ต้องมีฮาร์ดแวร์ ไม่ต้องมีงานด้านปฏิบัติการ หน้าต่างบริบท 1M โทเคน เพดานเอาต์พุต 128,000 โทเคน รองรับอินพุตรูปภาพ ตัวปรับระดับความพยายามที่ลดต้นทุนลงได้ตามต้องการ คะแนนอิสระที่เผยแพร่ไว้ที่ 43 และราคา $0.10 กับ $0.50 ต่อล้าน ซึ่งทำให้จุดคุ้มทุนเมื่อเทียบกับเวิร์กสเตชันอยู่ที่ประมาณเก้าพันล้านโทเคน ตัวเลข $0.00 ต่อโทเคนนั้นเป็นจริง เพียงแต่มันไม่ใช่การลบทั้งหมด

ถ้าเหตุผลที่คุณดู PPLX 27B คือน้ำหนักของ Qwen 3.8 27B ที่อยู่เบื้องหลังมัน มากกว่าการรันในเครื่อง คุณสามารถเข้าถึงโมเดลฐานได้ผ่าน API เดียวที่รองรับโมเดลกว่า 200 โมเดล คีย์เดียวและบิลเดียว โดยส่งต่อราคาตามรายการของผู้ให้บริการโดยไม่บวกมาร์กอัป 0% และมีการสลับไปยังผู้ให้บริการรายอื่นโดยอัตโนมัติเมื่อเกิดความล้มเหลวภายใต้ระบบ

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube