การ์ดฮีโร่ที่สร้างขึ้นสำหรับ 'ถูกกว่าต่อโทเคน แพงกว่าต่อคำตอบ' ติดป้ายว่า 'ต้นทุนต่อคำตอบ' พร้อมคำโปรย 'สองระดับราคาถูก หนึ่งกระดานคะแนนร่วม' และคำบรรยายรอง 'Claude Haiku 5.5 ที่ 43.40 เทียบกับ Gemini 3.5 Flash-Lite ที่ 22.2 บน Intelligence Index v4.3.2' ชิปสี่อันระบุว่า '43.40 vs 22.2', '$0.21 vs $0.12', '$0.10 vs $0.30' และ '$0.50 vs $2.50' การ์ดสองใบด้านล่างมีป้ายกำกับว่า 'ANTHROPIC'S EDGE' ('สูงกว่ายี่สิบเอ็ดคะแนนบนกระดานคะแนนร่วม และถูกกว่าทั้งสองมาตรวัด') และ 'GOOGLE'S EDGE' ('ถูกกว่าสำหรับงานที่ทำเสร็จแล้ว และรองรับทั้งวิดีโอและเสียง') ส่วนท้ายระบุว่า 'คะแนนและต้นทุนต่องานจาก Artificial Analysis โดยอิสระ; ราคาตั้ง ณ วันที่ 8 ตุลาคม 2026' โลโก้ OrcaRouter ถูกคอมโพสิตไว้ที่มุมล่างขวา
Guides & Insights

Claude Haiku 5.5 กับ Gemini 3.5 Flash-Lite: ถูกกว่าต่อโทเค็น แต่แพงกว่าต่อคำตอบ

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Claude Haiku 5.5 มีค่าใช้จ่าย $0.10 ต่อโทเคนอินพุตหนึ่งล้านโทเคน และ $0.50 ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคน Gemini 3.5 Flash-Lite มีค่าใช้จ่าย $0.30 และ $2.50 บนสองหน่วยวัดเดียวกัน โมเดลของ Ant​hropic มีราคาหนึ่งในสามสำหรับขาเข้า และหนึ่งในห้าสำหรับขาออก และทำคะแนนได้ 43.40 เทียบกับ 22.2 บน Artificial Analysis Intelligence Index v4.3.2 — ช่องว่างมากกว่ายี่สิบจุดในแวดวงที่สิบคะแนนถือเป็นการก้าวกระโดดครั้งใหญ่ ในแง่ของตารางราคา นี่ไม่ใช่การเปรียบเทียบที่สูสี และในแง่ขีดความสามารถก็ไม่ใช่การเปรียบเทียบที่สูสีเช่นกัน

บนใบแจ้งหนี้ถือเป็นการเปรียบเทียบที่สูสี และผลลัพธ์กลับกัน เมื่อนำทั้งสองโมเดลไปวางบนบอร์ดอิสระเดียวกัน และคิดค่าบริการกับแต่ละโมเดลต่อหนึ่งงานที่ทำเสร็จ ไม่ใช่ต่อโทเคน Gemini 3.5 Flash-Lite จึงออกมาถูกกว่าต่อคำตอบ Artificial Analysis จัดให้ Claude Haiku 5.5 อยู่ที่ $0.21 ต่อหนึ่งงาน Intelligence Index และ Gemini 3.5 Flash-Lite อยู่ที่ $0.1235 — เป็นข้อได้เปรียบ 1.7 ต่อ 1 สำหรับโมเดลที่จ่ายแพงกว่า 5 เท่าสำหรับทุกโทเคนที่ปล่อยออกมา

การกลับทิศทางนั้นคือแก่นทั้งหมดของการเปรียบเทียบนี้ Claude Haiku 5.5 มาแทนระดับราคาถูกที่สุดที่ Ant​hropic เคยเปิดตัว และเอาชนะทุกรุ่นที่อยู่ใกล้เคียงบนกระดานคะแนนร่วม Gemini 3.5 Flash-Lite เปิดตัวเมื่อวันที่ 21 กรกฎาคม 2026 และเป็นตัวเลือกที่คุ้มค่าในกลุ่มนี้มาตั้งแต่ฤดูร้อน คำถามที่ผู้ซื้อมีจริง ๆ ไม่ใช่ว่ารุ่นไหนดีกว่า เพราะคำตอบเรื่องนั้นชัดเจนแล้ว แต่คือจะเลือกรุ่นไหนมารองรับคำขอที่ต้องได้คำตอบกลับมาแบบประหยัด

ทุกอย่างด้านล่างนี้คิดเป็นต่อหนึ่งล้านโทเค็นในหน่วยดอลลาร์สหรัฐ ราคาตั้งคืออัตราที่ผู้จำหน่ายแต่ละรายประกาศเอง คะแนนอิสระ ตัวเลขต้นทุนต่องาน และผลการวัดความเร็วที่ระบุว่าเป็นของ Artificial Analysis นั้นเป็นของผู้ประเมินรายนั้น ค่าความหน่วงของ Gemini 3.5 Flash-Lite มาจากข้อมูลทราฟฟิกที่เราวัดเอง ในกรณีที่ตัวเลขหนึ่งปรากฏอยู่ในบันทึกโมเดลที่เราเก็บไว้ แทนที่จะอ่านจากหน้าเว็บของผู้ประเมินในวันนั้น เราได้ถือว่าผู้ประเมินรายนั้นเป็นแหล่งที่มา ไม่ใช่ตัวเราเอง

สติกเกอร์กับใบแจ้งหนี้ไม่ตรงกัน

ช่องว่างของต้นทุนต่องานไม่ได้อธิบายได้ด้วยเรตการ์ด และเหตุผลที่มันเกิดขึ้นก็เป็นสิ่งที่ควรรู้ก่อนที่โมเดลใดโมเดลหนึ่งจะเข้าใกล้โปรดักชัน

Claude Haiku 5.5 พูดมากเกินไป และผู้ประเมินก็บอกเช่นนั้นออกมาตรง ๆ ในการรัน Intelligence Index นั้น Artificial Analysis บันทึกโทเค็นเอาต์พุต 440 ล้านโทเค็นจากโมเดล เมื่อเทียบกับค่ามัธยฐาน 100 ล้านโทเค็นในภาพรวมทั้งหมด และติดธงว่ามันพูดมากเกินไปอย่างชัดเจน การคิดถูกคิดค่าใช้จ่ายเป็นเอาต์พุต การคิดเปิดไว้เป็นค่าเริ่มต้นพร้อมปุ่มปรับระดับความพยายามที่เริ่มต้นที่ระดับกลาง และอัตราอินพุตราคาถูกก็ไม่ได้ช่วยภาระงานที่มีค่าใช้จ่ายส่วนใหญ่มาจากเอาต์พุต

Gemini 3.5 Flash-Lite ก็ไม่กระชับเช่นกัน แต่มีค่าใช้จ่ายต่องานต่ำกว่าอย่างวัดผลได้ บอร์ดเดียวกันบันทึกโทเคนเอาต์พุต 17,507 ต่องานจัดทำดัชนีที่เสร็จสมบูรณ์สำหรับมัน — โดย 10,405 เป็นการให้เหตุผล และ 7,102 เป็นคำตอบ เมื่อนำไปเทียบกับปริมาณโทเคนของโมเดล Ant​hropic แล้วการคำนวณก็กระจ่าง: ความได้เปรียบห้าต่อหนึ่งในอัตราเอาต์พุตถูกใช้ไปบางส่วนโดยโมเดลที่ส่งคำตอบขนาดใหญ่กว่า และสิ่งที่เหลืออยู่ในระดับงานคือข้อเสียเปรียบเล็กน้อยแทนที่จะเป็นความได้เปรียบมาก

มีผลกระทบที่สองที่เงียบกว่าซึ่งดำเนินไปในทางเดียวกัน เอกสารของ Anthropic ระบุว่า Claude Haiku 5.5 ใช้โทเคไนเซอร์ร่วมกับ Claude 4.7 และรุ่นหลังจากนั้น ดังนั้นข้อความเดียวกันจึงถูกนับเป็นโทเคนมากกว่าที่เคยนับบนโมเดลที่รุ่นนี้มาแทนที่ราว 30% อัตราลดลงเหลือหนึ่งในสามเมื่อเทียบกับระดับของ Google จำนวนโทเคนไม่ได้ลดลง และเมื่อใช้ข้อความเดียวกัน กลับเพิ่มขึ้น

ทั้งสองรุ่น ในตัวเลขที่สำคัญ

ราคาแคชและราคาตามรายการจากเอกสารของ Anthropic และ Google เอง ตัวเลขอิสระที่อ้างอิงจาก Artificial Analysis ความหน่วงแบบเรียลไทม์จากหน้าต่างทราฟฟิกเจ็ดวันของเราเอง แคชเมื่อ 2026-10-08

A generated scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.5 Flash-Lite - on the numbers that matter'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, input modality text and images, Intelligence Index v4.3.2 43.40, cost per task $0.21. Gemini 3.5 Flash-Lite reads input $0.30, output $2.50, cached input $0.03, maximum output 65,536 tokens, input modality text images video audio and files, Intelligence Index v4.3.2 22.2, cost per task $0.12. A footer reads 'Vendors' published list rates; independent scores and cost per task from Artificial Analysis.'

• อินพุต — Claude Haiku 5.5 $0.10 สูงสุด 100,000 โทเค็น และ $0.50 ขึ้นไป; Gemini 3.5 Flash-Lite $0.30 คงที่ตลอดหน้าต่าง 1,048,576 โทเค็น

• เอาต์พุต — Claude Haiku 5.5 $0.50 สำหรับไม่เกิน 100,000 โทเคน และ $2.50 สำหรับส่วนที่เกิน; Gemini 3.5 Flash-Lite $2.50 แบบคงที่

• อินพุตที่แคชไว้ — Claude Haiku 5.5 $0.01 สูงสุด 100,000 โทเค็น และ $0.05 ขึ้นไป; Gemini 3.5 Flash-Lite $0.03 การเขียนแคชอยู่ที่ $0.125 และ $0.625 ต่อล้านโทเค็นสำหรับ Claude Haiku 5.5

• บริบทและเอาต์พุต — อย่างละหนึ่งล้านโทเคน เอาต์พุตสูงสุดคือ 128,000 โทเคนสำหรับ Claude Haiku 5.5 เทียบกับ 65,536 สำหรับ Gemini 3.5 Flash-Lite ดังนั้นเพดานของ Ant​hropic จึงสูงกว่าเป็นประมาณสองเท่า

• รูปแบบอินพุต — ข้อความและรูปภาพสำหรับ Claude Haiku 5.5; ข้อความ รูปภาพ วิดีโอ เสียง และไฟล์สำหรับ Gemini 3.5 Flash-Lite ทั้งคู่จะส่งคืนข้อความ

• คะแนนอิสระ — 43.40 สำหรับ Claude Haiku 5.5 (Max) เป็นอันดับที่สองจาก 182 โมเดลบน Intelligence Index v4.3.2 เทียบกับ 22.2 สำหรับ Gemini 3.5 Flash-Lite ซึ่งเป็นอันดับที่ 96 จาก 147 และอยู่ในเปอร์เซ็นไทล์ที่ 34 ของตารางจัดอันดับนั้น

• ต้นทุนต่องานแบบอิสระ — $0.21 เทียบกับ $0.1235 บนบอร์ดเดียวกัน

• ทรูพุต — 241.9 โทเคนเอาต์พุตต่อวินาทีที่วัดได้สำหรับ Claude Haiku 5.5 โดย Artificial Analysis เทียบกับ 280.0 สำหรับ Gemini 3.5 Flash-Lite ซึ่งวัดบน playground ของเราเองในช่วงเจ็ดวันที่ผ่านมา ทั้งสองค่านี้มาจากฮาร์เนสสองตัว ไม่ใช่ตัวเดียว ดังนั้นให้อ่านเป็นระดับขนาด ไม่ใช่การแข่งกัน

ยี่สิบเอ็ดจุด และสิ่งที่พวกมันทำมาจาก

ช่องว่าง 21 คะแนนบนดัชนีที่มีค่าอยู่ในหลักหกสิบไม่ใช่แค่ส่วนต่างเล็ก ๆ น้อย ๆ มันคือความแตกต่างระหว่างโมเดลที่รับมือกับลูปแบบ agentic ได้ กับโมเดลที่ควรได้รับมอบหมายให้เป็นการเรียกเพียงครั้งเดียวที่ระบุไว้อย่างชัดเจน

ผู้ขายทั้งสองรายไม่ได้วัดฮาร์เนสของกันและกัน ชุดทดสอบของแต่ละเจ้าจึงไม่สามารถวางเทียบกันได้ Anthropic เผยแพร่ผลลัพธ์ GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 และ FrontierCode สำหรับ Claude Haiku 5.5; Google เผยแพร่ชุดของตนเองสำหรับระดับ Flash-Lite; ไม่มีรายใดรันชุดของอีกฝ่าย การเปรียบเทียบแบบเทียบกันได้ตรง ๆ เพียงอย่างเดียวที่มีคือลีดเดอร์บอร์ดอิสระ และในนั้นโมเดลของ Anthropic นำอยู่ด้วยระยะห่างที่ไม่ใกล้เคียงเลย

คะแนนย่อยของผู้ประเมินสำหรับ Gemini 3.5 Flash-Lite บันทึกลักษณะของระดับนั้นไว้เป็นหลักฐานอย่างชัดเจน โดยทำได้ 83.8% บน GPQA Diamond และ 54.2% บน SWE-Bench Pro, 54% บน Terminal-bench 2.1, 41.3% บน SciCode และ 39.2% บน MLE-Bench พร้อมกับ 18.8% บน Humanity's Last Exam ตัวเลขเหล่านี้เป็นของระดับอเนกประสงค์ที่มีความสามารถในราคาถูก — แข็งแกร่งในคำถามด้านความรู้ แต่ตามหลังอย่างเห็นได้ชัดในด้านการให้เหตุผลและการประเมินงานวิจัยที่ยากที่สุด Claude Haiku 5.5 ที่ 43.40 ในคะแนนรวมอยู่ในวงที่แตกต่างออกไปโดยสิ้นเชิง และข้อตีความในทางปฏิบัติก็คือ งานที่ต้องมีการวางแผนหลายขั้นตอนในระยะยาวไม่ใช่งานสำหรับระดับของ Google เลย

หนึ่งล้านโทเคนของหน้าต่าง และ 65,536 ของคำตอบ

หน้าต่างบริบททั้งสองมีขนาดเท่ากัน และไม่ใช่ผลิตภัณฑ์เดียวกัน

บริบทแบบยาวบน Gemini 3.5 Flash-Lite เสื่อมลงเมื่อระยะห่างเพิ่มขึ้นในลักษณะที่ควรประเมินต้นทุนก่อนจะเชื่อถือ บน GDM-MRCR v2 ซึ่งเป็นการประเมินการค้นคืนแบบแปดเข็ม (eight-needle retrieval) มันทำได้เฉลี่ย 72.2% เมื่อเข็มอยู่ภายใน 128,000 โทเคน และ 21.3% บนตัวแปร pointwise ขนาดหนึ่งล้านโทเคน ตัวเลข Long-Context Recall ของมันคือ 76% และ CharXiv Reasoning อยู่ที่ 74.5% เมื่อไม่ใช้เครื่องมือ และ 76.5% เมื่อใช้เครื่องมือ หน้าต่างขนาดหนึ่งล้านโทเคนเป็นความสามารถจริง การดึงข้อมูลจากปลายสุดของมันได้อย่างเชื่อถือได้เป็นความสามารถที่เล็กกว่า และตัวเลขสองตัวข้างต้นคือระยะห่างระหว่างสองสิ่งนั้น หน้าต่างของโมเดล Claude ยังไม่ได้รับการวัดด้วยวิธีเดียวกันบนบอร์ดเดียวกัน ดังนั้นจึงไม่มีตัวเลขเทียบเท่าสำหรับมัน และบทความนี้จะไม่กุตัวเลขขึ้นมา

เพดานเอาต์พุตคือความแตกต่างที่ใช้งานได้ทันทีมากกว่า Claude Haiku 5.5 จะส่งออก 128,000 โทเค็นในหนึ่งการตอบกลับ; Gemini 3.5 Flash-Lite หยุดที่ 65,536 หากสิ่งที่คุณต้องการได้กลับมาเป็นไฟล์ยาว การย้ายข้อมูลทั้งหมด ชุดทดสอบที่สร้างขึ้น หรือการเขียนใหม่ระดับบทสนทนา หนึ่งในสองโมเดลนี้สามารถสร้างมันได้ในการเรียกครั้งเดียว และอีกโมเดลไม่สามารถทำได้ — และงานที่แยกออกเป็นสองครั้งมีค่าใช้จ่ายมากกว่าสองเท่าของการเรียกครั้งเดียว เพราะคำนำหน้าที่ใช้ร่วมกันถูกส่งสองครั้ง

A screenshot of the Artificial Analysis model page for Gemini 3.5 Flash-Lite, showing the model name over the provider Google, the release month July 2026, a one-million-token context window, the input modality list covering text, image, video, audio and PDF, an Intelligence Index v4.3.2 score of 22, the per-million-token input and output rates with the cached-input discount, and the measured output speed, total response time and cost per task.

เสียงและวิดีโอไม่ใช่เรื่องของราคา

Gemini 3.5 Flash-Lite รองรับวิดีโอ เสียง และไฟล์ในอัตราเดียวกับข้อความ Claude Haiku 5.5 รองรับข้อความและรูปภาพ

สำหรับไปป์ไลน์ที่นำเข้าข้อมูลจากสายที่บันทึกไว้ การจับภาพหน้าจอ หรือฟุตเทจจากการเฝ้าระวัง ความแตกต่างของความสามารถที่สำคัญไม่ใช่คะแนนดัชนี 21 คะแนน แต่เป็นความจริงที่ว่าโมเดลหนึ่งในนี้รับอินพุตโดยตรง ในขณะที่อีกโมเดลหนึ่งต้องมีขั้นตอนการถอดเสียงหรือการแยกเฟรมอยู่ข้างหน้า — ซึ่งหมายถึงโมเดลที่สอง ค่าใช้จ่ายที่สอง และโหมดความล้มเหลวใหม่ที่คั่นกลางระหว่างต้นทางกับคำตอบ ทีมที่อยู่ในสถานการณ์นั้นไม่ได้เลือกระหว่างสองระดับราคาถูก แต่พวกเขากำลังเลือกระหว่างโมเดลหนึ่งกับไปป์ไลน์

สิ่งที่ตรงกันข้ามเป็นจริงสำหรับรูปภาพและเอกสาร โมเดลทั้งสองอ่านรูปภาพได้โดยกำเนิด และ Claude Haiku 5.5 ทำได้ 43.40 บนคอมโพสิต ดังนั้นงานสกัดข้อมูลจากภาพหน้าหรือการทำความเข้าใจไดอะแกรมที่ไม่มีเสียงอยู่ในนั้นจึงควรอยู่ฝั่ง Ant​hropic ในแง่ของตัวเลข มากกว่าที่จะเป็นข้อโต้แย้งเรื่องโมดัลลิตี้

กำลังรันหนึ่งในสองจากตรงนี้

Gemini 3.5 Flash-Lite อยู่ในแค็ตตาล็อกของ OrcaRouter ในราคาตามรายการของ Google โดยบวกเพิ่ม 0%, ซึ่งหมายความว่าอัตราของผู้ให้บริการจะถูกส่งผ่านโดยตรงแทนที่จะถูกผสม และการเปลี่ยนแปลงการ์ดของ Goo​gle จะไปถึงใบแจ้งหนี้ของคุณในวันที่ไปถึงของพวกเขา นั่นคือคีย์เดียวและ SDK เดียวสำหรับระดับของ Goo​gle ควบคู่ไปกับ Claude Sonnet 5.5 และ Claude Opus 5.5 ซึ่งอยู่ในแค็ตตาล็อกเช่นกัน — ดังนั้นการทดสอบ A/B ระหว่างขา Goo​gle Flash-Lite กับขา Ant​hropic จึงเป็นการตั้งค่าแทนที่จะเป็นโปรเจกต์การผสานรวม การสลับสำรองอัตโนมัติอยู่เบื้องหลัง, ดังนั้นไม่มีขาใดเป็นจุดล้มเหลวจุดเดียว และ DSL การกำหนดเส้นทางจะแสดงการยกระดับในเส้นทาง หากนั่นคือจุดที่ตรรกะควรอยู่

โปรไฟล์ความหน่วงของช่วงนั้นอ้างอิงจากการวัดของเราเอง ไม่ใช่ของผู้ให้บริการ ตลอดเจ็ดวันที่ผ่านมาของทราฟฟิกจริง Gemini 3.5 Flash-Lite ทรงตัวอยู่ที่ p50 เท่ากับ 2,426 มิลลิวินาที และ p95 เท่ากับ 8,600 มิลลิวินาที ที่อัตรา 280 โทเคนเอาต์พุตต่อวินาที โดยมีอัตราความผิดพลาด 0.313% ให้อ่านค่านี้เป็นหน้าต่างเลื่อน ไม่ใช่คำสัญญา เพราะมันขยับไปตามทราฟฟิกและสภาวะของผู้ให้บริการที่เปลี่ยนไป และตัวเลขที่ควรเชื่อถือสำหรับไปป์ไลน์ใด ๆ คือตัวเลขที่คุณวัดเองหลังจากผ่านไปหนึ่งสัปดาห์

A screenshot of the Artificial Analysis model page for Claude Haiku 5.5 (Max), showing the Anthropic model name and an October 2026 release, Intelligence Index v4.3.2 of 43 ranking second of 182, speed ninth of 182 at 241.9 output tokens per second, a $0.21 cost per task, input $0.10 and output $0.50 per million tokens, and a one-million-token context window.

Claude Haiku 5.5 ไม่ได้อยู่ในแค็ตตาล็อก เปิดตัวเมื่อวันที่ 7 ตุลาคม 2026 — หนึ่งวันก่อนที่สิ่งนี้จะถูกเขียน — และวันนี้ยังไม่สามารถกำหนดเส้นทางจากเราได้ ดังนั้นฝั่ง Ant​hropic ของการเปรียบเทียบนี้ในปัจจุบันจึงเข้าถึงได้เฉพาะที่ Ant​hropic เท่านั้น การพูดเช่นนั้นอย่างตรงไปตรงมาดีกว่าการปล่อยให้เป็นนัย ช่องว่างระหว่างการเปิดตัวโมเดลกับการที่โมเดลจะเรียกใช้ผ่านเราได้เป็นเรื่องปกติ มันไม่ใช่คำสัญญาว่าช่องว่างนั้นจะปิดเมื่อไหร่ และผู้อ่านที่วางแผนการโยกย้ายควรวางแผนตามปฏิทินที่พวกเขามองเห็น มากกว่าปฏิทินที่พวกเขาอยากให้เป็น

อันไหน และสำหรับใคร

ถ้างานเป็นข้อความเข้าและข้อความออก ถ้าพรอมป์อยู่ในขอบเขตไม่เกิน 100,000 โทเค็น และถ้างานต้องมีการวางแผนหลายขั้นตอนหรือเอเจนต์ที่ทำงานในระยะยาว Claude Haiku 5.5 เป็นโมเดลที่แข็งแกร่งกว่า 21 คะแนน และถูกกว่าต่อโทเค็น 3 ถึง 5 เท่า ให้ตั้งงบจากต้นทุนต่องานมากกว่าจากตารางราคา คาดว่าจะอยู่ที่ประมาณ $0.21 สำหรับงานประเภทที่คณะกรรมการอิสระวัด และนับพรอมป์ของคุณใหม่ก่อนจะคาดการณ์อะไร เพราะการเปลี่ยนแปลงตัวตัดโทเค็นทำให้จำนวนเปลี่ยนไปประมาณ 30% ด้วยตัวมันเอง

หากงานนั้นสั้น มีปริมาณมาก และมีรูปแบบเป็นคำตอบ — เช่น แท็ก หมวดหมู่ การสกัดข้อมูล การตัดสินใจแบบ guardrail — แล้วการคำนวณจะเอียงไปทาง Gemini 3.5 Flash-Lite และเป็นเช่นนั้นด้วยเหตุผลที่ไม่น่าตื่นเต้น ค่าใช้จ่ายสำหรับการเรียกที่ให้ผลลัพธ์ออกมาน้อยมากจะถูกครอบงำโดยอินพุต อัตราค่าอินพุตสองอัตราคือ $0.30 กับ $0.10 และภาระงานที่สั้นกว่ามากของโมเดล Google หมายความว่าอัตราที่ถูกกว่าจะชนะงานที่เสร็จแล้ว แม้ว่ามันจะแพ้ในราคาที่ติดป้ายก็ตาม เพิ่มอินพุตวิดีโอ เสียง หรือไฟล์ แล้วทางเลือกก็จะไม่เกี่ยวกับราคาอีกต่อไป

สิ่งที่การจับคู่นี้ชี้ขาดจริง ๆ นั้นแคบกว่าคำว่า “Haiku ใหม่ราคาถูก” มันชี้ขาดว่า อัตราที่โฆษณาไว้บนระดับราคาถูกเป็นตัวชี้วัดที่ไม่ดีว่าคุณต้องจ่ายเท่าไรสำหรับระดับนั้น และโมเดลที่ดูแพงกว่าถึงสามเท่าบนหน้าตาราคาอาจส่งใบแจ้งหนี้ที่ยอดต่ำกว่าให้คุณ ไม่ว่าคุณจะลงเอยทางไหน ให้วัดโทเค็นที่คุณปล่อยออกมา ไม่ใช่โทเค็นที่คุณส่งเข้าไป เพราะสำหรับทั้งสองโมเดลนี้ นั่นคือมิเตอร์ที่บิลถูกคิดขึ้นมาจริง ๆ

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube