การ์ดฮีโร่ที่สร้างขึ้นสำหรับ 'ค่าใช้จ่ายหกเท่าสำหรับสองคะแนนดัชนี' ติดป้าย 'ต้นทุนต่องาน' พร้อมคำโปรย 'สองโมเดลระดับแฟลช หนึ่งบอร์ด' และคำบรรยายย่อย 'Claude Haiku 5.5 ที่ 43.40 เทียบกับ Gemini 3.8 Flash ที่ 40.93 บน Intelligence Index v4.3.2' ชิปสี่ชิ้นอ่านว่า '43.40 vs 40.93', '$0.21 vs $1.24', '$0.10 vs $0.75' และ 'ปรับขึ้น 1 ม.ค. 2027' การ์ดสองใบด้านล่างมีป้ายกำกับว่า 'จุดได้เปรียบของ ANTHROPIC' ('สูงกว่าบนบอร์ดที่ใช้ร่วมกัน และถูกกว่าหกเท่าต่องานที่เสร็จสิ้น') และ 'จุดได้เปรียบของ GOOGLE' ('อินพุตเสียงและวิดีโอ และอัตราคงที่ตลอดหน้าต่าง') ส่วนท้ายอ่านว่า 'การวัดผลอิสระจาก Artificial Analysis; ราคาตามรายการ ณ วันที่ 8 ตุลาคม 2026' โลโก้ OrcaRouter ถูกคอมโพสิตไว้ที่มุมขวาล่าง
Guides & Insights

Claude Ha 5.5 กับ Gemini 3.8 Flash: สองคะแนนดัชนี ค่าใช้จ่ายต่องานหกเท่า

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Claude Haiku 5.5 และ Gemini 3.8 Flash มีความใกล้เคียงกันในแง่ความสามารถที่วัดได้มากกว่าคู่โมเดลอื่นใดในระดับราคานี้ — 43.40 เทียบกับ 40.93 บน Artificial Analysis Intelligence Index v4.3.2 โดยทั้งคู่อยู่ในห้าสิบอันดับแรกของกระดานจัดอันดับที่มี 225 โมเดล สิ่งที่ทำให้ทั้งสองต่างกันคือต้นทุนของหนึ่งคะแนนดัชนีนั้น จากการวัดอิสระชุดเดียวกัน การทำภารกิจ Intelligence Index ให้สำเร็จหนึ่งครั้งมีค่าใช้จ่าย 0.21 ดอลลาร์บน Claude Haiku 5.5 และ 1.24 ดอลลาร์บน Gemini 3.8 Flash

นั่นคือช่องว่างถึงหกเท่าสำหรับความต่างของคะแนนเพียงสองจุดครึ่ง และมันคือตัวเลขที่ควรใช้ชี้ขาดการเปรียบเทียบนี้ ทุกอย่างอื่น — อัตราค่าบริการที่ประกาศไว้ รายการโมดัลลิตี กำหนดเวลาที่ผูกติดกับราคาของ Google — เป็นเพียงการถกเถียงกันเรื่องรายละเอียดรอบนอก

ทั้งสองรุ่น ในตัวเลขที่สำคัญ

ต่อหนึ่งล้านโทเค็นเป็นดอลลาร์สหรัฐ จากเอกสารราคาของ Ant​hropic และ Google เอง โดยการวัดอิสระนั้นอ้างอิงจาก Artificial Analysis แคชเมื่อ 2026-10-08

A generated scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.8 Flash - on the numbers that matter'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, input modality text and images, Intelligence Index v4.3.2 43.40, cost per task $0.21. Gemini 3.8 Flash reads input $0.75 now and $1.50 after January 1 2027, output $3.75 and $7.50, cached input $0.075 plus storage, maximum output 65,536 tokens, input modality text images speech and video, Intelligence Index v4.3.2 40.93, cost per task $1.24. A footer reads 'Vendors' published list rates; Google's lower rate runs through December 31, 2026; independent scores from Artificial Analysis.'

• อินพุต — Claude Haiku 5.5 $0.10 สูงสุด 100,000 โทเค็น และ $0.50 สำหรับส่วนที่เกิน; Gemini 3.8 Flash $0.75 คงที่ เพิ่มขึ้นเป็น $1.50 ในวันที่ 1 มกราคม 2027

• เอาต์พุต — Claude Haiku 5.5 $0.50 สูงสุด 100,000 โทเค็น และ $2.50 สำหรับส่วนที่เกิน; Gemini 3.8 Flash $3.75 ราคาคงที่ ปรับขึ้นเป็น $7.50 ในวันที่เดียวกัน

• อินพุตที่แคชไว้ — Claude Haiku 5.5 $0.01 และ $0.05; Gemini 3.8 Flash $0.075 พร้อมค่าจัดเก็บ $0.50 ต่อล้านโทเค็นต่อชั่วโมง

• บริบท — 1M โทเคนสำหรับทั้งสอง เอาต์พุตสูงสุด — 128,000 โทเคนสำหรับ Claude Haiku 5.5 เทียบกับ 65,536 สำหรับ Gemini 3.8 Flash

• รูปแบบอินพุต — ข้อความและรูปภาพสำหรับ Claude Haiku 5.5; ข้อความ รูปภาพ เสียง และวิดีโอสำหรับ Gemini 3.8 Flash นี่คือบรรทัดเดียวที่รายการของ Google ยาวกว่าอย่างแท้จริง

• คะแนนอิสระ — 43.40 สำหรับ Claude Haiku 5.5 (Max) เทียบกับ 40.93 สำหรับ Gemini 3.8 Flash (High) บน Intelligence Index v4.3.2

• ต้นทุนอิสระต่องาน — $0.21 เทียบกับ $1.24 บนบอร์ดเดียวกัน

• ความเร็ว — 241.9 โทเค็นเอาต์พุตต่อวินาที เทียบกับ 125.2 โดยทั้งสองค่าวัดจาก Artificial Analysis

ตัวเลขหกเท่านี้มาจากไหน

ช่องว่างของต้นทุนต่องานนั้นใหญ่กว่าช่องว่างของราคาหน้าป้าย และนั่นคือส่วนที่น่าสนใจ เพราะมันหมายความว่าเรตการ์ดเพียงอย่างเดียวไม่อาจอธิบายได้

การคำนวณราคาหน้ากล่องนั้นตรงไปตรงมาพอ: $0.10 เทียบกับ $0.75 สำหรับอินพุตนั้นถูกกว่า 7.5 เท่า และ $0.50 เทียบกับ $3.75 สำหรับเอาต์พุตก็มีอัตราส่วนเดียวกัน หากทั้งสองโมเดลสร้างโทเค็นเท่ากันสำหรับงานเดียวกัน อัตราส่วนนั้นก็จะส่งผลตรงไปถึงใบแจ้งหนี้เลย

มันไม่ได้ส่งผลต่อเนื่อง และผลกระทบทั้งสองข้อล้วนเอื้อประโยชน์ต่อ Google. Claude Haiku 5.5 ช่างใช้คำฟุ่มเฟือยในแบบที่ผู้ให้บริการของตัวเองก็ยอมรับ: Artificial Analysis บันทึกโทเคนเอาต์พุต 440 ล้านโทเคนขณะรัน Index เทียบกับค่ามัธยฐาน 100 ล้าน และเรียกโมเดลนี้ว่าช่างใช้คำฟุ่มเฟือยมาก. Gemini 3.8 Flash สร้าง 170 ล้าน เทียบกับค่ามัธยฐาน 81 ล้าน — ก็ถูกระบุว่าช่างใช้คำฟุ่มเฟือยเช่นกัน แต่มีจำนวนโทเคนเพียงหนึ่งในสาม. เอกสารของ Anthropic เองเพิ่มผลกระทบข้อที่สอง: Claude Haiku 5.5 ใช้ตัวแบ่งโทเคน (tokenizer) ใหม่ที่ใช้ร่วมกับ Claude 4.7 และรุ่นหลังจากนั้น ดังนั้นข้อความเดียวกันจึงนับเป็นโทเคนมากกว่าราว 30% เมื่อเทียบกับโมเดลที่มันมาแทน

เมื่อนำมารวมกัน เวอร์ชันที่ตรงไปตรงมาของคำกล่าวอ้างด้านราคาคือ: ข้อได้เปรียบด้านอัตราอินพุต 10 ต่อ 1 และข้อได้เปรียบด้านอัตราเอาต์พุต 7.5 ต่อ 1 ซึ่งถูกกัดกินไปบางส่วนโดยโมเดลที่เขียนโทเคนต่อคำตอบมากกว่า จนได้ข้อได้เปรียบ 6 ต่อ 1 ในการวัดที่คิดค่าบริการทั้งงาน ยังคงเป็นการเอาชนะแบบขาดลอย และเป็นชัยชนะที่เล็กกว่าที่ตารางราคาชี้ไว้

ราคาของ Google มีวันที่กำกับอยู่

สิ่งที่มีประโยชน์ที่สุดเพียงหนึ่งเดียวบนหน้า�าราคาของ Google คือประโยคที่ตารางเปรียบเทียบส่วนใหญ่ตัดทิ้งไป

Gemini 3.8 Flash ถูกระบุราคาไว้ที่ $0.75 สำหรับอินพุต และ $3.75 สำหรับเอาต์พุต "ถึงวันที่ 31 ธันวาคม 2026" และที่ $1.50 และ $7.50 "เริ่มตั้งแต่วันที่ 1 มกราคม 2027" อินพุตแบบแคชเปลี่ยนจาก $0.075 เป็น $0.15 ในวันเดียวกัน นั่นคืออัตราช่วงแนะนำที่มีวันหมดอายุพิมพ์กำกับไว้ข้าง ๆ ซึ่งห่างออกไปประมาณสิบเอ็ดสัปดาห์นับจากเวลาที่เขียนนี้

ไม่มีข้อความใดในการ์ดของ Ant​hropic ที่อ่านเป็นแบบนั้น อัตราของ Claude Haiku 5.5 ถูกระบุไว้เป็นอัตรา โดยมีโครงสร้างสองระดับที่ผูกกับความยาวพรอมป์ต์แทนที่จะผูกกับปฏิทิน และมีคำมั่นเรื่องการปลดระวางว่าจะไม่เร็วกว่า 7 ตุลาคม 2027 หากคุณกำลังจำลองไปป์ไลน์ที่ดำเนินไปถึงปีหน้า การปรับขึ้นในเดือนมกราคมของ Google คือการเพิ่มเป็นสองเท่า และควรนำมาใส่ในโมเดล ส่วนของ Ant​hropic ไม่มีเหตุการณ์เทียบเท่าให้ต้องวางแผนรองรับ

เรื่องนี้ใช้ได้กับทั้งสองทาง และการตีความที่เป็นธรรมไม่ใช่ "ผู้ขายรายหนึ่งซื่อสัตย์และอีกรายไม่ซื่อสัตย์" ราคาโปรโมชันก็เป็นราคาจริงตราบเท่าที่มันยังมีผล และ Google มีสิทธิ์กำหนดราคาสำหรับการเปิดตัวแบบนั้น เป็นเพียงข้อเท็จจริงเกี่ยวกับการเปรียบเทียบว่า ฝั่งที่ดูเหมือนถูกกว่าของตัวเลขเดือนมกราคมคือฝั่งที่มีกำหนดเส้นตาย

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications row and the published pricing table beneath it, with the per-million-token input, output and cache rates and the prompt-length threshold at which the second tier begins.

สองจุดของดัชนีมีค่าเท่าไหร่

ช่องว่าง 2.47 คะแนนบนดัชนีที่คะแนนสูงสุดอยู่ในช่วงหกสิบไม่ใช่ความคลาดเคลื่อนจากการปัดเศษ และก็ไม่ใช่เหวลึกที่แยกจากกันสุดขั้ว โมเดลทั้งสองอยู่ในช่วงการทำงานเดียวกัน และคำถามในทางปฏิบัติคือช่องว่างนี้ปรากฏในงานที่คุณเรียกใช้จริงหรือไม่

จากตัวเลขของผู้ให้บริการเอง ทั้งสองไม่ได้วัดบนฮาร์เนสเดียวกัน ดังนั้นจึงไม่สามารถเทียบเคียงกันได้โดยตรง — Ant​hropic เผยแพร่ผลลัพธ์ GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 และ FrontierCode สำหรับ Claude Haiku 5.5 และ Google เผยแพร่ชุดของตัวเองสำหรับ Gemini 3.8 Flash และไม่มีผู้ให้บริการรายใดรันชุดทดสอบของอีกราย การเปรียบเทียบที่เทียบกันได้จริงเท่านั้นที่มีอยู่คือบอร์ดอิสระ และที่นั่นคำตอบคือ Ant​hropic นำอยู่ด้วยส่วนต่างที่วัดได้แต่เล็กน้อย

ความแตกต่างด้านความสามารถที่บางทีมจะให้ความสำคัญมากกว่านั้นอยู่ที่เรื่องของมอดาลิตี Gemini 3.8 Flash รับอินพุตเสียงพูดและวิดีโอ ส่วน Claude Haiku 5.5 รับอินพุตข้อความและภาพ ไปป์ไลน์ที่รับบันทึกการสนทนาหรือการแคปเจอร์หน้าจอเข้ามาโดยตรงไม่ได้กำลังเลือกระหว่างสองโมเดลนี้ด้วยเรื่องราคาเลย — หนึ่งในสองตัวนั้นทำงานไม่ได้หากไม่มีขั้นตอนถอดเสียงหรือสกัดเฟรมอยู่ข้างหน้า และขั้นตอนนั้นก็มีต้นทุนและโหมดความล้มเหลวของมันเอง

Running ด้านที่ถูกกว่าของคู่นี้

Gemini 3.8 Flash อยู่ในแค็ตตาล็อกของ OrcaRouter ที่ราคาเต็มตามที่ Google ประกาศ โดยบวกเพิ่ม 0% ซึ่งในกรณีนี้สำคัญกว่าปกติ: อัตราของผู้ให้บริการถูกส่งผ่านโดยตรงแทนที่จะนำมาคละรวมกัน ดังนั้นหากคุณอยากเห็นว่าการปรับราคาในเดือนมกราคมส่งผลต่อบิลจริง ๆ อย่างไร ตัวเลขก็จะขยับตามที่ Google ขยับ Claude Sonnet 5.5 และ Claude Opus 5.5 ก็อยู่ในแค็ตตาล็อกเช่นกัน ซึ่งทำให้การทดสอบการจัดเส้นทางแบบสามทาง — ขา Flash ของ Google, ระดับกลางของ Ant​hropic และระดับเล็กของ Ant​hropic ในภายหลัง — กลายเป็นการตั้งค่าแทนที่จะเป็นโปรเจกต์ คีย์เดียว SDK เดียว ระบบสลับสำรองอัตโนมัติที่อยู่เบื้องหลัง และ DSL สำหรับการจัดเส้นทาง หากคุณอยากกำหนดการยกระดับไว้ในเส้นทางมากกว่าในโค้ดแอปพลิเคชัน.

Claude Haiku 5.5 เองยังไม่อยู่ในแค็ตตาล็อก และการพูดแบบนั้นย่อมดีกว่าปล่อยให้คลุมเครือ ปัจจุบันฝั่งของ Ant​hropic ในการเปรียบเทียบนี้เข้าถึงได้เฉพาะที่ Ant​hropic เท่านั้น ขณะที่ฝั่งของ Google นั้นเราเรียกใช้งานได้แล้ววันนี้ในราคาที่แสดงไว้ข้างต้น

A screenshot of the OrcaRouter catalogue page for Gemini 3.8 Flash, showing the model identifier in provider-slash-model form, the provider Google, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

อันไหน และสำหรับใคร

ถ้างานของคุณเป็นข้อความเข้าและข้อความออก พรอมต์ของคุณอยู่ต่ำกว่า 100,000 โทเค็น และคุณจ่ายต่อโทเค็นสำหรับปริมาณการใช้งานจริง Claude Haiku 5.5 คือโมเดลที่ถูกกว่าในทุกตัวชี้วัดในบทความนี้ และเป็นตัวที่ได้คะแนนสูงกว่าบนบอร์ดที่ใช้ร่วมกันเพียงแห่งเดียว — โดยมีข้อแม้ว่าข้อได้เปรียบอยู่ที่หกเท่าในด้านต้นทุนต่องาน ไม่ใช่สิบเท่าที่ป้ายราคาบ่งชี้

หากคุณต้องการอินพุตเสียงหรือวิดีโอ หรือคุณต้องการคำตอบขนาด 65K ขึ้นไป หรือพรอมป์ตของคุณมักยาวเป็นประจำ การคำนวณก็เปลี่ยนไป: Gemini 3.8 Flash รองรับอินพุตที่ระดับเล็กของ Ant​hropic ไม่สามารถรับได้ และเมื่อเกิน 100,000 โทเคน ระดับที่สองของ Ant​hropic เองมีราคาสูงกว่าอัตราคงที่ของ Google อยู่มาก

สิ่งเดียวที่ต้องยึดไว้คือกำหนดวันที่ อัตราของ Google มีผลถึงสิ้นปีและจะเพิ่มเป็นสองเท่าหลังจากนั้น ส่วนของ Ant​hropic ระบุเป็นอัตราคงที่โดยมีขั้นตามความยาว ไม่ว่าคุณจะเลือกอยู่ฝั่งไหน ให้สร้างปฏิทินลงในสเปรดชีตก่อนที่คุณจะสร้างไปป์ไลน์

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube