การ์ดฮีโร่ที่สร้างขึ้นซึ่งมีชื่อว่า 'Claude Haiku 5.5 vs Gemini 3.6 Flash' พร้อมคำโปรย 'ค่าใช้จ่ายต่อคำตอบ 7.5 เท่า' โดยแสดง Claude Haiku 5.5 ที่อินพุต $0.10, เอาต์พุต $0.50 และดัชนี 43.40 เทียบกับ Gemini 3.6 Flash ที่อินพุต $0.75, เอาต์พุต $3.75 และดัชนี 33.98 บนแถบที่ระบุว่า 'ค่าใช้จ่ายต่องานที่เสร็จสมบูรณ์ $0.21 เทียบกับ $1.60'
Engineering & Research

Claude Haiku 5.5 vs Gemini 3.6 Flash: ค่าใช้จ่ายต่อคำตอบสูงกว่า 7.5 เท่า แต่คะแนนโมเดลต่ำกว่าเก้าคะแนน

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Claude Haiku 5.5และGemini 3.6 Flashอยู่ในระดับเดียวกันของไลน์อัปแต่ละค่าย นั่นคือรุ่นเล็ก เร็ว และราคาถูก และความคล้ายคลึงกันก็จบลงเพียงเท่านั้น บน Artificial Analysis Intelligence Index v4.3.2 Claude Haiku 5.5 ทำคะแนนได้ 43.40 ในคอนฟิกูเรชัน Max เทียบกับ 33.98 ของ Gemini 3.6 Flash ในคอนฟิกูเรชัน High และในการรันเดียวกัน งาน Index หนึ่งงานที่ทำเสร็จมีค่าใช้จ่าย $0.21 บน Claude Haiku 5.5 และ $1.60 บน Gemini 3.6 Flash

อ่านคู่นั้นพร้อมกัน เพราะการอ่านอย่างใดอย่างหนึ่งเพียงลำพังจะทำให้เข้าใจผิด โมเดลที่ถูกกว่าไม่ได้ถูกกว่าเพียงเล็กน้อย แต่ถูกกว่า 7.5 เท่าต่องานที่เสร็จสมบูรณ์ และโมเดลที่มันกำลังเอาชนะไม่ได้อ่อนแอเพียงเล็กน้อย แต่อ่อนแอกว่า 9.42 จุดดัชนี ซึ่งบนกระดาน 182 โมเดลคือระยะห่างระหว่างควอร์ไทล์บนและค่ากลาง

ข้อเท็จจริงทั้งสองข้อนี้มาจากการรันอิสระครั้งเดียวกัน ซึ่งสำคัญเพราะการ์ดข้อมูลจากผู้ขายในที่นี้ไม่ได้บอกข้อมูลใดในสองเรื่องนี้เลย Anthropic เปิดตัว Claude Haiku 5.5 เมื่อวันที่ 7 ตุลาคม 2026; Google ปล่อย Gemini 3.6 Flash เมื่อวันที่ 21 กรกฎาคม 2026 ช่วงสามเดือนระหว่างทั้งสองคือส่วนที่น่าสนใจ

การ์ดสองใบเคียงข้างกัน

ต่อล้านโทเคนในหน่วยดอลลาร์สหรัฐ อัตราของ Anthropic และ Google มาจากเอกสารการกำหนดราคาของบริษัทเอง ส่วนแถวที่ใช้ร่วมกันคือ Artificial Analysis Intelligence Index v4.3.2 แคชเมื่อ 2026-10-08

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.6 Flash — the scoreboard' with rows Index v4.3.2 43.40 against 33.98, cost per task $0.21 against $1.60, input price $0.10 against $0.75, output tokens per task 162,164 against 41,606, Terminal Bench 4.0 0.3283 against 0.0707 and input modality 'text, image' against 'text, image, video, audio', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; Gemini 3.6 Flash is flagged deprecated on the board.'

• อินพุต — Claude Haiku 5.5 $0.10 สูงสุด 100,000 โทเคน และ $0.50 สำหรับส่วนที่เกิน; Gemini 3.6 Flash $0.75 แบบคงที่ในปัจจุบัน และจะเพิ่มเป็น $1.50 ในวันที่ 1 มกราคม 2027

• เอาต์พุต — Claude Haiku 5.5 $0.50 สูงสุด 100,000 โทเคน และ $2.50 สำหรับที่เกิน; Gemini 3.6 Flash ราคาคงที่ $3.75 วันนี้ และจะขึ้นเป็น $7.50 ในวันเดียวกัน

• อินพุตแบบแคช — Claude Haiku 5.5 $0.01 และ $0.05; Gemini 3.6 Flash $0.075 พร้อมค่าจัดเก็บ $0.50 ต่อล้านโทเคนต่อชั่วโมง

• ขีดจำกัดของบริบทและเอาต์พุต — 1M โทเค็นสำหรับทั้งคู่ Claude Haiku 5.5 จำกัดการตอบกลับไว้ที่ 128,000 โทเค็น; Gemini 3.6 Flash ที่ 65,536

• โมดัลลิตี — Claude Haiku 5.5 รับข้อความและรูปภาพ ส่วน Gemini 3.6 Flash รับข้อความ รูปภาพ วิดีโอ เสียง และไฟล์ นี่เป็นแถวเดียวที่ฝั่งของ Google เหนือกว่าอย่างชัดเจน และสำหรับไปป์ไลน์การทำความเข้าใจสื่อ มันสามารถตัดสินคำถามทั้งหมดได้

• คะแนนอิสระ — 43.40 สำหรับ Claude Haiku 5.5 (Max) เทียบกับ 33.98 สำหรับ Gemini 3.6 Flash (High)

• ค่าใช้จ่ายต่องานที่ทำเสร็จ — $0.21 เทียบกับ $1.60 ในการประเมินรอบเดียวกัน

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the pricing lines $0.10/$0.50 up to 100,000 tokens and $0.50/$2.50 over it, and the release line 'Released October 7, 2026'.

ทำไมตัวเลขที่ควรใช้จึงเป็นต่องาน ไม่ใช่ต่อโทเค็น

ตัวคูณตามเรตการ์ดดูเหมือนจะเป็น 7.5 ทางฝั่งอินพุตและ 7.5 ทางฝั่งเอาต์พุตอยู่แล้ว ดังนั้นตัวเลขต่องานจึงไม่น่าแปลกใจตรงนี้ — แต่ก็คุ้มค่าที่จะแสดงว่าทำไมสองโมเดลจึงลงเอยที่จุดเดียวกันในตัวชี้วัดหนึ่ง แต่ห่างกันมากในอีกตัวชี้วัดหนึ่ง เพราะเลขคณิตแบบเดียวกันให้ผลตรงกันข้ามในการจับคู่อื่น ๆ ของแบตช์นี้

Gemini 3.6 Flash เป็นรุ่นที่ละเอียดน้อยกว่าในสองรุ่นนี้ โดยปล่อยโทเคนเอาต์พุต 41,606 โทเคนต่องาน Intelligence Index — แบ่งเป็น 20,061 สำหรับการให้เหตุผล และ 21,545 สำหรับคำตอบ — เมื่อเทียบกับ Claude Haiku 5.5 ที่ 162,164 โทเคน ซึ่งแบ่งเป็น 129,047 สำหรับการให้เหตุผล และ 33,118 สำหรับคำตอบ โมเดลของ Anthropic ใช้โทเคนมากกว่าเกือบสี่เท่าในการทำงานเดียวกัน และยังเป็นตัวที่มีอัตราเอาต์พุตเพียงหนึ่งในเจ็ดของ Google ช่องว่างด้านโทเคนและช่องว่างด้านอัตราจึงทวีคูณกันแทนที่จะหักลบกัน

การรวมกันแบบนั้น — มิเตอร์ราคาถูกคูณกับการใช้งานหนัก — คือคำอธิบายที่ตรงไปตรงมาของเศรษฐศาสตร์ของ Claude Haiku 5.5 และโพสต์เปิดตัวของ Anthropic เองก็ยอมรับอีกด้านหนึ่งของเรื่องนี้ว่า โมเดลนี้ "คุ้มค่าเป็นพิเศษเมื่อใช้กับงานที่มีพรอมป์ต์ไม่เกิน 100,000 โทเคน ซึ่งคิดเป็นประมาณ 90% ของคำขอที่ส่งมาที่โมเดล Haiku รุ่นก่อนของเรา" เมื่อเกิน 100,000 โทเคน มิเตอร์อินพุตจะกลายเป็น $0.50 และมิเตอร์เอาต์พุต $2.50 ซึ่ง ณ จุดนั้น ตัวคูณเมื่อเทียบกับ Gemini 3.6 Flash จะลดลงเหลือประมาณ 1.5 เท่า

สิ่งที่ tier ของ Google เองทำ ในขณะที่การเปรียบเทียบนี้ยังคงหยุดนิ่ง

นี่คือจุดที่บทความนี้หยุดเป็นการเปรียบเทียบสองโมเดล และกลายเป็นคำเตือนเกี่ยวกับว่าจริง ๆ แล้วคุณกำลังเปรียบเทียบกับ Gemini ตัวไหน

Google ได้ตรึงราคาของ Flash ให้คงที่ตลอดสามรุ่น Gemini 3.6 Flash, Gemini 3.7 Flash และ Gemini 3.8 Flash ต่างก็มีราคาอยู่ที่ $0.75 สำหรับอินพุต และ $3.75 สำหรับเอาต์พุต ในเอกสารราคาของ Google เอง โดยมีอัตราแคชเท่ากันที่ $0.075 และการปรับขึ้นราคาในวันที่ 1 มกราคม 2027 เป็น $1.50 และ $7.50 เช่นเดียวกัน การ์ดของ Google สำหรับสาย 3.6 อธิบายว่าเป็น "โมเดล Flash รุ่นก่อนหน้าของเรา" ซึ่งเป็นคำพูดของเจ้าของผลิตภัณฑ์เอง

สิ่งที่ขยับคือคะแนน ไม่ใช่ราคา บนบอร์ดจัดอันดับอิสระ Gemini 3.6 Flash ได้คะแนน 33.98, Gemini 3.7 Flash ได้ 39.06 และ Gemini 3.8 Flash ได้ 40.93 — ทั้งหมดในการตั้งค่าความเข้มข้นสูงสุดที่เผยแพร่ คะแนนดัชนีเก้าจุดเพิ่มขึ้นภายในระดับ flash ของ Google ในเวลาเพียงหกสัปดาห์ โดยที่อัตราไม่เปลี่ยนแปลง

ผลที่ตามมาสำหรับใครก็ตามที่กำลังอยู่ระหว่างการประเมินนั้นชัดเจนเป็นรูปธรรม: หากคุณวัดประสิทธิภาพการเปรียบเทียบนี้เมื่อสามสัปดาห์ก่อนกับ Gemini 3.7 Flash ผลลัพธ์ของคุณก็ล้าสมัยแล้ว และหากคุณวัดกับ Gemini 3.8 Flash ช่องว่างที่ห่างจาก Claude Haiku 5.5 จะแคบลงเหลือ 2.47 คะแนน Gemini 3.6 Flash เป็นเวอร์ชันของการเปรียบเทียบนี้ที่ทำให้ Anthropic ดูดีที่สุด และยังเป็นเวอร์ชันที่ Google อยู่ห่างไกลจากการขายมากที่สุด

Artificial Analysis ทำเครื่องหมายรายการ 3.6 ว่าเลิกใช้งานแล้ว เอกสารราคาของ Google ยังคงเผยแพร่อัตราดังกล่าว และรายการโมเดลของบริษัทก็ยังนำไปยังส่วน 3.6 ดังนั้นการตีความอย่างตรงไปตรงมาจึงไม่ใช่ "หายไป" แต่เป็น "ถูกแทนที่ถึงสองครั้งภายในตระกูลเดียวกันในสิบสัปดาห์" — และนั่นเป็นข้อเท็จจริงเกี่ยวกับความเร็วที่ระดับนี้เปลี่ยนแปลงไป ไม่ใช่เหตุผลที่จะข้ามการเปรียบเทียบ

นี่ตัดสินใจแทนใครกันแน่

มีเหตุผลที่แท้จริงสำหรับ Gemini 3.6 Flash และมันไม่ใช่คะแนน

หากคุณต้องการเสียงหรือวิดีโอในพรอมต์ Claude Haiku 5.5 ทำไม่ได้เลย — มันอ่านได้แค่ข้อความกับรูปภาพเท่านั้น ไม่มีอย่างอื่น Gemini 3.6 Flash อ่านได้ทั้งข้อความ รูปภาพ วิดีโอ เสียง และไฟล์ และแค็ตตาล็อกของเราเองบันทึกไว้ที่ค่าที่วัดได้ 582 โทเคนเอาต์พุตต่อวินาที โดยมีค่ามัธยฐานเวลาถึงโทเคนแรกที่ 4.1 วินาทีในช่วงสัปดาห์ที่ผ่านมา ซึ่งเป็นโมเดลที่เร็วแม้เมื่อเทียบตามมาตรฐานของ Flash สำหรับไปป์ไลน์ทำความเข้าใจสื่อ รายการรูปแบบข้อมูลคือการตัดสินใจทั้งหมด และช่องว่างของดัชนีเป็นเพียงเชิงอรรถ

ถ้างานของคุณเป็นข้อความและรูปภาพ ตัวเลขก็ไม่ได้ใกล้กันพอที่จะมาเถียงกันได้ ด้วยส่วนผสมที่เน้นอินพุตแบบ 7:2:1 ซึ่งเป็นรูปแบบที่ทราฟฟิกโปรดักชันส่วนใหญ่มี Claude Haiku 5.5 อยู่ที่ $0.077 ต่อล้านโทเคน เทียบกับ $0.63 สำหรับ Gemini 3.6 Flash หากใช้โทเคนผสมเกินหนึ่งล้านโทเคนต่อวัน นั่นคือ 77 เซนต์ เทียบกับ $6.30 และตัวเลขที่สองจะแย่ลงในวันที่ 1 มกราคม 2027 ขณะที่ตัวเลขแรกไม่ขยับ

หน้าผา 100,000 โทเคนคือเงื่อนไขเดียวที่พลิกสถานการณ์ ไปป์ไลน์การค้นคืนหรือเอกสารยาวที่ประกอบพรอมป์ขนาด 150,000 โทเคนเป็นประจำจะต้องจ่ายในระดับราคา $0.50/$2.50 ของ Anthropic สำหรับคำขอทั้งหมด และ ณ จุดนั้น สองโมเดลมีราคาห่างกันไม่ถึง 1.5 เท่า ขณะที่ Gemini 3.6 Flash ยังคงชนะในด้านมัลติโมดัลและในตัวเลข 91.8% ที่ Google เผยแพร่สำหรับการค้นคืนแบบหลายเข็มที่ค่าเฉลี่ย 128k นั่นเป็นข้อมูลที่ผู้ขายรายงานเองและยังไม่มีการทำซ้ำ และมันควรถูกวางไว้ในกรอบแบบนั้นเท่านั้น

A capture of the OrcaRouter model page for Gemini 3.6 Flash under google/gemini-3.6-flash, showing a 65K maximum output, text, image, video, file and audio input, public benchmarks published by Google dated 2026-07-21, a p50 time to first token of 4.1 seconds, and the page's own description of the model as Google's fast, cost-efficient multimodal model in the Gemini 3 family with a 1M-token context window.

เรียกทั้งคู่ หรือเรียกคนเดียว

Gemini 3.6 Flash อยู่ในแค็ตตาล็อกของ OrcaRouter แล้ววันนี้ที่ google/gemini-3.6-flash ในราคาตามประกาศของ Google โดยบวกเพิ่ม 0% — 0.75 ดอลลาร์ และ 3.75 ดอลลาร์ พร้อมค่าอ่านแคช 0.075 ดอลลาร์ คิดตามที่ผู้ให้บริการเรียกเก็บจริง เรื่องนี้สำคัญกับโมเดลนี้โดยเฉพาะ เพราะการปรับขึ้นราคาวันที่ 1 มกราคมของ Google ถือเป็นการเปลี่ยนอัตราค่าบริการ และแค็ตตาล็อกแบบส่งผ่านราคาจะปรับตามทันทีในวันที่เกิดขึ้น ไม่ใช่รอถึงการต่อสัญญาครั้งถัดไป คีย์ API เพียงคีย์เดียวและการเรียก SDK เพียงครั้งเดียวก็ใช้ได้ทั้งโมเดลนี้หรือโมเดลอื่นอีกกว่า 200 โมเดลในแค็ตตาล็อก ดังนั้นการทดสอบ A/B ระหว่างขา Google กับขา Anthropic จึงเป็นเพียงการเปลี่ยนสตริงชื่อโมเดล โดยมีระบบสลับสำรองอัตโนมัติรองรับอยู่ข้างใต้ ไม่ใช่การเชื่อมต่อเพิ่มอีกชุด

Claude Haiku 5.5 ไม่มีอยู่ในแค็ตตาล็อก โมเดลของ Anthropic นั้นเข้าถึงได้ผ่าน API ของ Anthropic เอง และผ่าน AWS, Google Cloud และ Microsoft Azure และนั่นก็คือคำตอบที่ตรงไปตรงมาทั้งหมด สิ่งที่เรามีให้บริการจากไลน์อัปนั้นก็คือ Claude Sonnet 5.5 และ Claude Opus 5.5 — ซึ่งเป็นสิ่งที่ทำให้เส้นทางการยกระดับจากการเรียกจำแนกประเภทแบบราคาถูก ไปสู่การเรียกแบบเอเจนต์ระดับกลาง กลายเป็นการตัดสินใจเรื่องการจัดเส้นทาง มากกว่าจะเป็นโปรเจกต์

ซึ่งทำให้คำตัดสินเรียบง่ายพอจะกล่าวได้อย่างตรงไปตรงมา สำหรับงานข้อความและภาพที่ความยาวพรอมป์ต์สั้น ๆ Claude Haiku 5.5 ชนะในทุกแกน ยกเว้นเพดานการตอบสนอง สำหรับสิ่งใดก็ตามที่มีเสียงหรือวิดีโออยู่ด้วย Gemini 3.6 Flash เป็นเพียงตัวเดียวในสองตัวนี้ที่ตอบได้เลย — และถ้าคุณจะจ่ายในอัตราของ Google สำหรับความสามารถนั้น จงถามว่าคุณกำลังจ่ายให้ Gemini ตัวไหน เพราะในระดับนี้คุณได้คะแนนดัชนีเพิ่มอีกเก้าคะแนนด้วยเงินเท่ากันจากรุ่นน้องที่ใหม่กว่า

API เดียวสำหรับโมเดล 200 กว่าตัว คีย์เดียว พร้อมการสลับไปใช้ตัวสำรองอัตโนมัติอยู่เบื้องหลัง ดังนั้นการทำ A/B ระหว่างขา Google กับขา Anthropic จึงเป็นแค่การเปลี่ยนสตริงโมเดล ไม่ใช่การผสานรวมครั้งที่สอง

การเปรียบเทียบในบทความนี้2

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube