google/gemini-2.5-pro-preview-tts vs Gemini 3.5 Flash: เบนช์มาร์ก ราคา และความเร็ว (สิงหาคม 2569)

การเปรียบเทียบแบบตัวต่อตัวระหว่าง google/gemini-2.5-pro-preview-tts (google) และ Gemini 3.5 Flash (google) บน OrcaRouter — ราคา หน้าต่างบริบท ความหน่วง ทรูพุต และคุณภาพ benchmark เคียงข้างกัน เพื่อให้คุณเลือกโมเดลที่เหมาะกับภาระงานของคุณ

สรุป

ในด้านราคา google/gemini-2.5-pro-preview-tts เป็นตัวเลือกที่ถูกกว่า — ต่ำกว่า Gemini 3.5 Flash ประมาณ 33% ในด้าน tokens อินพุต ในด้านคุณภาพ benchmark Gemini 3.5 Flash นำหน้าในดัชนีรวม

เริ่มใช้ฟรี · ทั้งสองรุ่นด้วยคีย์เดียว · คิดค่าใช้จ่ายตามราคาผู้ให้บริการ ไม่มีส่วนบวกเพิ่มต่อโทเคน

ทั้ง google/gemini-2.5-pro-preview-tts และ Gemini 3.5 Flash ให้บริการผ่าน endpoint เดียวกันของ OrcaRouter ที่ราคาต้นทุนของผู้ให้บริการโดยไม่มีการบวกเพิ่มค่า token ใด ๆ

อ่านบทวิเคราะห์ฉบับเต็ม

ดังนั้นการสลับระหว่างทั้งสองจึงเป็นการแก้เพียงบรรทัดเดียว และตัวเลขด้านล่างคือสิ่งที่คุณจ่ายจริง การเปรียบเทียบนี้ดึงราคาแบบเรียลไทม์ context window ที่ประกาศไว้ และการวัด latency กับ throughput ของ OrcaRouter เอง เพื่อให้คุณชั่งน้ำหนักต้นทุนกับประสิทธิภาพสำหรับภาระงานเฉพาะของคุณ แทนที่จะพึ่งพา benchmark หน้าร้านของผู้ให้บริการ ทางเลือกที่ถูกต้องมักขึ้นอยู่กับรูปทรงของทราฟฟิกของคุณเสมอ — ความยาวของ prompt ปริมาณข้อความที่คุณสร้าง ผู้ใช้ของคุณไวต่อ latency แค่ไหน และการให้เหตุผลยากเพียงใด — ดังนั้นส่วนต่าง ๆ ด้านล่างจึงแยกย่อยการตัดสินใจทีละมิติและปิดท้ายด้วยคำแนะนำที่เป็นรูปธรรม เมื่อใดที่ตัวชี้วัดของหนึ่งในสองโมเดลขาดหายไป แถวนั้นจะถูกตัดออกแทนที่จะเดา ดังนั้นทุกข้อกล่าวอ้างที่นี่จึงมีตัวเลขจริงรองรับ

ภาพรวมโดยย่อ

  • อินพุต $/ล้าน$1.00google/gemini-2.5-pro-preview-tts 33%
  • คุณภาพ9.0Gemini 3.5 Flash 350%

การเปรียบเทียบโมเดล

ราคา บริบท ความหน่วง ทรูพุต และคุณภาพสำหรับ google/gemini-2.5-pro-preview-tts และ Gemini 3.5 Flash
ตัวชี้วัดgoogle/gemini-2.5-pro-preview-ttsGemini 3.5 Flashข้อสรุป
อินพุต $/ล้าน$1.00$1.50google/gemini-2.5-pro-preview-tts ถูกกว่า Gemini 3.5 Flash 33% ในด้าน tokens อินพุต
เอาต์พุต $/ล้าน$20.00$9.00Gemini 3.5 Flash ถูกกว่า google/gemini-2.5-pro-preview-tts 55% ในด้าน tokens เอาต์พุต
บริบท1M
ความหน่วง p503791 ms
ทรูพุต401 tok/s
คุณภาพ2.09.0Gemini 3.5 Flash ได้คะแนนสูงกว่า google/gemini-2.5-pro-preview-tts 350% ในดัชนีคุณภาพรวม

ในด้านราคา google/gemini-2.5-pro-preview-tts เป็นตัวเลือกที่ถูกกว่า — ต่ำกว่า Gemini 3.5 Flash ประมาณ 33% ในด้าน tokens อินพุต ในด้านคุณภาพ benchmark Gemini 3.5 Flash นำหน้าในดัชนีรวม

สองโมเดล คีย์ API เดียว เริ่มจากตัวใดก็ได้ แล้วย้ายทราฟฟิกระหว่างกันเมื่อตัวเลขของคุณเปลี่ยน

รับคีย์ API

ใช้ google/gemini-2.5-pro-preview-tts และ Gemini 3.5 Flash ด้วยคีย์ API เดียว

คุณไม่จำเป็นต้องเลือกอย่างใดอย่างหนึ่ง ทั้งสองโมเดลเรียกใช้ได้บน OrcaRouter ด้วยคีย์ API เดียว คิดค่าบริการตามราคาผู้ให้บริการต้นทางโดยไม่บวกเพิ่มค่าโทเคน ทั้งคู่ใช้โปรโตคอลคำขอต่างกัน แต่ละการเรียกจึงใช้รูปแบบที่โมเดลนั้นต้องการ แต่ยังคงเป็นบัญชีเดียวและชุดข้อมูลรับรองเดียว

นั่นคือสิ่งที่ทำให้การแลกเปลี่ยนข้างต้นจัดการได้จริงในระบบproduction: ส่งทราฟฟิกส่วนใหญ่ไปยังรุ่นที่ชนะในมิติที่คุณให้ความสำคัญ เก็บอีกรุ่นไว้สำหรับคำขอที่จำเป็นต้องใช้ และปรับสัดส่วนเมื่อตัวเลขของคุณเปลี่ยน

ทดสอบจริง: google/gemini-2.5-pro-preview-tts vs Gemini 3.5 Flash ในโหมด Battle

โหมดต่อสู้ — ลองทั้งสองแบบเทียบกันสด
เปิดใน playground
google/gemini-2.5-pro-preview-tts
$1.00 /M ·
Gemini 3.5 Flash
$1.50 /M · p50 3791ms

การกำหนดราคาและการวิเคราะห์ต้นทุน

สำหรับ token ขาเข้า google/gemini-2.5-pro-preview-tts คิด $1.00 ต่อ 1 ล้าน เทียบกับ $1.50 ของ Gemini 3.5 Flash และสำหรับขาออก $20.00 เทียบกับ $9.00 ต่อ 1 ล้าน

อ่านบทวิเคราะห์ฉบับเต็ม

โดยทั่วไปบิลถูกตัดสินที่ token ขาออก: ภาระงานแชทหรือ agent ที่สร้างคำตอบยาวจะถูกครอบงำด้วยอัตราขาออก ดังนั้นโมเดลที่ดูถูกกว่าฝั่งขาเข้าจึงยังอาจเป็นตัวเลือกที่แพงกว่าเมื่อคิดแบบครบวงจร ประเมินอัตราส่วนขาเข้าต่อขาออกจริงของคุณก่อนเลือกเพียงเพราะราคา — prompt ที่เน้นการดึงข้อมูลพร้อมคำตอบสั้น กับ prompt สั้นที่มีการสร้างเนื้อหายาว จะตกอยู่คนละขั้วของตารางนี้ วิธีประเมินขนาดที่ใช้ได้จริงคือหยิบตัวอย่าง prompt ที่เป็นตัวแทน นับจำนวน token ขาเข้าและขาออกเฉลี่ย แล้วคูณแต่ละค่าเข้ากับอัตราของทั้งสองโมเดลตามลำดับ โมเดลที่มีต้นทุนแบบผสม (blended) ต่ำกว่าบนส่วนผสมจริงของคุณคือโมเดลที่ต้องเอาชนะ จำไว้ว่าราคาทั้งสองที่นี่คืออัตราดิบของผู้ให้บริการ — OrcaRouter ไม่บวกเพิ่มใด ๆ — ดังนั้นการเปรียบเทียบจึงเป็นแบบเทียบเท่ากัน และเงินที่คุณคำนวณว่าประหยัดได้ก็คือเงินที่คุณเก็บไว้จริง

ทั้งสองอัตราเป็นราคาดิบของผู้ให้บริการ — OrcaRouter ไม่บวกเพิ่ม ดังนั้นยอดประหยัดที่คุณคำนวณคือยอดที่คุณได้จริง

เริ่มใช้ฟรี

เปรียบเทียบราคาต่อโทเค็น

อินพุต $/ล้าน
google/gemini-2.5-pro-preview-tts$1.00
Gemini 3.5 Flash$1.50
เอาต์พุต $/ล้าน
google/gemini-2.5-pro-preview-tts$20.00
Gemini 3.5 Flash$9.00

ต่อ 1 ล้าน tokens

ความเร็วและความหน่วง

latency และ throughput ตัดสินว่าโมเดลให้ความรู้สึกอย่างไรในการใช้งานจริง latency การตอบสนองค่ามัธยฐาน (p50) คือระยะเวลาที่คำขอทั่วไปรอก่อน token แรก ส่วน throughput (token

อ่านบทวิเคราะห์ฉบับเต็ม

ต่อวินาที) กำหนดว่าคำตอบสตรีมเร็วแค่ไหนเมื่อเริ่มแล้ว สำหรับแชทเชิงโต้ตอบและลูป agent latency p50 ต่ำสำคัญที่สุดเพราะผู้ใช้กำลังรอ token แรกอยู่ ส่วนการสร้างแบบชุดและเอาต์พุตรูปแบบยาว throughput ครอบงำเวลารวมเพราะคำตอบยาว กราฟแนวโน้ม 7 วันด้านบนแสดงว่า latency ของแต่ละโมเดลคงที่หรือเลื่อนไหล ซึ่งเป็นสิ่งที่ตัวเลขเด่นเพียงตัวเดียวปิดบังไว้ — โมเดลที่มีค่าเฉลี่ยดีเยี่ยมแต่หางแกว่งก็ยังอาจพลาด p95 SLA ที่เข้มงวดได้ หากผลิตภัณฑ์ของคุณมีงบประมาณ latency ให้อ่านทั้งค่ามัธยฐานและรูปทรงของเส้นโค้ง และจำไว้ว่า latency แบบครบวงจรยังรวมถึงการกระโดดข้ามเครือข่ายของคุณและการดึงข้อมูลหรือการเรียกเครื่องมือใด ๆ ที่คุณทำรอบ ๆ โมเดลด้วย

google/gemini-2.5-pro-preview-tts
Gemini 3.5 Flash

เบนช์มาร์กและคุณภาพ

คะแนน benchmark ประมาณความสามารถได้แต่ไม่ใช่สิ่งทดแทนการทดสอบบน prompt ของคุณเอง ดัชนีรวมที่แสดงที่นี่รวบรวมการประเมินสาธารณะหลายรายการ

อ่านบทวิเคราะห์ฉบับเต็ม

และเปอร์เซ็นไทล์บอกว่าแต่ละโมเดลอยู่ตรงไหนเมื่อเทียบกับทุกโมเดลที่เทียบเคียงได้ในแคตตาล็อก — เป็นสัญญาณคัดกรองที่มีประโยชน์ ไม่ใช่การรับประกันสำหรับงานของคุณ โมเดลที่นำในดัชนีความฉลาดทั่วไปก็ยังอาจตามหลังในโดเมนของคุณ (การเขียนโค้ด การสกัด หลายภาษา การให้เหตุผลบน context ยาว) ดังนั้นจงใช้ benchmark เพื่อจำกัดตัวเลือก แล้วรันทั้งสองโมเดลบนสไลซ์ทราฟฟิกที่เป็นตัวแทน จงใส่ใจกับดัชนีเฉพาะที่ตรงกับกรณีใช้งานของคุณ มากกว่าตัวเลขรวมบนสุด: ผลิตภัณฑ์ที่เน้นการเขียนโค้ดควรให้น้ำหนักกับดัชนีการเขียนโค้ด ส่วนผู้ช่วยวิจัยให้น้ำหนักกับดัชนีการให้เหตุผล benchmark ยังล้าสมัยลงเมื่อโมเดลได้รับการอัปเดต ดังนั้นจงถือว่ามันเป็นสมมติฐานตั้งต้นที่คุณยืนยันด้วยชุดประเมินของคุณเอง

google/gemini-2.5-pro-preview-tts
Gemini 3.5 Flash
70.1
AA Coding
ดีกว่า 84% ของโมเดลที่เปรียบเทียบ
อันดับ 21 จาก 133
52.0
AA Intelligence
ดีกว่า 77% ของโมเดลที่เปรียบเทียบ
อันดับ 29 จาก 135
51.0
AA Math
ดีกว่า 27% ของโมเดลที่เปรียบเทียบ
อันดับ 60 จาก 82

ควรเลือกตัวไหน?

หากต้นทุนเป็นข้อจำกัดที่ผูกมัด ให้เริ่มด้วยโมเดลที่ถูกกว่าบนส่วนผสมขาเข้าต่อขาออกจริงของคุณ และขยับขึ้นเฉพาะเมื่อคุณภาพไม่ถึง หากความสามารถในการตอบสนองเป็นสิ่งสำคัญ —

อ่านบทวิเคราะห์ฉบับเต็ม

แชทที่เผชิญผู้ใช้ agent หรืออะไรก็ตามที่มีคนกำลังรอ — ให้น้ำหนัก latency p50 และ throughput เหนือส่วนต่างราคาเล็กน้อย หากคุณกำลังผลักงานให้เหตุผล การเขียนโค้ด หรือ context ยาวที่หนักที่สุด ให้ผู้ชนะด้าน benchmark และ context window เป็นตัวนำ และยอมรับอัตราที่สูงกว่าในจุดที่มันคุ้มค่า เนื่องจากทั้งสองโมเดลอยู่หลัง API เดียวกัน การเคลื่อนไหวที่มีความเสี่ยงต่ำคือกำหนดเส้นทางทราฟฟิกจริงส่วนหนึ่งไปยังแต่ละโมเดลและเปรียบเทียบต้นทุน latency และคุณภาพคำตอบบน prompt ของคุณเองก่อนตัดสินใจ รูปแบบที่พบบ่อยคือการแบ่งชั้น (tier): ส่งคำขอที่ง่ายและปริมาณสูงส่วนใหญ่ไปยังโมเดลที่ถูกกว่าหรือเร็วกว่า และสงวนโมเดลที่แข็งแกร่งกว่าไว้สำหรับคำขอที่ต้องการมันจริง ๆ ซึ่งจะเก็บเกี่ยวข้อได้เปรียบด้านคุณภาพส่วนใหญ่ด้วยต้นทุนเพียงเศษเสี้ยว ไม่ว่าคุณจะเลือกอันไหน จงทำให้การสลับย้อนกลับได้ — คุณสามารถย้ายทราฟฟิกกลับได้ทันทีที่ตัวเลขหรือความต้องการของคุณเปลี่ยนไป

หรือไม่ต้องเลือกเลย — กระจายทีละคำขอไปยังทั้งสองตัว ด้วยคีย์เดียวและบิลเดียว

รับทั้งสองรุ่น

เหมาะที่สุดสำหรับ

  • การให้เหตุผลและการเขียนโค้ดที่ยากที่สุดGemini 3.5 Flash

คำถามที่พบบ่อย google/gemini-2.5-pro-preview-tts vs Gemini 3.5 Flash

google/gemini-2.5-pro-preview-tts หรือ Gemini 3.5 Flash ตัวไหนถูกกว่า?
google/gemini-2.5-pro-preview-tts ถูกกว่าในด้าน tokens อินพุตที่ $1.00 ต่อ 1 ล้าน เทียบกับ $1.50 ต่อ 1 ล้าน
อันไหนถูกกว่าในด้าน token ขาออก google/gemini-2.5-pro-preview-tts หรือ Gemini 3.5 Flash?
Gemini 3.5 Flash มีราคาขาออกต่ำกว่าที่ $9.00 ต่อ 1 ล้าน เทียบกับ $20.00 ต่อ 1 ล้าน ราคาขาออกมักสำคัญกว่าขาเข้าสำหรับภาระงานที่เน้นการสร้าง ดังนั้นให้ชั่งน้ำหนักตามนั้น
อันไหนทำคะแนน benchmark ได้สูงกว่า google/gemini-2.5-pro-preview-tts หรือ Gemini 3.5 Flash?
Gemini 3.5 Flash นำในดัชนีคุณภาพรวมที่แสดงด้านบน แต่ความได้เปรียบด้าน benchmark ไม่ได้ถ่ายทอดไปยังโดเมนเฉพาะเสมอไป — ตรวจสอบบน prompt ของคุณเองก่อนกำหนดเป็นมาตรฐาน
ฉันควรใช้ google/gemini-2.5-pro-preview-tts หรือ Gemini 3.5 Flash?
เลือก google/gemini-2.5-pro-preview-tts หรือ Gemini 3.5 Flash ตามลำดับความสำคัญของคุณ: ต้นทุน หน้าต่างบริบท ความหน่วง หรือคุณภาพ benchmark ตารางด้านบนแสดงว่าโมเดลใดชนะในแต่ละด้าน ให้จับคู่ผู้ชนะกับมิติที่สำคัญที่สุดสำหรับภาระงานของคุณ
google/gemini-2.5-pro-preview-tts และ Gemini 3.5 Flash คิดค่าบริการอย่างไรบน OrcaRouter?
ทั้งคู่คิดค่าบริการตามอัตราของผู้ให้บริการต้นทางโดยไม่มีการบวกเพิ่มค่า token ใด ๆ — คุณจ่ายราคาต่อ token เท่ากับที่คุณจะจ่ายให้ผู้ให้บริการโดยตรง ผ่านคีย์ API และ endpoint ของ OrcaRouter เพียงหนึ่งเดียว
ฉันสามารถเรียกทั้ง google/gemini-2.5-pro-preview-tts และ Gemini 3.5 Flash ด้วยโค้ดเดียวกันได้ไหม?
ได้ ทั้งคู่เปิดให้ใช้ผ่าน API แบบ OpenAI-compatible ของ OrcaRouter ดังนั้นคุณเปลี่ยนเพียงชื่อโมเดลเพื่อกำหนดเส้นทางระหว่างทั้งสอง — ไม่ต้องเปลี่ยน SDK ไม่ต้องมีข้อมูลรับรองแยกต่างหาก

เริ่มด้วย google/gemini-2.5-pro-preview-tts หรือ Gemini 3.5 Flash

คีย์เดียว ทั้งสองรุ่น ผู้ให้บริการกว่า 40 ราย

คิดค่าบริการตามราคาผู้ให้บริการโดยไม่บวกเพิ่มค่าโทเคน เริ่มฟรี ใช้ทั้งสองตัวจากบัญชีเดียว และย้อนกลับการตัดสินใจได้เสมอ

สร้างบัญชีฟรี