Gemini 3.1 Pro Preview Custom Tools vs google/gemini-embedding-001: เบนช์มาร์ก ราคา และความเร็ว (กันยายน 2569)

การเปรียบเทียบแบบตัวต่อตัวระหว่าง Gemini 3.1 Pro Preview Custom Tools (google) และ google/gemini-embedding-001 (google) บน OrcaRouter — ราคา หน้าต่างบริบท ความหน่วง ทรูพุต และคุณภาพ benchmark เคียงข้างกัน เพื่อให้คุณเลือกโมเดลที่เหมาะกับภาระงานของคุณ

สรุป

ในด้านราคา google/gemini-embedding-001 เป็นตัวเลือกที่ถูกกว่า — ต่ำกว่า Gemini 3.1 Pro Preview Custom Tools ประมาณ 96% ในด้าน tokens อินพุต สำหรับภาระงานที่ไวต่อความหน่วง google/gemini-embedding-001 ส่งคืน token แรกได้เร็วกว่า ในด้านคุณภาพ benchmark Gemini 3.1 Pro Preview Custom Tools นำหน้าในดัชนีรวม google/gemini-embedding-001 นำทั้งด้านต้นทุนและเวลาแฝงมัธยฐาน จึงเป็นตัวเลือกเริ่มต้น — เปลี่ยนไปใช้ Gemini 3.1 Pro Preview Custom Tools เมื่อรุ่นนั้นชนะในมิติที่งานของคุณต้องพึ่งพา

เริ่มใช้ฟรี · ทั้งสองรุ่นด้วยคีย์เดียว · คิดค่าใช้จ่ายตามราคาผู้ให้บริการ ไม่มีส่วนบวกเพิ่มต่อโทเคน

ทั้ง Gemini 3.1 Pro Preview Custom Tools และ google/gemini-embedding-001 ให้บริการผ่าน endpoint เดียวกันของ OrcaRouter ที่ราคาต้นทุนของผู้ให้บริการโดยไม่มีการบวกเพิ่มค่า token ใด ๆ

อ่านบทวิเคราะห์ฉบับเต็ม

ดังนั้นการสลับระหว่างทั้งสองจึงเป็นการแก้เพียงบรรทัดเดียว และตัวเลขด้านล่างคือสิ่งที่คุณจ่ายจริง การเปรียบเทียบนี้ดึงราคาแบบเรียลไทม์ context window ที่ประกาศไว้ และการวัด latency กับ throughput ของ OrcaRouter เอง เพื่อให้คุณชั่งน้ำหนักต้นทุนกับประสิทธิภาพสำหรับภาระงานเฉพาะของคุณ แทนที่จะพึ่งพา benchmark หน้าร้านของผู้ให้บริการ ทางเลือกที่ถูกต้องมักขึ้นอยู่กับรูปทรงของทราฟฟิกของคุณเสมอ — ความยาวของ prompt ปริมาณข้อความที่คุณสร้าง ผู้ใช้ของคุณไวต่อ latency แค่ไหน และการให้เหตุผลยากเพียงใด — ดังนั้นส่วนต่าง ๆ ด้านล่างจึงแยกย่อยการตัดสินใจทีละมิติและปิดท้ายด้วยคำแนะนำที่เป็นรูปธรรม เมื่อใดที่ตัวชี้วัดของหนึ่งในสองโมเดลขาดหายไป แถวนั้นจะถูกตัดออกแทนที่จะเดา ดังนั้นทุกข้อกล่าวอ้างที่นี่จึงมีตัวเลขจริงรองรับ

ภาพรวมโดยย่อ

  • อินพุต $/ล้าน$0.15google/gemini-embedding-001 96%
  • ความหน่วง p50182 msgoogle/gemini-embedding-001 94%
  • คุณภาพ10.0Gemini 3.1 Pro Preview Custom Tools 233%

การเปรียบเทียบโมเดล

ราคา บริบท ความหน่วง ทรูพุต และคุณภาพสำหรับ Gemini 3.1 Pro Preview Custom Tools และ google/gemini-embedding-001
ตัวชี้วัดGemini 3.1 Pro Preview Custom Toolsgoogle/gemini-embedding-001ข้อสรุป
อินพุต $/ล้าน$4.00$0.15google/gemini-embedding-001 ถูกกว่า Gemini 3.1 Pro Preview Custom Tools 96% ในด้าน tokens อินพุต
เอาต์พุต $/ล้าน$18.00
บริบท1M
ความหน่วง p503241 ms182 msgoogle/gemini-embedding-001 ตอบสนองเร็วกว่า Gemini 3.1 Pro Preview Custom Tools 94% ที่ค่ามัธยฐาน
ทรูพุต160 tok/s
คุณภาพ10.03.0Gemini 3.1 Pro Preview Custom Tools ได้คะแนนสูงกว่า google/gemini-embedding-001 233% ในดัชนีคุณภาพรวม

ในด้านราคา google/gemini-embedding-001 เป็นตัวเลือกที่ถูกกว่า — ต่ำกว่า Gemini 3.1 Pro Preview Custom Tools ประมาณ 96% ในด้าน tokens อินพุต สำหรับภาระงานที่ไวต่อความหน่วง google/gemini-embedding-001 ส่งคืน token แรกได้เร็วกว่า ในด้านคุณภาพ benchmark Gemini 3.1 Pro Preview Custom Tools นำหน้าในดัชนีรวม google/gemini-embedding-001 นำทั้งด้านต้นทุนและเวลาแฝงมัธยฐาน จึงเป็นตัวเลือกเริ่มต้น — เปลี่ยนไปใช้ Gemini 3.1 Pro Preview Custom Tools เมื่อรุ่นนั้นชนะในมิติที่งานของคุณต้องพึ่งพา

สองโมเดล คีย์ API เดียว เริ่มจากตัวใดก็ได้ แล้วย้ายทราฟฟิกระหว่างกันเมื่อตัวเลขของคุณเปลี่ยน

รับคีย์ API

ใช้ Gemini 3.1 Pro Preview Custom Tools และ google/gemini-embedding-001 ด้วยคีย์ API เดียว

คุณไม่จำเป็นต้องเลือกอย่างใดอย่างหนึ่ง ทั้งสองโมเดลเรียกใช้ได้บน OrcaRouter ด้วยคีย์ API เดียว คิดค่าบริการตามราคาผู้ให้บริการต้นทางโดยไม่บวกเพิ่มค่าโทเคน ทั้งคู่ใช้โปรโตคอลคำขอต่างกัน แต่ละการเรียกจึงใช้รูปแบบที่โมเดลนั้นต้องการ แต่ยังคงเป็นบัญชีเดียวและชุดข้อมูลรับรองเดียว

นั่นคือสิ่งที่ทำให้การแลกเปลี่ยนข้างต้นจัดการได้จริงในระบบproduction: ส่งทราฟฟิกส่วนใหญ่ไปยังรุ่นที่ชนะในมิติที่คุณให้ความสำคัญ เก็บอีกรุ่นไว้สำหรับคำขอที่จำเป็นต้องใช้ และปรับสัดส่วนเมื่อตัวเลขของคุณเปลี่ยน

ทดสอบจริง: Gemini 3.1 Pro Preview Custom Tools vs google/gemini-embedding-001 ในโหมด Battle

โหมดต่อสู้ — ลองทั้งสองแบบเทียบกันสด
เปิดใน playground
Google: Gemini 3.1 Pro Preview Custom Tools
$4.00 /M · p50 3241ms
google/gemini-embedding-001
$0.15 /M · p50 182ms

การกำหนดราคาและการวิเคราะห์ต้นทุน

โมเดลหนึ่งหรือทั้งสองนี้ไม่ได้เปิดเผยราคาต่อ token ที่นี่ (อาจเป็นโมเดลระดับฟรี คิดค่าบริการต่อการเรียก หรือยังไม่ได้กำหนดราคา)

อ่านบทวิเคราะห์ฉบับเต็ม

ดังนั้นให้ถือว่าคอลัมน์ต้นทุนเป็นค่าอ้างอิงและยืนยันอัตราแบบเรียลไทม์ในหน้าของแต่ละโมเดลก่อนตั้งงบประมาณจากมัน

ทั้งสองอัตราเป็นราคาดิบของผู้ให้บริการ — OrcaRouter ไม่บวกเพิ่ม ดังนั้นยอดประหยัดที่คุณคำนวณคือยอดที่คุณได้จริง

เริ่มใช้ฟรี

เปรียบเทียบราคาต่อโทเค็น

อินพุต $/ล้าน
Gemini 3.1 Pro Preview Custom Tools$4.00
google/gemini-embedding-001$0.15

ต่อ 1 ล้าน tokens

ความเร็วและความหน่วง

latency และ throughput ตัดสินว่าโมเดลให้ความรู้สึกอย่างไรในการใช้งานจริง latency การตอบสนองค่ามัธยฐาน (p50) คือระยะเวลาที่คำขอทั่วไปรอก่อน token แรก ส่วน throughput (token

อ่านบทวิเคราะห์ฉบับเต็ม

ต่อวินาที) กำหนดว่าคำตอบสตรีมเร็วแค่ไหนเมื่อเริ่มแล้ว สำหรับแชทเชิงโต้ตอบและลูป agent latency p50 ต่ำสำคัญที่สุดเพราะผู้ใช้กำลังรอ token แรกอยู่ ส่วนการสร้างแบบชุดและเอาต์พุตรูปแบบยาว throughput ครอบงำเวลารวมเพราะคำตอบยาว กราฟแนวโน้ม 7 วันด้านบนแสดงว่า latency ของแต่ละโมเดลคงที่หรือเลื่อนไหล ซึ่งเป็นสิ่งที่ตัวเลขเด่นเพียงตัวเดียวปิดบังไว้ — โมเดลที่มีค่าเฉลี่ยดีเยี่ยมแต่หางแกว่งก็ยังอาจพลาด p95 SLA ที่เข้มงวดได้ หากผลิตภัณฑ์ของคุณมีงบประมาณ latency ให้อ่านทั้งค่ามัธยฐานและรูปทรงของเส้นโค้ง และจำไว้ว่า latency แบบครบวงจรยังรวมถึงการกระโดดข้ามเครือข่ายของคุณและการดึงข้อมูลหรือการเรียกเครื่องมือใด ๆ ที่คุณทำรอบ ๆ โมเดลด้วย

ในช่วง 7 วันที่ผ่านมา google/gemini-embedding-001 รักษาความหน่วงในการตอบสนองมัธยฐานที่ต่ำกว่าไว้ได้

Gemini 3.1 Pro Preview Custom Tools
google/gemini-embedding-001

เบนช์มาร์กและคุณภาพ

คะแนน benchmark ประมาณความสามารถได้แต่ไม่ใช่สิ่งทดแทนการทดสอบบน prompt ของคุณเอง ดัชนีรวมที่แสดงที่นี่รวบรวมการประเมินสาธารณะหลายรายการ

อ่านบทวิเคราะห์ฉบับเต็ม

และเปอร์เซ็นไทล์บอกว่าแต่ละโมเดลอยู่ตรงไหนเมื่อเทียบกับทุกโมเดลที่เทียบเคียงได้ในแคตตาล็อก — เป็นสัญญาณคัดกรองที่มีประโยชน์ ไม่ใช่การรับประกันสำหรับงานของคุณ โมเดลที่นำในดัชนีความฉลาดทั่วไปก็ยังอาจตามหลังในโดเมนของคุณ (การเขียนโค้ด การสกัด หลายภาษา การให้เหตุผลบน context ยาว) ดังนั้นจงใช้ benchmark เพื่อจำกัดตัวเลือก แล้วรันทั้งสองโมเดลบนสไลซ์ทราฟฟิกที่เป็นตัวแทน จงใส่ใจกับดัชนีเฉพาะที่ตรงกับกรณีใช้งานของคุณ มากกว่าตัวเลขรวมบนสุด: ผลิตภัณฑ์ที่เน้นการเขียนโค้ดควรให้น้ำหนักกับดัชนีการเขียนโค้ด ส่วนผู้ช่วยวิจัยให้น้ำหนักกับดัชนีการให้เหตุผล benchmark ยังล้าสมัยลงเมื่อโมเดลได้รับการอัปเดต ดังนั้นจงถือว่ามันเป็นสมมติฐานตั้งต้นที่คุณยืนยันด้วยชุดประเมินของคุณเอง

Gemini 3.1 Pro Preview Custom Tools
68.8
AA Coding
ดีกว่า 75% ของโมเดลที่เปรียบเทียบ
อันดับ 30 จาก 138
29.7
AA Intelligence
ดีกว่า 62% ของโมเดลที่เปรียบเทียบ
อันดับ 52 จาก 141
google/gemini-embedding-001

ควรเลือกตัวไหน?

หากต้นทุนเป็นข้อจำกัดที่ผูกมัด ให้เริ่มด้วยโมเดลที่ถูกกว่าบนส่วนผสมขาเข้าต่อขาออกจริงของคุณ และขยับขึ้นเฉพาะเมื่อคุณภาพไม่ถึง หากความสามารถในการตอบสนองเป็นสิ่งสำคัญ —

อ่านบทวิเคราะห์ฉบับเต็ม

แชทที่เผชิญผู้ใช้ agent หรืออะไรก็ตามที่มีคนกำลังรอ — ให้น้ำหนัก latency p50 และ throughput เหนือส่วนต่างราคาเล็กน้อย หากคุณกำลังผลักงานให้เหตุผล การเขียนโค้ด หรือ context ยาวที่หนักที่สุด ให้ผู้ชนะด้าน benchmark และ context window เป็นตัวนำ และยอมรับอัตราที่สูงกว่าในจุดที่มันคุ้มค่า เนื่องจากทั้งสองโมเดลอยู่หลัง API เดียวกัน การเคลื่อนไหวที่มีความเสี่ยงต่ำคือกำหนดเส้นทางทราฟฟิกจริงส่วนหนึ่งไปยังแต่ละโมเดลและเปรียบเทียบต้นทุน latency และคุณภาพคำตอบบน prompt ของคุณเองก่อนตัดสินใจ รูปแบบที่พบบ่อยคือการแบ่งชั้น (tier): ส่งคำขอที่ง่ายและปริมาณสูงส่วนใหญ่ไปยังโมเดลที่ถูกกว่าหรือเร็วกว่า และสงวนโมเดลที่แข็งแกร่งกว่าไว้สำหรับคำขอที่ต้องการมันจริง ๆ ซึ่งจะเก็บเกี่ยวข้อได้เปรียบด้านคุณภาพส่วนใหญ่ด้วยต้นทุนเพียงเศษเสี้ยว ไม่ว่าคุณจะเลือกอันไหน จงทำให้การสลับย้อนกลับได้ — คุณสามารถย้ายทราฟฟิกกลับได้ทันทีที่ตัวเลขหรือความต้องการของคุณเปลี่ยนไป

หรือไม่ต้องเลือกเลย — กระจายทีละคำขอไปยังทั้งสองตัว ด้วยคีย์เดียวและบิลเดียว

รับทั้งสองรุ่น

เหมาะที่สุดสำหรับ

  • อ่อนไหวต่อต้นทุน ปริมาณสูงgoogle/gemini-embedding-001
  • แชทและเอเจนต์ที่ต้องการความหน่วงต่ำgoogle/gemini-embedding-001
  • การให้เหตุผลและการเขียนโค้ดที่ยากที่สุดGemini 3.1 Pro Preview Custom Tools

คำถามที่พบบ่อย Gemini 3.1 Pro Preview Custom Tools vs google/gemini-embedding-001

Gemini 3.1 Pro Preview Custom Tools หรือ google/gemini-embedding-001 ตัวไหนถูกกว่า?
google/gemini-embedding-001 ถูกกว่าในด้าน tokens อินพุตที่ $0.15 ต่อ 1 ล้าน เทียบกับ $4.00 ต่อ 1 ล้าน
ตัวไหนเร็วกว่า Gemini 3.1 Pro Preview Custom Tools หรือ google/gemini-embedding-001?
google/gemini-embedding-001 มีความหน่วงในการตอบสนองมัธยฐาน (p50) ที่ต่ำกว่าในการวัดแบบเรียลไทม์ของ OrcaRouter
อันไหนทำคะแนน benchmark ได้สูงกว่า Gemini 3.1 Pro Preview Custom Tools หรือ google/gemini-embedding-001?
Gemini 3.1 Pro Preview Custom Tools นำในดัชนีคุณภาพรวมที่แสดงด้านบน แต่ความได้เปรียบด้าน benchmark ไม่ได้ถ่ายทอดไปยังโดเมนเฉพาะเสมอไป — ตรวจสอบบน prompt ของคุณเองก่อนกำหนดเป็นมาตรฐาน
ฉันควรใช้ Gemini 3.1 Pro Preview Custom Tools หรือ google/gemini-embedding-001?
เลือก Gemini 3.1 Pro Preview Custom Tools หรือ google/gemini-embedding-001 ตามลำดับความสำคัญของคุณ: ต้นทุน หน้าต่างบริบท ความหน่วง หรือคุณภาพ benchmark ตารางด้านบนแสดงว่าโมเดลใดชนะในแต่ละด้าน ให้จับคู่ผู้ชนะกับมิติที่สำคัญที่สุดสำหรับภาระงานของคุณ
Gemini 3.1 Pro Preview Custom Tools และ google/gemini-embedding-001 คิดค่าบริการอย่างไรบน OrcaRouter?
ทั้งคู่คิดค่าบริการตามอัตราของผู้ให้บริการต้นทางโดยไม่มีการบวกเพิ่มค่า token ใด ๆ — คุณจ่ายราคาต่อ token เท่ากับที่คุณจะจ่ายให้ผู้ให้บริการโดยตรง ผ่านคีย์ API และ endpoint ของ OrcaRouter เพียงหนึ่งเดียว
ฉันสามารถเรียกทั้ง Gemini 3.1 Pro Preview Custom Tools และ google/gemini-embedding-001 ด้วยโค้ดเดียวกันได้ไหม?
ได้ ทั้งคู่เปิดให้ใช้ผ่าน API แบบ OpenAI-compatible ของ OrcaRouter ดังนั้นคุณเปลี่ยนเพียงชื่อโมเดลเพื่อกำหนดเส้นทางระหว่างทั้งสอง — ไม่ต้องเปลี่ยน SDK ไม่ต้องมีข้อมูลรับรองแยกต่างหาก

เริ่มด้วย Gemini 3.1 Pro Preview Custom Tools หรือ google/gemini-embedding-001

คีย์เดียว ทั้งสองรุ่น ผู้ให้บริการกว่า 40 ราย

คิดค่าบริการตามราคาผู้ให้บริการโดยไม่บวกเพิ่มค่าโทเคน เริ่มฟรี ใช้ทั้งสองตัวจากบัญชีเดียว และย้อนกลับการตัดสินใจได้เสมอ

สร้างบัญชีฟรี