Gemma 4 31B

google/gemma-4-31b-it
โดย Google · 2026-04-02

Gemma 4 31B Instruct เป็นโมเดล multimodal แบบหนาแน่นของ Google DeepMind ขนาด 30.7B พารามิเตอร์ รองรับการป้อนข้อความและรูปภาพพร้อมผลลัพธ์เป็นข้อความ มีหน้าต่างบริบทขนาด 256K โทเค็น โหมดคิด/ให้เหตุผลที่ปรับแต่งได้ ฟังก์ชันดั้งเดิม...

เอนด์พอยต์:/v1/chat/completions
p50 TTFT1.22 s
INPUT$0.13/ 1M โทเค็น
OUTPUT$0.38/ 1M โทเค็น
p50 TTFT1.22 s7 วัน
p95 TTFT3.84 s7 วัน
ทราฟฟิก74.4Kโทเค็น / 7วัน
รับ API ของ Gemma 4 31B →▶ ลองใน playground</> ใช้ผ่าน API

Google Gemma 4 31B เป็นตัวแปรที่ปรับแต่งตามคำสั่งของตระกูล Gemma 4 พัฒนาโดย Google มีพารามิเตอร์ประมาณ 31 พันล้านตัว และได้รับการปรับให้เหมาะสมสำหรับงานสนทนาและการปฏิบัติตามคำสั่ง…

Google Gemma 4 31B คืออะไรกันแน่

ใครควรใช้โมเดลนี้

OrcaRouter ส่งมอบโมเดลนี้อย่างไร?

คะแนน GPQA Diamond มีความสำคัญอย่างไร

ตัวอย่างโค้ด

เรียกใช้จาก SDK ใดก็ได้

เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemma-4-31b-it",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

ราคา

ราคา
อินพุต / 1M โทเค็น$0.130
เอาต์พุต / 1M โทเค็น$0.380
อ่านแคช / 1M$0.020
สกุลเงินUSD

เครื่องคำนวณค่าใช้จ่าย

โทเค็น / เดือน10MM
สัดส่วนอินพุต70%%
ประมาณ / เดือน $2.05 · เมื่อใช้แคชพรอมป์ต์ $1.67

ประมาณการจากราคาตั้ง

เครื่องมือประเมิน token และค่าใช้จ่าย

token อินพุต: 13ค่าใช้จ่ายต่อคำขอ: $0.000192

เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ

ประสิทธิภาพ

p50 TTFT
1.22 s
ความเร็วเอาต์พุต
36.7 tok/s
p95 TTFT
3.84 s
อัตราข้อผิดพลาด
67.3%

เกณฑ์มาตรฐานสาธารณะ

43.4
AA Coding
ดีกว่า 45% ของโมเดลที่เปรียบเทียบ
อันดับ 76 จาก 138
14.7
AA Intelligence
ดีกว่า 20% ของโมเดลที่เปรียบเทียบ
อันดับ 117 จาก 147
65.9
AA Math
ดีกว่า 54% ของโมเดลที่เปรียบเทียบ
อันดับ 38 จาก 82
GPQA Diamond
85.7
Humanity's Last Exam
23.6
IFBench
75.6
Long-Context Recall
69.7
MMLU-Pro
72.9 index
SciCode
45.5
tau_banking
14.8
TerminalBench Hard
36.4
terminalbench_v2_1
43.4
τ²-Bench
59.9
แหล่งที่มา: artificialanalysis.ai

กระแสในชุมชน

สิ่งที่นักพัฒนาพูดถึงในสัปดาห์นี้

Hacker News0 การกล่าวถึง · 7 วัน

การเปรียบเทียบ

Gemma 4 31BGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
อินพุต $/ล้าน$0.13$2.00$4.00$0.50
เอาต์พุต $/ล้าน$0.38$12.00$18.00$3.00
บริบท—1.0M1.0M1.0M
คุณภาพ—10/1010/109/10
เปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกัน

เพิ่มเติมจาก Google

FAQ

ค่าใช้จ่ายต่อโทเค็นสำหรับ Gemma 4 31B ผ่าน OrcaRouter คือเท่าไร
โทเคนอินพุตราคา $0.13 ต่อ 1 ล้านโทเคน และโทเคนเอาต์พุตราคา $0.38 ต่อ 1 ล้านโทเคน ไม่มีการบวกเพิ่ม นี่คืออัตราจากผู้ให้บริการที่แน่นอน
ขนาดหน้าต่างบริบทของ Gemma 4 31B คืออะไร
ไม่มีการระบุขนาดหน้าต่างบริบทในข้อเท็จจริงที่ให้มา กรุณาอ้างอิงเอกสารทางการของ Google สำหรับจำนวนโทเคนสูงสุดที่แน่นอน
จุดแข็งหลักของ Gemma 4 31B คืออะไร?
จากข้อเท็จจริงที่ให้มา มันได้คะแนน GPQA Diamond ที่ 85.7% ซึ่งบ่งชี้ถึงการให้เหตุผลระดับบัณฑิตศึกษาที่แข็งแกร่ง นอกจากนี้ยังมีราคาที่คุ้มค่าสำหรับโมเดลที่มี 31B พารามิเตอร์
Gemma 4 31B เปรียบเทียบกับโมเดลที่มีขนาดใกล้เคียงกันอย่างไร?
ไม่มีเกณฑ์มาตรฐานโดยตรงที่เปรียบเทียบกับโมเดลอื่นๆ อย่างไรก็ตาม คะแนน GPQA ของมันบ่งชี้ว่ามีความสามารถในการตอบคำถามระดับผู้เชี่ยวชาญ ผู้ใช้ควรทดสอบกับงานของตนเอง
OrcaRouter ปฏิบัติตามแนวทางปฏิบัติในการจัดการข้อมูลใดบ้าง
การจัดการข้อมูลของ OrcaRouter ไม่ได้ระบุรายละเอียดในข้อเท็จจริงที่ให้มา สำหรับนโยบายความเป็นส่วนตัวและการเก็บรักษาข้อมูล โปรดดูข้อกำหนดในการให้บริการและนโยบายความเป็นส่วนตัวของ OrcaRouter
ฉันจะเรียกใช้ Gemma 4 31B โดยใช้ OpenAI SDK ได้อย่างไร
ตั้งค่า base URL เป็น https://api.orcarouter.ai/v1 ใช้ OrcaRouter API key ของคุณ และระบุ model ID "google/gemma-4-31b-it" วิธีการ chat completion ของ SDK ทำงานได้โดยตรง
มีการแคชหรือส่วนลดสำหรับโทเค็นที่ใช้ซ้ำหรือไม่?
ไม่มีกล่าวถึงการแคชหรือส่วนลดตามปริมาณในข้อเท็จจริงที่ให้ไว้ ตรวจสอบเอกสารของ OrcaRouter สำหรับฟีเจอร์การปรับต้นทุนที่เป็นไปได้
ทำไมฉันถึงเลือก Gemma 4 9B แทนโมเดล 31B นี้?
หากงานของคุณเป็นงานง่ายและไม่ต้องการการให้เหตุผลที่แข็งแกร่งตามที่วัดโดย GPQA Diamond โมเดล 9B จะถูกกว่าและเร็วกว่า ส่วนโมเดล 31B เหมาะที่สุดสำหรับการทำตามคำแนะนำที่ซับซ้อนและคำถามระดับผู้เชี่ยวชาญ
OrcaRouter รองรับการตอบกลับแบบสตรีมมิ่งสำหรับโมเดลนี้หรือไม่
ใช่ API ที่เข้ากันได้กับ OpenAI ของ OrcaRouter รองรับการสตรีม (set stream=True in the request) ซึ่งทำงานเหมือนกับโมเดล OpenAI

ฝังป้ายนี้

Google: Gemma 4 31B•$0.13/M in•1222ms p50•ผ่าน OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemma-4-31b-it" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemma-4-31b-it.svg" alt="Google: Gemma 4 31B บน OrcaRouter" /> </a>
Markdown [![Google: Gemma 4 31B](https://www.orcarouter.ai/embed/google/gemma-4-31b-it.svg)](https://www.orcarouter.ai/models/google/gemma-4-31b-it)

ข้อมูลโมเดลแบบ data

GET /api/public/models/google/gemma-4-31b-itเปิด
อ่านได้ด้วยเครื่อง:/llms.txt/llms-full.txt