Gemini 3.5 Flash

google/gemini-3.5-flash
การมองเห็นเสียงเครื่องมือJSONการให้เหตุผล
โดย google · 2026-05-23

Google Gemini 3.5 Flash — โมเดลระดับ Flash ที่แข็งแกร่งที่สุดของ Google อยู่รองจาก 3.1-pro-preview เพียงเล็กน้อยในด้านความฉลาด (AA Intel 55.3 เทียบกับ 57.2) ด้วยความหน่วงแบบ Flash หน้าต่างบริบท 1M โทเค็น (1,048,576), 64K เอาต์พุตสูงสุด (65,536) รองรับอินพุตแบบมัลติโมดัลเต็มรูปแบบทั้งข้อความ รูปภาพ เสียง วิดีโอ และไฟล์; เอาต์พุตเป็นข้อความเท่านั้น AA Coding 45, GPQA Diamond 92.2%, IFBench 76.3% (การปฏิบัติตามคำแนะนำระดับสูง), Long-Context Recall 69.3%, SciCode 53.1%, τ²-Bench 95.3% (การใช้เครื่องมือแบบเอเจนต์), HLE 41% รองรับการให้เหตุผล (include_reasoning / reasoning), เอาต์พุตที่มีโครงสร้าง, การเรียกใช้เครื่องมือ, response_format, seed, stop, และการควบคุมการสุ่มตัวอย่างมาตรฐาน เอนด์พอยต์: chat_completions, gemini_generate เหมาะที่สุดสำหรับ: ลูปเอเจนต์ปริมาณมาก, การวิเคราะห์เอกสารยาว, และการสกัดมัลติโมดัลที่ความหน่วงหรือต้นทุนระดับ Pro มากเกินไป

ctx1.05M โทเค็น
เอาต์พุตสูงสุด65.5K
อินพุตtext + image + video + file + audio
เอาต์พุตtext
p50 TTFT2.51 s
INPUT$1.50/ 1M โทเค็น
OUTPUT$9.00/ 1M โทเค็น
p50 TTFT2.51 s7 วัน
p95 TTFT8.59 s7 วัน
ทราฟฟิก1.1Mโทเค็น / 7วัน
รับ API ของ Gemini 3.5 Flash ลองใน playground</> ใช้ผ่าน API

Gemini 3.5 Flash เป็นโมเดลภาษาขนาดใหญ่ที่พัฒนาโดย Google ซึ่งถูกปรับแต่งมาเพื่อความเร็วและประสิทธิภาพ โดยเป็นส่วนหนึ่งของตระกูล Gemini และถูกออกแบบมาให้รองรับอินพุตแบบมัลติโมดัล ได้แก่ ข้อความ รูปภาพ…

Gemini 3.5 Flash คืออะไร?

ใครควรใช้ Gemini 3.5 Flash?

Gemini 3.5 Flash รองรับรูปแบบการป้อนข้อมูลใดบ้าง?

Gemini 3.5 Flash เข้าถึงผ่าน OrcaRouter ได้อย่างไร?

ตัวอย่างโค้ด

เรียกใช้จาก SDK ใดก็ได้

เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

พารามิเตอร์ที่รองรับ

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

ราคา

อินพุต / 1M โทเค็น$1.50
เอาต์พุต / 1M โทเค็น$9.00
อ่านแคช / 1M$0.150
เขียนแคช / 1M$0.083
สกุลเงินUSD

เครื่องคำนวณค่าใช้จ่าย

โทเค็น / เดือน10MM
สัดส่วนอินพุต70%%
ประมาณ / เดือน $37.50 · เมื่อใช้แคชพรอมป์ต์ $32.78

ประมาณการจากราคาตั้ง

เครื่องมือประเมิน token และค่าใช้จ่าย

token อินพุต: 13ค่าใช้จ่ายต่อคำขอ: $0.004520

เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ

ประสิทธิภาพ

p50 TTFT
2.51 s
ความเร็วเอาต์พุต
664 tok/s
p95 TTFT
8.59 s
อัตราข้อผิดพลาด
0.92%

เกณฑ์มาตรฐานสาธารณะ

70.1
AA Coding
ดีกว่า 88% ของโมเดลที่เปรียบเทียบ
อันดับ 15 จาก 120
50.2
AA Intelligence
ดีกว่า 83% ของโมเดลที่เปรียบเทียบ
อันดับ 21 จาก 122
51.0
AA Math
ดีกว่า 27% ของโมเดลที่เปรียบเทียบ
อันดับ 59 จาก 81
GPQA Diamond
92.2
Humanity's Last Exam
41.0
IFBench
76.3
Long-Context Recall
69.3
MMLU-Pro
59.0 index
SciCode
53.1
tau_banking
25.4
TerminalBench Hard
40.9
terminalbench_v2_1
78.7
τ²-Bench
95.3
แหล่งที่มา: artificialanalysis.ai

การเปรียบเทียบ

Gemini 3.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
อินพุต $/ล้าน$1.50$2.00$4.00$0.50
เอาต์พุต $/ล้าน$9.00$12.00$18.00$3.00
บริบท1.0M1.0M1.0M1.0M
คุณภาพ9/1010/1010/109/10
เปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกัน

เพิ่มเติมจาก google

FAQ

ราคา Gemini 3.5 Flash บน OrcaRouter เท่าไหร่?
โทเค็นอินพุตมีค่าใช้จ่าย $1.50 ต่อ 1 ล้านโทเค็น; โทเค็นเอาต์พุตมีค่าใช้จ่าย $9.00 ต่อ 1 ล้านโทเค็น OrcaRouter คิดค่าบริการตามอัตราของผู้ให้บริการโดยไม่มีมาร์กอัป ไม่มีค่าธรรมเนียมเพิ่มเติม
ขนาดหน้าต่างบริบทของ Gemini 3.5 Flash คือเท่าใด
รองรับหน้าต่างบริบทขนาด 1,048,576 โทเคน (ประมาณ 1 ล้านโทเคน) ซึ่งรวมทั้งโทเคนอินพุตและเอาต์พุตเข้าไว้ด้วยกัน
จุดแข็งหลักของ Gemini 3.5 Flash คืออะไร?
มันถูกปรับแต่งให้เหมาะสำหรับค่า latency ต่ำ, throughput สูง, และประสิทธิภาพด้านต้นทุน มันรองรับอินพุตแบบ multimodal (ข้อความ, รูปภาพ, วิดีโอ, ไฟล์, เสียง) และหน้าต่างบริบทขนาดใหญ่ ทำให้เหมาะสำหรับแอปพลิเคชันแบบเรียลไทม์และการประมวลผลเอกสารยาว
Gemini 3.5 Flash เปรียบเทียบกับ Gemini 3.5 Pro อย่างไร?
Flash เร็วกว่าและถูกกว่า แต่มีประสิทธิภาพด้านการวัด benchmark ที่ต่ำกว่าในการทำงานที่ซับซ้อนด้านการใช้เหตุผลและคณิตศาสตร์ ส่วน Pro มีความแม่นยำมากกว่าแต่ช้าและแพงกว่า Flash เหมาะกับแอปพลิเคชันที่ต้องการปริมาณสูงและไวต่อความหน่วง
เมื่อใช้ Gemini 3.5 Flash ผ่าน OrcaRouter ข้อมูลจะถูกจัดการอย่างไร?
OrcaRouter ทำหน้าที่เป็นพร็อกซีและไม่จัดเก็บข้อมูลของคุณ อย่างไรก็ตาม นโยบายการจัดการข้อมูลของ Google มีผลกับโมเดลพื้นฐาน OrcaRouter แนะนำให้ตรวจสอบข้อกำหนดของ Google เกี่ยวกับการเก็บรักษาข้อมูลและความเป็นส่วนตัว
ฉันจะเรียกใช้ Gemini 3.5 Flash โดยใช้ API ที่เข้ากันได้กับ OpenAI ได้อย่างไร
ใช้ base URL https://api.orcarouter.ai/v1, model ID "google/gemini-3.5-flash", และส่ง OrcaRouter API key ในส่วนหัว Authorization API รองรับการแชทแบบมาตรฐานและการสตรีม
Gemini 3.5 Flash สามารถสร้างความยาวเอาต์พุตได้เท่าใด
มันสามารถสร้างได้สูงสุด 65,536 โทเคนต่อการตอบกลับ ซึ่งมากกว่าโมเดลหลายตัวอย่างมีนัยสำคัญ ทำให้สามารถสร้างเนื้อหาแบบยาว โค้ด หรือการให้เหตุผลที่ขยายความได้
มีส่วนลดสำหรับโทเค็นที่ถูกใช้ซ้ำหรือถูกแคชหรือไม่?
จากข้อเท็จจริงที่ให้มา OrcaRouter ไม่มีการเสนอแคชหรือส่วนลดตามปริมาณ แต่ละโทเคนจะถูกเรียกเก็บเงินในอัตรามาตรฐานโดยไม่คำนึงถึงการใช้งานซ้ำ

ฝังป้ายนี้

Gemini 3.5 Flash$1.50/M in2509ms p50ผ่าน OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg" alt="Gemini 3.5 Flash บน OrcaRouter" /> </a>
Markdown [![Gemini 3.5 Flash](https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.5-flash)

ข้อมูลโมเดลแบบ data

GET /api/public/models/google/gemini-3.5-flashเปิด
อ่านได้ด้วยเครื่อง:/llms.txt/llms-full.txt