
Gemini 3.7 Flash Đã Ra Mắt: Nửa Giá, Ngữ Cảnh 1M, và Những Gì Thực Sự Được Xác Nhận
- grokMỚISpaceXAI: Grok 4.62026-08-1261Trí tuệ77Lập trình
- metaMỚIMeta: Muse Spark 1.22026-08-0557Trí tuệ72Lập trình
- qwenMỚIQwen: Qwen3.8 Max2026-08-0358Trí tuệ72Lập trình
- deepseekMỚIDeepSeek: DeepSeek V4 Flash 07312026-07-3152Trí tuệ69Lập trình
- minimaxMỚIMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token · 2190 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2152Trí tuệ69Lập trình
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Trí tuệ49Lập trình
- metaMeta: Muse Spark 1.12026-07-1653Trí tuệ71Lập trình
- kimiMoonshotAI: Kimi K32026-07-1560Trí tuệ76Lập trình
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Trí tuệ71Lập trình
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Trí tuệ77Lập trình
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Trí tuệ77Lập trình
- grokxAI: Grok 4.52026-07-0856Trí tuệ72Lập trình
- tencentTencent: Hy32026-07-0642Trí tuệ59Lập trình
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Trí tuệ42Lập trình
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Trí tuệ39Lập trình
- anthropicAnthropic: Claude Sonnet 52026-06-3055Trí tuệ72Lập trình
Gemini 3.7 Flash đã có mặt. Google đã phát hành mô hình tiếp theo trong phân khúc Flash vào ngày 13 tháng 8 năm 2026 — chỉ ba tuần sau Gemini 3.6 Flash — và công bố mức giá $0.75 cho mỗi triệu token đầu vào và $3.75 cho mỗi triệu token đầu ra, chính xác bằng một nửa so với mức $1.50/$7.50 của Gemini 3.6 Flash. Tín hiệu rò rỉ mà blog này theo dõi một tuần trước đã hóa ra chính xác ở mọi điểm quan trọng: mô hình là có thật, tên "3.7" được giữ nguyên trong ID mô hình chính thức, và mức giá một nửa được đồn đoán chính là mức giá được công bố.
Gemini 3.7 Flash là mô hình đa phương thức mà thẻ mô hình của Google mô tả là mô hình Flash mới nhất và mạnh nhất của họ, được xây dựng cho lập trình phức tạp, quy trình làm việc tác tử và thực thi đa bước đáng tin cậy. Thông điệp ra mắt của Google nhấn mạnh vào những cải thiện về lập trình, công việc tri thức và phát triển web — những tuyên bố của nhà cung cấp sẽ được xem xét bên dưới — trong khi các thông số kỹ thuật đã được ghi nhận: cùng một cửa sổ ngữ cảnh 1 triệu token mà phân khúc Flash đã chuẩn hóa, đầu ra 64K token, và được cung cấp qua Gemini API (bao gồm Google AI Studio), Google Antigravity, Gemini Enterprise và Gemini Spark cho các thuê bao AI Pro và Ultra. Mô hình này là gì, chi phí bao nhiêu và chạy ở đâu giờ đã được ghi nhận; câu hỏi còn bỏ ngỏ là nó thực sự mang lại điều gì.
Một nguyên tắc kỷ luật từ việc đưa tin về rò rỉ được áp dụng trực tiếp vào bài phát hành: các tuyên bố về hiệu suất của Google chỉ do nhà cung cấp báo cáo cho đến khi có phép đo độc lập xác nhận. Con số độc lập đầu tiên xuất hiện trong vòng một ngày — Artificial Analysis chấm Gemini 3.7 Flash 56 điểm trên Chỉ số Trí tuệ ở mức suy luận cao, cao hơn 4 điểm so với mức 52 mà Gemini 3.6 Flash đạt được khi ra mắt và, theo AA, nằm trên biên giới Pareto giữa trí tuệ và tốc độ. Các con số điểm chuẩn của chính Google về lập trình, công việc tri thức và phát triển web vẫn chỉ là lời của nhà cung cấp. Hãy coi giá, cửa sổ ngữ cảnh và tính khả dụng là sự thật. Hãy coi những chênh lệch về hiệu suất là những lời hứa đang được kiểm chứng.
Từ rò rỉ đến ra mắt: những tín hiệu đã được kiểm chứng
Vì mô hình này lần đầu tiên được theo dõi tại đây như một rò rỉ chưa được xác minh, nên cần ghi lại cách rò rỉ đó phát triển — đó là sự khác biệt giữa một tin đồn và một khuôn mẫu mà tầng Flash hiện đã chứng minh nhiều lần.
• Bài đăng ngày 7 tháng 8 trên X từ @chetaslua cho biết công tác chuẩn bị cho Gemini 3.7 Flash đã "đâu vào đấy về phía họ," nhưng không nêu ngày cụ thể. Sáu ngày sau, mô hình đã được ra mắt. Nhận định "sớm hơn là muộn" hóa ra là đúng.
• Các tham chiếu từ ngày 7-8 tháng 8 tới gemini-3.7-flash bên trong Python GenAI SDK của chính Google trên GitHub đã trỏ tới một ID mô hình thực — ID tương tự hiện đang có trong Gemini API.
• Báo cáo ngày 13 tháng 8 rằng Gemini 3.7 Flash đã được đưa lên Gemini Enterprise ở trạng thái ẩn với khả năng phát hành ngay trong cùng ngày là chính xác về ngày, và mức giá $0.75/$3.75 được đồn đoán cũng chính xác về giá.
Không điều nào trong số đó khiến việc đưa tin về rò rỉ trở nên thừa thãi — những tín hiệu tương tự này có thể đã chỉ ra "trì hoãn" hoặc "đổi tên." Nhưng một phân khúc phát hành nhanh như vậy, âm thầm như vậy và rẻ như vậy chính là lý do vì sao Google tiếp tục làm những việc thú vị nhất của mình trong Flash.
Điều gì đã được xác nhận so với điều gì vẫn chỉ là tuyên bố?
Giờ khi mô hình đã hoạt động, bảng theo dõi từ bài rò rỉ đã đảo ngược: phần lớn những gì được "báo cáo" đã chuyển sang cột xác nhận, và độ không chắc chắn còn lại nằm ở hiệu suất, chứ không phải ở sự tồn tại.
• Đã xác nhận — Google đã công bố thẻ mô hình Gemini 3.7 Flash; mô hình có sẵn thông qua Gemini API, Google AI Studio, Google Antigravity, Gemini Enterprise và Gemini Spark; mức giá được công bố là $0.75/$3.75 mỗi triệu token cho đến hết ngày 31 tháng 12 năm 2026; cửa sổ ngữ cảnh là 1M token với đầu ra 64K token.
• Được đo lường độc lập — Artificial Analysis đã đưa Gemini 3.7 Flash vào bảng xếp hạng Intelligence Index của mình trong vòng một ngày sau khi ra mắt: 56 ở mức suy luận cao (53 ở mức trung bình, 51 ở mức thấp), cao hơn bốn điểm so với 52 mà Gemini 3.6 Flash đạt được khi ra mắt, với những mức tăng mà AA chủ yếu quy cho các đánh giá tác nhân.
• Theo báo cáo của nhà cung cấp — số liệu đánh giá của chính Google cho các trường hợp sử dụng chính: 43,6% trên FrontierCode 1.1 (tăng từ 34,4%), 65,3% trên DeepSWE v1.1, Elo 1588 trong đấu trường phát triển web mà Google cho biết xếp hạng #1, 34,0% trên GDP.pdf, và 30,4% trên AutomationBench. Đây là các con số của Google cho đến khi bên ngoài xác nhận lại.
• Chưa rõ — liệu Google có gia hạn mức giá giới thiệu sau ngày 31 tháng 12 năm 2026 hay không (mức giá sẽ tăng gấp đôi lên 1,50 USD / 7,50 USD vào ngày 1 tháng 1 năm 2027), liệu những lợi ích đạt được có thay đổi cách tính toán vốn khiến Gemini 3.5 Pro chưa được phát hành hay không, và mô hình hoạt động ra sao trên các khối lượng công việc mà nhà cung cấp không quảng cáo.
Để có bối cảnh về những tuyên bố "vượt trội hơn Gemini 3.6 Flash" đó, đây là đường cơ sở độc lập mà Google đang được đo lường dựa trên:

Chỉ số Artificial Analysis Intelligence Index được đo lường độc lập của Gemini 3.6 Flash là 52 (xếp hạng #26 trong số 185 mô hình khi ra mắt) và mức giá đầu vào $1.50/1M của nó là những con số mà Gemini 3.7 Flash phải vượt qua — và mức giá 3.7 đã thấp hơn một nửa so với giá đầu vào của 3.6 trước khi bất kỳ so sánh hiệu suất nào bắt đầu.
Tại sao giá lại là tiêu đề
Việc giảm giá một nửa là phần quan trọng nhất của đợt ra mắt này, và phép tính rất đơn giản. Với khối lượng công việc 1 triệu token đầu vào / 1 triệu token đầu ra, Gemini 3.6 Flash có giá $1.50 cộng $7.50, tức $9.00. Gemini 3.7 Fl{{1}}ash{{/1}} ở mức giá đã công bố là $0.75 cộng $3.75, tức $4.50 — giảm 50% trên cùng khối lượng, và nếu những cải thiện hiệu quả mà Go{{2}}ogle{{/2}} tuyên bố được giữ vững, chi phí thực tế cho mỗi tác vụ hoàn thành sẽ còn giảm sâu hơn nữa.
Hai lưu ý đáng để ghi lại. Thứ nhất, mức giá $0.75/$3.75 là mức giá giới thiệu và có thời hạn: Google đã xác nhận mức giá này có hiệu lực đến hết ngày 31 tháng 12 năm 2026, và sẽ tăng gấp đôi lên $1.50/$7.50 vào ngày 1 tháng 1 năm 2027. Thứ hai, một số nền tảng hiện đang chạy chương trình giá khuyến mãi thấp hơn mức giá đã công bố, vì vậy hãy kiểm tra giá trực tiếp tại thời điểm gọi để biết bạn thực sự phải trả bao nhiêu — mức giá công bố là mức sàn đáng tin cậy, nhưng đó là một mức sàn có ngày hết hạn.
Bối cảnh Gemini 3.5 Pro vẫn còn quan trọng.
Gemini 3.5 Pro hàng đầu của Google vẫn chưa được phát hành tính đến ngày 14 tháng 8 năm 2026 — nhiều tháng sau I/O, với việc Bloomberg đưa tin vào giữa tháng 7 rằng nó bị chậm tiến độ do khả năng mã hóa và các báo cáo sau đó mô tả việc trượt hạn chót nội bộ. Dòng Flash tiếp tục mang lại giá trị trong khi dòng Pro đình trệ, đó là lý do tại sao một Flash nhanh hơn với giá bằng nửa giá là một sự kiện lớn hơn một bản phát hành điểm thông thường: đó là bằng chứng cho thấy dòng sản phẩm chủ lực của Google chính là nơi công ty thực sự cạnh tranh.
Đừng nhầm lẫn nó với Qwen 3.7 Flash
Both "3.7 Flash" models now exist as shipped models, and they could not be more different.
• Gemini 3.7 Flash — Google's new Flash-tier model at $0.75/$3.75 per million tokens, 1M context, multimodal, announced August 13, 2026.
• Qwen 3.7 Flash — Alibaba's vision-language model that shipped quietly in late July 2026 at roughly $0.03/$0.13 per million tokens with a 1M context window, aimed at multimodal agents and computer-use tasks.
The price gap alone — roughly 25x on input tokens — separates them, and the vendor does too. When someone says "I'm running 3.7 Flash," the first question is still which one.
Should you move from Gemini 3.6 Flash?
The honest answer splits in two. For cost, the announced half-price is a real lever: if you pay meaningful volume on Gemini 3.6 Flash, the same workload on Gemini 3.7 Flash costs half as much on tokens, before any claimed efficiency gains. That is a switch worth modeling on your own call patterns. For trust, the picture improved within a day of launch — the independent Artificial Analysis Index is already in at 56 versus 3.6 Flash's 52 — but the specific coding, knowledge-work, and web-development deltas Google is selling are still vendor-reported, and Gemini 3.6 Flash remains the stable, documented default. The standard play is to keep a proven model as the default and route a slice of traffic to the new one, comparing quality on your own tasks.
Neither move requires a project if you are on a routing layer. Gemini 3.6 Flash and Gemini 3.5 Flash are both available today through a single OpenAI-compatible endpoint on OrcaRouter at provider list price with no markup — so a Google price cut anywhere in the tier shows up on our side the same day, and a later switch from one Flash model to another is a model-name change rather than an integration. Automatic failover is the pattern for evaluating a just-shipped model however it is served: point a slice of real traffic at it, let the router fall back to a proven model on errors, rate limits, or obvious quality regressions, and keep the old model as the safety net until the new one earns the traffic. The routing DSL and model fusion let you compose the new model with others in a single call, so testing it against your own workload is a configuration change.
Xem gì tiếp theo
• The next independent check — Artificial Analysis has already published its Intelligence Index (56 at high reasoning), so the open question has moved from "is the gain real" to whether Google's coding and web-development benchmark claims survive external reproduction and hold up on your own workloads.
• The price — the $0.75/$3.75 rate is now a dated fact: it holds through December 31, 2026, then doubles. Watch whether Google extends it, and whether third-party promotional pricing normalizes to it.
• Gemini 3.5 Pro — if Google's flagship finally ships, the "Flash is where Google delivers" framing of the past month may shift.
Câu hỏi thường gặp
Gemini 3.7 Flash đã được phát hành chưa?
Yes — on August 13, 2026. Google has published a Gemini 3.7 Flash model card describing it as its latest and most capable Flash model, the gemini-3.7-flash ID is served through the Gemini API, and Google lists it across Google AI Studio, Google Antigravity, Gemini Enterprise, and Gemini Spark. This is the model whose preparation was reported here as a leak on August 7.
How much does Gemini 3.7 Flash cost?
$0.75 per million input tokens and $3.75 per million output at the announced introductory price — half of Gemini 3.6 Flash's $1.50/$7.50, per Google's announcement. The rate is confirmed through December 31, 2026, and doubles to $1.50/$7.50 on January 1, 2027. Some platforms currently run promotional pricing below the announced rate, so the live rate at the point of call is what you will pay.
Should I upgrade from Gemini 3.6 Flash to Gemini 3.7 Flash?
The price is half and the first independent score is in — Artificial Analysis Index 56 at high reasoning, up from 3.6 Flash's 52 — but Google's headline coding, knowledge-work, and web-development deltas are still vendor-reported. Standard practice: keep Gemini 3.6 Flash as the default, evaluate Gemini 3.7 Flash on your own workload with failover, and switch when it earns the traffic.
Gemini 3.7 Flash is the Flash tier doing exactly what the Flash tier does — shipping fast, shipping cheaper, and this time arriving with an independent score that beats its predecessor. The leak was right about the name, the date, and the price; the performance claims are still under test. If cost-per-task is your lever, the half-price makes Gemini 3.7 Flash worth benchmarking today. If stability is your priority, Gemini 3.6 Flash remains the proven choice — and moving later is a model-name change, not a project.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
