Thẻ tiêu đề cho phần so sánh GPT-5.3 Codex Spark với GPT-5.6 Sol, hiển thị hai thẻ bo tròn: thẻ trái có nhãn GPT-5.3 Codex Spark với biểu tượng tia sét, ghi 1.000+ tok/s bản xem trước nghiên cứu với biểu ngữ ghi chưa có giá API công khai, và thẻ phải có nhãn GPT-5.6 Sol với biểu tượng khiên, ghi $5 / $30 phiên bản cao cấp với biểu ngữ ghi API có thể gọi ngay hôm nay.
Guides & Insights

GPT-5.3 Codex Spark so với GPT-5.6 Sol: Mánh khóe tốc độ của OpenAI chưa có trên API (Chưa)

Tác giả

Elias Hawthorne

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

GPT-5.3 Codex Spark là mô hình lập trình nhanh nhất từng được phát hành — một bản xem trước nghiên cứu tạo ra hơn 1.000 token mỗi giây trên silicon Cerebras và hoàn thành các chỉnh sửa mã nhanh gấp 15 lần so với bản đầy đủ GPT-5.3 Codex, một tuyên bố của nhà cung cấp. Đây là phần mà hầu hết các bài viết bỏ qua: nó không phải là một sản phẩm API thông thường. Không có giá API công khai, quyền truy cập chỉ dành cho thuê bao ChatGPT Pro thông qua ứng dụng Codex và CLI, và nó không có sẵn trên OrcaRouter. Hai mô hình lập trình bạn thực sự có thể gọi qua một endpoint hiện tại là GPT-5.3 Codex với giá $1.75 mỗi triệu token đầu vào và $14.00 mỗi triệu token đầu ra, và GPT-5.6 Sol với giá $5.00 / $30.00 — và việc so sánh giữa bản xem trước tốc độ và mô hình chủ lực sẽ cho bạn biết liệu Spark có đáng chờ đợi hay không.

Dòng thời gian giải thích sự nhầm lẫn này. GPT-5.3 Codex, mô hình lập trình tác tử của OpenAI, đã có mặt trên API vào tháng 2 năm 2026; biến thể Spark nối tiếp ngay trong tháng đó dưới dạng bản xem trước nghiên cứu nhắm thẳng vào lập trình tương tác — nơi vài mili giây giữa thao tác gõ phím và phản hồi quan trọng hơn một điểm benchmark. Năm tháng sau, OpenAI phát hành dòng GPT-5.6 — gồm Sol, Terra và Luna — và GPT-5.6 Sol, mẫu flagship giá $5 / $30 phát hành ngày 9 tháng 7 năm 2026, chính là mô hình khiến phần lớn khoảng cách tốc độ chỉ còn mang tính học thuật. Đây không phải cuộc so tài giữa hai đối thủ; đây là cuộc so tài giữa một bản xem trước nghiên cứu và mẫu flagship ra mắt sau nó.

GPT-5.3 Codex Spark thực sự là gì

GPT-5.3 Codex Spark là mô hình đầu tiên của OpenAI được thiết kế cho lập trình thời gian thực, đồng thời là cột mốc công khai đầu tiên trong sự hợp tác tháng 1 năm 2026 với nhà sản xuất chip Cerebras. Mô hình này chạy trên Wafer Scale Engine 3 của Cerebras — con chip có kích thước bằng chiếc đĩa ăn tối với bốn nghìn tỷ bóng bán dẫn — giúp nó né tránh được nút thắt cổ chai giao tiếp giữa các cụm GPU, vốn chiếm phần lớn độ trễ trong suy luận thông thường. Bên cạnh con chip, OpenAI đã cắt giảm khoảng 80% chi phí overhead cho mỗi vòng khứ hồi, khoảng 30% chi phí overhead cho mỗi token và khoảng 50% thời gian nhận token đầu tiên nhờ các kết nối WebSocket bền vững cùng những thay đổi trong Responses API — kênh WebSocket được bật theo mặc định cho Spark.

Sự đánh đổi thật thẳng thừng. Trên các điểm chuẩn kỹ thuật phần mềm agentic mà OpenAI trích dẫn, Spark nằm thấp hơn hẳn so với GPT-5.3 Codex bản đầy đủ — 58,4% so với 77,3% trên Terminal-Bench 2.0, cả hai đều do nhà cung cấp báo cáo — vì nó mặc định theo phong cách làm việc tối giản, thực hiện các chỉnh sửa nhỏ, có mục tiêu và không tự động chạy kiểm thử trừ khi bạn yêu cầu một cách tường minh. Đây là một mô hình chỉ hỗ trợ văn bản, có ngữ cảnh 128K, khiến nó tụt hậu xa so với các flagship hiện tại về dung lượng. Tốc độ là sản phẩm, và sản phẩm này là một bản xem trước.

The OrcaRouter model page for openai/gpt-5.6-sol, showing the GPT-5.6 Sol header with Vision, Tools, and JSON badges, the 1.05M-token context window, a 128K max output, the p50 TTFT figure, and the flagship description covering deep reasoning and long-horizon agentic workflows.

Tình hình giá cả: không có giá API, và những gì các trình theo dõi nói.

OpenAI vẫn chưa công bố mức giá API cho GPT-5.3 Codex Spark. Tại thời điểm ra mắt, mô hình này chỉ dành cho người đăng ký ChatGPT Pro thông qua ứng dụng Codex, Codex CLI và tiện ích mở rộng VS Code, với quyền truy cập API chỉ được cấp cho một số đối tác thiết kế được chọn lọc — đồng thời nó có giới hạn tốc độ riêng biệt thay vì tính chung vào mức sử dụng tiêu chuẩn. Nửa năm sau, đó vẫn là tóm tắt trung thực nhất. Một vài trang theo dõi giá bên thứ ba hiện niêm yết mức $1,75 / $14,00 cho mỗi triệu dòng đối với Spark — giống hệt GPT-5.3 Codex bản đầy đủ — nhưng OpenAI chưa đưa ra bất kỳ thông báo phát hành rộng rãi nào, và một con số trên trang theo dõi không phải là con số bạn có thể mua được. Hãy coi mọi mức giá của Spark là chưa được xác nhận cho đến khi OpenAI tuyên bố chính thức.

Những gì bạn có thể mua hôm nay, với giá đã được công bố:

GPT-5.3 Codex — $1.75 mỗi triệu token đầu vào, $14.00 mỗi triệu token đầu ra, đầu vào được lưu cache ở mức $0.175. Cửa sổ ngữ cảnh 400K với trần đầu ra 128K. Mô hình lập trình tác nhân của OpenAI, có mặt trong API công khai từ tháng 2 năm 2026.

GPT-5.6 Sol — $5.00 cho mỗi triệu token đầu vào và $30.00 cho mỗi triệu token đầu ra cho các yêu cầu lên tới 32K token đầu vào, tăng lên $10 / $45 cho mức vượt quá; đầu vào lưu cache $0.50, ghi cache $6.25. Ngữ cảnh khoảng 1,05 triệu token với 128K token đầu ra, hỗ trợ đầu vào văn bản, hình ảnh và tệp. Mô hình chủ lực của OpenAI, phát hành ngày 9 tháng 7 năm 2026.

Cả hai đều nằm trên OrcaRouter với giá niêm yết của các nhà cung cấp và mức chênh lệch 0% — mức giá $1.75 / $14 và $5 / $30 là giá tại đây, không phải phiên bản của bên bán lại. Một đợt giảm giá từ nhà cung cấp được áp dụng tại phía này ngay cùng ngày nhà cung cấp thực hiện, vì OrcaRouter truyền nguyên giá niêm yết thay vì định giá lại.

The OrcaRouter model page for openai/gpt-5.3-codex, showing the GPT-5.3-Codex header with Vision, Tools, JSON, and Reasoning badges, the 400K-token context window, the $1.75 per million input and $14.00 per million output pricing, and an OpenAI-compatible code snippet pointing at the OrcaRouter base URL.

GPT-5.3 Codex Spark so với GPT-5.6 Sol, từng khía cạnh một

Tốc độ — Spark đạt 1.000+ token mỗi giây trên phần cứng Cerebras (theo nhà cung cấp công bố), toàn bộ lý do khiến nó tồn tại; sản lượng đo được của GPT-5.6 Sol trên OrcaRouter trong 7 ngày qua là khoảng 244 token mỗi giây. Không hề gần — và đó chưa phải toàn bộ câu chuyện.

Giá — Spark không có mức giá API công khai; GPT-5.6 Sol có giá $5 / $30 ở gói cơ bản, $10 / $45 trên 32K token đầu vào.

Ngữ cảnh — Spark ở 128K, chỉ văn bản; GPT-5.6 Sol ở khoảng 1.05M với đầu vào văn bản, hình ảnh và tệp tin.

Lập trình tác tử — Spark đạt 58,4% trên Terminal-Bench 2.0 (theo báo cáo của nhà cung cấp); GPT-5.6 Sol đạt điểm AA Coding là 77,4, được Artificial Analysis đo lường độc lập, xếp hạng #2 trong số 132 mô hình.

Phong cách làm việc — Spark thực hiện các chỉnh sửa tối thiểu và mặc định bỏ qua các lần chạy thử nghiệm; GPT-5.6 Sol là flagship agentic toàn diện với khả năng suy luận và sử dụng công cụ.

Truy cập — Spark là bản xem trước nghiên cứu của ChatGPT Pro; GPT-5.6 Sol là mô hình API công khai với mức giá được công bố.

Nếu thứ duy nhất bạn muốn là một bản nháp đầu tiên thật nhanh cho một chỉnh sửa nhỏ, thiết kế của Spark là lý tưởng. Nếu bạn muốn một tác nhân đọc kho mã nguồn, lên kế hoạch cho một thay đổi, chạy các bài kiểm thử và lặp lại cho đến khi vượt qua, thì Spark không cố gắng trở thành như vậy — và điểm AA Coding 77.4 của Sol là con số cần cân nhắc so với một bản xem trước không có điểm số nào.

A three-column comparison scoreboard for GPT-5.3 Codex Spark, GPT-5.3 Codex, and GPT-5.6 Sol: Spark shows no public API price, a 128K context, 1,000+ tokens per second vendor-reported, Terminal-Bench 2.0 of 58.4 percent, text-only input, and Pro-only preview access; GPT-5.3 Codex shows $1.75/$14, a 400K context, about 73 tokens per second, Terminal-Bench 2.0 of 77.3 percent, text plus image plus file input, and public API access; GPT-5.6 Sol shows $5/$30, a 1.05M context, about 244 tokens per second, an AA Coding score of 77.4, text plus image plus file input, and public API access.

Thực tế về định tuyến: bạn không cần phải chọn trong bóng tối

Đây là một trong những cặp đối đầu mà tầng định tuyến thay đổi quyết định. Cả hai mô hình gọi được đều nằm trên OrcaRouter với giá niêm yết của chính nhà cung cấp, markup 0% — openai/gpt-5.3-codex ở $1.75 / $14 và openai/gpt-5.6-sol ở $5 / $30 — nên bạn có thể chạy cùng một khối lượng công việc qua cả hai trên một key và để lưu lượng của chính mình quyết định thay vì tin vào câu chuyện của bất kỳ nhà cung cấp nào. DSL định tuyến giúp điều đó trở nên khả thi: một quy tắc failover trong đó các tác vụ agent thiên về lập trình chạy trên GPT-5.3 Codex, còn các cuộc gọi khó, ngữ cảnh dài được chuyển lên GPT-5.6 Sol, đo lường theo từng tác vụ trên dữ liệu của chính bạn.

Ba đặc điểm riêng của OrcaRouter giúp giải pháp này rẻ hơn so với các lựa chọn thay thế. Đầu tiên, phụ phí $0 cho mỗi token — bạn trả đúng giá niêm yết của nhà cung cấp, không phải trả thêm gì cả. Thứ hai, BYOK — bạn mang khóa nhà cung cấp hiện có của mình và nhà cung cấp lập hóa đơn trực tiếp cho bạn, nhờ đó không có khoản tín dụng trả trước và không có hóa đơn bị nhà định tuyến thổi phồng để đối chiếu. Thứ ba, điểm cuối tương thích với OpenAI: hãy trỏ ứng dụng khách chat/completions hoặc Responses hiện có của bạn đến URL gốc của OrcaRouter và cùng một mã nguồn vẫn hoạt động, với hơn 200 mô hình đằng sau một điểm cuối duy nhất phòng khi bạn vượt quá danh mục sản phẩm của một nhà cung cấp. Lớp bảo vệ phía trước điểm cuối đó là lý do khác khiến bạn có thể an tâm trì hoãn sự thôi thúc dùng bản xem trước nghiên cứu — cho đến khi Spark có API công khai và SLA, câu trả lời cho môi trường sản xuất là một mô hình đã phát hành, và lớp định tuyến giữ mô hình đó ở mức giá niêm yết với tính năng chuyển đổi dự phòng tự động để một đợt tăng đột biến giới hạn tốc độ không làm gián đoạn quy trình.

Nơi Spark là câu trả lời sai

Ranh giới trung thực, vì thiết kế của Spark là một sự thỏa hiệp mà bạn không nên vô tình vấp phải. Nếu công việc của bạn là lập trình tác nhân dài hạn — một nhiệm vụ cần hiểu toàn bộ kho mã, giữ kế hoạch qua nhiều lượt, và tự xác minh các thay đổi của chính nó — thì mặc định chỉnh sửa tối thiểu, không chạy thử nghiệm của Spark là một cái bẫy, và ngữ cảnh chỉ văn bản 128K của nó sẽ không chứa nổi kho mã. Nếu bạn cần hình ảnh hoặc tệp trong lời nhắc, nó không thể nhận chúng. Nếu bạn cần một mức giá có thể dự báo hoặc một SLA đáng tin cậy, nó không có cả hai. Và nếu khối lượng công việc của bạn là một đường ống xử lý hàng loạt thông lượng cao, 1.000 token mỗi giây không quan trọng; chi phí mỗi token và thông lượng mới là điều đáng kể, và những yếu tố đó nghiêng về phía GPT-5.3 Codex rẻ hơn.

Cũng đáng nêu tên những gì chúng tôi không lưu trữ: GPT-5.3 Codex Spark không có trên OrcaRouter, vì không có API công khai nào để định tuyến. Chúng tôi không giả vờ điều ngược lại, và bước đi trung thực trong lập kế hoạch là xây dựng trên các mô hình hiện có — GPT-5.3 Codex cho công việc agent thiên về lập trình ở mức $1.75 / $14, GPT-5.6 Sol cho các lệnh gọi agent khó nhằn, ngữ cảnh dài, đa phương thức ở mức $5 / $30 — và coi Spark như một bản xem trước để theo dõi, chứ không phải một thứ phụ thuộc để đặt cược pipeline vào.

Kết luận

GPT-5.3 Codex Spark là bản xem trước nghiên cứu thú vị nhất mà OpenAI phát hành trong năm nay, và nó chưa phải là một quyết định sản xuất. Quyết định sản xuất — quyết định có giá được công bố, điểm chuẩn bạn có thể kiểm chứng, và một API đưa ra câu trả lời — là GPT-5.3 Codex cho các tác vụ agent định hướng lập trình, và GPT-5.6 Sol cho những yêu cầu khó nhất, cả hai trên cùng một endpoint với giá niêm yết và không tăng thêm. Khi Spark có một API công khai, gần như chắc chắn nó sẽ nằm sau loại endpoint tương tự, và việc chuyển đổi chỉ là thay đổi tên mô hình, không phải là một cuộc di chuyển hệ thống. Cho đến lúc đó, nó là một lý do để theo dõi — và cách nhanh nhất để sẵn sàng là kết nối các mô hình có thể gọi được trên một key bạn đã sở hữu.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày

© 2026 OrcaRouter

Dành cho nhà cung cấp

Bạn vận hành nền tảng suy luận? Đưa mô hình của bạn lên OrcaRouter.

providers@orcarouter.ai

Tham gia cộng đồng

Discordsupport@orcarouter.aiXGitHubYouTube