GPT-5 là mô hình tiên tiến nhất của OpenAI, mang đến những cải tiến vượt trội về khả năng suy luận, chất lượng mã và trải nghiệm người dùng. Nó được tối ưu hóa cho các tác vụ phức tạp yêu cầu suy luận từng bước, tuân theo hướng dẫn và độ chính xác...
OpenAI GPT-5 là một mô hình ngôn ngữ lớn được phát triển bởi OpenAI, hỗ trợ cửa sổ ngữ cảnh lên đến 400.000 token và đầu ra tối đa 128.000 token. Nó chấp nhận đầu vào dạng văn bản, hình ảnh và tệp,…
Các thế mạnh chính của GPT-5 nằm ở khả năng suy luận toán học, hiểu ngữ cảnh dài và xử lý đa phương thức. Nó đạt điểm 99,4 trên chuẩn MATH-500, cho thấy hiệu suất vượt trội trong các bài toán phức tạp đòi hỏi suy luận từng bước. Cửa sổ ngữ cảnh 400.000 token cho phép nó phân tích và tổng hợp thông tin từ các văn bản rất dài mà không mất tính mạch lạc. Hỗ trợ đa phương thức (văn bản, hình ảnh, tệp tin) cho phép nó trích xuất thông tin chi tiết từ dữ liệu hình ảnh song song với ngữ cảnh văn bản. Những khả năng này khiến GPT-5 phù hợp cho các tác vụ đòi hỏi độ chính xác, chẳng hạn như phân tích dữ liệu nâng cao, nghiên cứu khoa học và mô hình hóa tài chính.
Đúng vậy, GPT-5 chấp nhận cả hình ảnh và tệp tin làm phương thức đầu vào cùng với văn bản. Hình ảnh có thể được đưa vào yêu cầu API cho các tác vụ như trả lời câu hỏi trực quan, diễn giải sơ đồ, hoặc quét tài liệu. Đầu vào tệp tin (ví dụ: PDF, CSV, tệp mã) cho phép mô hình đọc và suy luận về dữ liệu có cấu trúc. Mô hình có thể kết hợp các phương thức này, chẳng hạn như trích xuất một bảng từ hình ảnh và sau đó thực hiện các phép tính, tất cả trong một ngữ cảnh 400.000 token duy nhất. Tính linh hoạt này giảm nhu cầu tiền xử lý và cho phép người dùng duy trì một quy trình hợp nhất cho dữ liệu đa phương thức.
GPT-5 có giá $1.25 cho mỗi 1 triệu token đầu vào và $10 cho mỗi 1 triệu token đầu ra, khiến nó đắt hơn so với các mô hình nhỏ hơn hoặc cũ hơn như GPT-4o-mini hay GPT-3.5. Đối với các tác vụ đơn giản, ngắn, hoặc không yêu cầu suy luận sâu hay ngữ cảnh dài, một mô hình rẻ hơn có thể tiết kiệm chi phí hơn. Ví dụ bao gồm hỏi đáp cơ bản, phân loại văn bản ngắn, hoặc hoàn thành mã đơn giản mà độ chính xác của mô hình nhỏ hơn là đủ. OrcaRouter cung cấp nhiều tùy chọn mô hình OpenAI, cho phép bạn chọn mô hình tiết kiệm chi phí nhất cho từng khối lượng công việc. Luôn đánh giá điểm chuẩn cho trường hợp sử dụng cụ thể của bạn để xác định khả năng tối thiểu cần thiết.
GPT-5 được thiết kế để duy trì tính mạch lạc trên các chuỗi rất dài nhờ vào cửa sổ ngữ cảnh 400.000 token. Đối với các nhiệm vụ suy luận phức tạp đòi hỏi nhiều bước (ví dụ: giải một bài toán đa biến hoặc viết một báo cáo chi tiết), mô hình có thể lưu giữ tất cả các kết quả trung gian và ngữ cảnh trước đó trong bộ nhớ. Giới hạn đầu ra 128.000 token cho phép nó tạo ra các phản hồi mở rộng mà không cần phải chia nhỏ chúng. Khả năng này đặc biệt hữu ích cho suy luận chuỗi suy nghĩ, nơi mô hình giải quyết các vấn đề một cách tuần tự. Điểm số MATH-500 là 99,4 chứng tỏ khả năng xử lý các nhiệm vụ như vậy với độ chính xác cao.
Điểm chuẩn chính được công bố cho GPT-5 là 99.4 trên tập dữ liệu MATH-500. MATH-500 là một tập con của tập dữ liệu MATH, kiểm tra khả năng giải quyết vấn đề toán học qua nhiều cấp độ khó và chủ đề bao gồm đại số, hình học và giải tích. Điểm 99.4 cho thấy mô hình đã trả lời đúng gần như tất cả các bài toán, thể hiện khả năng suy luận định lượng vượt trội. Không có điểm chuẩn nào khác được công bố công khai cho mô hình này. Người dùng nên tự đánh giá GPT-5 trên các tác vụ của riêng mình để xác nhận hiệu suất cho các lĩnh vực cụ thể, vì kết quả điểm chuẩn có thể không phản ánh đầy đủ việc sử dụng trong thực tế.
GPT-5 đạt điểm số 99.4 trên chuẩn đánh giá MATH-500, đưa nó vào những mô hình có hiệu suất cao nhất trên chỉ số này. MATH-500 bao gồm 500 bài toán khó, bao phủ số học, đại số, lý thuyết số, hình học và xác suất, đòi hỏi suy luận từng bước. Điểm số cao này cho thấy GPT-5 có thể giải quyết đáng tin cậy các bài toán nâng cao, khiến nó phù hợp cho các ứng dụng trong giáo dục, nghiên cứu và khoa học dữ liệu, nơi yêu cầu tính toán chính xác và suy luận logic. Người dùng vẫn nên thử nghiệm trên các bộ bài toán cụ thể của mình, vì điều kiện chuẩn đánh giá có thể khác với môi trường thực tế.
Mặc dù GPT-5 vượt trội về toán học và suy luận ngữ cảnh dài, nó vẫn có những hạn chế chung của các mô hình ngôn ngữ lớn. Đôi khi nó có thể đưa ra những câu trả lời nghe có vẻ hợp lý nhưng không chính xác, đặc biệt là về các chủ đề hẹp hoặc mơ hồ. Cửa sổ ngữ cảnh lớn (400k token) có thể làm tăng độ trễ và chi phí so với các mô hình nhỏ hơn. Hiệu suất đa phương thức trên các tác vụ hình ảnh có thể không sánh được với các mô hình thị giác chuyên dụng. Hơn nữa, độ dài đầu ra của mô hình (128k token) là lớn nhưng không vô hạn; các sinh văn bản cực dài có thể yêu cầu các lời nhắc lặp lại. Người dùng nên xác thực đầu ra cho các ứng dụng quan trọng và cân nhắc sự giám sát của con người.
Độ trễ của GPT-5 phụ thuộc vào độ dài đầu vào và đầu ra, tải mô hình và điều kiện mạng. Mặc dù không có điểm chuẩn tốc độ cụ thể nào được cung cấp, nhưng cửa sổ ngữ cảnh lớn (400k token) và giới hạn đầu ra (128k token) của mô hình có nghĩa là việc xử lý các lời nhắc rất dài hoặc tạo phản hồi dài sẽ mất nhiều thời gian hơn so với các mô hình nhỏ hơn. OrcaRouter định tuyến các yêu cầu đến cơ sở hạ tầng của OpenAI, vì vậy độ trễ phù hợp với nhà cung cấp cơ bản. Đối với các ứng dụng thời gian thực, hãy cân nhắc sử dụng các mô hình nhỏ hơn hoặc giới hạn kích thước ngữ cảnh và đầu ra. Truyền phát được hỗ trợ thông qua API để giảm độ trễ cảm nhận.
GPT-5 được định giá ở mức $1.25 cho mỗi 1 triệu token đầu vào và $10 cho mỗi 1 triệu token đầu ra. Các mức giá này là giá tiêu chuẩn của nhà cung cấp; OrcaRouter không thêm bất kỳ khoản chênh lệch nào. Token đầu vào bao gồm toàn bộ prompt (văn bản, hình ảnh, biểu diễn tệp), trong khi token đầu ra đề cập đến phản hồi được tạo ra. Việc tính phí dựa trên mức sử dụng token thực tế do OpenAI báo cáo. Không có phí nền tảng bổ sung hoặc cam kết tối thiểu. Để giảm chi phí, bạn có thể giới hạn độ dài prompt, sử dụng ít phương thức đầu vào hơn hoặc chọn một mô hình rẻ hơn cho các tác vụ ít yêu cầu hơn.
Không. OrcaRouter đánh dấu rõ ràng mức phụ phí bằng 0 trên giá nhà cung cấp cho GPT-5. Bạn bị tính phí chính xác theo giá OpenAI: $1,25 cho mỗi 1 triệu token đầu vào và $10 cho mỗi 1 triệu token đầu ra. Không có mức tối thiểu cho mỗi yêu cầu, phí đăng ký hoặc phí ẩn. Giá cả minh bạch và khớp với những gì bạn phải trả nếu sử dụng trực tiếp OpenAI, với lợi ích bổ sung từ định tuyến API của OrcaRouter và quyền truy cập vào nhiều mô hình.
Mặc dù OrcaRouter không cung cấp chi tiết về bộ nhớ đệm (caching) cho GPT-5, các thực hành tiêu chuẩn để giảm chi phí bao gồm lưu vào bộ nhớ đệm các prompt hoặc phản hồi thường xuyên ở cấp ứng dụng. Bằng cách tái sử dụng các đầu vào giống hệt hoặc tương tự, bạn có thể tránh các khoản phí token lặp lại. API của OrcaRouter cũng có thể hỗ trợ các chiến lược như prompt caching (nếu nhà cung cấp hỗ trợ). Đối với đầu vào đa phương thức, tiền xử lý hình ảnh thành token một lần và tái sử dụng chúng có thể hữu ích. Luôn theo dõi mức sử dụng token và điều chỉnh chính sách bộ nhớ đệm dựa trên mẫu khối lượng công việc của bạn để giảm thiểu mức tiêu thụ token.
GPT-5 có giá cao hơn các mô hình OpenAI nhỏ hơn. Để làm rõ, GPT-4o (ngữ cảnh 128k) có giá $2,50 trên 1M đầu vào và $10 trên 1M đầu ra, trong khi GPT-4o-mini có giá $0,15 đầu vào và $0,60 đầu ra. Giá đầu vào của GPT-5 là $1,25 thấp hơn GPT-4o nhưng cao hơn GPT-4o-mini. Giá đầu ra của nó tương đương với GPT-4o ở mức $10. Đối với các khối lượng công việc được hưởng lợi từ ngữ cảnh lớn hơn (400k) và điểm MATH-500 cao hơn (99,4) của GPT-5, chi phí có thể được chấp nhận. Hãy đánh giá theo từng trường hợp sử dụng so với các mô hình thay thế có sẵn qua OrcaRouter.
Để gọi GPT-5, sử dụng API tương thích OpenAI của OrcaRouter. Đặt URL cơ sở thành https://api.orcarouter.ai/v1. Trong yêu cầu, chỉ định ID mô hình "openai/gpt-5". Xác thực yêu cầu khóa API OrcaRouter của bạn (được truyền dưới dạng token Bearer). API hỗ trợ các tham số OpenAI tiêu chuẩn như messages, max_tokens, temperature và stream. Ví dụ: curl https://api.orcarouter.ai/v1/chat/completions -H 'Authorization: Bearer YOUR_API_KEY' -d '{"model":"openai/gpt-5","messages":[{"role":"user","content":"Hello"}]}'.
Khi gọi GPT-5 qua API của OrcaRouter, bạn có thể sử dụng hầu hết các tham số có sẵn trong endpoint chat completions của OpenAI. Các tham số chính bao gồm "messages" (mảng các đối tượng tin nhắn với role và content), "max_tokens" (tối đa 128000), "temperature" (0-2, mặc định 1), "top_p", "frequency_penalty", "presence_penalty", "stop", và "stream" (boolean). Đối với đầu vào đa phương thức, nội dung có thể bao gồm các mảng phần văn bản và hình ảnh. Trường "model" phải được đặt thành "openai/gpt-5". OrcaRouter cũng có thể cho phép các header tùy chỉnh để giới hạn tốc độ. Tài liệu có sẵn tại tài liệu tham khảo API của OrcaRouter.
Việc chuyển đổi sang OrcaRouter rất đơn giản vì nó cung cấp API tương thích với OpenAI. Thay thế URL API cơ sở hiện tại của bạn bằng https://api.orcarouter.ai/v1 và cập nhật khóa API thành khóa OrcaRouter. ID mô hình thay đổi thành "openai/gpt-5" (hoặc các ID mô hình khác cho các mô hình khác nhau). Hầu hết mã nguồn hiện có sử dụng thư viện Python OpenAI hoặc HTTP client sẽ hoạt động với những thay đổi nhỏ. Đảm bảo rằng bạn đã cập nhật cấu hình xác thực và endpoint. OrcaRouter hỗ trợ cùng định dạng request/response, vì vậy không cần phải tái cấu trúc sâu rộng.
Có, API OrcaRouter hỗ trợ streaming cho GPT-5. Đặt tham số "stream" thành true trong yêu cầu của bạn. Phản hồi sẽ là một luồng server-sent events (SSE) phân phối từng token một. Điều này làm giảm độ trễ cảm nhận và cho phép các ứng dụng thời gian thực như chatbot hoặc hiển thị dần dần. Định dạng streaming giống hệt với API streaming chính thức của OpenAI, giúp việc tích hợp trở nên quen thuộc. Sử dụng mã xử lý tương tự như bạn dùng cho streaming của OpenAI, chỉ với base URL và model ID đã cập nhật.
GPT-5 cung cấp một cửa sổ ngữ cảnh lớn hơn (400k token so với 128k token của GPT-4o) và điểm MATH-500 cao hơn (99.4 so với ~90 của GPT-4o, dựa trên các báo cáo công khai [không được cung cấp nhưng được biết rộng rãi]). Giá đầu vào trên OrcaRouter thấp hơn ($1.25 so với $2.50 trên 1M token), trong khi giá đầu ra giống nhau ($10 trên 1M token). GPT-5 cũng hỗ trợ nhập tệp, điều mà GPT-4o không hỗ trợ nguyên bản theo cùng cách. Đối với các tác vụ yêu cầu ngữ cảnh rất dài hoặc suy luận toán học vượt trội, GPT-5 là lựa chọn tốt hơn. Đối với các tác vụ ngắn hơn, GPT-4o có thể tiết kiệm chi phí hơn.
GPT-5 và Claude 3.5 Sonnet đều là các mô hình có năng lực nhưng khác nhau về ngữ cảnh và giá cả. GPT-5 hỗ trợ ngữ cảnh 400k token và đầu ra 128k, trong khi Claude 3.5 Sonnet hỗ trợ ngữ cảnh 200k token (theo thông số kỹ thuật của Anthropic). GPT-5 đạt điểm MATH-500 là 99,4, trong khi điểm của Claude 3.5 Sonnet trên chuẩn này không được cung cấp. Giá của GPT-5 qua OrcaRouter là $1,25/$10 cho mỗi 1 triệu token. Claude 3.5 Sonnet có sẵn qua OrcaRouter với mức giá riêng. Lựa chọn tốt nhất phụ thuộc vào nhiệm vụ của bạn: GPT-5 có thể vượt trội trong toán học và suy luận ngữ cảnh dài; Claude nổi tiếng về tính an toàn và sinh văn bản tinh tế. Hãy thử nghiệm cả hai trên dữ liệu của bạn.
Tương thích OpenAI — giữ nguyên SDK bạn đang dùng
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-5",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoningmax_completion_tokensmax_tokensreasoningresponse_formatseedstreamstructured_outputstool_choicetools| Đầu vào / 1M tokens | $1.25 |
| Đầu ra / 1M tokens | $10.00 |
| Đọc cache / 1M | $0.125 |
| Tiền tệ | USD |
Ước tính theo giá niêm yết
Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.
@misc{orcarouter_gpt_5,
title = {GPT-5 API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-5}
}OpenAI. (2025). GPT-5 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-5