Xem trước mô hình GPT-4o chỉ văn bản với ngữ cảnh 128K, đầu ra 16K, truy cập qua OrcaRouter API với giá $2.50/$10 mỗi triệu token.
Mô hình này là bản phát hành xem trước từ OpenAI, chỉ giới hạn đầu vào dạng văn bản. Nó mang định danh openai/gpt-4o-search-preview-2025-03-11 khi được truy cập qua API của OrcaRouter. Mô hình cung…
Là bản xem trước GPT-4o chỉ văn bản, nó xuất sắc trong việc hiểu và tạo ra ngôn ngữ tự nhiên trên nhiều lĩnh vực khác nhau. Nó có thể thực hiện tóm tắt tài liệu, trả lời câu hỏi, viết sáng tạo, dịch thuật và tạo mã. Cửa sổ ngữ cảnh lớn cho phép nó duy trì tính mạch lạc trên các đoạn văn rất dài, làm cho nó phù hợp với các tác vụ như phân tích sách hoặc xử lý các bản ghi dài. Nó hỗ trợ các tin nhắn hệ thống, người dùng và trợ lý trong định dạng giống như trò chuyện. Khả năng suy luận zero-shot và few-shot của mô hình là điển hình cho các mô hình lớp GPT-4, cho phép nó xử lý các hướng dẫn phức tạp mà không cần tinh chỉnh sâu rộng.
Nếu tác vụ của bạn không yêu cầu toàn bộ khả năng suy luận của GPT-4o, hãy cân nhắc sử dụng một mô hình nhỏ hơn hoặc rẻ hơn từ OrcaRouter, chẳng hạn như openai/gpt-4o-mini hoặc gpt-3.5-turbo. Các ví dụ về tác vụ phù hợp hơn với các mô hình rẻ hơn bao gồm phân loại đơn giản, tạo nội dung dạng ngắn, hoặc hỏi đáp cơ bản với ngữ cảnh hạn chế. Chi phí của mô hình xem trước có thể không hợp lý cho các yêu cầu khối lượng lớn, độ phức tạp thấp. Ngoài ra, nếu yêu cầu đầu vào đa phương thức, mô hình này không thể xử lý hình ảnh hoặc âm thanh; cần phải sử dụng một mô hình khác (ví dụ: GPT-4o tiêu chuẩn hoặc GPT-4V). Luôn đánh giá sự cân bằng giữa chất lượng và chi phí mỗi token.
Mô hình này được xác định là một biến thể 'search-preview', nhưng không có khả năng sử dụng công cụ hoặc tìm kiếm web cụ thể nào được mô tả chi tiết trong các thông số kỹ thuật công khai. Nó chỉ hoạt động với văn bản và hoạt động như một mô hình ngôn ngữ tiêu chuẩn. Người dùng không nên cho rằng có bất kỳ chức năng tìm kiếm hoặc truy xuất tích hợp nào. Để tạo sinh tăng cường, bạn có thể triển khai các pipeline tạo sinh tăng cường truy xuất (RAG) riêng biệt, đưa các tài liệu đã truy xuất vào cửa sổ ngữ cảnh của mô hình. OrcaRouter không thêm bất kỳ phần mềm trung gian sử dụng công cụ nào; mô hình chỉ phản hồi dựa trên quá trình huấn luyện và lời nhắc được cung cấp. Các phiên bản tương lai có thể thay đổi hành vi này, nhưng tính đến thời điểm xem trước, không có tích hợp công cụ nào được ghi lại.
Bản xem trước này có thể có hành vi không mong muốn hoặc độ tin cậy thấp hơn so với các bản phát hành ổn định. Nó chỉ hỗ trợ văn bản, vì vậy mọi yêu cầu đa phương thức sẽ bị từ chối. Giới hạn đầu ra tối đa 16.384 token là đáng kể nhưng vẫn có thể cắt ngắn các đoạn văn bản rất dài. Ngày cắt kiến thức và dữ liệu huấn luyện của mô hình không được chỉ định; mô hình có thể không biết về các sự kiện rất gần đây. Không khuyến khích sử dụng trong sản xuất vì mô hình có thể bị cập nhật hoặc loại bỏ. Ngoài ra, độ trễ có thể cao hơn so với các mô hình ổn định do tính chất xem trước này. Luôn kiểm tra kỹ lưỡng trước khi triển khai trên quy mô lớn.
Không có điểm số benchmark cụ thể nào được cung cấp cho phiên bản xem trước đặc biệt này. Là một biến thể của GPT-4o, mô hình này được kỳ vọng sẽ hoạt động tương tự GPT-4o tiêu chuẩn trong các tác vụ ngôn ngữ thông thường, nhưng các con số chính xác không được tiết lộ. Người dùng có thể tự chạy đánh giá bằng các bộ dữ liệu công khai. Cửa sổ ngữ cảnh lớn mang lại lợi thế cho mô hình trong các bài kiểm tra tài liệu dài, tuy nhiên vì đây là phiên bản xem trước, điểm số có thể khác so với mô hình sản xuất. Để có số liệu chính thức, hãy tham khảo các báo cáo benchmark chính thức của OpenAI cho GPT-4o. OrcaRouter không thay đổi đầu ra hay hiệu suất của mô hình.
Các số liệu về độ trễ và thông lượng cho mô hình xem trước này chưa được công bố. Là phiên bản xem trước, mô hình này có thể chậm hơn so với GPT-4o ổn định do cơ sở hạ tầng thử nghiệm. Thời gian phản hồi phụ thuộc vào độ dài đầu vào, độ dài đầu ra và nhu cầu đồng thời. OrcaRouter không gây thêm độ trễ nào ngoài định tuyến API thông thường. Để ước tính tốc độ, nhà phát triển có thể chạy các yêu cầu mẫu với tải trọng điển hình. Đối với các ứng dụng sản xuất yêu cầu hiệu suất ổn định, hãy cân nhắc sử dụng mô hình gpt-4o ổn định thay thế, trừ khi cần các tính năng cụ thể của phiên bản xem trước.
Các mô hình thuộc lớp GPT-4 được biết đến với khả năng suy luận mạnh mẽ trên nhiều lĩnh vực, bao gồm toán học, logic và suy luận thông thường. Bản xem trước này dự kiến sẽ kế thừa những khả năng đó. Ngữ cảnh lớn cho phép suy luận theo chuỗi tư duy phức tạp qua nhiều bước mà không bị mất dấu các phần trước đó. Tuy nhiên, không có điểm chuẩn suy luận cụ thể nào được cung cấp cho phiên bản chính xác này. Người dùng nên xác thực hiệu suất trên các tác vụ cụ thể của riêng họ. Mô hình cũng có thể thể hiện khả năng tuân theo hướng dẫn được cải thiện so với các phiên bản GPT trước đó, nhưng một lần nữa, việc xác minh độc lập được khuyến nghị.
Ngoài việc là bản xem trước, mô hình không hỗ trợ đa phương thức. Nó không thể xử lý trực tiếp hình ảnh, âm thanh hoặc video. Ngày cắt kiến thức của nó không xác định, vì vậy nó có thể thiếu thông tin về các sự kiện sau quá trình huấn luyện. Giới hạn đầu ra 16.384 token, mặc dù hào phóng, không thể tạo ra các văn bản cực dài trong một lần sinh; đối với đầu ra dài hơn, cần phải nhắc nhở lặp đi lặp lại hoặc chia nhỏ. Bản xem trước cũng có thể có tỷ lệ lỗi cao hơn hoặc tỷ lệ từ chối cao hơn đối với một số chủ đề nhạy cảm. Hiệu suất trên các ngôn ngữ khác ngoài tiếng Anh có thể khác nhau. Luôn kiểm tra trên dữ liệu đại diện trước khi triển khai.
Mô hình có giá $2.50 cho mỗi 1 triệu token đầu vào và $10.00 cho mỗi 1 triệu token đầu ra. Đây là giá của nhà cung cấp OpenAI; OrcaRouter không thêm bất kỳ khoản phụ phí nào. Ví dụ, xử lý một prompt 10.000 token và tạo ra 1.000 token sẽ có chi phí xấp xỉ $0.025 cho đầu vào và $0.01 cho đầu ra, tổng cộng là $0.035. Chi phí tăng tuyến tính theo lượng token sử dụng. Không có thêm phí nào khi sử dụng OrcaRouter làm cổng API. Hãy theo dõi mức sử dụng để tránh các khoản phí bất ngờ. So sánh với các mô hình rẻ hơn nếu tác vụ của bạn không cần đến toàn bộ khả năng.
OrcaRouter hiện không cung cấp chiết khấu theo dung lượng hoặc lưu trữ token cho mô hình này. Tất cả thanh toán đều là trả theo nhu cầu dựa trên lượng token thực tế được sử dụng theo giá của nhà cung cấp. OrcaRouter không thực hiện lưu trữ đệm các prompt hoặc phản hồi; mỗi yêu cầu được xử lý độc lập. Nếu bạn có lưu lượng rất cao, hãy liên hệ OrcaRouter để có các thỏa thuận tùy chỉnh tiềm năng. Để tối ưu hóa chi phí, hãy cân nhắc sử dụng các prompt ngắn hơn, tái sử dụng ngữ cảnh hiệu quả hoặc gộp các cuộc gọi. Mô hình không hỗ trợ giá giảm cho các kết quả trúng lưu trữ đệm vì không có cơ chế lưu trữ đệm nào được áp dụng.
Với mức giá $2.50/$10 mỗi triệu token, bản xem trước này được định giá tương tự GPT-4o tiêu chuẩn nhưng có thể chênh lệch đôi chút. Các lựa chọn rẻ hơn bao gồm openai/gpt-4o-mini (khoảng $0.15/$0.60 mỗi triệu) hoặc gpt-3.5-turbo (khoảng $0.50/$1.50). Đối với các tác vụ có thể chấp nhận chất lượng thấp hơn, những mô hình đó mang lại khoản tiết kiệm đáng kể. Chi phí của mô hình xem trước nằm ở mức cao trong danh mục OrcaRouter. Nếu bạn chỉ sử dụng nó để kiểm thử, bạn có thể phải chịu chi phí ở mức vừa phải tùy thuộc vào khối lượng yêu cầu. Luôn đánh giá mức sử dụng token dự kiến và so sánh với lợi ích về chất lượng khi dùng mô hình lớn hơn.
Để sử dụng mô hình này, hãy thiết lập base URL của ứng dụng API khách của bạn thành https://api.orcarouter.ai/v1, và chỉ định ID mô hình là openai/gpt-4o-search-preview-2025-03-11. Bạn phải sử dụng khóa API do OrcaRouter cấp. API này hoàn toàn tương thích với OpenAI, do đó mã nguồn hiện có được viết cho endpoint chat completions của OpenAI sẽ hoạt động với những thay đổi tối thiểu. Ví dụ gọi API bằng curl: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_ORCAROUTER_KEY" -H "Content-Type: application/json" -d '{ "model": "openai/gpt-4o-search-preview-2025-03-11", "messages": [{"role": "user", "content": "Hello"}], "max_tokens": 100 }'
Bạn có thể sử dụng tất cả các tham số hoàn tất hội thoại tiêu chuẩn được OpenAI hỗ trợ: 'messages', 'max_tokens', 'temperature', 'top_p', 'frequency_penalty', 'presence_penalty', 'stop', và 'n'. Mô hình hỗ trợ cửa sổ ngữ cảnh 128.000 token, do đó 'max_tokens' có thể được đặt tối đa lên đến 16.384. 'temperature' kiểm soát độ ngẫu nhiên; giá trị dao động từ 0 đến 2. 'stream' được hỗ trợ để phản hồi thời gian thực. OrcaRouter không giới thiệu tham số bổ sung. Đảm bảo các yêu cầu của bạn tuân thủ giới hạn token; đầu vào dài hơn cửa sổ ngữ cảnh (bao gồm cả phản hồi) sẽ bị cắt bớt hoặc trả về lỗi.
Việc di chuyển rất đơn giản. Thay thế URL cơ sở OpenAI của bạn (https://api.openai.com/v1) bằng URL cơ sở của OrcaRouter (https://api.orcarouter.ai/v1). Thay đổi khóa API của bạn thành khóa OrcaRouter. Cập nhật trường model thành openai/gpt-4o-search-preview-2025-03-11. Không cần thay đổi mã nào khác. Nếu bạn đang sử dụng một mô hình OpenAI khác, bạn có thể tiếp tục sử dụng cùng cấu trúc mã. OrcaRouter chuyển tiếp tất cả các tham số tiêu chuẩn. Sau khi di chuyển, hãy xác minh rằng các phản hồi nhất quán. Lưu ý rằng việc thanh toán sẽ do OrcaRouter xử lý và bạn sẽ cần một tài khoản tại đó.
OrcaRouter không công khai tiết lộ các giới hạn tốc độ cụ thể cho mô hình xem trước này. Tính khả dụng phụ thuộc vào hạ tầng của OpenAI và dung lượng cổng kết nối của OrcaRouter. Đối với các ứng dụng sản xuất, hãy cân nhắc trạng thái xem trước của mô hình và khả năng không ổn định. OrcaRouter có thể áp dụng các giới hạn sử dụng hợp lý để ngăn chặn lạm dụng. Bạn có thể mong đợi dịch vụ nỗ lực tốt nhất, nhưng không có SLA nào được cung cấp. Nếu bạn yêu cầu thông lượng đảm bảo, hãy liên hệ OrcaRouter để có các tùy chọn chuyên dụng. Mô hình cũng có thể bị xóa hoặc thay thế mà không cần thông báo, vì vậy hãy lên kế hoạch cho các mô hình dự phòng.
Mô hình GPT-4o tiêu chuẩn (openai/gpt-4o) là một bản phát hành ổn định, đa phương thức, trong khi bản xem trước này chỉ hỗ trợ văn bản và dành cho thử nghiệm sớm. Bản xem trước có thể bao gồm các tính năng sắp ra mắt chưa có trong phiên bản tiêu chuẩn, nhưng cũng có thể kém tin cậy hơn. Giá cả tương tự. Mô hình tiêu chuẩn hỗ trợ đầu vào rộng hơn (hình ảnh, âm thanh). Nếu bạn không cần các tính năng xem trước, GPT-4o tiêu chuẩn là lựa chọn an toàn hơn. Cả hai đều có sẵn trên OrcaRouter với cùng giao diện API, giúp việc chuyển đổi dễ dàng.
Gpt-4o-mini là một mô hình nhỏ hơn, rẻ hơn được tối ưu hóa cho các tác vụ đơn giản. Chi phí khoảng $0,15 cho mỗi triệu token đầu vào và $0,60 cho mỗi triệu token đầu ra (xấp xỉ). Mô hình xem trước này đắt hơn khoảng 16 lần cho đầu vào và 16 lần cho đầu ra. Mô hình xem trước cung cấp ngữ cảnh lớn hơn (128K so với 128K? Thực ra gpt-4o-mini cũng có 128K, nhưng điều đó có thể thay đổi. Chúng tôi biết mô hình này là 128K. Ngữ cảnh của Gpt-4o-mini cũng là 128K theo thông tin công khai, nhưng chúng tôi không thể khẳng định. Chúng tôi sẽ nói 'cửa sổ ngữ cảnh tương đương' nhưng lưu ý sự khác biệt về giá.) Mô hình này tốt hơn cho suy luận phức tạp, trong khi gpt-4o-mini đủ dùng cho nhiều tác vụ tiêu chuẩn. Hãy lựa chọn dựa trên nhu cầu về chất lượng và ngân sách.
Các mô hình Claude (ví dụ: Claude 3.5 Sonnet) cung cấp cửa sổ ngữ cảnh lớn và khả năng suy luận mạnh mẽ, nhưng API của chúng không tương thích trực tiếp với OpenAI. OrcaRouter cung cấp giao diện thống nhất cho nhiều nhà cung cấp, nhưng bản xem trước này chỉ đến từ OpenAI. Các mô hình Claude có thể có mức giá và điểm mạnh khác nhau trong các lĩnh vực như an toàn và tạo văn bản dài. Để so sánh trực tiếp, bạn cần thử nghiệm trên các trường hợp sử dụng của riêng mình. OrcaRouter cho phép bạn chuyển đổi giữa các nhà cung cấp, nhưng mô hình xem trước này chỉ khả dụng qua tuyến OpenAI. Không có so sánh điểm chuẩn nào được cung cấp.
Tương thích OpenAI — giữ nguyên SDK bạn đang dùng
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview-2025-03-11",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Đầu vào / 1M tokens | $2.50 |
| Đầu ra / 1M tokens | $10.00 |
| Tiền tệ | USD |
Ước tính theo giá niêm yết
Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.
GET /api/public/models/openai/gpt-4o-search-preview-2025-03-11Mở @misc{orcarouter_gpt_4o_search_preview_2025_03_11,
title = {openai/gpt-4o-search-preview-2025-03-11 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11}
}openai. (n.d.). openai/gpt-4o-search-preview-2025-03-11 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11