Thẻ tiêu đề hero được tạo cho bài viết 'GPT-Rosalind Discovery', với phụ đề 'Mục Rosalind thứ hai, được phát hiện trên trang định giá — không thông báo, không trang tài liệu', mang một huy hiệu ghi 'CHƯA CÔNG BỐ — phát hiện trên chính trang định giá của nhà cung cấp' và ba thẻ ghi 'Giá: $5.00 / $0.50 / $25.00 mỗi 1M token', 'Giống với gpt-rosalind-research ở cả ba cột' và 'Trang tài liệu: HTTP 404 tính đến ngày 10 tháng 10 năm 2026', phía trên một dải chân trang ghi 'Nguồn: trang định giá API developers.openai.com, đọc trực tiếp. Không tồn tại thông báo nào từ OpenAI.'
Engineering & Research

GPT-Rosalind Discovery: Mô hình Rosalind thứ hai xuất hiện trên trang định giá của OpenAI mà không có thông báo

Tác giả

Magnus Corvin

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Hiện có hai mô hình trong gia đình Rosalind, và công ty mới chỉ từng công bố một trong số đó. Cuộn đến khối Life sciences trên trang định giá API của chính nhà cung cấp — phần có tiêu đề "Our latest Rosalind models" — và bạn sẽ thấy GPT-Rosalind Discoverynằm ngay bên dưới GPT-Rosalind Research. Id mô hình API là gpt-rosalind-discovery và gpt-rosalind-research. Cả hai đều được niêm yết ở mức 5,00 USD mỗi triệu token đầu vào, 0,50 USD mỗi triệu token đầu vào được lưu đệm, và 25,00 USD mỗi triệu token đầu ra. Dòng thứ hai là mới, nó không được đề cập ở bất kỳ nơi nào khác trên trang dành cho nhà phát triển của nhà cung cấp, và tính đến ngày 10 tháng 10 năm 2026, không có thông báo, không có mục nhật ký thay đổi, và không có trang tài liệu mô hình nào cho nó. Những gì sau đây là những điều mà trang thực sự nói, những điều mà nó không nói, và những cách đọc nào về cái tên còn trụ vững khi tiếp xúc với phần còn lại của tài liệu Rosalind từ nhà cung cấp.

Chính xác những gì trang nói

Bằng chứng ở đây tuy mỏng nhưng lại sạch một cách bất thường, vì không có phần nào trong đó đến từ bên thứ ba. Mọi thứ dưới đây đều được đọc trực tiếp từ tài liệu dành cho nhà phát triển của nhà cung cấp vào ngày 10 tháng 10.

• Danh sách — nhóm Life sciences trên trang định giá có hai dòng dưới tiêu đề "Các mô hình Rosalind mới nhất của chúng tôi. Giá trên mỗi 1 triệu token.": gpt-rosalind-research và gpt-rosalind-discovery

• Những con số — cả hai hàng đều hiển thị $5.00 input, $0.50 cached input, $25.00 output, tính trên mỗi triệu token. Không hề gần nhau. Giống hệt nhau ở cả ba cột

• Chú thích — nó chỉ nêu tên mô hình cũ hơn: "Việc tính phí cho gpt-rosalind-research bắt đầu từ ngày 5 tháng 10 năm 2026. Định giá ghi bộ nhớ đệm không áp dụng cho mô hình này. Quyền truy cập được giới hạn cho nghiên cứu nội bộ đã được phê duyệt thông qua chương trình truy cập tin cậy." Sau đó, nó nêu thêm rằng "Tất cả các tổ chức đủ điều kiện sẽ tiếp tục được truy cập các mô hình GPT-Rosalind mới nhất khi chúng được phát hành," cùng với mức tăng tiêu chuẩn 10% cho các endpoint xử lý theo khu vực

• Điều gì còn thiếu — không có thông báo trên blog của nhà cung cấp, không có mục Rosalind nào trong changelog, và không có trang tài liệu. Cả /api/docs/models/gpt-rosalind-discovery và /api/docs/models/gpt-rosalind đều trả về HTTP 404. Danh mục mô hình vẫn liệt kê một mục Rosalind duy nhất, được mô tả là "Lập luận khoa học đời sống cho các tổ chức được phê duyệt"

404 là phần chứa nhiều thông tin nhất. Một dòng giá là một mục trong bảng thanh toán, và bảng thanh toán là thứ thường được seed trước khi ra mắt để hạ tầng lập hóa đơn, hạn ngạch và giới hạn tần suất đã sẵn sàng ngay khi công tắc được bật. Một trang tài liệu mô hình là thứ được viết ra khi có gì đó để ghi lại. Một trong hai thứ đó tồn tại còn thứ kia thì không, và điều đó mô tả một mô hình đang ở staging tốt hơn nhiều so với một mô hình đang ở production.

A screenshot of OpenAI's developer API pricing page, Life sciences models group, headed 'Our latest Rosalind models. Prices per 1M tokens.' The table lists gpt-rosalind-research and gpt-rosalind-discovery with identical columns: Input $5.00, Cached input $0.50, Output $25.00. Below it the footnote reads 'Billing for gpt-rosalind-research begins on October 5, 2026. Cache-write pricing does not apply to this model. Access is limited to approved internal research through the trusted-access program.'

Hai SKU, một mức giá — và giá ngang bằng có thể cho bạn biết điều gì

Sự thật được trích dẫn nhiều nhất về phát hiện này là sự thật trong tín hiệu gốc: mô hình mới “có mức giá giống hệt gpt-rosalind-research”. Điều đó là chính xác, và đáng để nói rõ nó ngụ ý và không ngụ ý điều gì, bởi cách hiểu tự nhiên — “nó là một Research được đóng gói lại” — không phải là cách hiểu duy nhất, và có lẽ cũng không phải cách hiểu hay nhất.

• Định giá giống hệt nhau là chuẩn mực đối với các SKU cùng dòng — khi một nhà cung cấp tách một mô hình thành các endpoint theo vai trò cụ thể, mức tính toán trên mỗi token thường như nhau và khác biệt nằm ở system prompt, bộ công cụ, hoặc phạm vi an toàn và truy cập, không yếu tố nào trong số đó làm thay đổi mức giá trên mỗi token

• Giá giống hệt nhau cũng là dấu hiệu của một placeholder — một hàng staging thường được tạo bằng cách sao chép hàng anh em hiện có và chỉnh sửa id, tạo ra đúng dấu hiệu đặc trưng này: cùng ba con số, cùng một chú thích, không có tài liệu

• Việc ngang giá loại trừ một khả năng — đây không phải là một biến thể chưng cất nhỏ hơn, rẻ hơn. Một mô hình theo đuổi chi phí thấp trong dòng này lẽ ra sẽ được định giá dưới mức $5.00/$25.00, giống như cách phần còn lại trong danh mục sản phẩm của nhà cung cấp giảm dần qua các bậc.

• Và nó cũng đúng ở một khía cạnh khác — dù Discovery là gì, nhà cung cấp kỳ vọng nó tiêu thụ gần như cùng mức kinh tế token như Research, điều này cho thấy kích thước mô hình tương đương hoặc nỗ lực suy luận tương đương mỗi lần gọi, chứ không phải một lớp hệ thống khác.

Lưu ý sự mơ hồ cố ý: một bảng tính phí không thể phân biệt giữa "một tầng năng lực riêng biệt mà tình cờ được định giá giống hệt nhau" và "một bản sao của một hàng hiện có mà chưa ai cấu hình xong". Cả hai đều tạo ra cùng ba con số. Bất kỳ ai nói với bạn rằng mức giá chứng minh một trong hai điều này thì đều đang đoán.

Cái tên, và nơi duy nhất nó không phù hợp

"Discovery" không phải là một từ mà nhà cung cấp đã dùng cho bất kỳ thứ gì khác trong dòng sản phẩm này, vì vậy bài tập hữu ích nhất là đối chiếu nó với các bề mặt Rosalind mà công ty thực sự đã tài liệu hóa. Bài đăng dành cho nhà phát triển về Rosalind Workbench ngày 28 tháng 8 năm 2026 là tài liệu tham khảo tốt nhất hiện có, và nó nói rõ về các chế độ của tác nhân: "Tác nhân ChatGPT trong Rosalind Workbench hỗ trợ hai chế độ: chế độ Explore … chế độ Research."

Hai chế độ. Không phải ba. Discovery không nằm trong số đó. Đó là một điểm dữ liệu thực sự chống lại cách lý giải đơn giản nhất — rằng đây chỉ là một chế độ Workbench được đổi tên hoặc mới được lộ ra — và nó đẩy những cách hiểu hợp lý về phía lớp mô hình thay vì lớp sản phẩm.

Những gì còn tồn tại, được nêu ra như phỏng đoán và được ghi nhãn đúng như vậy:

• Sự tách biệt giữa nghiên cứu và phát triển — "Nghiên cứu" được hiểu là việc tạo giả thuyết và lập luận dựa trên tài liệu; "Khám phá" được hiểu là xác định mục tiêu, sàng lọc, hoặc tìm kiếm hit. Trong bối cảnh khoa học sự sống, đó là một cách phân công lao động mạch lạc, và đó là cách hiểu mà hầu hết mọi người nghĩ đến đầu tiên

• Một bậc dành cho đối tác — cách diễn đạt quyền truy cập của chú thích cuối trang ("nghiên cứu nội bộ đã được phê duyệt thông qua chương trình truy cập tin cậy") mô tả một chương trình yêu cầu phê duyệt. SKU thứ hai có thể là một quyền cấp có phạm vi khác trong cùng chương trình đó, thay vì một năng lực mới

• Một endpoint đánh giá hoặc chỉ dùng nội bộ — một số nhà cung cấp để lộ những mô hình không bao giờ dành cho khách hàng gọi, được liệt kê để hạch toán nội bộ. Một trang tài liệu 404 là nhất quán với điều này, dù một bản ghi được tạo quá sớm cũng vậy.

• Cái nhàm chán — một artifact staging không bao giờ được phát hành dưới tên này. Nó xứng đáng có mặt trong danh sách. Những dòng giá chưa được công bố đứng trước các thông báo, nhưng chúng cũng đứng trước các đợt hủy bỏ.

Không có điều nào trong số này được xác nhận, và dù có nhìn chằm chằm vào bảng giá bao lâu cũng không thể chọn ra được giữa chúng. Tóm tắt trung thực là một cái tên, một mức giá và một lỗi 404 là đủ để xác lập rằng có thứ gì đó tồn tại và gần như không gì khác.

A generated single-column infographic titled 'GPT-Rosalind Discovery — the scoreboard' with six rows reading 'Price: $5.00 / $0.50 / $25.00', 'Parity: identical to gpt-rosalind-research', 'Docs page: HTTP 404', 'Announcement: none', 'Workbench mode: not among Explore or Research', 'Availability: trusted-access program only'. The footer reads 'All figures read from OpenAI's own API pricing page, Oct 10 2026; no independent benchmark exists.'

Nếu bạn xây dựng bằng các mô hình, đây là cách hiểu thực tế.

Hiện chưa có mục hành động nào cho bất kỳ ai bên ngoài chương trình truy cập tin cậy, và thật đáng nói thẳng rằng OrcaRouter không phục vụ GPT-Rosalind Discovery hay GPT-Rosalind Research — tuần này, danh sách /v1/models có tới 205 mô hình và không chứa bất kỳ mục Rosalind nào dưới bất kỳ hình thức nào. Cơ chế kiểm soát quyền truy cập cho dòng này là một quy trình phê duyệt, không phải quyết định định tuyến, và không gateway nào có thể trao cho bạn quyền truy cập mà nó không có. Cho đến khi nhà cung cấp công bố một trang tài liệu và mở quyền truy cập cho mô hình, con đường duy nhất để tiếp cận một trong hai là API riêng của nhà cung cấp và chương trình truy cập xung quanh nó.

Điều hữu ích lúc này là hình dạng của vấn đề mà rò rỉ này tạo ra cho bất kỳ ai thực sự có được quyền truy cập. Bạn sẽ được giao một mô hình chưa được kiểm chứng với cái tên ngụ ý một công việc cụ thể, không có benchmark công khai, không có model card, và một mức giá chẳng nói cho bạn biết nên đưa mô hình nào trong hai mô hình có giá tương đương vào lộ trình sản xuất. Cách tiêu chuẩn để vượt qua điều đó là ngừng coi nó như một canh bạc và bắt đầu coi nó như một ứng viên: chạy thử nó đối chiếu với mô hình bạn đang dùng, trên dữ liệu của chính bạn, sau một router có thể gửi một phần lưu lượng đến nó và giữ nguyên phần còn lại ở chỗ cũ. Đó là công việc định tuyến mô hình thông thường, và đây là lớp mà các chi tiết cụ thể đứng vững — một API duy nhất cho hơn 200 mô hình ở mức giá niêm yết của nhà cung cấp với 0% markup, nên khi nhà cung cấp thay đổi giá, nó xuất hiện trên hóa đơn của bạn cùng ngày nó xuất hiện trên hóa đơn của họ; tự động chuyển đổi dự phòng khi một nhà cung cấp suy giảm chất lượng, điều giúp một thử nghiệm kéo dài hai tuần trên một endpoint chưa được chứng minh trở nên khả thi; và một DSL định tuyến cho phép bạn ghép nhiều mô hình vào một lời gọi duy nhất, đó là cách tự nhiên để hỏi liệu Discovery và Research có thực sự bất đồng về cùng một câu hỏi hay không.

Một con số đáng ghi nhớ: ngày 5 tháng 10 năm 2026 bắt đầu tính phí cho gpt-rosalind-research là mốc thời gian cứng đầu tiên mà chương trình này từng có. Dù Discovery rốt cuộc là gì, nó nằm trong một dòng sản phẩm đã không còn miễn phí nữa.

A screenshot of the OrcaRouter model catalogue at orcarouter.ai/models, headed 'Discover the best AI models in one place.' and showing a 'Total models 205' counter with filter tabs for All, Chat, Code, Image, Video, Audio and Embedding. The featured chat list includes GPT-6 Astra, GPT-6 Luna, GPT-6 Sol, GPT-6.1 Sol, GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna, DeepSeek V4 Pro, DeepSeek V4.1 Flash and GLM-5.2 — and no Rosalind model of any kind.

Điều gì sẽ thay đổi cách hiểu

Đây là một bài rò rỉ, nên phán đoán kết luận nên xoay quanh việc bác bỏ hơn là dự đoán. Bốn điều, theo thứ tự tương đối về mức độ mà mỗi điều sẽ giải quyết được:

• Một trang tài liệu được đưa lên trực tuyến — một thẻ mô hình với cửa sổ ngữ cảnh, mốc cắt kiến thức và danh sách công cụ được hỗ trợ — biến “có gì đó đã được dàn sẵn” thành “có gì đó đã được đặc tả rõ ràng”

• Sự biến mất của nó khỏi bảng — cách xử lý rẻ nhất và khả dĩ nhất. Các hàng staging bị rút đi. Nếu tuần sau nó không còn nữa, thì toàn bộ chuyện chỉ là hạ tầng ngầm.

• Một mức giá thứ ba — nếu Discovery có bao giờ lệch khỏi $5.00/$0.50/$25.00, thì hai mô hình rõ ràng là những hệ thống khác nhau và việc đọc ra tính tương đương chỉ là hệ quả giả tạo từ một hàng được sao chép

• Một chế độ Workbench được đặt tên theo nó — điều đó có nghĩa là cái tên thuộc về lớp sản phẩm, và hai chế độ được ghi tài liệu chỉ đơn giản là chưa đầy đủ

Cho đến khi ít nhất một trong những điều đó xảy ra, lập trường đúng đắn là lập trường kém hào nhoáng: hãy ghi nhận rằng mục hàng đó tồn tại, đừng xây dựng lộ trình dựa trên nó, và đừng để một ID mô hình trong bảng thanh toán thay đổi thứ bạn phát hành trong tháng này. Họ mô hình là thật, cổng kiểm soát là thật, và mục thứ hai vẫn chưa được công ty sẽ bán nó công bố.