Một thẻ tiêu đề được tạo tự động ghi 'đặc vụ o của OpenAI: rò rỉ DevDay, đã gắn nhãn', kèm dòng trạng thái 'Được báo cáo là một đặc vụ luôn bật dành cho các gói ChatGPT Pro - không có trang sản phẩm, không có giá, không có ID mô hình, không có tuyên bố nào từ OpenAI'. Ba thẻ ghi: 'Tham chiếu - được phát hiện dưới dạng một tên hiển thị và một hậu tố email, theo một báo cáo'; 'Khung thời gian - DevDay 2026, ngày 29 tháng 9, Fort Mason Center'; 'Khoảng trống - nhiệm vụ, quyền hạn, bộ nhớ, lập lịch và tính khả dụng đều chưa được báo cáo'. Một dòng chân trang ghi 'Rò rỉ từ một nguồn duy nhất. Không có gì ở đây là thông báo của OpenAI.' Logo OrcaRouter nằm ở góc dưới cùng bên phải.
Guides & Insights

Agent “o” của OpenAI: Bản rò rỉ DevDay 2026 thực sự nói gì, và những gì nó không nói

Tác giả

Alistair Wren

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Cái tên được đồn đại là phần kém thú vị nhất. Điều mà rò rỉ nói về trợ lý luôn bật của công ty là nó sẽ được gọi là "o", rằng nó sẽ nằm trong mọi gói ChatGPT Pro, và rằng một Chế độ Nhanh — chạy trên chip Cerebras — được gắn kèm với nó. Chi tiết đáng để dừng lại thì nhỏ hơn và lạ hơn thế: theo báo cáo, tham chiếu đó được phát hiện trên trang nâng cấp của gói Pro $100, chứ không phải gói $200, vào đúng tháng mà công ty ngừng bán gói $200 hoàn toàn. Không có trang sản phẩm, không có giá, không có mã định danh mô hình và không có tuyên bố nào của công ty dùng chữ cái đó làm tên sản phẩm. Bài đăng đằng sau bài viết này là bản tóm tắt của một tài khoản về những gì nó nói là đã thấy, và hội nghị mà nó gắn với là có thật: DevDay 2026 diễn ra ngày 29 tháng 9 tại Fort Mason Center ở San Francisco. Trợ lý mà nó cạnh tranh cùng cũng có thật — Gro​k Bot, sản phẩm đồng nghiệp số mà SpaceXAI đưa vào bản beta sớm ngày 11 tháng 8. Mô hình mà trợ lý này nhiều khả năng sẽ chạy trên đó là có thật và có ngày tháng: GPT-6 Astra, được phát hành rộng rãi từ ngày 3 tháng 9. Hầu như không có gì khác trong tuyên bố này là thật.

Rò rỉ thực sự bao gồm những gì, được sắp xếp theo mức độ quan trọng

Có ba điều đang được báo cáo, và chúng không nên bị đọc như một khẳng định duy nhất.

Các tham chiếu trong ảnh chụp màn hình là phần mạnh nhất. Bài đưa tin công bố ngày 26 tháng 9 cho biết các tham chiếu đến "O" xuất hiện khắp cấu hình của chính ChatGPT — như một tên hiển thị, và như một hậu tố thư được viết là "-o" — và rằng cùng chuỗi đó gần đây đã được liệt kê như một quyền lợi trên trang nâng cấp của gói ChatGPT Pro giá 100 USD. Đó là những dấu vết mang dáng dấp triển khai chứ không phải phát minh: các bề mặt cấu hình là nơi một công ty dàn dựng sản phẩm trước khi công bố, giống như cách các feature flag vẫn làm. Chúng cũng là loại dấu vết yếu nhất hiện có, vì một chuỗi được dàn dựng có thể bị đổi tên, thay đổi mục đích hoặc bỏ đi, và nó không mang theo hành vi nào. Báo cáo nói rõ về khoảng trống đó: tác nhân làm gì, nó có thể truy cập những gì, liệu nó có lên lịch bất cứ điều gì không, nó ghi nhớ trong bao lâu, và ai sẽ được nhận nó — tất cả đều không được nêu.

Cái tên chỉ là tuyên bố thứ yếu. Một tài khoản @o bị đình chỉ trên X được viện dẫn như một sự đặt trước khả dĩ. Một handle bị đình chỉ chỉ là một điểm dữ liệu về ý định tại một thời điểm nào đó, chứ không phải về việc sản phẩm là gì, và chính chữ cái đó đã từng đi qua bộ phận đặt tên của OpenAI một lần — sẽ nói thêm về điều này ở dưới.

Lớp thứ ba là phần đến từ tín hiệu của tuần này chứ không phải từ hoạt động đưa tin: rằng "o" xuất hiện trong tất cả các hạng Pro, rằng Fast Mode đã được xác nhận, rằng nó được cho là được gộp vào một gói đăng ký $500, và rằng silicon của Cerebras chính là thứ giúp tốc độ đó trở nên khả thi. "Presumably" đang đảm nhiệm một vai trò rõ rệt trong câu đó. Bản thân bài đăng tín hiệu đã bị cắt cụt trong bản chụp mà radar lấy được — mục thứ năm của nó bắt đầu bằng "shared m…" rồi dừng — nên hãy đọc danh sách đó như chưa hoàn chỉnh thay vì như năm điểm đã chốt.

Vấn đề đặt tên mà chưa ai kiểm tra

OpenAI đã dùng chữ cái đó rồi. Các mô hình suy luận của hãng ra mắt dưới tên o1, o3, o3-mini và o4-mini trong suốt năm 2024 và 2025, và dòng sản phẩm này đã bị thu hẹp dần thay vì mở rộng: o4-mini bị gỡ khỏi ChatGPT vào tháng 2 năm 2026, GPT-4.5 rời đi vào tháng 6, và o3 được ấn định thời gian khai tử 90 ngày công bố trong ghi chú phát hành mô hình ngày 28 tháng 5 — một sự ngừng hoạt động mà blog này đã đưa tin vào thời điểm đó vì người dùng báo cáo tình trạng phản hồi biến mất trước hạn chót.

Vậy nên một chữ "o" trơ trọi làm tên cho một agent tiêu dùng sẽ đụng độ với lịch sử gần đây của chính công ty, và sẽ gây nhập nhằng ở đúng một nơi mà sự nhập nhằng rất tốn kém: trình chọn mô hình. Đó không phải bằng chứng cho thấy vụ rò rỉ là sai — các nhà cung cấp vẫn tái sử dụng chữ cái, và một tên mã nội bộ thường chết ở khâu duyệt đặt tên — nhưng đó là lý do để coi cái tên là phần dễ bị gạt bỏ nhất trong câu chuyện. Nếu "o" ra mắt dưới một nhãn khác, mọi dữ kiện kèm ngày tháng bên dưới vẫn đứng vững.

Tại sao thời điểm lại đáng tin cậy dù sản phẩm thì không

Bằng chứng mạnh mẽ nhất cho việc ra mắt agent tại DevDay không phải là vụ rò rỉ. Mà là những gì OpenAI đã chuẩn bị sẵn trong bốn tuần trước đó.

• Ngày 3 tháng 9 — GPT-6 Astra đã đạt trạng thái sẵn sàng chung với tư cách là mô hình tiên phong của OpenAI: ngữ cảnh 1,05 triệu token, đầu ra tối đa 128K, được niêm yết ở mức 10,00 USD cho mỗi triệu token đầu vào và 50,00 USD cho mỗi triệu token đầu ra, với đầu vào được lưu đệm ở mức 1,00 USD và ghi bộ đệm ở mức 12,50 USD. Danh mục của riêng chúng tôi có cùng mô hình đó dưới ngày niêm yết 2026-09-04; Artificial Analysis ghi nhận ngày phát hành là ngày 3 tháng 9.

• Ngày 10 tháng 9 — OpenAI đã mở Agents API ở dạng beta công khai, bán cho các nhà phát triển bộ khung Codex được quản lý: OpenAI đảm nhận việc điều phối, nén ngữ cảnh và khôi phục, còn nhà phát triển cung cấp tác vụ, mô hình, công cụ và môi trường. Đó là hạ tầng của một agent hoạt động liên tục, được bán như một sản phẩm dành cho nhà phát triển.

• Ngày 10 tháng 9 — cùng ngày hôm đó, các lượt đăng ký mới và nâng cấp lên gói ChatGPT Pro 200 đô la đã bị tạm dừng, với lý do được đưa ra là nhu cầu đối với GPT-6 Astra. Các gói 100 đô la, Plus, Go, Business và Enterprise cùng API đều vẫn mở.

• Ngày 22 tháng 9 — GPT-6 Sol và GPT-6 Luna đã ra mắt với mức giá 2,00 USD / 10,00 USD và 0,10 USD / 0,50 USD mỗi triệu token, điều mà OpenAI mô tả là vĩnh viễn chứ không phải chỉ mang tính khuyến mãi, kéo dài phần rẻ nhất của dòng sản phẩm mà tác nhân sẽ dựa vào cho công việc thường ngày.

• Ngày 26 tháng 9 — tài liệu của tầng phục vụ Ultrafast đã được mở rộng, với bộ chọn tốc độ cung cấp Standard, Fast và Ultrafast được phát hiện dù chưa được công bố trong Responses API Playground, và các báo cáo chỉ ra một đợt triển khai rộng hơn quanh DevDay.

• 29 tháng 9 — DevDay 2026, bài phát biểu chính được phát trực tiếp, Sam Altman khai mạc. Tài khoản nhà phát triển của OpenAI đã đăng “72 giờ nữa là đến OpenAI DevDay” vào đúng cuối tuần mà báo cáo về agent được công bố.

Screenshot of the OrcaRouter model page for OpenAI GPT-6 Astra, showing a 1.05M-token context window, input pricing of $10.00 and output pricing of $50.00 per million tokens with $1.00 cached input and $12.50 cache writes, and a second pricing row above 272,000 input tokens at double the input and cache rates and 1.5x the output rate, plus capability tags for Vision, Tools, JSON and Reasoning.

Đọc sáu dòng đó cùng nhau và hình dạng của câu chuyện là mạch lạc: OpenAI đã sản phẩm hóa bộ khung tác nhân, bán nó cho các nhà phát triển, phân bổ hạn chế suất dành cho người dùng vốn mang mô hình tốt nhất của mình, và có một bài phát biểu chính trong bốn ngày nữa. Một phiên bản hướng tới người dùng của chính bộ khung đó — được bán dưới dạng thuê bao thay vì endpoint tính theo token — là bước đi tiếp theo hiển nhiên. Không điều nào trong số đó làm cho cái tên, hạng dịch vụ, hay mối liên hệ Cerebras được xác minh. Nó khiến thời điểm trở nên hợp lý, đó là một khẳng định khác và yếu hơn.

Fast Mode, Ultrafast và tuyên bố của Cerebras

Tín hiệu cho thấy Fast Mode đã được "xác nhận" và chip Cerebras "phát huy tác dụng". Cần tách bạch hai điều này khỏi nhau, bởi một bên là hạ tầng nền tảng đã được ghi rõ trong tài liệu, còn bên kia là suy luận về việc chip nào phục vụ sản phẩm nào.

Fast mode là một tier thực sự, có tính phí trên API của OpenAI dành cho dòng GPT-6: nó tính giá gấp đôi mức tiêu chuẩn và đổi lấy tốc độ đầu ra nhanh hơn khoảng 2,5 lần, và đây chính là tier đã được đổi tên từ Priority processing vào ngày 30 tháng 7 năm 2026 — API chấp nhận cả service_tier: "fast" hoặc service_tier: "priority". Nó không khả dụng với EU data residency trên ít nhất một model trong dòng. Bên trong nhóm đăng ký ChatGPT, các báo cáo về cấu trúc tín dụng đăng ký cho thấy Fast mode ở mức 2,5 lần tỷ lệ tín dụng thay vì 2 lần của API, khiến cho cài đặt nhanh nhất trở thành một lựa chọn hơi kém hời hơn trong ChatGPT so với bên ngoài — một chi tiết đáng để biết trước khi cho rằng lợi ích của Fast-Mode đáng giá như cách nó được nghe.

Ultrafast là gói cấp Cerebras và nó là một loài hoàn toàn khác. OpenAI công bố nó vào ngày 13 tháng 8 năm 2026 với tư cách là sản phẩm đầu tiên của quan hệ đối tác tính toán với Cerebras — một thỏa thuận được báo cáo trị giá khoảng 10 tỷ USD trong ba năm — và nó mang lại thông lượng lên tới gấp 14 lần mức tiêu chuẩn cùng tối đa 750 token đầu ra mỗi giây trên GPT-5.6 Sol, mô hình mà hiện tại nó chỉ được giới hạn ở đó. Nó được kiểm soát quyền truy cập, không có mức giá công bố, và tính đến tuần này, nó vẫn là một gói cấp trong danh sách chờ chứ chưa phải gói phổ thông. Tài liệu tham chiếu API Responses liệt kê ultrafast là một giá trị cho tham số service_tier, kèm theo lưu ý rằng nó "hiện chỉ khả dụng cho gpt-5.6-sol".

Đó chính xác là lý do câu về Cerebras trong rò rỉ nên được coi là một phỏng đoán có cơ sở hợp lý chứ không phải một xác nhận. Một agent dành cho người tiêu dùng chạy liên tục sẽ bị chi phối bởi độ trễ và chi phí trên mỗi tác vụ, và tốc độ đẳng cấp Cerebras là câu trả lời thực sự cho nửa đầu của điều đó. Nhưng chưa có đường Ultrafast nào được tài liệu hóa cho bất kỳ mô hình GPT-6 nào, không có bảng giá cho nó, và không có gì từ OpenAI gắn một agent tiêu dùng với loại silicon đó. Hướng của suy luận là hợp lý; sự chắc chắn trong cách diễn đạt thì không có cơ sở.

Việc “có trong mọi gói Pro” sẽ khiến bạn phải trả giá như thế nào

Đây là phần của tuyên bố mà người đọc thực sự có thể đánh giá, bởi vì cấu trúc phân tầng bên dưới nó đã được công bố.

• Giá hàng tháng — các gói ChatGPT Pro 100 USD và 200 USD đều đã được mở bán trong suốt tháng 9; việc đăng ký mới cho gói 200 USD đã bị tạm dừng kể từ ngày 10 tháng 9 và OpenAI chưa công bố ngưỡng mở lại nào.

• Phiên bản tính theo mức sử dụng của cùng khả năng đó — GPT-6 Pro bị giới hạn ở 200 tin nhắn một tuần đối với gói $200 và 50 tin nhắn một tuần đối với gói $100, mức sau được lấy từ hạn mức chia sẻ với GPT-5.6 Sol Pro. Các gói dành cho doanh nghiệp còn thấp hơn. Đó là những con số đã được OpenAI công bố và chúng chính là giới hạn thực sự đối với giá trị của một "lợi ích trên trang nâng cấp".

• Phép tính token trên mô hình bên dưới — ở mức $10,00 / $50,00 mỗi triệu, $500 dùng API GPT-6 Astra tương đương khoảng 50M token đầu vào hoặc 10M token đầu ra, rồi lại giảm một nửa nữa về khối lượng công việc hiệu dụng khi vượt ngưỡng đầu vào 272K, thời điểm mà toàn bộ yêu cầu được định giá lại ở mức $20,00 / $2,00 / $75,00.

• Nửa rẻ hơn của dòng sản phẩm — cùng 500 đô-la mua được khoảng 250 triệu token đầu vào hoặc 50 triệu token đầu ra trên GPT-6 Sol với mức 2,00 / 10,00 đô-la, và gấp mười lần con số đó trên GPT-6 Luna với mức 0,10 / 0,50 đô-la.

Nếu agent đến trong một gói đăng ký sẵn có, việc so sánh không còn là về giá niêm yết mà trở thành về việc bạn đã trả tiền cho chỗ ngồi nào. Nếu nó đến như một mục hàng riêng, OpenAI phải biện minh cho nó so với một danh mục mà ở đó một đối thủ đã tung ra được sáu tuần. Dù theo cách nào, một agent hoạt động liên tục cũng thay đổi hình thái của hóa đơn: một trợ lý vẫn tiếp tục làm việc trong lúc bạn ngủ sẽ tiêu tốn token mà không có con người trong vòng lặp, và đó chính là khối lượng công việc mà một gói tính theo lượng sử dụng trừng phạt còn một chỗ ngồi thì hấp thụ. Đây cũng là khối lượng công việc mà đầu vào được cache ở mức một phần mười so với đầu vào mới quyết định tổng chi phí — một agent thường trú gửi lại một ngữ cảnh gần như không đổi ở mỗi lượt, và đó chính xác là kiểu mẫu mà chiết khấu cache được sinh ra để dành cho.

Đó là lớp mà OrcaRouter vận hành, và cần nói thẳng về những gì nó không bao phủ. Chúng tôi định tuyến các mô hình của OpenAI theo token với giá niêm yết của nhà cung cấp được chuyển nguyên mức 0% markup, nên khi nhà cung cấp thay đổi giá thì ở đây có hiệu lực ngay trong cùng ngày, với tự động chuyển đổi dự phòng giữa các nhà cung cấp và một DSL định tuyến để kết hợp các lệnh gọi. GPT-6 Astra, GPT-5.6 Sol, GPT-6 Sol và GPT-6 Luna đều nằm trên cùng một key. Điều chúng tôi không thể bán cho bạn là một gói đăng ký ChatGPT hay một agent chưa tồn tại — chẳng có gì để định tuyến cho đến khi OpenAI phát hành nó.

Ngưỡng mà tác nhân phải vượt qua thấp hơn vẻ ngoài của nó.

Grok Bot là sự so sánh mà chính vụ rò rỉ đưa ra, và cách đọc trung thực về nó là SpaceXAI đã đặt ra một tiêu chuẩn thấp. Nó bước vào giai đoạn beta sớm vào ngày 11 tháng 8 với cấu hình khởi điểm $120 mỗi ghế, được gói kèm trong Cursor Premium Teams, với các gói cá nhân ở mức $200 và $300 một tháng và việc sử dụng vượt quá giới hạn bao gồm sẽ được tính phí theo chi phí token. Mỗi bot có máy ảo đám mây riêng với trình duyệt, hệ thống tập tin và terminal; nó đăng nhập vào các ứng dụng không có API; nó lưu các quy trình làm việc đã được trình diễn thành các quy trình và vẫn tiếp tục sau khi laptop đóng lại.

Điều chưa được công bố lại chính là phần có thể giải quyết mọi chuyện. SpaceXAI chưa công bố bất kỳ đánh giá chuẩn độc lập hay dữ liệu độ tin cậy nào cho nó, bộ định tuyến mô hình đằng sau nó hoạt động tự động và người dùng không thể ghim một mô hình, những người thử nghiệm ban đầu đã công khai tỏ ra không mấy ấn tượng, và các nhà đánh giá lưu ý sự thiếu vắng một lớp kiểm soát dành cho doanh nghiệp — không có quyền hạn theo phạm vi, quy tắc leo thang hay dấu vết kiểm toán. Muse của Meta ra mắt tiếp sau đó vào ngày 8 tháng 9, bước vào một hạng mục mà giờ đây đã có tới ba sản phẩm.

A two-column scoreboard titled 'o vs Grok Bot - the scoreboard'. The left column, 'o (reported)', reads: Status reported for DevDay, Sept 29; Evidence a display name and a mail suffix, per one report; Tiers reported as all Pro tiers, unconfirmed; Speed mode reported Fast Mode on Cerebras, unconfirmed; Behaviour unreported; Benchmarks none. The right column, 'Grok Bot (shipped)', reads: Status early beta since Aug 11, 2026; Evidence vendor product page; Tiers from $120 per seat per month, bundled with Cursor Premium Teams; Speed mode vendor-managed, model not pinnable; Behaviour cloud VM with browser, filesystem and terminal; Benchmarks none published. A footer line reads 'o column is single-source reporting; Grok Bot figures per SpaceXAI. Neither side has published independent reliability data.'

Hàng cuối cùng đó chính là điểm mấu chốt của toàn bộ phép so sánh. Không có chỉ số Artificial Analysis nào cho câu hỏi "liệu agent có hoàn thành nhiệm vụ mà không gây ra thảm họa nào không", nên một agent thường trực được mua dựa trên đúng bằng chứng mà một chatbot từng được mua vào năm 2023: các bản demo và cảm nhận. Ràng buộc gắn với thời điểm duy nhất mà không ai trong câu chuyện này nhắc đến là lập trường an toàn của chính OpenAI. GPT-6 Astra đã chạm ngưỡng năng lực an ninh mạng Critical của công ty, và OpenAI đã cảnh báo rằng việc giám sát có thể làm chậm, tạm dừng hoặc dừng các nhiệm vụ hợp lệ — bao gồm rõ ràng cả những tác vụ chạy dài. Một agent luôn bật theo định nghĩa là một tác vụ chạy dài, trong chính nền tảng đã từng nói rằng nó có thể ngắt một tác vụ như vậy.

Điều gì sẽ khiến điều này có thể kiểm chứng được, và khi nào?

Tin đồn về một sản phẩm còn bốn ngày nữa mới ra mắt thì rẻ, và những bước kiểm chứng thì cụ thể.

• Một trang OpenAI, ghi chú phát hành hoặc mục trong trung tâm trợ giúp sử dụng tên đó như tên sản phẩm. Đến nay vẫn chưa có gì xuất hiện, và lịch sử của lá thư bên trong OpenAI khiến đây trở thành phép thử có nhiều khả năng thất bại nhất.

• Một bề mặt cấu hình tồn tại qua một lần làm mới — một gói thực sự có thể mua được, một hạn mức được niêm yết, một trang cài đặt — chứ không phải một chuỗi hiển thị được dàn dựng trong một bản dựng.

• Bất kỳ đặc tả hành vi nào, dù chỉ là nhỏ nhất: nó có thể được cấp những gì, nó lên lịch những gì, nó ghi nhớ trong bao lâu, liệu nó có danh tính thư riêng trong môi trường sản xuất hay chỉ trong một tệp cấu hình.

• Một mức giá. "Trong tất cả các gói Pro" không phải là một mức giá, và một gói 500 đô-la không trở thành sự thật chỉ vì một báo cáo riêng rẽ đã tìm thấy các chuỗi đăng ký 500 đô-la ở một chỗ khác.

• Việc liên kết Cerebras hoặc xuất hiện trong tài liệu phục vụ của chính OpenAI cho hạng đó, giống như cách mà hạn chế của Ultrafast đối với GPT-5.6 Sol đã thể hiện, hoặc hoàn toàn không xuất hiện.

A two-column card titled 'The o agent - verified vs claimed'. The left column, 'Verified and dated', reads: DevDay 2026 on September 29 at Fort Mason Center; GPT-6 Astra generally available September 3 at $10 / $50 per million; Agents API public beta September 10; ChatGPT Pro $200 sign-ups paused September 10; GPT-6 Sol and GPT-6 Luna shipped September 22 at $2 / $10 and $0.10 / $0.50; Ultrafast documented as access-controlled on GPT-5.6 Sol; Grok Bot in early beta since August 11. The right column, 'Claimed and unverified', reads: the product name 'o'; an announcement at DevDay; availability in all Pro tiers; Fast Mode bundled into a $500 tier; Cerebras serving the agent; tasks, permissions, memory and scheduling; any published price. A footer line reads 'Left column per OpenAI, SpaceXAI and Artificial Analysis; right column single-source reporting.'

Quyết định mà điều này để lại nơi người đọc thì nhỏ hơn những gì vụ rò rỉ ngụ ý, và nó không nằm ở lá thư. Nếu bạn đang cân nhắc một agent luôn bật để phục vụ công việc, thì sản phẩm tồn tại ở thời điểm hiện tại là Gro​k Bot, và nước đi hợp lý là dùng thử ngắn hạn với chính quy trình làm việc của bạn thay vì cam kết mua theo ghế — gói khởi điểm $120 chỉ là mức sàn, không phải mức trần, và phần sử dụng vượt quá giới hạn đi kèm sẽ bị tính theo chi phí token. Nếu bạn đang xây dựng, Agents API đã ở giai đoạn public beta từ ngày 10 tháng 9 và là phần của câu chuyện này mà bạn thực sự có thể kiểm thử ngay hôm nay, với harness, sandbox và phần tính phí đều đã được tài liệu hóa.

Và nếu bạn đang định giá xem bất kỳ thứ nào trong số này sẽ tốn bao nhiêu để vận hành, hãy làm điều đó dựa trên các mô hình thay vì dựa trên tin đồn. GPT-6 Astra ở mức $10.00 / $50.00 mỗi triệu token đang hoạt động trên OrcaRouter theo đúng giá niêm yết của OpenAI mà không cộng thêm phụ trội, GPT-6 Sol và GPT-6 Luna cũng có ở đó với mức $2.00 / $10.00 và $0.10 / $0.50, và mức giá đọc bộ nhớ đệm — $1.00 so với $10.00 đối với Astra — chính là con số quyết định chi phí thực tế của một khối lượng công việc thường trực. Một agent mà OpenAI chưa công bố thì không thể được benchmark, định tuyến hay mua. Các token bên dưới nó thì có thể, ngay hôm nay, và đồng hồ đo bạn xây dựng dựa trên chúng vẫn sẽ là đồng hồ đo đúng nếu cái tên trên hộp hóa ra là một thứ gì đó khác chứ không phải một chữ cái đơn.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày