Thẻ tiêu đề được tạo có tiêu đề 'Step 5 Preview vs GLM-5.5 — một cái ra mắt, một cái thì không' với hai cột: Step 5 Preview ở Chỉ số AA 44, tổng 600B / 27B hoạt động, giá $1.00 / $2.70, đầu ra 99,8 token/giây và API hoạt động từ ngày 20 tháng 9; GLM-5.5 với các hàng ghi không có thẻ mô hình, không có mã định danh API, không có giá và không có tên được xác nhận. Một chân trang ghi 'Số liệu của Step 5 Preview theo Artificial Analysis; GLM-5.5 là một mô hình chưa được công bố, chưa phát hành.'
Guides & Insights

Step 5 Preview so với GLM-5.5: Một mô hình ra mắt ngay hôm nay, mô hình kia vẫn chỉ là dự báo

Tác giả

Gideon Frost

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Step 5 Preview đã mở API vào ngày 20 tháng 9 năm 2026, cùng ngày StepFun công bố nó, và bạn có thể gọi nó ngay chiều nay từ một endpoint duy nhất với mức giá 1,00 USD cho mỗi triệu token đầu vào và 2,70 USD cho mỗi triệu token đầu ra. GLM-5.5 không tồn tại. Không có model card, không có mã định danh API, không có giá, không có checkpoint và không có tệp giấy phép, và không có bất kỳ trang Z.ai nào sử dụng cái tên đó — bởi vì GLM-5.5 là cách gọi tắt của cộng đồng mà công ty chưa từng áp dụng. Chính sự bất đối xứng đó là bài viết. Phần tiếp theo là những gì StepFun thực sự đã phát hành, những gì thực sự đã được xác lập về chiếc flagship tiếp theo của Z.ai, và màn đối đầu mà bạn có thể chạy ngay hôm nay thay cho màn đối đầu trong tiêu đề.

GLM-5.5 là gì và không phải là gì

Cái tên này bắt đầu được nhắc đến vào giữa năm 2026 gắn với một khung thời gian phát hành, và khung thời gian đó có nguồn gốc truy vết được: một dự báo của chuyên gia phân tích được chuyển tiếp vào ngày 25 tháng 6 năm 2026, đặt sản phẩm chủ lực tiếp theo của Z.ai vào tháng 8. Đó là một khung thời gian để theo dõi, chứ không phải cam kết từ phía nhà cung cấp, và tháng 8 đã kết thúc mà không có nó. Thứ mà Z.ai phát hành thay vào đó là GLM-5.3, được công bố ngày 14 tháng 8, với API hoạt động khoảng ngày 18 tháng 8 và trọng số mở vào ngày 28 tháng 8, tiếp theo là GLM-5.3-Flash vào ngày 26 tháng 8. Không có checkpoint GLM-5.5 nào xuất hiện trên tổ chức Hugging Face của chính nhà cung cấp, nơi các kho lưu trữ mới nhất vẫn chỉ dừng ở dòng GLM-5.3.

Việc đặt tên cũng chưa ngã ngũ. GLM-5.3, GLM-5.4, GLM-5.5 và GLM-6 đều đã được đưa ra trong cùng một khoảng thời gian, và Z.ai chưa xác nhận cái nào cả. Tín hiệu duy nhất từ phía công ty là phát biểu của một nhà đồng sáng lập về một bản phát hành “epic plus”, vốn là một tâm thế hơn là một đặc tả. Các nhà phân tích đọc nhịp ra bản của nhà cung cấp — khoảng một mẫu chủ lực mỗi 54 đến 70 ngày — giờ dự phóng mô hình tiếp theo vào khoảng từ ngày 8 tháng 10 đến ngày 9 tháng 11 năm 2026, và kỳ vọng nó sẽ được đánh số là GLM-5.4 chứ không phải GLM-5.5.

Ba khẳng định đang được lan truyền như thể đã được xác nhận, và đáng để nói chính xác về cả ba. Số lượng tham số là điểm yếu nhất: không có thông tin chính thức nào ủng hộ con số “hơn 1 nghìn tỷ”, và những bài đăng mạng xã hội sau đó thổi phồng nó vượt 3 nghìn tỷ thì không trích dẫn bất cứ điều gì. Ngữ cảnh 1 triệu token là giả định an toàn nhất, vì GLM-5.2 và GLM-5.3 đều có nó. Trọng số mở là một kỳ vọng hơn là một lời hứa — Z.ai đã phát hành trọng số cho vài mô hình chủ lực gần đây nhất của mình, đó là một quy luật, không phải một cam kết.

Bản xem trước Step 5 thực sự phát hành những gì

Mô hình của StepFun là phần cụ thể của phép so sánh này, và các thông số kỹ thuật thì khác thường. Đây là một mô hình mixture-of-experts thưa với tổng cộng 600B tham số, chỉ có khoảng 27B tham số hoạt động trên mỗi token — tỷ lệ kích hoạt gần 4,5% — được xây dựng trên một transformer hẹp và sâu 92 lớp với sparse grouped-query attention và hợp nhất token theo khối. Cửa sổ ngữ cảnh là 1M token, đầu vào là văn bản và hình ảnh, đầu ra là văn bản, và mô hình suy luận bằng extended thinking. StepFun đã bỏ qua toàn bộ dòng Step 4.x để đến đây, đi thẳng từ Step-3.7-Flash lên Step 5.

• Chỉ số Thông minh — 44 trên Artificial Analysis, đứng thứ 24 trong số 200 mô hình được chấm điểm, so với mức trung vị là 24

• Tốc độ đầu ra — 99,8 token mỗi giây, thứ 45 trong số 200

• Thời gian đến token đầu tiên — 2,96 giây trên cùng một lần chạy độc lập

• Giá — $1.00 cho mỗi 1 triệu token đầu vào, $2.70 cho mỗi 1 triệu token đầu ra, với mức chiết khấu 95% cho bộ nhớ đệm

• Chi phí mỗi tác vụ Intelligence Index — $0,71, thứ 27 trong 200

• Trọng số — hôm nay không có; một checkpoint BF16 được lên lịch vào ngày 15 tháng 10 năm 2026

• Giấy phép — không được công bố. Mô hình là độc quyền, không có quyền sử dụng thương mại, quyền phân phối lại hay quyền tinh chỉnh nào được nêu.

Mức giá là hàng gây chú ý, và đây cũng là một điểm không có lợi cho StepFun như vẻ ngoài ban đầu: 160M token đầu ra trên Intelligence Index so với mức trung vị 92M, xếp thứ 64/200 theo tiêu chí đó. Mô hình này dài dòng, và sự dài dòng là một hệ số nhân chi phí đúng trong những khối lượng công việc agentic mà nó được bán để phục vụ. Con số $0.71 chi phí mỗi tác vụ đã tính sẵn điều đó, nên đây là con số trung thực hơn để trích dẫn so với giá niêm yết.

Các đánh giá của chính StepFun chưa được tái lập và nên được đọc như tài liệu của nhà cung cấp cho đến khi có ai đó độc lập chạy lại chúng. Họ đặt mô hình ở mức 29,5 trên ALE-CLI, 66,4 trên FrontierFinance, 83,3 trên DRACO, 80,5 trên ProgramBench, 67,7 trên DeepSWE v1.1 và 49,0 trên StepCodeBench, với 33,3% trên Terminal-Bench 4.0 và 1571 trên GDPval-AA v2. StepFun cũng báo cáo đỉnh MLA 508 TFLOPS trong một tác vụ tối ưu hóa kernel GPU kéo dài 24 giờ, so với 493 của Claude Opus 5. Đó là những con số của StepFun về một mô hình mà StepFun chưa mở.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator with a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second at rank 45 of 200, cost per Intelligence Index task $0.71 at rank 27 of 200, verbosity 160M output tokens against a 92M median, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning support, text and image input, and a 1M-token context window.

Cuộc đối đầu mà bạn có thể chạy thay vì cuộc này

Nếu bạn muốn có sự so sánh mà tiêu đề hứa hẹn, sự thay thế trung thực là Step 5 Preview đối đầu với GLM-5.3 — mô hình mà Z.ai thực sự phát hành, vẫn là mô hình chủ lực mã nguồn mở hiện tại của họ, và là mô hình mà bất kỳ GLM-5.5 nào cũng sẽ thay thế. Trên bảng xếp hạng độc lập, hai mô hình cách nhau một điểm. Ở gần như mọi thứ khác thì không.

• Chỉ số Trí tuệ — Step 5 Preview 44 so với GLM-5.3 45

• Tham số — tổng 600B / 27B hoạt động so với tổng 753B / 40B hoạt động

• Tốc độ đầu ra — 99.8 tokens/giây so với 72.1 tokens/giây

• Thời gian đến token đầu tiên — 2,96 giây so với 2,99 giây

• Giá trên 1 triệu token — 1,00 đô đầu vào / 2,70 đô đầu ra so với 1,40 đô đầu vào / 4,40 đô đầu ra

• Chiết khấu bộ đệm — 95% so với 81%

• Chi phí cho mỗi tác vụ Intelligence Index — 0,71 USD so với 2,01 USD

• Phương thức nhập — văn bản và hình ảnh so với chỉ văn bản

• Giấy phép — không có giấy phép nào được công bố so với một giấy phép Z.ai tùy chỉnh không phải MIT

Cục diện này lặp lại điều mà bản ra mắt Step 5 Preview đã xác lập trước mọi mô hình đang được phát hành mà nó từng được chấm điểm: một lợi thế hiệu quả mang tính quyết định và một thế ngang bằng về mặt thống kê ở khả năng. Nó sinh token nhanh hơn khoảng 38%, tốn chi phí chỉ bằng khoảng một nửa trên mỗi triệu token ở cả hai chiều, và rẻ hơn 2,8 lần cho mỗi tác vụ index so với GLM-5.3 — dù đạt điểm thấp hơn một điểm. Trên bảng xếp hạng, con số 44 đó cũng đưa nó ngang bằng với Kimi K3, điều đáng để biết trước khi coi một trong hai là kẻ dẫn đầu.

Hàng duy nhất mà Step 5 Preview rõ ràng bị tụt lại chính là hàng mà bạn không thể đánh giá chuẩn. GLM-5.3 có một tệp giấy phép và trọng số có thể tải xuống; Step 5 Preview chỉ có một kho Hugging Face chứa duy nhất một .gitattributes và một ngày được nêu là 15 tháng 10 cho checkpoint BF16. Nếu mẫu flagship tiếp theo của Z.ai ra mắt với trọng số mở theo đúng những điều khoản tùy chỉnh mà họ đã dùng suốt cả năm nay, nó sẽ rơi vào hạng mục duy nhất mà Step 5 Preview hiện chưa có câu trả lời — đó chính là lý do thực sự khiến một phép so sánh với GLM-5.5 đáng để chờ đợi hơn là chạy ngay.

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GLM-5.5 — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71, and API live since September 20. The right column gives GLM-5.5 the rows AA Index no model to score, parameters more than 1T rumored and unconfirmed, price none, cache discount none, cost per index task none, and availability not released. A footer reads 'Step 5 Preview figures per Artificial Analysis Intelligence Index; GLM-5.5 is an unannounced, unreleased model with no vendor or independent figures.'

Tại sao chờ đợi GLM-5.5 lại là lựa chọn tốn kém

Vấn đề thực tế với một mô hình mà suốt hai tháng nay vẫn luôn còn hai tháng nữa mới ra mắt là công việc đánh giá của bạn không thể chờ nó. GLM-5.5 chưa có endpoint, nên không thể được đánh giá chuẩn, so sánh giá, kiểm thử tải hay đặt sau một quy tắc dự phòng. Mỗi tuần dành để lập kế hoạch xoay quanh nó là một tuần các quyết định bị hoãn lại dựa trên sức mạnh của một dự báo — và dự báo đó đã bỏ lỡ một cửa sổ.

Ngược lại, GLM-5.3 đang hoạt động trên OrcaRouter với z-ai/glm-5.3 ở mức 1,26 USD cho đầu vào và 3,96 USD cho đầu ra, so với mức niêm yết 1,40 USD và 4,40 USD của Z.ai trên trang riêng của họ. Mức đó được chuyển thẳng với chênh lệch bằng không, nghĩa là con số bạn thấy là mức giá hiện hành của nhà cung cấp chứ không phải mức do chúng tôi đặt ra, và khi nhà cung cấp thay đổi giá thì bên chúng tôi cập nhật ngay trong cùng ngày thay vì đợi đến chu kỳ thanh toán tiếp theo.

Step 5 Preview không có trong danh mục của chúng tôi và chúng tôi không định tuyến nó. Nó chạy trên API và Studio riêng của StepFun, và đó là nơi duy nhất nó chạy cho đến khi cột mốc ngày 15 tháng 10 đến. Điều OrcaRouter mang lại cho bạn trong lúc chờ đợi là mọi thứ ở phía bên kia của phép so sánh đó nằm sau một API duy nhất cho hơn 200 mô hình: GLM-5.3 với mức giá trên, GPT-6 Astra, DeepSeek V4 Pro, Claude Opus 5 và những mô hình còn lại, với khả năng chuyển đổi dự phòng tự động giữa các nhà cung cấp nhằm duy trì ổn định một đường dẫn production trong khi đường cong năng lực của bản preview vẫn chưa được biết, cùng DSL định tuyến giúp kết hợp nhiều mô hình trong một lệnh gọi duy nhất thay vì phải tích hợp thêm lần nữa. Hãy đánh giá hiệu năng bản preview so với một mô hình production trên cùng một khóa; cứ để đường dẫn production nguyên tại chỗ.

Screenshot of the OrcaRouter model page for GLM-5.3 at www.orcarouter.ai/models/z-ai/glm-5.3, showing the model id z-ai/glm-5.3, a 1M-token context and 131.1K max output, input pricing of $1.26 and output pricing of $3.96 per million tokens against the crossed-out list rates of $1.40 and $4.40, a seven-day median time to first token of 3.68 seconds and a 95th percentile of 10.00 seconds, seven-day traffic of 2296.2M tokens, and the endpoints and SDK snippets behind the OrcaRouter API.

Điều gì sẽ làm thay đổi câu trả lời

Hai mốc thời gian quyết định điều này. Ngày 15 tháng 10 là khi StepFun cho biết checkpoint BF16 cho Step 5 Preview sẽ ra mắt, và giấy phép đi kèm với nó là ẩn số hệ trọng nhất trong phép so sánh — một giấy phép thông thoáng sẽ biến lợi thế chi phí trên mỗi tác vụ gấp 2,8 lần thành thứ bạn sở hữu thay vì đi thuê, và sẽ xóa bỏ trục duy nhất mà GLM-5.3 rõ ràng dẫn trước. Một giấy phép hạn chế khiến GLM-5.3 trở thành mô hình duy nhất trong cặp mà bạn có thể xây dựng sản phẩm dựa trên nó, và biến khoảng cách một điểm thành chuyện vặt về hai mô hình mà dù sao bạn cũng sẽ dùng theo cách khác nhau.

Điều thứ hai là cửa sổ phân tích kéo dài từ ngày 8 tháng 10 đến ngày 9 tháng 11 dành cho mẫu flagship tiếp theo của Z.ai, thứ có thể được gọi là GLM-5.5 hoặc không, và có thể giống hoặc không giống với tin đồn. Nếu nó thực sự ra mắt, nó sẽ ra mắt dưới dạng một mô hình có giấy phép và một checkpoint — hai thứ mà Step 5 Preview đang thiếu — và khi đó việc so sánh trở nên thực sự có ý nghĩa.

Cho đến khi cả hai đều được giải quyết, câu hỏi hữu ích không phải là cái nào trong hai cái tốt hơn, bởi vì một trong số chúng không thể chạy được. Đó là việc bạn nên xây dựng dựa trên mô hình nào trong số các mô hình hiện có ngay bây giờ, và liệu câu trả lời có thay đổi khi checkpoint tiếp theo xuất hiện hay không. Câu hỏi đó có câu trả lời có thể kiểm chứng được trong tuần này, và nó không đòi hỏi phải chờ đợi một cái tên trở thành một mô hình.

So sánh trong bài viết này3

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày