Một thẻ tiêu đề hero cho sự kiện ra mắt Tencent HY4 Preview. Tiêu đề căn giữa ghi dòng chữ 'Tencent HY4 Preview — tiên phong mã nguồn mở, giá rẻ'. Các chip thông số chính bên dưới: '770B tổng / 49B hoạt động (MoE)', 'Ngữ cảnh 1M', 'Trọng số mở: 28 tháng 8, 2026', '6 / 18 nhân dân tệ mỗi MTok'. Dòng chân trang ghi: 'Kỹ thuật phần mềm · văn phòng · phát triển game · nghiên cứu khoa học'. Logo OrcaRouter được ghép ở góc dưới bên phải.
Guides & Insights

Tencent HY4 Preview chính thức mã nguồn mở: 770B MoE, ngữ cảnh 1M và mức giá rẻ hơn cả các mô hình tiên tiến nhất

Tác giả

Magnus Corvin

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Tencent HY4 Preview, được phát hành và mở mã nguồn vào ngày 28 tháng 8 năm 2026, là flagship open-weight đầu tiên thực sự cạnh tranh từ một phòng thí nghiệm Trung Quốc trong nhiều tháng qua, và con số gây bất ngờ nhất chính là giá. Tencent niêm yết mức 6 NDT (~0,85 USD) cho mỗi triệu token đầu vào và 18 NDT (~2,50 USD) cho mỗi triệu token đầu ra — chỉ bằng khoảng một phần mười chi phí mà một mô hình frontier đóng hàng đầu tính cho đầu ra — đồng thời công bố mô hình mixture-of-experts với 770 tỷ tham số, trong đó 49 tỷ được kích hoạt cho mỗi token, cùng cửa sổ ngữ cảnh vượt mốc một triệu token. Đây là phiên bản kế nhiệm của Hy3 (tổng 295B, ngữ cảnh 256K) trong dòng Hunyuan, nhân bốn cửa sổ ngữ cảnh trong khi dung lượng kích hoạt tăng hơn gấp đôi. Trọng số có thể tải về ngay hôm nay từ Hugging Face, GitHub, ModelScope và GitCode, và cùng mô hình đó đã hoạt động trực tiếp trong các sản phẩm của Tencent: WorkBuddy, CodeBuddy ở cả bản nội địa lẫn quốc tế, trợ lý Yuanbao và ứng dụng không gian làm việc ima. Đối với những ai từng chứng kiến các mô hình open-weight tụt hậu so với frontier trong các tác vụ kỹ thuật phần mềm, đây chính là bản phát hành cuối cùng khiến khoảng cách ấy trở nên đáng bàn — và những lưu ý, hạn chế cũng quan trọng không kém các con số.

Sự định vị này là có chủ đích. Tencent giới thiệu Tencent HY4 Preview như một mô hình năng suất cho bốn lĩnh vực: kỹ thuật phần mềm, văn phòng và phân tích dữ liệu, phát triển trò chơi và nghiên cứu khoa học. Điểm nhấn về kỹ thuật chính là điều tách biệt nó khỏi nhóm các mô hình đa năng — ghi chú phát hành mở đầu bằng khả năng hiểu tác vụ trong thời gian dài, lập kế hoạch và gỡ lỗi, chứ không phải chất lượng trò chuyện. Trọng tâm đó thể hiện rõ trong danh sách tích hợp cũng như bảng benchmark: CodeBuddy tích hợp mô hình trong IDE, WorkBuddy tích hợp trong quy trình làm việc văn phòng (Tencent trình diễn mô hình xử lý 72 tài liệu tài chính trong một lượt), và các nhà phát triển trò chơi nhận được kết nối MCP vào Unreal Engine 5 và Unity, biến một câu lệnh duy nhất thành một bản demo chơi được.

Những gì thực sự đã được phát hành

Bảng thông số kỹ thuật đáng để đọc từng dòng một, vì mỗi dòng đều thay đổi những gì một mô hình trọng số mở được phép làm.

• Kiến trúc — Mixture-of-Experts với tổng cộng 770B tham số và 49B tham số hoạt động trên mỗi token, tỷ lệ thưa khoảng 16:1 giúp chi phí suy luận nằm trong mức mà một nhóm nhỏ thực sự có thể chi trả.

• Cửa sổ ngữ cảnh — hơn 1 triệu token, gấp bốn lần mức 256K của Hy3. Các tác vụ kỹ thuật tầm xa — một kho lưu trữ đầy đủ trong cửa sổ, một lần tái cấu trúc nhiều tệp, một loạt tài liệu lớn — trở thành các bài toán chỉ với một yêu cầu duy nhất.

• Trọng số — phát hành mở theo phong cách MIT trên Hugging Face, GitHub, ModelScope và GitCode. Đây là mô hình có thể tải về và tự lưu trữ, không phải bản giới thiệu trực tuyến.

• API — có sẵn trên TokenHub của Tencent Cloud, endpoint lưu trữ riêng của nhà cung cấp, được định giá 6 nhân dân tệ cho mỗi triệu token đầu vào, 18 nhân dân tệ cho mỗi triệu token đầu ra và 0,3 nhân dân tệ cho mỗi triệu token khi cache hit.

• Tích hợp sản phẩm — WorkBuddy, CodeBuddy (trong nước và quốc tế), Yuanbao và ima, nghĩa là các trọng số mà Tencent triển khai trong các ứng dụng của mình cũng chính là những trọng số bạn có thể tải về và chạy.

Tencent cũng báo cáo một con số kỹ thuật suy luận hiếm khi xuất hiện trong thông báo ra mắt: cải thiện 31,8% thông lượng đầu cuối nhờ hợp nhất toán tử và tối ưu hóa truyền thông. Điều khiến con số này không chỉ là chú thích nhỏ trong bảng thông số là Tencent cho biết chính Tencent HY4 Preview đã tự tìm ra các điểm nghẽn — mô hình tự phân tích ngăn xếp suy luận của chính nó, và các tối ưu hóa được báo cáo là ổn định trên nhiều độ dài ngữ cảnh và mức độ tải đồng thời. Đó là kiểu chi tiết phân biệt một mô hình mà phòng thí nghiệm ra mắt như một sản phẩm nghiên cứu với một mô hình mà công ty kỳ vọng sẽ phải gánh lưu lượng sản xuất thực tế. Với một bản preview mới công khai vài ngày, đây cũng chính là kiểu tuyên bố mà chưa ai ngoài Tencent xác minh được.

Những điểm số đáng trích dẫn.

Mọi điểm chuẩn mà Tencent công bố cho Tencent HY4 Preview đều do chính nhà cung cấp tự báo cáo — được chạy trên hệ thống đánh giá riêng của Tencent, chưa được bất kỳ phòng thí nghiệm độc lập nào tái kiểm chứng, và mô hình mới chỉ được công khai vài ngày. Hãy xem chúng là mức trần mà Tencent tin rằng mình đạt được, chứ không phải là sự thật đã được xác lập.

A single-model scoreboard titled 'Tencent HY4 Preview — the scoreboard'. Rows read: 'Total params: 770B MoE', 'Active params: 49B', 'Context: 1M tokens', 'Weights: open (HF / GitHub / ModelScope / GitCode)', 'Price: 6 / 18 yuan per MTok (0.3 yuan cache hit)', 'Independent benchmarks: none yet'. A footer reads 'Benchmark claims vendor-reported, unreproduced as of Aug 28, 2026.' The OrcaRouter logo is composited in the bottom-right corner.

Con số chính là Terminal Bench 2.1, một bài kiểm tra khả năng điều khiển terminal thực tế của mô hình trong lúc viết mã. Tencent báo cáo Tencent HY4 Preview đạt 85.4, mà họ cho là ngang bằng với Claude Opus 5 và vượt qua DeepSeek V4 Pro, đồng thời vượt qua phiên bản tiền nhiệm Hy3 của chính mình 14.6 điểm. Con số đơn lẻ này đang gánh một trọng trách lớn — đó là tuyên bố đặt một mô hình trọng số mở ngang hàng với các mô hình frontier đóng đắt tiền nhất trong một bài kiểm tra lập trình tác tử khó — và đó cũng là tuyên bố cần được xác nhận độc lập nhất.

Phần còn lại của bảng nội bộ: DeepSWE, một điểm chuẩn kỹ thuật phần mềm, tăng từ 28,0 ở Hy3 lên 64,3, điều mà Tencent mô tả là "đang dần thu hẹp khoảng cách" với các mô hình hàng đầu. Trong Toolathlon-Verified, một bài kiểm tra gọi công cụ, nó đạt 74,1, mà Tencent cho biết vượt qua Qwen 3.8 Max và GPT-5.6 Sol, đồng thời tiến gần đến Kimi K3 và Claude Opus 5. Trong APEX-Agents pass@1, nó đạt 37,1, chỉ kém một chút so với mức 37,2 của Kimi K3. Và trong một bài kiểm tra mù nội bộ riêng biệt, 163 chuyên gia đã chấm điểm 203 nhiệm vụ kỹ thuật với 2,99 trên 4,00, nhỉnh hơn mức 2,92 của GLM-5.3 và 2,94 của Kimi K3.

Có hai xu hướng nổi bật. Thứ nhất, mọi con số ấn tượng đều thuộc về công việc kỹ thuật tác nhân — điều khiển terminal, gọi công cụ, tác vụ quy mô kho mã nguồn — và không con số nào nằm ở kiến thức hay suy luận thông thường, điều này nhất quán với định vị năng suất chứ không phải ngẫu nhiên. Thứ hai, Tencent thận trọng khi mô tả DeepSWE và các công cụ khác là thu hẹp, chứ không phải khép lại, khoảng cách. Tuyên bố ngang bằng rõ ràng và dễ tiếp thị duy nhất là kết quả hòa trên Terminal Bench 2.1, và đó là tuyên bố đáng kiểm chứng nhất với khối lượng công việc của chính bạn.

Mức giá thực sự mua được những gì

Định giá là điểm mà bản phát hành không còn chỉ thú vị mà bắt đầu gây đột phá. Ở mức giá niêm yết của Tencent, một triệu token đầu vào có chi phí tương đương với một lần gọi API tầm trung trên một số nền tảng. Con số 18 tệ mỗi triệu token đầu ra (khoảng 2,50 USD) thấp hơn nhiều so với mức giá 25 USD mỗi triệu token đầu ra của một mô hình tiên phong đóng hàng đầu, và tỷ lệ cache-hit 0,3 tệ khiến các vòng lặp tác nhân dài — nơi cùng một system prompt và các tiền tố hội thoại được gửi lại liên tục — trở nên rẻ một cách bất thường để vận hành.

Đây cũng là nơi duy nhất mà lớp định tuyến thay đổi cách tính. OrcaRouter chưa định tuyến Tencent HY4 Preview — Tencent chưa mở mô hình này cho các nền tảng suy luận bên thứ ba, nên nó chạy trên endpoint TokenHub của chính Tencent Cloud và trên các hệ thống tự triển khai từ trọng số mở, và chúng tôi không tuyên bố phục vụ những gì chúng tôi không có. Nhưng nguyên tắc làm cho việc giảm giá trở nên quan trọng cũng chính là nguyên tắc mà phần còn lại của danh mục vận hành: OrcaRouter truyền thẳng giá niêm yết của nhà cung cấp mà không cộng thêm phí, nên khi một nhà cung cấp như Tencent định giá token ở mức 6 yuan, con số bạn trả ở phía chúng tôi là 6 yuan, không phải phiên bản bán lại bị đội giá, và ngày nhà cung cấp thay đổi giá, sự thay đổi đó sẽ có hiệu lực ở phía chúng tôi ngay trong ngày. Một API cho hơn 200 mô hình, tự động chuyển đổi dự phòng giữa các nhà cung cấp khi một nhà cung cấp gặp trục trặc, và DSL định tuyến để kết hợp các mô hình — đó là cơ chế sẽ đưa Tencent HY4 Preview vào vận hành ngay khi nó có thể định tuyến được, cùng với các mô hình mở và đóng khác đã có trong danh mục.

A screenshot of the OrcaRouter model catalog page (www.orcarouter.ai/models, captured August 28, 2026) showing a browsable grid of AI models with pricing and provider information. It illustrates the one-API, 200+ models catalog through which vendor list-price pass-through and failover operate.

Những phần không nằm gọn trên bảng thông số kỹ thuật

Có hai tuyên bố trong tài liệu ra mắt cần được chú ý riêng biệt vì chúng nói về cách mô hình được xây dựng, chứ không phải về điểm số mà nó đạt được.

Đầu tiên là vòng lặp tự cải thiện. Tencent cho biết Tencent HY4 Preview đã tham gia vào quá trình nghiên cứu và phát triển của chính nó — mô hình được sử dụng để tối ưu hóa các phương pháp huấn luyện, chiến lược dữ liệu, hệ thống đánh giá và các toán tử nền tảng đã tạo ra nó. Mức tăng thông lượng 31,8% là kết quả công khai cụ thể nhất của vòng lặp đó: Tencent ghi nhận điều này nhờ vào các điểm nghẽn mà mô hình đã xác định trong chính hệ thống phục vụ của mình. Đó là một chu kỳ tự tăng cường đệ quy ban đầu: một mô hình giúp thiết kế phiên bản tiếp theo của chính nó. Việc một phòng thí nghiệm tiên phong báo cáo những mảnh ghép của quá trình này không phải là điều bất thường, nhưng một mô hình trọng số mở của Trung Quốc công khai mô tả vòng lặp này như một năng lực đã được phát hành chính là bước ngoặt trong cách các bản phát hành này nói về chính chúng.

Kết quả thứ hai là về toán học. Tencent báo cáo rằng mô hình đã nâng cận dưới đã biết của thể tích cho bài toán Blaschke–Lebesgue — một câu hỏi mở lâu đời trong hình học lồi về vật thể có chiều rộng không đổi với thể tích tối thiểu — từ 0,380799 lên 0,41104, đưa nó đến gần khoảng 2% so với cận của giả thuyết tứ diện Meissner. Tencent cũng báo cáo mức tăng tốc gấp 2,0 lần trên mô phỏng lớp kép phospholipid gồm 32.512 nguyên tử, giảm xuống còn 54,9 mili giây mỗi bước, trong hạng mục nghiên cứu khoa học. Đây là những kết quả thường giúp một mô hình có được bài báo nghiên cứu riêng; ở đây chúng chỉ là những gạch đầu dòng ra mắt, và cũng như bao tài liệu ra mắt khác, chúng là lời tường thuật của chính Tencent.

Thành thật mà nói, điều gì còn thiếu?

Tencent liệt kê rõ ràng những hạn chế đã biết, và chúng có ý nghĩa với bất kỳ ai đang quyết định xây dựng gì trên mô hình này. Không có khả năng thị giác hay đầu vào đa phương thức — Tencent HY4 Preview là mô hình văn bản thuần túy, chấm hết, nên mọi thứ liên quan đến hình ảnh hoặc video thuộc về một mô hình khác. Tencent cũng nêu rõ rằng mô hình có hành vi khởi động chậm với các tác vụ phức tạp — suy nghĩ lâu trước khi tạo đầu ra đầu tiên — và có xu hướng tự xác minh quá mức, đốt token để kiểm tra lại những gì nó đã làm. Sự kết hợp đó hoàn toàn sai cho các cuộc trò chuyện nhạy cảm với độ trễ và hoàn toàn chấp nhận được cho công việc kỹ thuật xử lý hàng loạt ngoại tuyến, điều đó cho bạn biết Tencent mong bạn chạy nó ở đâu.

Và sự thiếu vắng quan trọng nhất chính là sự xác minh. Hiện chưa có bất kỳ điểm số độc lập nào cho Tencent HY4 Preview — không có trên bảng xếp hạng công khai, không có từ phòng thí nghiệm đánh giá bên thứ ba, thậm chí không có mục nào trên Artificial Analysis. Mô hình này quá mới để có những dữ liệu đó. Bài kiểm tra mù nội bộ của chuyên gia là một tín hiệu hữu ích về cách các nhà đánh giá của chính Tencent nhìn nhận nó so với GLM-5.3 và Kimi K3, nhưng đó là các nhà đánh giá của Tencent đánh giá trên các bài kiểm tra của Tencent. Mọi thứ vượt trên bảng thông số kỹ thuật đều chỉ là lời tuyên bố đang chờ được kiểm chứng.

A screenshot of the Artificial Analysis model leaderboard (artificialanalysis.ai, captured August 28, 2026) showing frontier models ranked by the Artificial Analysis Intelligence Index. Tencent HY4 Preview does not yet appear — it is too new to have an independent score, which illustrates the verification gap discussed in this article.

Ai nên kéo tạ hôm nay?

Nói thật thì bản phát hành này chia thành hai nhóm đối tượng rõ rệt. Nếu bạn chạy các khối lượng công việc kỹ thuật trên hạ tầng riêng của mình và chi phí của các API đóng là điều đang kìm hãm bạn, thì Tencent HY4 Preview đáng để dành một cuối tuần thử nghiệm nghiêm túc ngay bây giờ: trọng số được mở, cửa sổ ngữ cảnh ở quy mô kho lưu trữ, và giá niêm yết khiến một vòng lặp tác tử dài trở nên phải chăng theo cách mà một mô hình $25 mỗi triệu token đầu ra sẽ không bao giờ có được. Còn nếu bạn đang vận hành chat sản xuất nhạy cảm với độ trễ, hoặc bất cứ thứ gì đa phương thức, hoặc bất cứ thứ gì mà bạn không thể chấp nhận một mô hình có bằng chứng duy nhất là benchmark do chính nhà cung cấp công bố, thì hãy chờ — nhịp độ cập nhật hai tháng một lần mà Tencent duy trì từ tháng 2 cho thấy bản phát hành Hy4 đầy đủ sẽ không còn xa, và bản preview rõ ràng chỉ là một phiên bản sớm với những khuyết điểm đã biết.

Con đường trung gian thực dụng là một mẫu định tuyến: chạy mô hình đã được kiểm chứng trên luồng quan trọng của bạn và mô hình mới ngay bên cạnh, chuyển sang Tencent HY4 Preview cho những tác vụ mà hồ sơ chi phí của nó chiếm ưu thế và tự động quay về khi không thắng thế. Đó chính là mẫu mà một bộ định tuyến tồn tại để phục vụ — cùng một OrcaRouter đang vận chuyển Claude Opus 5, DeepSeek V4 Pro và Gemini 3.1 Pro theo giá niêm yết của nhà cung cấp sẽ vận chuyển mô hình này ngay khi Tencent mở quyền truy cập. Cho đến lúc đó, các trọng số nằm trên GitHub, API nằm trên Tencent Cloud, và tuyên bố rằng một mô hình trọng số mở đã đạt đến hạng cao nhất của lập trình tác tử cuối cùng đã có một con số cụ thể đi kèm. Con số đó là của Tencent. Bài kiểm tra là của bạn.

So sánh trong bài viết này2

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày

© 2026 OrcaRouter

Dành cho nhà cung cấp

Bạn vận hành nền tảng suy luận? Đưa mô hình của bạn lên OrcaRouter.

providers@orcarouter.ai

Tham gia cộng đồng

Discordsupport@orcarouter.aiXGitHubYouTube