Một thẻ tiêu đề hero được tạo tự động, gắn nhãn “Đã phát hành chính thức trong GitHub Copilot - 7 tháng 10 năm 2026”, có dòng kicker “Báo cáo khả dụng mô hình”, tiêu đề “Claude Haiku 5.5 trong GitHub Copilot”, với phụ đề “Rẻ hơn 10 lần trên mỗi token so với Haiku mà nó thay thế - cho đến khi một yêu cầu vượt quá 100.000 token”, ba chip ghi “$0.10 / $0.50 mỗi M”, “1 tín dụng AI = $0.01” và “Pro: 1.500 tín dụng/tháng”, cùng ba thẻ cho “Bậc ngắn: dưới 100K token”, “Bậc dài: gấp 5 lần mọi mức giá” và “Chưa có trong danh mục của chúng tôi: Claude Haiku 4.5 là”.
Guides & Insights

Claude Haiku 5.5 Đã Có Mặt Trên GitHub Copilot: Mô Hình Anthropic Rẻ Nhất Tốn Bao Nhiêu Trong Ngân Sách Tín Dụng

Tác giả

Rowan Sterling

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Claude Haiku 5.5 đã xuất hiện trong trình chọn mô hình của GitHub Copilot vào ngày 7 tháng 10 năm 2026 — cùng ngày nhà cung cấp phát hành nó — và mục nhật ký thay đổi công bố nó dành phần lớn độ dài cho các nền tảng. Visual Studio Code, Visual Studio, Copilot CLI, GitHub Copilot cloud agent, ứng dụng Copilot, github.com, GitHub Mobile trên iOS và Android, các IDE JetBrains, Xcode, Eclipse. Câu quan trọng nếu bạn nắm ngân sách thì ngắn hơn: mô hình được tính phí "theo giá niêm yết của nhà cung cấp trong cơ chế tính phí dựa trên mức sử dụng". Trong Copilot, điều đó có nghĩa là tín dụng AI, và mức giá của Claude Haiku 5.5 thấp đến mức phép tính tín dụng trở thành phần thú vị của đợt ra mắt chứ không phải là chuyện nghĩ thêm sau. Bài viết này thực hiện phép tính đó, tách bạch những gì GitHub thực sự đã chứng minh với những gì nó chỉ mới khẳng định, và đề cập hai ngoại lệ trong tài liệu của chính nhà cung cấp mà các bài đưa tin về đợt ra mắt phần lớn đã bỏ qua.

GitHub đã phát hành những gì và cho ai

Bài viết có tiêu đề đơn giản là “Claude Haiku 5.5 in GitHub Copilot”, và được đăng lên lúc 13:12 giờ Thái Bình Dương ngày 7 tháng 10. Nó dành cho những người đăng ký Copilot Pro, Pro+, Max, Business và Enterprise — nghĩa là mọi gói trả phí, và đáng chú ý là không bao gồm gói miễn phí, nơi việc chọn mô hình vẫn được xử lý tự động thay vì do người dùng thực hiện. Việc triển khai diễn ra dần dần, nên trình chọn trong trình soạn thảo của bạn có thể chậm hơn nhật ký thay đổi vài ngày; điều đó được nêu trong bài viết thay vì để bạn tự phát hiện.

Cách GitHub tự trình bày về mục đích của mô hình đáng để đọc kỹ, vì nó hẹp hơn cách của nhà cung cấp:

• Công việc nhanh, khối lượng lớn — subagent, chỉnh sửa nhanh và tác vụ terminal, theo đúng cách GitHub diễn đạt • Không được định vị là sản phẩm thay thế các mô hình lớn trong trình chọn, mà là tầng giá rẻ bên dưới chúng • Được cung cấp rộng rãi, theo tài liệu tham chiếu về các mô hình được hỗ trợ của GitHub, trong đó liệt kê Claude Haiku 5.5 là được cung cấp rộng rãi, với trạng thái GA • Cũng được liệt kê trong tài liệu tham chiếu đó với một dòng phiên bản IDE đánh dấu TBD, đây chính là lý do thực tế khiến việc triển khai có vẻ diễn ra dần dần từ phía trình biên tập • Được định giá theo giá niêm yết của nhà cung cấp theo hình thức thanh toán dựa trên mức sử dụng, chứ không phải theo mức phụ trội riêng của Copilot img src="2.png"> p>Các mốc ngày trong nhật ký thay đổi xung quanh mang lại bối cảnh về nhịp độ mà một trang mô hình đơn lẻ không thể có. Claude Sonnet 5.5 có mặt trong Copilot vào ngày 28 tháng 9, Claude Opus 5.5 vào ngày 22 tháng 9, và Claude Fable 5.1 vào ngày 1 tháng 9. Anthropic đang tung ra một bản tích hợp Copilot khoảng hai đến bốn tuần một lần và GitHub xử lý mỗi bản trong vài ngày. Nhịp độ đó cũng là lý do có một chiếc đồng hồ đếm ngược cho việc này: GitHub đã đăng thông báo ngừng hỗ trợ vào giữa tháng 9 đối với "một số mô hình GitHub Copilot được chọn" vào giữa tháng 10, rồi tiếp tục vào ngày 2 tháng 10 xác nhận việc loại bỏ. Nếu nhóm của bạn đang ghim một mô hình trong cấu hình Copilot, thì giờ đây thứ dễ hỏng nhất chính là việc ghim đó, chứ không phải giá.

A screenshot of GitHub's "Supported AI models in GitHub Copilot" reference page, showing its model availability and default settings prose and a Claude (by Anthropic) table that lists Claude Haiku 4.5 and Claude Haiku 5.5 alongside the Claude Opus and Claude Sonnet rows.

Bảng giá, được đọc như một sổ cái tín dụng

Claude Haiku 5.5 tính phí theo hai bậc, được chuyển đổi dựa trên kích thước yêu cầu chứ không phải bởi bất kỳ cài đặt nào bạn chọn. Mọi nội dung bên dưới là bảng giá chính thức do GitHub công bố, và tất cả đều tính trên mỗi triệu token:

• Ở mức 100,000 token đầu vào trở xuống — $0.10 đầu vào, $0.01 đầu vào đã cache, $0.125 ghi cache, $0.50 đầu ra • Trên 100,000 token đầu vào — $0.50 đầu vào, $0.05 đầu vào đã cache, $0.625 ghi cache, $2.50 đầu ra • Claude Haiku 4.5, để so sánh — $1.00 đầu vào, $0.10 đầu vào đã cache, $1.25 ghi cache, $5.00 đầu ra • Claude Sonnet 5.5, tầng cao hơn — $2.00 đầu vào, $0.10 đầu vào đã cache, $2.50 ghi cache, $10.00 đầu ra • Ghi cache được tính phí riêng trên các mô hình Anthropic, cao hơn và vượt ngoài phần đầu vào đã cache — một mục chi phí không tồn tại ở mọi nhà cung cấp trong danh sách lựa chọn img src="3.png"> p>Có hai điều rút ra khi đọc các hàng đó cùng nhau. Thứ nhất, tầng ngắn của Claude Haiku 5.5 rẻ hơn đúng mười lần so với Claude Haiku 4.5 ở cả đầu vào lẫn đầu ra, và rẻ hơn khoảng hai mươi lần về đầu vào so với Claude Sonnet 5.5 — đó chính là lý do nó thuộc về các vị trí subagent, nơi một loạt lời gọi nhỏ sẽ nhân lên bất kỳ khoản nào bạn trả cho mỗi lời gọi. Thứ hai, tầng ngữ cảnh dài đúng bằng năm lần tầng ngắn ở mọi mức giá cùng lúc, tại cùng ranh giới 100,000 token. Một yêu cầu 99,000 token và một yêu cầu 101,000 token không cách nhau 2 phần trăm ở những token đã vượt qua ranh giới; chúng cách nhau năm lần ở tất cả số token đó. Bước nhảy đó được kế thừa trực tiếp từ giá niêm yết của Anthropic, và hệ thống tín dụng của Copilot không hề làm phẳng nó.

A screenshot of GitHub's "Models and pricing for GitHub Copilot" documentation page, listing per-million-token input, cached input, cache write and output rates for Claude Haiku 4.5, Claude Haiku 5.5, Claude Opus and Claude Sonnet, with the surrounding AI credit conversion notes.

Giờ đến phần tín dụng. Cách tính phí dựa trên mức sử dụng của Copilot quy đổi mức sử dụng mô hình thành tín dụng AI theo tỷ lệ được công bố là 0,01 USD mỗi tín dụng, và mỗi gói có một hạn mức tín dụng hàng tháng:

• Copilot Pro, 10 đô la một tháng — 1.500 credit, được niêm yết là 1.000 cơ bản cộng 500 linh hoạt • Copilot Pro+, 39 đô la một tháng — 7.000 credit, được niêm yết là 3.900 cơ bản cộng 3.100 linh hoạt • Copilot Max, 100 đô la một tháng — 20.000 credit, được niêm yết là 10.000 cơ bản cộng 10.000 linh hoạt • Copilot Business, 19 đô la mỗi ghế mỗi tháng — 1.900 credit mỗi người dùng • Copilot Enterprise, 39 đô la mỗi ghế mỗi tháng — 3.900 credit mỗi người dùng • Hạn mức của tổ chức và doanh nghiệp được chia sẻ giữa các ghế thay vì tách riêng theo từng người dùng • Mức sử dụng vượt quá hạn mức chung được tính $0,01 mỗi credit — cùng một tỷ lệ quy đổi, áp dụng cho phần vượt mức • Tính năng hoàn thành mã và gợi ý chỉnh sửa tiếp theo hoàn toàn nằm ngoài cơ chế tính phí theo credit và vẫn không giới hạn trên các gói trả phí p>Ghép hai điều đó lại, hình hài của đợt ra mắt trở nên cụ thể. Lấy một bước tác tử ở quy mô vừa phải — 40.000 token đầu vào, 2.000 token đầu ra, không dùng bộ nhớ đệm. Với bậc ngắn của Claude Haiku 5.5, con số đó là 40.000 nhân $0,10 mỗi triệu cộng 2.000 nhân $0,50 mỗi triệu, tức $0,005, bằng nửa credit theo tỷ lệ quy đổi đã công bố. Cùng lệnh gọi y hệt đó với mức giá của Claude Haiku 4.5 tốn $0,05, tức năm credit. Phép tính ở đây là của chúng tôi, không phải của GitHub, nhưng mọi số liệu đầu vào đều lấy từ bảng giá đã công bố, và kết luận thì không hề tinh tế: hạn mức 1.500 credit của một thuê bao Pro hấp thụ được khoảng 3.000 lệnh gọi như vậy trên Haiku mới, trong khi trước đây chỉ hấp thụ được khoảng 300 lệnh trên phiên bản cũ. Hạn mức dài gấp mười lần mà gói đăng ký không hề thay đổi.

Đó là tuyên bố giá trị trung thực, và nó đi kèm với lưu ý trung thực rằng pool được định giá bằng tín dụng thay vì đô la, nên mức trần thực tế của một gói sẽ thay đổi mỗi khi bảng giá thay đổi. Việc giảm giá gấp mười lần ở một mô hình không làm pool kéo dài gấp mười lần nếu lưu lượng của bạn trải đều trên ba mô hình.

Những gì GitHub nói mô hình làm được, và những gì nó chưa cho thấy

Nhật ký thay đổi chứa một tuyên bố về hiệu năng, và nó đang phải gánh vác nhiều hơn mức nó có thể chịu trong bài đưa tin. GitHub viết rằng trong thử nghiệm ban đầu, Claude Haiku 5.5 “ngang bằng Claude Sonnet 5 trên nhiều tác vụ lập trình” trong khi sử dụng “ít token và bước hơn đáng kể”.

Hãy đọc các từ hạn định theo thứ tự. Đây là kiểm thử ban đầu. Đây là kiểm thử của GitHub, trên các tác vụ của GitHub, và GitHub chính là bên bán tích hợp đó. Không có khung đánh giá nào được nêu tên, không có tập tác vụ nào được công bố, không có số liệu nào đi kèm với bất kỳ vế nào của câu, và “nhiều” không phải là một con số. Tuyên bố này hoàn toàn có thể đúng — một mô hình nhỏ ngang bằng một mô hình lớn trên các tác vụ lập trình hẹp, có dạng công cụ, là một kết quả hợp lý vào năm 2026 — nhưng xét như những gì đã công bố, đó là khẳng định của nhà cung cấp, và cần được ghi nhãn như vậy mỗi lần nó được nhắc lại. Vế “ít token và bước hơn” là vế bền vững hơn trong hai vế, vì đó là tuyên bố về hiệu quả chứ không phải về năng lực, và hiệu quả ở mức giá Haiku sẽ xuất hiện trong dữ liệu đo lường từ xa về mức sử dụng của chính bạn trong vòng một tuần. Vế năng lực cần một khung đánh giá của bên thứ ba trước khi nó được đưa vào slide.

Các con số của chính Anthropic là một tuyên bố riêng biệt so với của GitHub và mang cùng vấn đề về nguồn gốc. Anthropic tuyên bố rằng Claude Haiku 5.5 chạy rẻ hơn khoảng 75 phần trăm tính trung bình, và rằng khoảng 90 phần trăm các yêu cầu trước đây được gửi đến một mô hình thuộc lớp Haiku nằm dưới 100.000 token, đây là mức mà mô hình "đặc biệt đáng giá". Cả hai đều là nhà cung cấp đang mô tả các yếu tố kinh tế của chính sản phẩm mình. Chúng nhất quán với bảng giá đã công bố — mức giảm lớn cho bậc ngắn, mức giảm nhỏ hơn cho bậc dài — và hữu ích như hướng dẫn từ nhà cung cấp hơn là như một kết quả đo lường được.

Bật nó lên là quyết định của quản trị viên, và mặc định là bật.

Phần trong nhật ký thay đổi mà người mua Copilot Business và Enterprise nên đọc lại hai lần là đoạn về kiểm soát truy cập. Quản trị viên quản lý quyền truy cập mô hình thông qua chính sách mô hình trong cài đặt Copilot, và hành vi mặc định được GitHub ghi trong tài liệu là các mô hình mới sẽ tự động được bật, trừ khi quản trị viên đã tắt mặc định toàn cục hoặc vô hiệu hóa rõ ràng mô hình cụ thể đó. Mặc định là cho phép; việc hạn chế thuộc dạng phải chủ động từ chối.

Hai hệ quả kéo theo. Nếu tổ chức của bạn có quy trình quản trị mô hình nghiêm ngặt, Claude Haiku 5.5 có thể đã được các nhà phát triển của bạn chọn được mà không cần bất kỳ ai phê duyệt nó theo tên. Và nếu thay vào đó, tổ chức của bạn đã vô hiệu hóa mặc định toàn cục, mô hình sẽ không xuất hiện với bạn bất kể changelog nói gì — đây rất có thể là lời giải thích cho câu hỏi hỗ trợ phổ biến nhất trong tuần đầu tiên của bất kỳ đợt ra mắt mô hình Copilot nào. Trước khi bạn gỡ lỗi một mục chọn bị thiếu, hãy kiểm tra chính sách mô hình.

Hai ngoại lệ mà tài liệu của Anthropic có nêu nhưng các bài đăng ra mắt thì không.

Cả hai điều này đều đến từ tài liệu nền tảng của Anthropic chứ không phải từ bất kỳ đưa tin nào của báo chí, và cả hai đều ảnh hưởng đến những gì bạn có thể xây dựng chứ không phải những gì bạn phải trả:

• Priority Tier không khả dụng trên Claude Haiku 5.5 — tài liệu về service-tier của Anthropic nêu tên model này trong danh sách loại trừ rõ ràng, cùng với Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1 và dòng Mythos. Nếu kiến trúc của bạn giả định có provisioned throughput trên tier rẻ, giả định đó không đúng ở đây. • Cửa sổ ngữ cảnh đầy đủ 1 triệu token ở mức giá tiêu chuẩn được dành cho "Claude 4.6 và các model về sau (trừ Claude Haiku 5.5)" — phần trong ngoặc là của Anthropic, và Claude Haiku 5.5 chính là model hiện hành duy nhất bị loại ra khỏi đó. Cửa sổ này vẫn được quảng cáo trên dòng thông số của model là 1M, với đầu ra tối đa 128.000 token; điều mà việc loại trừ này có nghĩa là bạn không nên hiểu rằng cam kết giá dài hạn áp dụng chung cho mọi trường hợp cũng đúng với model này. • Tokenizer đã thay đổi. Anthropic nêu rõ rằng Claude 4.7 và các model về sau dùng tokenizer mới hơn, tạo ra lượng token nhiều hơn khoảng 30 phần trăm cho cùng một đoạn văn bản, nghĩa là giá trên mỗi token và giá trên mỗi trang văn bản của bạn đi theo hai hướng ngược nhau. Dòng thông số của Claude Haiku 5.5 ghi vị trí của nó là "Fastest", mặc định adaptive thinking ở mức medium, thời điểm cắt kiến thức là tháng 6 năm 2026, và model ID là claude-haiku-5-5.

Không có điểm nào trong số này là trở ngại chí mạng đối với các khối lượng công việc dành cho tác nhân phụ và chỉnh sửa nhanh mà GitHub đang nhắm mô hình tới. Chúng là sự khác biệt giữa việc trích dẫn một bài đăng ra mắt và việc trích dẫn tài liệu, và cái thứ hai mới là thứ trụ vững khi đối mặt với kiểm thử tải.

Nếu bạn muốn định tuyến nó thay vì chuyển công cụ

Có một lý lẽ hợp lý để gọi Claude Haiku 5.5 từ chính ngăn xếp của bạn thay vì chỉ thông qua gói đăng ký chat-và-editor: bạn nhận được mức giá thô của hạng ngắn mà không cần quy đổi tín dụng ở giữa, và bạn giữ quyết định định tuyến trong chính mã của mình. Bức tranh về tính khả dụng, nói thẳng ra, là Anthropic bán nó qua Claude Platform và qua Amazon Bedrock, Vertex AI cùng Microsoft Azure — và nó chưa có trong danh mục của chúng tôi. OrcaRouter hiện cung cấp Claude Haiku 4.5, Claude Sonnet 5.5, Claude Opus 5.5 và Claude Fable 5.1 trong một danh mục chỉ hơn 200 mô hình, và Claude Haiku 5.5 không nằm trong số đó. Đối với chính mô hình này ngay bây giờ, hãy gọi trực tiếp Anthropic hoặc một trong ba dịch vụ đám mây đó.

A screenshot of OrcaRouter's Claude Haiku 4.5 model page, showing $1.00 per million input tokens and $5.00 per million output tokens, a 200K context window, the claude-haiku-4-5 model ID, availability across three providers, and an Anthropic SDK snippet that points the base URL at OrcaRouter while keeping the existing SDK.

Chỗ chúng tôi thực sự phù hợp là lớp bao quanh nó. OrcaRouter truyền nguyên giá niêm yết của nhà cung cấp với mức markup bằng không, nên khi một nhà cung cấp điều chỉnh giá một mô hình — như Anthropic đã làm với mô hình này — mức giá mới có hiệu lực ngay bên phía chúng tôi trong cùng ngày thay vì phải chờ hết một chu kỳ thanh toán. Cơ chế tự động chuyển đổi dự phòng nghĩa là một lệnh gọi ở hạng rẻ gặp lỗi sẽ được đưa sang một tuyến đang hoạt động thay vì làm hỏng yêu cầu, điều này càng quan trọng đối với một đội subagent thực hiện hàng nghìn lệnh gọi nhỏ hơn là với một phiên tương tác đơn lẻ. Và DSL định tuyến tồn tại chính xác cho dạng quyết định mà lần ra mắt này tạo ra: gửi công việc ngắn, khối lượng lớn đến mô hình rẻ nhất dưới ngưỡng và công việc ngữ cảnh dài đến mô hình rẻ nhất trên ngưỡng, từ một endpoint duy nhất trên một hóa đơn, thay vì mã hóa sự phân tách đó vào hai tích hợp. Nếu Haiku 5.5 xuất hiện trong danh mục, nó sẽ khớp vào chính sách đó mà không cần thay đổi mã nguồn.

Cần làm gì với cái này trước sprint tiếp theo?

Cách hiểu theo nghĩa hẹp là mô hình rẻ nhất hiện tại của Anthropic giờ đã có thể chọn trong mọi gói Copilot trả phí và rẻ hơn khoảng mười lần trên mỗi token so với Haiku mà nó thay thế ở gói ngắn. Nếu nhóm của bạn đang chạy các subagent hoặc tự động hóa dạng terminal thông qua Copilot, thì việc chuyển mô hình chỉ là một thay đổi cài đặt, nhưng có tác động lớn và tức thì đến việc một quỹ tín dụng hàng tháng có thể kéo dài được bao xa.

Hai điều đáng kiểm tra trước tiên lại chính là những điều mà thông báo cố tình chôn kỹ. Hãy nhìn vào phân vị thứ 95 của kích thước yêu cầu: nếu nó nằm trên 100.000 token, thì bậc mà bạn thực sự bị tính phí là bậc thứ hai, và phép so sánh gấp mười lần thực chất chỉ còn gấp năm lần. Và hãy xem chính sách mô hình của tổ chức bạn có bật mặc định toàn cục hay không — với các ghế Business và Enterprise, chỉ riêng cài đặt đó quyết định liệu bản ra mắt này có khả dụng với các lập trình viên của bạn hay không.

chuyển thẳng giá niêm yết của nhà cung cấp mà không cộng thêm lợi nhuận