Claude Sonnet 5.5 và Haiku 5.5: Có gì mới, Giá cả và Các lựa chọn thay thế (2026)

Claude Sonnet 5.5 và Claude Haiku 5.5 là hai mô hình mới nhất trong dòng mô hình Claude 5.5 của Anthropic. Mô hình Sonnet ra mắt vào ngày 28 tháng 9 năm 2026, và Haiku 5.5 ra mắt tiếp theo vào ngày 7 tháng 10 năm 2026. Sonnet 5.5 có chi phí $2 cho đầu vào và $10 cho đầu ra trên mỗi triệu API token. Haiku 5.5 có giá khởi điểm từ $0.10 đầu vào và $0.50 đầu ra.
Hướng dẫn này sẽ đề cập đến những thay đổi trong từng mô hình và kết quả các bài kiểm tra khi ra mắt đối với tài liệu, trang trình bày và bảng tính. Hướng dẫn cũng bao gồm thông tin về giá cả, giới hạn và các giải pháp thay thế đáng để thử nghiệm. Mọi số liệu đều được lấy từ trang thông tin của nhà cung cấp vào ngày 8 tháng 10 năm 2026.
Anthropic đã phát hành những gì và khi nào
Ba kênh chính thức đã xác nhận các mốc thời gian này. Trang thông tin mô hình của Anthropic hiển thị ngày 28 tháng 9 cho đợt phát hành Sonnet và ngày 7 tháng 10 cho Haiku. Tài liệu cập nhật của Claude Platform cũng ghi nhận hai ngày tương tự. Tài liệu cập nhật của Claude Help Center, nơi theo dõi các ứng dụng Claude, cũng liệt kê cả hai đợt ra mắt này.
Dòng mô hình này hiện có ba thành viên. Claude Opus 5.5 ra mắt đầu tiên vào ngày 22 tháng 9. Anthropic gọi Sonnet mới là "mô hình thứ hai trong dòng Claude 5.5." Hãng mô tả mô hình này là "một sự bổ sung nhanh hơn, chi phí thấp hơn cho Claude Opus 5.5."
Haiku 5.5 là mảnh ghép hoàn thiện bộ ba này. Anthropic giới thiệu đây là "mô hình nhỏ rẻ nhất, nhanh nhất và có khả năng mạnh mẽ nhất mà chúng tôi từng phát hành." Đó là tuyên bố từ chính nhà cung cấp, vì vậy hãy coi đó là điểm khởi đầu cho các thử nghiệm của bạn.
Đối với các nhà phát triển, ID mô hình là claude-sonnet-5-5 và claude-haiku-5-5. Cả hai mô hình đều có sẵn trên Claude API, Amazon Bedrock, Google Cloud và Microsoft Foundry, theo tài liệu cập nhật của nền tảng.
Claude Sonnet 5.5: những điểm thay đổi
Anthropic định vị Sonnet 5.5 là mô hình dành cho công việc hàng ngày trong dòng sản phẩm này. Trang ra mắt của hãng cho biết mô hình này "mạnh nhất ở các tác vụ hàng ngày có phạm vi rõ ràng, sửa lỗi và tạo ra các tài liệu, trang trình bày và bảng tính trau chuốt." Trang này cũng cho biết thêm: "Mô hình này cũng có mắt thẩm mỹ sắc bén về thiết kế."
Bốn thay đổi nổi bật trên trang ra mắt:
- Tốc độ. Anthropic cho biết Sonnet 5.5 "tạo kết quả đầu ra nhanh hơn 30%+ so với Sonnet 5." Hãng gọi đây là mô hình Sonnet nhanh nhất từ trước đến nay.
- Khả năng viết. Giống như Opus 5.5, Sonnet mới "viết rõ ràng hơn thế hệ mô hình trước của chúng tôi," theo Anthropic.
- Tác vụ dài và hình ảnh. Anthropic cho biết đây là "mô hình Sonnet đầu tiên đánh bại Pokémon Red chỉ bằng cách hoạt động dựa trên ảnh chụp màn hình."
- An toàn. Đây là mô hình Sonnet đầu tiên được ra mắt với các biện pháp bảo vệ an ninh mạng tương tự như trên các mô hình mạnh mẽ nhất của Anthropic.
Anthropic cũng nêu rõ về giới hạn tối đa. Trang này cho biết "Opus 5.5 vẫn mạnh hơn rõ rệt ở các công việc phức tạp, có tính chất mở và đòi hỏi khả năng đánh giá liên tục." Trên thực tế, mô hình Sonnet xử lý phần lớn các công việc thường nhật, trong khi Opus 5.5 được dành riêng cho các trường hợp khó khăn.
Có một lưu ý quan trọng dành cho nhà phát triển trước khi bạn chuyển đổi. Các đội ngũ chạy Sonnet với tính năng suy nghĩ được tắt cần cấu hình cài đặt between_tools mới trước khi chuyển sang Sonnet 5.5. Hướng dẫn di chuyển của Anthropic sẽ cung cấp chi tiết về vấn đề này.
Claude Haiku 5.5: những điểm thay đổi
Haiku 5.5 hướng tới số lượng lớn. Anthropic cho biết mô hình này "được thiết kế cho các tác vụ khối lượng lớn và nhạy cảm về chi phí." Trang ra mắt liệt kê "tóm tắt, rút gọn văn bản, truy vấn cơ sở dữ liệu và yêu cầu phân loại" là những công việc điển hình.
Trang này cũng mô tả Haiku 5.5 như một trợ thủ cho các mô hình lớn hơn. Nó "kết hợp tốt với Opus 5.5 và Sonnet 5.5 như một tác nhân phụ trên các công việc lập trình." Một chú thích bổ sung rằng Haiku 5.5 là mô hình nhanh nhất của Anthropic ở tốc độ tiêu chuẩn.
Haiku 5.5 cũng là "mô hình thuộc phân khúc Haiku đầu tiên của chúng tôi đi kèm với cài đặt mức độ nỗ lực có thể điều chỉnh." Điều đó cho phép bạn cân đối giữa chi phí và chất lượng trên mỗi yêu cầu, tương tự như những gì bạn đã có thể làm với các mô hình lớn hơn.
Hai câu trích dẫn từ khách hàng trên trang ra mắt mô tả trực tiếp công việc làm báo cáo và slide thuyết trình. Box cho biết họ sẽ sử dụng Haiku 5.5 "cho các công việc phân tích chạy ở quy mô lớn, từ báo cáo chi phí đến tóm tắt tài chính và các đánh giá định kỳ hàng tuần." Rogo mô tả một công việc được phân chia trong câu trích dẫn của mình. "Trong khi một mô hình lớn hơn xây dựng slide thuyết trình, một tác nhân phụ Haiku 5.5 sẽ truy cập vào báo cáo 10-K và trích xuất dòng doanh thu phân khúc mà slide đó cần."
Mô hình thứ hai đó rất đáng để học hỏi. Một mô hình lớn lập kế hoạch và viết, còn một mô hình nhỏ sẽ đi lấy các số liệu cần thiết.
Các bài kiểm tra khi ra mắt nói gì về tài liệu, trang trình bày và bảng tính
Cả hai trang ra mắt đều bao gồm các bài kiểm tra hiệu năng về lập trình. Ba trong số các bài kiểm tra trên các trang này sẽ hữu ích hơn nếu công việc của bạn kết thúc bằng một báo cáo, một bảng tính hoặc một slide thuyết trình.
GDPval-AA và AA-Briefcase: công việc chuyên môn
Anthropic mô tả GDPval-AA v2.1 là một bài kiểm tra "đánh giá các tác nhân trên công việc chuyên môn thực tế thuộc 44 ngành nghề." Sonnet mới đạt 1844 điểm trong bài kiểm tra này, kém hai điểm so với Opus 5.5 ở mức 1846 điểm. Haiku 5.5 đạt 1620 điểm.
Trên AA-Briefcase v1.1, một bài kiểm tra công việc tri thức dài hạn, mô hình Sonnet đạt 1811 điểm và Haiku 5.5 đạt 1578 điểm. Cả hai bài kiểm tra đều được thực hiện bởi Artificial Analysis, và Anthropic lưu ý một lỗi trước khi phát hành có thể đã làm giảm nhẹ điểm số của Sonnet 5.5.
Chartography: đọc biểu đồ
Chartography đo lường khả năng nhận diện biểu đồ trực quan. Sonnet mới đạt 61.6% khi không dùng công cụ hỗ trợ, và Haiku 5.5 đạt 46.4%. Sonnet 5 đạt 15.6% trên cùng một bảng xếp hạng.
Đây là bài kiểm tra cần lưu ý nếu dữ liệu đầu vào của bạn bao gồm ảnh chụp màn hình biểu đồ, báo cáo được quét hoặc các trang trình bày từ slide thuyết trình của người khác.
OSWorld: vận hành máy tính
Trên OSWorld 2.1, mô hình Sonnet đạt 80.1% điểm thành phần. Haiku 5.5 đạt 72.4% trên tập dữ liệu ngoại tuyến. Hai con số này sử dụng cách tính điểm khác nhau, vì vậy chỉ nên so sánh từng mô hình với các hàng mà Anthropic liệt kê bên cạnh nó.
Hãy coi tất cả những kết quả này là do nhà cung cấp công bố. Các tệp tin của riêng bạn, với những đặc thù định dạng riêng, mới là bài kiểm tra thực sự có giá trị.
Giá cả
Giá API dưới đây là các mức giá được hiển thị trên trang tính phí của Claude. Giá được tính trên mỗi triệu token, và giá lưu bộ nhớ đệm prompt phản ánh bộ nhớ đệm 5 phút.
| Mô hình | Đầu vào | Đầu ra | Đọc bộ nhớ đệm | Ghi bộ nhớ đệm |
|---|---|---|---|---|
| Claude Sonnet 5.5 | $2 | $10 | $0.10 | $2.50 |
| Claude Haiku 5.5, prompt lên đến 100K token | $0.10 | $0.50 | $0.01 | $0.125 |
| Claude Haiku 5.5, prompt trên 100K token | $0.50 | $2.50 | $0.05 | $0.625 |
| Claude Opus 5.5 | $4 | $20 | $0.20 | $5 |
Haiku 5.5 là mô hình duy nhất trong bảng có hai mức giá. Mức giá phụ thuộc vào độ dài của prompt, do đó các prompt dài sẽ có chi phí cao hơn trên mỗi token. Anthropic cho biết các prompt lên đến 100,000 token "chiếm khoảng 90% số lượng yêu cầu đối với mô hình Haiku trước đây của chúng tôi."
Bên trong các ứng dụng Claude, chi phí hoạt động theo các gói đăng ký thay vì tính theo token. Trang tính phí liệt kê gói Pro ở mức $17 mỗi tháng đối với gói năm, hoặc $20 nếu thanh toán hàng tháng. Gói Max có giá khởi điểm từ $100 mỗi tháng.
Những người đăng ký gói Max và Team cũng nhận được một khoản tín dụng API hàng tháng mới cho Claude Platform. Trang thông tin của Haiku 5.5 liệt kê mức $100 mỗi tháng cho Max 5x, $200 cho Max 20x, và lên đến $500 cho Team, được gộp chung cho các người dùng.
Cửa sổ ngữ cảnh, giới hạn đầu ra và cài đặt mức độ nỗ lực
Trang tổng quan về các mô hình của Anthropic liệt kê các giới hạn cốt lõi giống nhau cho cả hai mô hình:
- Cửa sổ ngữ cảnh: 1M token.
- Đầu ra tối đa: 128K token.
- Đầu vào: văn bản và hình ảnh, với đầu ra là văn bản.
Cài đặt mức độ nỗ lực là thay đổi thực tế lớn hơn đối với người dùng Haiku. Trang ra mắt biểu diễn Haiku 5.5 ở năm mức độ nỗ lực, từ Thấp đến Tối đa, so với chi phí trên mỗi tác vụ. Trang Sonnet 5.5 của Anthropic giải thích quy luật chung: nỗ lực cao hơn thường đồng nghĩa với chi phí trên mỗi tác vụ cao hơn và điểm số cao hơn.
Đối với các báo cáo định kỳ, điều đó gợi ý một quy tắc đơn giản. Hãy bắt đầu ở cài đặt mức độ nỗ lực thấp, kiểm tra kết quả đầu ra so với một báo cáo chuẩn đã biết là tốt, và chỉ tăng mức độ nỗ lực ở những chỗ mà cài đặt thấp bỏ sót.
Sonnet 5.5, Haiku 5.5, hay Opus 5.5: nên chọn mô hình nào
Các mô tả của chính Anthropic đưa ra sự phân chia rõ ràng:
- Sử dụng Opus 5.5 cho các công việc dài hạn, quan trọng đòi hỏi khả năng đánh giá liên tục.
- Sử dụng Sonnet 5.5 cho các tài liệu, trang trình bày và bảng tính hàng ngày, cũng như cho hầu hết các tác vụ của tác nhân.
- Sử dụng Haiku 5.5 cho các bước có khối lượng lớn như trích xuất, phân loại, tóm tắt và tra cứu bằng tác nhân phụ.
Trang tổng quan về các mô hình tóm tắt mỗi mô hình trong một dòng. Sonnet 5.5 là "Sự kết hợp tốt nhất giữa tốc độ và trí thông minh." Haiku 5.5 là "Dành cho các tác vụ khối lượng lớn, nhạy cảm với độ trễ như phân loại, trích xuất và định tuyến."
Một cách đáng tin cậy để lựa chọn là thử nghiệm trên chính các tệp tin của bạn. Hãy chạy một tác vụ thực tế qua hai mô hình với cùng một dữ liệu đầu vào. Ghi lại thời gian, chi phí trên mỗi tác vụ và mọi con số mà bạn phải chỉnh sửa.
Các giải pháp thay thế đáng chú ý
Một vài phiên bản phát hành tiên phong khác cũng đã xuất hiện trong cùng hai tuần đó. Bảng dưới đây liệt kê những mô hình bạn có thể dùng thử ngay hôm nay, cùng với một mô hình đã được công bố nhưng chưa được mở rộng rãi.
| Mô hình | Ngày phát hành | Giá API trên mỗi triệu token | Nơi sử dụng |
|---|---|---|---|
| Claude Sonnet 5.5 | Ngày 28 tháng 9 năm 2026 | $2 đầu vào / $10 đầu ra | Các ứng dụng Claude, Claude API, các nền tảng đám mây |
| Claude Haiku 5.5 | Ngày 7 tháng 10 năm 2026 | Từ $0.10 đầu vào / $0.50 đầu ra | Claude API, các nền tảng đám mây |
| GPT-6.1 Sol | Ngày 29 tháng 9 năm 2026 | $2 đầu vào / $10 đầu ra, lên đến 272K token đầu vào | ChatGPT Work, Codex, OpenAI API |
| GPT-6 Luna | Ngày 22 tháng 9 năm 2026 | $0.10 đầu vào / $0.50 đầu ra, lên đến 272K token đầu vào | ChatGPT, OpenAI API |
| Gemini 4 Argon | Ngày 30 tháng 9 năm 2026 | Chưa mở cho các nhà phát triển | Chỉ dành cho những người thử nghiệm sớm |
GPT-6.1 Sol. Tài liệu cập nhật của ChatGPT cho biết mô hình này "cải thiện so với GPT-6 Sol trong việc lập trình mang tính tác nhân, sử dụng máy tính và công việc chuyên môn." Mô hình này đang được triển khai trong ChatGPT Work và Codex, bắt đầu với những người dùng gói Pro. Trang tính phí API của OpenAI liệt kê mức giá của nó tương đương với Sonnet 5.5.
GPT-6 Luna. Mô hình dành cho khối lượng lớn của OpenAI là đối thủ cạnh tranh gần nhất với Haiku 5.5 về giá cả. Tài liệu cập nhật ngày 7 tháng 10 cho biết người dùng gói Free và Go sẽ có GPT-6 Luna trong tab Chat, đợt triển khai đó bắt đầu vào ngày hôm sau. Bài viết giải thích về GPT-6 Sol and Luna của chúng tôi sẽ cung cấp thêm thông tin về đợt ra mắt này.
Gemini 4 Argon. Google DeepMind đã công bố mô hình này vào ngày 30 tháng 9. Bài đăng của hãng cho biết Google sẽ thu thập phản hồi "trước khi cung cấp Argon cho các nhà phát triển, doanh nghiệp và người tiêu dùng trong thời gian sớm nhất có thể." Hiện tại, bài đăng mô tả quyền truy cập chỉ dành cho những người thử nghiệm sớm.
Để tìm hiểu về mô hình cao cấp nhất trong dòng Claude, hãy xem bài viết về Claude Opus 5.5 của chúng tôi.
Những trường hợp mà một mô hình nhanh hơn vẫn cần được kiểm tra lại
Giá trên mỗi token thấp hơn giúp việc chạy nhiều tác vụ hơn trở nên dễ dàng hơn. Tuy nhiên, điều đó không loại bỏ nhu cầu kiểm tra kết quả đầu ra. Một báo cáo có một con số sai vẫn là một báo cáo sai, bất kể chi phí của mô hình là bao nhiêu.
Việc kiểm tra đó chính là lúc một không gian làm việc trở nên quan trọng hơn tên của mô hình. Powerdrill Bloom tự mô tả mình là "Nhà phân tích dữ liệu AI hiển thị rõ quy trình làm việc của mình." Trang chủ của hãng cho biết thêm: "Mỗi con số đưa ra đều đi kèm với thông tin về trang, hàng và số liệu gốc đằng sau nó."
Tính chất công việc này hoàn toàn trùng khớp với những gì Anthropic mô tả cho Sonnet mới của mình. Bạn bắt đầu với một bảng tính hoặc một tập hợp tài liệu và kết thúc bằng một tệp tin hoàn chỉnh. Trang tính phí của Powerdrill Bloom liệt kê tính năng "Tạo trang trình bày, tài liệu Office, phân tích Excel và hình ảnh Nano Banana" trên các gói trả phí. Trang Excel to PowerPoint của chúng tôi đề cập đến quy trình đó, và trang trình tạo báo cáo AI đề cập đến các báo cáo bằng văn bản.
Hãy chọn mô hình bằng cách thử nghiệm nó. Sau đó, hãy giữ lại nguồn dẫn dữ liệu ngay bên cạnh kết quả đầu ra, để người kiểm duyệt có thể xác nhận từng con số trong vài giây.
Cách bắt đầu với Sonnet 5.5 and Haiku 5.5
Nếu bạn sử dụng các ứng dụng Claude, hãy chọn Sonnet 5.5 cho tác vụ tài liệu, slide thuyết trình hoặc bảng tính tiếp theo của mình. Hãy cung cấp cho nó một tệp tin thực tế và một sản phẩm đầu ra thực tế. Một bản tóm tắt hàng quý sẽ là bài kiểm tra tốt hơn nhiều so với một câu lệnh thử nghiệm đơn giản.
Nếu bạn xây dựng ứng dụng trên API, trước tiên hãy chuyển đổi ID mô hình và chạy lại bộ dữ liệu đánh giá của mình. Hãy so sánh chi phí trên mỗi tác vụ, chứ không chỉ chi phí trên mỗi token. Một mô hình hoàn thành công việc với ít bước hơn có thể giúp tiết kiệm chi phí tổng thể hơn.
Nếu quy trình xử lý của bạn có một bước đòi hỏi khối lượng lớn, hãy thử nghiệm Haiku 5.5 ở đó trước tiên. Việc trích xuất dữ liệu và tóm tắt sơ bộ là những ứng cử viên sáng giá, sau đó một mô hình lớn hơn sẽ xem xét lại kết quả.
Khi bạn muốn chuyển đổi một bảng tính thành một biểu đồ, báo cáo hoặc slide thuyết trình có nguồn dẫn rõ ràng, bạn có thể thử nghiệm Powerdrill Bloom trên chính các tệp tin của mình.
Câu hỏi thường gặp
Claude Sonnet 5.5 là gì?
Đây là mô hình thứ hai trong dòng Claude 5.5 của Anthropic, được phát hành vào ngày 28 tháng 9 năm 2026. Anthropic cho biết mô hình này mạnh nhất ở các tác vụ hàng ngày, sửa lỗi và tạo ra các tài liệu, trang trình bày và bảng tính trau chuốt. Giá API là $2 đầu vào và $10 đầu ra trên mỗi triệu token.
Claude Haiku 5.5 được dùng để làm gì?
Anthropic đã thiết kế mô hình này cho các tác vụ khối lượng lớn và nhạy cảm về chi phí như tóm tắt, truy vấn cơ sở dữ liệu và phân loại. Nó cũng hoạt động như một tác nhân phụ bên cạnh Opus 5.5 hoặc Sonnet 5.5. Mô hình được ra mắt vào ngày 7 tháng 10 năm 2026.
Claude Haiku 5.5 có giá bao nhiêu?
Đối với các prompt lên đến 100K token, mô hình có chi phí $0.10 trên mỗi triệu token đầu vào và $0.50 trên mỗi triệu token đầu ra. Đối với các prompt dài hơn, mức giá lần lượt là $0.50 và $2.50. Đó là các mức giá hiển thị trên trang tính phí của Claude.
Sự khác biệt giữa Sonnet 5.5 và Opus 5.5 là gì?
Opus 5.5 có chi phí $4 đầu vào và $20 đầu ra trên mỗi triệu token, gấp đôi so với mức giá của Sonnet 5.5. Anthropic cho biết Opus 5.5 vẫn mạnh mẽ hơn ở các công việc phức tạp, có tính chất mở và đòi hỏi khả năng đánh giá liên tục. Sonnet 5.5 là lựa chọn nhanh hơn cho các công việc hàng ngày có phạm vi rõ ràng.
Tại sao Haiku 5.5 lại có hai mức giá?
Mức giá phụ thuộc vào độ dài của prompt. Các prompt lên đến 100,000 token sẽ áp dụng khung giá thấp hơn, và các prompt dài hơn sẽ áp dụng khung giá cao hơn. Anthropic cho biết khoảng 90% số lượng yêu cầu đối với mô hình Haiku trước đây nằm trong khung giá thấp hơn.
Nguồn tham khảo: Anthropic, Introducing Claude Sonnet 5.5 · Anthropic, Introducing Claude Haiku 5.5 · Claude Platform release notes · Claude Help Center release notes · Claude pricing · Claude models overview · ChatGPT release notes · OpenAI API pricing · Google DeepMind, Gemini 4 Argon. Giá cả và tính khả dụng được ghi nhận từ trang thông tin của các nhà cung cấp vào ngày 8 tháng 10 năm 2026.