Anthropic ra mắt Claude Opus 5.5: Mạnh hơn, rẻ hơn 40% và an toàn nhất từ trước đến nay

Công nghệ22 tháng 9, 2026·6 phút đọc

Anthropic vừa giới thiệu Claude Opus 5.5, mô hình đầu tiên trong dòng Claude 5.5 với hiệu năng vượt trội so với Opus 5 nhưng chi phí vận hành giảm 40%. Mô hình này cũng đạt điểm số an toàn cao nhất từ trước đến nay và có giá token rẻ hơn đáng kể so với thế hệ trước.

Anthropic ra mắt Claude Opus 5.5: Mạnh hơn, rẻ hơn 40% và an toàn nhất từ trước đến nay

Anthropic vừa chính thức trình làng Claude Opus 5.5, mô hình đầu tiên thuộc dòng Claude 5.5 mới. Đây được xem là bước tiến lớn khi vừa nâng cao hiệu năng, vừa cắt giảm đáng kể chi phí vận hành so với người tiền nhiệm Opus 5.

Theo công bố từ Anthropic, Claude Opus 5.5 đạt hiệu năng tương đương Claude Fable 5.1 trong hầu hết các tác vụ, nhưng chi phí chạy chỉ bằng 60% so với Opus 5. Đây là mô hình đầu tiên được phát hành kể từ khi hãng kêu gọi "kiềm chế tốc độ phát triển" (pacing the frontier).

Hiệu năng vượt trội trong lập trình và công việc tri thức

Claude Opus 5.5 cho thấy sự cải thiện rõ rệt trong các tác vụ lập trình tự động (agentic coding), sử dụng máy tính và công việc tri thức. Một trong những điểm đáng chú ý nhất là khả năng xử lý các tác vụ dài hơi và phức tạp.

Theo chia sẻ từ một đơn vị thử nghiệm sớm, mô hình này đã hoàn thành việc di chuyển mã nguồn dài 680.000 dòng trong chưa đầy một ngày — công việc mà một nhóm kỹ sư thông thường phải mất nhiều tuần. Trong một bài kiểm tra khác, Opus 5.5 đã tối ưu thời gian tải trên mọi trang của một ứng dụng web thành công 39/40 lần, trong khi Opus 5 chỉ cải thiện được một phần và còn làm thay đổi hành vi của ứng dụng.

Trên các bảng xếp hạng chuẩn, Claude Opus 5.5 dẫn đầu ở nhiều hạng mục:

  • Terminal-Bench 4.0: đạt 66,4%, cao hơn Fable 5.1 (55,8%) và Opus 5 (52,3%)
  • FrontierCode v1.1: đạt 54,4%, vượt qua cả GPT-6 Astra (53,3%) và GPT-5.6 Sol (47,5%)
  • CursorBench 4.0: đạt 57,8%, bỏ xa GPT-5.6 Sol (41,7%)
  • OSWorld 2.0 (sử dụng máy tính): đạt 81,8%, cao nhất trong các mô hình được thử nghiệm
  • Humanity's Last Exam (suy luận đa lĩnh vực): đạt 67,7% khi dùng công cụ

"Các nhà phát triển muốn những tác nhân AI có thể đảm nhận công việc phần mềm thực sự và hoàn thành nó. Trong thử nghiệm của chúng tôi, Claude Opus 5.5 sử dụng ít token và ít bước nhất so với các mô hình khác, giúp các dự án lớn của nhà phát triển trở nên khả thi hơn." — Mario Rodriguez, Giám đốc Sản phẩm GitHub

Chi phí giảm mạnh, tốc độ nhanh hơn

Một trong những điểm hấp dẫn nhất của Claude Opus 5.5 là mức giá. Mô hình này tiêu tốn ít tài nguyên tính toán hơn Opus 5, và điều đó được phản ánh trực tiếp vào chi phí:

  • Token đầu vào: 4 USD/triệu token (giảm 20% so với 5 USD của Opus 5)
  • Token đầu ra: 20 USD/triệu token (giảm 20% so với 25 USD)
  • Đọc cache: 0,20 USD/triệu token (giảm 60% so với 0,50 USD)
  • Ghi cache: 5 USD/triệu token (giảm 20% so với 6,25 USD)

Anthropic cho biết ở cấu hình mặc định, Opus 5.5 sẽ rẻ hơn 40% so với Opus 5 trên các khối lượng công việc thông thường. Tốc độ sinh đầu ra cũng nhanh hơn hơn 30%. Ngoài ra, chế độ Fast mode cho Opus 5.5 cũng có sẵn trong Claude Code và Claude Platform với tốc độ nhanh gấp 2,5 lần, giá 8 USD/triệu token đầu vào và 40 USD/triệu token đầu ra.

Bên cạnh việc giảm giá, Anthropic cũng tăng giới hạn sử dụng 5 giờ trên các gói Pro, Max và Team, đồng thời cung cấp cho người dùng thuê bao khả năng đặt lại giới hạn tốc độ (rate limit reset) và sử dụng bất cứ lúc nào họ muốn.

An toàn là ưu tiên hàng đầu

Claude Opus 5.5 đạt điểm số tốt nhất từ trước đến nay trên bài kiểm tra hành vi tự động (automated behavioral audit) — bộ kiểm tra căn chỉnh toàn diện nhất mà Anthropic thực hiện, đánh giá Claude qua hàng nghìn tình huống mô phỏng.

Mô hình này ít có khả năng thực hiện các hành động khó đảo ngược hoặc vượt ra ngoài ranh giới được giao hơn nhiều so với các mô hình gần đây, và kháng lại các cuộc tấn công prompt injection tốt hơn Opus 5.

Đặc biệt, trong một đánh giá mới về xu hướng vượt qua ranh giới ngăn chặn, Opus 5.5 cố gắng vượt rào ít hơn khoảng 85% so với Opus 5 hoặc Claude Mythos 5.1, và mọi nỗ lực đều ở mức độ thấp và tự báo cáo.

Do Opus 5.5 có năng lực tương đương Claude Mythos 5.1 trong lĩnh vực sinh học và an ninh mạng, Anthropic triển khai mô hình này với các biện pháp bảo vệ tương tự Fable 5.1:

  • An ninh mạng: Hầu hết các tác vụ an ninh mạng sẽ được chuyển hướng sang Opus 4.8, trong khi người dùng vẫn có thể tìm và sửa lỗi trong quy trình phát triển phần mềm thông thường
  • Sinh học: Các tổ chức đã được xác minh có thể đăng ký Chương trình Xác minh Khoa học Sự sống (Life Sciences Verification Program) để sử dụng Opus 5.5 cho nghiên cứu sinh học
  • Chống chưng cất (anti-distillation): Mô hình được trang bị tính năng "preserved thinking" để ngăn chặn các cuộc tấn công chưng cất quy mô lớn

Giao tiếp tự nhiên hơn

Một trong những cải tiến được đánh giá cao là khả năng giao tiếp của Opus 5.5. Anthropic cho biết mô hình này viết rõ ràng và dễ theo dõi hơn, đặt thông tin quan trọng lên đầu, ít dùng thuật ngữ chuyên môn hoặc cách diễn đạt kỳ lạ, và tuân thủ các quy tắc viết mà người dùng đưa ra.

"Đầu ra dài dòng, khó theo dõi là điều tôi thấy khó chịu nhất với các mô hình tiên tiến, và Claude Opus 5.5 đã khắc phục được điều đó. Nó viết như một đồng nghiệp giỏi." — John Ruelas, Kỹ sư phần mềm cấp cao tại Ramp

Các khách hàng lớn như GitHub, Stripe, Spotify, Deloitte, Thomson Reuters và nhiều tổ chức khác cũng ghi nhận mức tiết kiệm token đáng kể, chất lượng đầu ra tốt hơn và khả năng hoàn thành các tác vụ phức tạp nhanh hơn.

Sẵn có trên mọi nền tảng

Claude Opus 5.5 hiện đã có mặt trên tất cả các nền tảng, bao gồm Amazon Web Services, Google Cloud và Microsoft Azure. Trên Claude Platform, nhà phát triển có thể bắt đầu với mã định danh claude-opus-5-5.

Anthropic cũng cho biết Claude Sonnet 5.5Claude Haiku 5.5 sẽ ra mắt trong vài tuần tới, với nhiều cải tiến tương tự về hiệu năng, hiệu quả và an toàn.

Đối với cộng đồng nhà phát triển và doanh nghiệp tại Việt Nam đang tìm kiếm các giải pháp AI tiết kiệm chi phí nhưng vẫn đảm bảo hiệu năng cao, Claude Opus 5.5 rõ ràng là một lựa chọn đáng cân nhắc, đặc biệt khi mức giá token giảm mạnh có thể giúp tối ưu ngân sách cho các dự án AI quy mô lớn.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗