AWS trình làng bộ khung agent mã nguồn mở Strands, tuyên bố tiết kiệm token hơn đối thủ

Phần mềm21 tháng 9, 2026·3 phút đọc

AWS vừa gia nhập cuộc đua AI agent mã nguồn mở với bộ khung Strands, khẳng định đạt hiệu năng gần ngang Claude Code và Codex trên các bài kiểm thử nhưng tiêu tốn ít hơn khoảng 28% token. Tuy nhiên, giới phân tích đặt câu hỏi vì AWS chỉ so sánh với các agent lập trình trong khi Strands được định vị là agent đa dụng.

AWS trình làng bộ khung agent mã nguồn mở Strands, tuyên bố tiết kiệm token hơn đối thủ

AWS vừa chính thức tham gia vào cuộc đua AI agent mã nguồn mở với bộ khung mang tên Strands. Hãng tuyên bố công cụ này đạt điểm chuẩn gần ngang các đối thủ nổi tiếng như Claude Code và Codex, nhưng chỉ tiêu tốn khoảng một phần tư lượng token so với chúng.

Strands được xây dựng dựa trên Strands Harness SDK của AWS, nhưng đã được đóng gói sẵn sàng để triển khai ngay, dù là chạy cục bộ hay đưa lên làm việc với bất kỳ nhà cung cấp AI nào mà người dùng lựa chọn.

Điểm nổi bật của Strands

AWS nhấn mạnh rằng điểm hấp dẫn lớn nhất của Strands nằm ở sự tiện lợi:

"Ngay khi bạn tự xây dựng một agent, bạn sẽ phải tự lo mọi thứ. Việc kết nối đúng các thành phần nguyên thủy sao cho đủ tốt để đạt cảm giác 'chạy là chạy được' thực sự rất khó."

Theo AWS, lựa chọn mã nguồn mở mới này cho phép người dùng chỉ cần một dòng Python hoặc TypeScript là có thể đưa nó vào hoạt động với mô hình mà họ chọn.

Về hiệu năng, AWS khẳng định Strands đạt "điểm chuẩn gần tương đương" so với Claude Code, Codex và "các bộ khung phổ biến khác" khi được kiểm thử bằng framework Harbor, phân tán trên nhiều node máy chủ ảo EC2 của chính AWS.

Đáng chú ý, AWS cho biết Strands tiêu thụ ít hơn 28% token qua sáu bài kiểm thử so với "các mô hình Claude hoặc GPT", thậm chí có trường hợp đạt độ chính xác cao hơn các bộ khung khác. Hãng cũng thừa nhận bộ khung của DeepSeek tiết kiệm token hơn, nhưng cho rằng nó kém chính xác hơn trên cùng bộ kiểm thử.

Bí quyết đến từ quản lý ngữ cảnh

AWS lý giải hiệu quả token của Strands đến từ các thiết lập mặc định về bộ nhớ đệm prompt (prompt caching)quản lý ngữ cảnh. Cụ thể, bộ khung này mặc định:

  • Cắt bớt kết quả công cụ vượt quá 1.500 token
  • Tự động nén cửa sổ ngữ cảnh khi vượt 85%
  • Tự động cố gắng khôi phục ngữ cảnh trong các trường hợp tràn

Câu hỏi còn bỏ ngỏ về tính khách quan

Cần lưu ý rằng AWS mô tả Strands được xây dựng như "một agent đa dụng thay vì agent lập trình". Điều này đặt ra nghi vấn đáng kể: tất cả các bộ khung mà AWS đem ra so sánh (Claude Code, Codex, oh-my-pi, OpenCode và DeepSeek Harness) đều được quảng bá là agent lập trình. Vậy các agent AI đa dụng khác sẽ thể hiện ra sao khi đối đầu với Strands?

Nói cách khác, AWS đang tự chấm bài của chính mình khi chỉ đua với các đối thủ lập trình trong khi sản phẩm của họ có định vị khác biệt.

Amazon cho biết sẽ công bố một bài báo khoa học từ các nhà nghiên cứu của mình với nhiều chi tiết kiểm thử hơn, hứa hẹn làm rõ cách đánh giá.

Sẵn sàng dùng ngay

Bất kỳ ai muốn thử bộ khung Strands mã nguồn mở, đa dụng này đều có thể làm theo hướng dẫn trong bài công bố. Nó có sẵn dưới dạng thư viện Python hoặc TypeScript, kèm cả giao diện dòng lệnh (CLI). Bộ khung còn đi kèm một tệp kỹ năng (skills file), giúp việc cắm thêm công cụ yêu thích trở nên dễ dàng; các công cụ shell, xử lý tệp và web đã được tích hợp sẵn ngay từ đầu.

"Chúng tôi tin rằng việc tạo mẫu nhanh chóng với một bộ khung đầy đủ tiện ích sẽ tạo ra nhiều agent hữu ích hơn."

Strands hiện đã hoạt động, sẵn sàng phục vụ bất cứ ai đang tìm kiếm thêm một lựa chọn mã nguồn mở. Tuy vậy, người dùng Việt Nam nên lưu ý rằng hiện vẫn thiếu một thước đo hiệu năng độc lập để kiểm chứng những tuyên bố ấn tượng của AWS.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗