Uber tách ý định mở rộng khỏi thực thi trên nền tảng Kubernetes
Uber vừa công bố chi tiết về ServiceScale, bộ điều khiển mới cho phép nhiều orchestrator cùng quản lý việc mở rộng (scaling) của các workload Kubernetes một cách an toàn. Giải pháp này tách biệt ý định mở rộng khỏi thực thi, giúp hỗ trợ chuyển đổi dự phòng theo vùng (regional failover) mà không cần duy trì dung lượng nhàn rỗi dự trữ.
Uber vừa công bố chi tiết về ServiceScale, bộ điều khiển (controller) mới cho phép nhiều orchestrator cùng quản lý việc mở rộng của các workload Kubernetes một cách an toàn. Bài viết trên blog kỹ thuật của công ty, do hai kỹ sư phần mềm cấp cao Egor Grishechko và Srikar Paruchuru thực hiện, mô tả cách Uber tách biệt ý định mở rộng (scaling intent) khỏi thực thi (execution) để hỗ trợ chuyển đổi dự phòng theo vùng mà không cần duy trì dung lượng nhàn rỗi dự trữ.
Bài toán đặt ra với Uber
Ở quy mô hạ tầng của Uber, hàng nghìn dịch vụ chạy trên Kubernetes và mỗi dịch vụ có thể được điều khiển bởi nhiều orchestrator khác nhau. Vấn đề nảy sinh khi nhiều hệ thống cùng muốn thay đổi số lượng bản sao (replica) của một workload: nếu không có cơ chế phối hợp, chúng sẽ ghi đè lẫn nhau, gây ra tình trạng mở rộng hoặc thu hẹp ngoài ý muốn.
Trước đây, để đối phó với kịch bản một vùng gặp sự cố, Uber thường phải duy trì dung lượng dự trữ nhàn rỗi — một cách làm tốn kém vì tài nguyên vẫn bị chiếm dụng dù không phục vụ lưu lượng thực tế.
ServiceScale: tách ý định khỏi thực thi
Điểm cốt lõi của ServiceScale là mô hình tách biệt ý định mở rộng khỏi hành động thực thi. Thay vì để từng orchestrator trực tiếp thay đổi số replica, các hệ thống này chỉ bày tỏ ý định về mức mở rộng mong muốn. ServiceScale đóng vai trò trung gian, tổng hợp các ý định đó và quyết định cấu hình cuối cùng trước khi áp dụng lên cụm Kubernetes.
Cách tiếp cận này mang lại một số lợi ích:
- Tránh xung đột: nhiều orchestrator có thể cùng đề xuất mức mở rộng mà không ghi đè lẫn nhau.
- Chuyển đổi dự phòng theo vùng: khi một vùng gặp sự cố, hệ thống có thể chuyển hướng lưu lượng và điều chỉnh quy mô mà không cần đã dự trữ sẵn dung lượng nhàn rỗi.
- Tiết kiệm chi phí: giảm lượng tài nguyên bị bỏ không chỉ để phòng ngừa sự cố.
Ý nghĩa với cộng đồng DevOps
Với các đội ngũ vận hành hạ tầng tại Việt Nam và trên toàn cầu, câu chuyện của Uber là một ví dụ đáng tham khảo về quản lý đa orchestrator trên Kubernetes. Khi hệ thống ngày càng phân tán và yêu cầu về khả năng chịu lỗi tăng cao, việc chuẩn hóa cách các thành phần bày tỏ ý định và phối hợp thực thi sẽ trở thành yếu tố then chốt để vừa đảm bảo độ sẵn sàng, vừa kiểm soát chi phí cloud.
Việc tách ý định khỏi thực thi không chỉ là một cải tiến kỹ thuật, mà còn là cách tiếp cận để các hệ thống lớn vận hành an toàn và hiệu quả hơn trong môi trường đa vùng.
Bài viết liên quan

Công nghệ
AI Agent sắp tràn vào lực lượng lao động: Chưa ai sẵn sàng cho điều đó
28 tháng 9, 2026

Phần mềm
Nvidia tung hệ thống bảo mật AI mã nguồn mở để đối phó với các tác nhân AI nổi loạn
28 tháng 9, 2026

Phần mềm
Cạm bẫy với Postgres "at time zone 'UTC'": hiểu sai có thể khiến dữ liệu thời gian của bạn lệch múi giờ
27 tháng 9, 2026