Cụm phân tán
Cụm máy chủ liên kết (Federated Cluster) đề cập đến một tập hợp các cụm máy tính hoặc kho dữ liệu độc lập, được kết nối với nhau, hoạt động bán tự chủ nhưng lại trình bày một cái nhìn thống nhất, mạch lạc cho người dùng cuối hoặc ứng dụng. Thay vì tập trung tất cả dữ liệu vào một hệ thống khổng lồ duy nhất, cơ chế liên kết cho phép nhiều cụm riêng biệt hợp tác trong các tác vụ hoặc truy vấn chung.
Trong môi trường doanh nghiệp hiện đại, dữ liệu hiếm khi bị cô lập ở một nơi. Nó tồn tại trên nhiều cơ sở dữ liệu vận hành khác nhau, các trung tâm dữ liệu khu vực và các dịch vụ vi mô chuyên biệt. Cụm máy chủ liên kết giải quyết sự phức tạp của việc truy vấn dữ liệu phân tán này. Nó cho phép các tổ chức tận dụng dữ liệu từ nhiều nguồn mà không phải chịu chi phí hoặc độ trễ lớn liên quan đến việc di chuyển và tập trung hóa dữ liệu quy mô lớn.
Cơ chế cốt lõi liên quan đến một lớp điều phối hoặc phần mềm trung gian (middleware). Khi một truy vấn được gửi đi, lớp này sẽ thông minh phân tách yêu cầu thành các truy vấn phụ được điều chỉnh cho từng cụm liên quan. Mỗi cụm sẽ thực thi truy vấn cục bộ của mình bằng cách sử dụng các khả năng sẵn có của nó. Sau đó, các kết quả được trả về cho lớp điều phối, nơi nó tổng hợp, hòa giải và trình bày tập hợp kết quả cuối cùng, thống nhất cho bên yêu cầu.
Các cụm máy chủ liên kết rất quan trọng trong một số kịch bản có nhu cầu cao:
Việc triển khai cơ chế liên kết mang lại sự phức tạp. Các thách thức chính bao gồm đảm bảo khả năng tương tác ngữ nghĩa (đảm bảo rằng các lược đồ dữ liệu khác nhau có cùng ý nghĩa), quản lý độ trễ mạng trên các nút không đồng nhất và duy trì các chính sách bảo mật nhất quán trên tất cả các cụm tham gia.
Khái niệm này có liên quan chặt chẽ đến Trực quan hóa dữ liệu (Data Virtualization), vốn tập trung nhiều hơn vào lớp trừu tượng logic, và Điện toán phân tán (Distributed Computing), mô tả mô hình kiến trúc cơ bản.