Với khối lượng dữ liệu khổng lồ được các doanh nghiệp lưu trữ ở những nơi riêng biệt, có các kiểu truy cập và thuộc tính của những nơi này sẽ khác nhau. Vì vậy doanh nghiệp cần một giải pháp để hợp nhất tất cả lại với nhau và cho phép truy cập dữ liệu bất kể dữ liệu nằm ở đâu hoặc định dạng nào.
Cùng Cloud Ace tìm hiểu giải pháp BigLake trên Google Cloud Platform và những lợi ích mà doanh nghiệp có thể nhận được như thế nào trong bài blog dưới đây.
BigLake là một công cụ của Google Cloud Platform giúp lưu trữ, hợp nhất các data warehouse và data lake bằng cách cho phép BigQuery và các mã nguồn mở như Spark truy cập dữ liệu.
BigLake cung cấp hiệu suất truy vấn được tăng tốc trên lưu trữ nhiều đám mây và các định dạng mở như Apache Iceberg.

Áp dụng các chính sách bảo mật cấp bảng, hàng, cột trên các bảng lưu trữ dữ liệu tương tự như các bảng BigQuery hiện có.

Duy trì một bản sao lưu dữ liệu duy nhất, quản lý các chính sách bảo mật ở một nơi và thực thi một cách nhất quán trên các công cụ truy vấn bằng giao diện API được tích hợp trong trình kết nối BigLake trên GCP.

Đạt được hiệu suất hàng đầu trong ngành đối với các kho dữ liệu trên Google Cloud, AWS và Azure, được cung cấp bởi cơ sở hạ tầng BigQuery đã được chứng minh.

Cho phép truy cập vào các định dạng dữ liệu mở phổ biến nhất bao gồm Parquet, Avro, ORC, CSV, JSON. Giúp hỗ trợ nhiều công cụ tính toán thông qua Apache Arrow.
BigLake cho phép chúng tôi mở khóa giá trị của kho dữ liệu bằng cách cho phép kiểm soát truy cập trên chế độ xem của chúng tôi đồng thời cung cấp giao diện hợp nhất cho người dùng và giữ chi phí lưu trữ dữ liệu ở mức thấp. Điều này cho phép người dùng của chúng tôi phân tích nhanh hơn trên các datasets của chúng tôi.
Martin Cekodhima, Kỹ sư phần mềm, Bol.com
Cloud Ace - Managed Service Partner của Google Cloud