Đề thi, bài tập trắc nghiệm online Dữ liệu lớn (BigData) – Đề 13

Đề 13 - Bài tập, đề thi trắc nghiệm online Dữ liệu lớn (BigData)

1. Ứng dụng nào sau đây KHÔNG phải là ứng dụng điển hình của Big Data?
2. MapReduce là một mô hình lập trình được sử dụng trong Hadoop, chức năng chính của nó là gì?
3. Hadoop Distributed File System (HDFS) là thành phần cốt lõi của Hadoop, nó dùng để làm gì?
4. Data Mining (Khai phá dữ liệu) đóng vai trò gì trong phân tích Big Data?
5. Data Governance (Quản trị dữ liệu) đóng vai trò gì trong môi trường Big Data?
6. Khía cạnh 'Volume' (Khối lượng) trong Big Data ám chỉ đến yếu tố nào?
7. Cloud Computing (Điện toán đám mây) mang lại lợi ích gì cho Big Data?
8. Đặc điểm 'Variety' (Đa dạng) của Big Data mô tả điều gì?
9. Đâu là định nghĩa chính xác nhất về Big Data?
10. Trong kiến trúc Lambda của Big Data, 'Batch Layer' (Lớp xử lý hàng loạt) có chức năng chính là gì?
11. Đâu là một thách thức về mặt đạo đức khi sử dụng Big Data?
12. Khi nói về 'Scalability' (Khả năng mở rộng) trong Big Data, chúng ta thường quan tâm đến điều gì?
13. Công nghệ nào sau đây thường được sử dụng để xử lý Big Data phân tán?
14. Thách thức lớn nhất khi làm việc với Big Data là gì?
15. Để giải quyết vấn đề 'Data Silos', giải pháp nào sau đây thường được áp dụng trong Big Data?
16. Ý nào sau đây mô tả đúng nhất về 'Data Silos' (Các silo dữ liệu) trong bối cảnh Big Data?
17. Yếu tố 'Value' (Giá trị) trong 4Vs của Big Data thể hiện điều gì?
18. Công cụ nào sau đây KHÔNG phải là một nền tảng NoSQL database phổ biến?
19. NoSQL database (Cơ sở dữ liệu NoSQL) thường được sử dụng trong Big Data vì lý do chính nào?
20. Machine Learning (Học máy) được ứng dụng trong Big Data để làm gì?
21. Trong bối cảnh Big Data, thuật ngữ 'Data Lake' (Hồ dữ liệu) dùng để chỉ điều gì?
22. Apache Spark so với Hadoop MapReduce có ưu điểm chính nào?
23. Trong kiến trúc Lambda của Big Data, 'Speed Layer' (Lớp tốc độ) có chức năng chính là gì?
24. Apache Kafka thường được sử dụng trong Big Data cho mục đích gì?
25. Kiến trúc Kappa của Big Data khác biệt chính so với kiến trúc Lambda ở điểm nào?
26. Data Visualization (Trực quan hóa dữ liệu) quan trọng như thế nào trong Big Data?
27. Công cụ nào sau đây thường được sử dụng cho việc ETL trong môi trường Big Data?
28. Thuộc tính 'Velocity' (Tốc độ) trong 4Vs của Big Data đề cập đến điều gì?
29. Quy trình ETL (Extract, Transform, Load) trong Big Data thường được sử dụng cho mục đích gì?
30. Thuật ngữ 'Data Warehouse' (Kho dữ liệu) khác biệt chính so với 'Data Lake' ở điểm nào?