Đề thi, bài tập trắc nghiệm online Dữ liệu lớn (BigData) – Đề 8

Đề 8 - Bài tập, đề thi trắc nghiệm online Dữ liệu lớn (BigData)

1. Công cụ trực quan hóa dữ liệu nào sau đây thường được sử dụng để tạo dashboard và báo cáo tương tác từ dữ liệu lớn?
2. Phương pháp 'Stream processing' (Xử lý luồng dữ liệu) trong Dữ liệu lớn khác biệt với 'Batch processing' (Xử lý theo lô) như thế nào?
3. Trong mô hình Lambda Architecture cho Dữ liệu lớn, lớp 'Speed Layer' (Tầng tốc độ) được sử dụng để làm gì?
4. Trong quá trình xử lý Dữ liệu lớn, 'Data Cleansing' (Làm sạch dữ liệu) đóng vai trò gì?
5. Trong ngữ cảnh Dữ liệu lớn, 'Data Lake' (Hồ dữ liệu) khác biệt với 'Data Warehouse' (Kho dữ liệu) chủ yếu ở điểm nào?
6. Loại cơ sở dữ liệu nào thường được sử dụng trong các ứng dụng Dữ liệu lớn để lưu trữ dữ liệu phi cấu trúc và bán cấu trúc, thay vì cơ sở dữ liệu quan hệ truyền thống?
7. Phương pháp 'MapReduce' trong Hadoop hoạt động dựa trên nguyên tắc nào?
8. Trong bối cảnh Dữ liệu lớn, 'Metadata' (Siêu dữ liệu) được sử dụng để làm gì?
9. Trong bối cảnh Dữ liệu lớn, 'Data Scientist' (Nhà khoa học dữ liệu) là người chịu trách nhiệm chính cho công việc nào?
10. Công nghệ 'In-memory computing' (Điện toán trong bộ nhớ) trong Dữ liệu lớn giúp cải thiện hiệu suất xử lý dữ liệu bằng cách nào?
11. Đâu là một ví dụ về ứng dụng của Dữ liệu lớn trong lĩnh vực tài chính - ngân hàng?
12. Ứng dụng nào sau đây KHÔNG phải là một ví dụ điển hình của việc sử dụng Dữ liệu lớn?
13. Loại dữ liệu nào sau đây thường được coi là 'dữ liệu phi cấu trúc' trong bối cảnh Dữ liệu lớn?
14. Đặc điểm nào sau đây KHÔNG phải là một trong '5Vs' thường được dùng để mô tả Dữ liệu lớn (Big Data)?
15. Trong kiến trúc Dữ liệu lớn, tầng 'Ingestion' (Tiếp nhận) chịu trách nhiệm chính cho công việc nào?
16. Thách thức về 'skills gap' (khoảng cách kỹ năng) trong lĩnh vực Dữ liệu lớn đề cập đến vấn đề gì?
17. Rủi ro nào sau đây có thể xảy ra khi sử dụng các thuật toán phân tích Dữ liệu lớn mà không cẩn thận?
18. Công nghệ nào sau đây KHÔNG phải là một thành phần phổ biến trong hệ sinh thái Hadoop?
19. Thuật ngữ 'Data Mining' (Khai phá dữ liệu) trong Dữ liệu lớn chủ yếu đề cập đến quy trình nào?
20. Lợi ích chính của việc sử dụng Dữ liệu lớn trong lĩnh vực y tế là gì?
21. Khi nói về 'khả năng mở rộng' (scalability) của hệ thống Dữ liệu lớn, chúng ta thường đề cập đến khả năng gì?
22. Trong lĩnh vực marketing, Dữ liệu lớn thường được sử dụng để thực hiện mục tiêu nào sau đây?
23. Đâu là một ví dụ về 'dữ liệu bán cấu trúc' trong Big Data?
24. Thách thức lớn nhất về mặt đạo đức khi sử dụng Dữ liệu lớn là gì?
25. Khái niệm 'Data Governance' (Quản trị dữ liệu) trong Dữ liệu lớn đề cập đến vấn đề gì?
26. Công cụ nào sau đây thường được sử dụng để thực hiện các truy vấn và phân tích dữ liệu trong hệ sinh thái Hadoop?
27. Quy trình 'ETL' (Extract, Transform, Load) trong Dữ liệu lớn thường được sử dụng để làm gì?
28. Ưu điểm chính của việc sử dụng 'Cloud Computing' (Điện toán đám mây) cho các dự án Dữ liệu lớn là gì?
29. Khía cạnh 'Veracity' (Độ xác thực) trong 5Vs của Dữ liệu lớn nhấn mạnh điều gì?
30. Công nghệ nào sau đây thường được sử dụng để xử lý và phân tích Dữ liệu lớn phân tán trên nhiều máy tính?