Đề thi, bài tập trắc nghiệm online Dữ liệu lớn (BigData) – Đề 1

Đề 1 - Bài tập, đề thi trắc nghiệm online Dữ liệu lớn (BigData)

1. Trong lĩnh vực Dữ liệu lớn, 'Edge Computing' (Điện toán biên) được ứng dụng để giải quyết vấn đề nào?
2. Ứng dụng nào sau đây KHÔNG phải là một ví dụ phổ biến của việc sử dụng Dữ liệu lớn?
3. Công nghệ nào sau đây KHÔNG phải là một dịch vụ lưu trữ đám mây phổ biến cho Dữ liệu lớn?
4. Công nghệ nào sau đây thường được sử dụng để xử lý luồng dữ liệu (data stream) thời gian thực trong Dữ liệu lớn?
5. Trong bối cảnh Dữ liệu lớn và bảo mật, kỹ thuật 'Data Masking' (Che dấu dữ liệu) được sử dụng để làm gì?
6. Trong Dữ liệu lớn, kỹ thuật 'Data Aggregation' (Tổng hợp dữ liệu) thường được sử dụng để làm gì?
7. Trong quá trình xử lý Dữ liệu lớn, ETL (Extract, Transform, Load) thường được thay thế bằng quy trình nào khi làm việc với Data Lake?
8. Trong bối cảnh Dữ liệu lớn, 'Data Virtualization' (Ảo hóa dữ liệu) mang lại lợi ích gì?
9. Khái niệm 'Data Silos' (Các silo dữ liệu) trong Dữ liệu lớn gây ra vấn đề gì?
10. Đặc điểm nào sau đây KHÔNG phải là một trong '5Vs' thường được dùng để mô tả Dữ liệu lớn?
11. Trong Dữ liệu lớn, thuật ngữ 'In-Memory Computing' (Tính toán trong bộ nhớ) mang lại lợi ích chính nào?
12. Công cụ nào sau đây thường được sử dụng để truy vấn và phân tích dữ liệu trong Hadoop Data Lake?
13. Trong mô hình 'Lambda Architecture' cho Dữ liệu lớn, lớp 'Speed Layer' (Lớp tốc độ) có vai trò chính là gì?
14. Trong Dữ liệu lớn, 'Data Governance' (Quản trị dữ liệu) bao gồm những hoạt động nào?
15. Khái niệm 'Scalability' (Khả năng mở rộng) trong Dữ liệu lớn đề cập đến điều gì?
16. Trong kiến trúc Dữ liệu lớn, 'Data Warehouse' thường được sử dụng cho mục đích nào sau đây?
17. Ngôn ngữ lập trình nào thường được sử dụng nhiều nhất trong hệ sinh thái Hadoop để xử lý và phân tích Dữ liệu lớn?
18. Thách thức lớn nhất khi làm việc với Dữ liệu lớn liên quan đến 'Variety' (Đa dạng) là gì?
19. Loại hình phân tích dữ liệu lớn nào tập trung vào việc dự đoán các sự kiện hoặc kết quả trong tương lai?
20. Trong Dữ liệu lớn, 'Data Wrangling' (Chuẩn bị dữ liệu) là quá trình nào?
21. Yếu tố 'Veracity' (Tính xác thực) trong 5Vs của Dữ liệu lớn liên quan đến vấn đề gì?
22. Trong ngữ cảnh Dữ liệu lớn, 'Data Lake' (Hồ dữ liệu) khác biệt với 'Data Warehouse' (Kho dữ liệu) chủ yếu ở điểm nào?
23. Trong ngữ cảnh Dữ liệu lớn, 'Machine Learning' (Học máy) đóng vai trò quan trọng nhất trong giai đoạn nào của quy trình phân tích dữ liệu?
24. Công cụ nào sau đây KHÔNG phải là một nền tảng phổ biến cho việc phân tích và trực quan hóa Dữ liệu lớn?
25. Công nghệ nào sau đây thường được sử dụng để lưu trữ và xử lý dữ liệu lớn phân tán trên nhiều máy tính?
26. Kỹ thuật 'Data Mining' (Khai phá dữ liệu) trong Dữ liệu lớn chủ yếu tập trung vào điều gì?
27. Kỹ thuật 'Data Sampling' (Lấy mẫu dữ liệu) được sử dụng trong Dữ liệu lớn khi nào?
28. Loại dữ liệu nào sau đây KHÔNG được coi là dữ liệu 'phi cấu trúc' trong Dữ liệu lớn?
29. Thuật ngữ 'Schema-on-Read' (Lược đồ khi đọc) thường liên quan đến loại hình lưu trữ dữ liệu lớn nào?
30. Thuật ngữ 'NoSQL' (Not Only SQL) dùng để chỉ loại cơ sở dữ liệu nào trong bối cảnh Dữ liệu lớn?