Đề thi, bài tập trắc nghiệm online Dữ liệu lớn (BigData) – Đề 14

Đề 14 - Bài tập, đề thi trắc nghiệm online Dữ liệu lớn (BigData)

1. Khái niệm 'Data Governance' (Quản trị dữ liệu) trong Big Data liên quan đến điều gì?
2. Ưu điểm của việc sử dụng 'cloud-based' Big Data solutions (giải pháp Big Data trên nền tảng đám mây) so với 'on-premise' (tại chỗ) là gì?
3. Điều gì KHÔNG phải là một lợi ích tiềm năng của việc ứng dụng Big Data Analytics trong lĩnh vực y tế?
4. Ưu điểm chính của việc sử dụng cơ sở dữ liệu NoSQL so với cơ sở dữ liệu quan hệ (SQL) trong Big Data là gì?
5. Yếu tố 'Value' (Giá trị) trong 5V của Big Data đề cập đến điều gì?
6. Đặc điểm nào sau đây KHÔNG phải là 'V' chính trong mô hình 5V thường được dùng để mô tả Dữ liệu lớn (Big Data)?
7. Trong bối cảnh Big Data và phân tích dữ liệu, 'Machine Learning' (Học máy) đóng vai trò gì?
8. Trong bối cảnh Internet of Things (IoT), Big Data đóng vai trò quan trọng như thế nào?
9. Trong ngữ cảnh bảo mật Big Data, điều gì là quan trọng nhất để bảo vệ dữ liệu nhạy cảm?
10. Công cụ nào sau đây thường được sử dụng để truy vấn và phân tích dữ liệu trong Hadoop?
11. Mục tiêu chính của 'Data Visualization' (Trực quan hóa dữ liệu) trong Big Data Analytics là gì?
12. Một thách thức đạo đức quan trọng liên quan đến Big Data và AI là gì?
13. Thuật ngữ 'Data Warehouse' (Kho dữ liệu) khác biệt với 'Data Lake' (Hồ dữ liệu) chủ yếu ở điểm nào?
14. Công nghệ nào sau đây thường được sử dụng để xử lý dữ liệu dòng (streaming data) trong thời gian thực?
15. Trong bối cảnh Big Data, 'Data Mining' (Khai thác dữ liệu) chủ yếu tập trung vào điều gì?
16. Khi nào thì việc sử dụng Big Data KHÔNG thực sự cần thiết hoặc hiệu quả?
17. Thách thức lớn nhất liên quan đến 'Veracity' (Tính xác thực) của Dữ liệu lớn là gì?
18. Trong kiến trúc Lambda của Big Data, layer 'Batch' (Lô) và layer 'Speed' (Tốc độ) phục vụ mục đích khác nhau nào?
19. Loại dữ liệu nào sau đây KHÔNG được xem là một phần của 'Variety' (Đa dạng) trong bối cảnh Big Data?
20. Công nghệ nào sau đây KHÔNG phải là một thành phần cốt lõi trong hệ sinh thái Hadoop?
21. Ứng dụng nào sau đây KHÔNG phải là một ví dụ điển hình của việc sử dụng Dữ liệu lớn?
22. Trong mô hình MapReduce của Hadoop, giai đoạn 'Map' chịu trách nhiệm chính cho việc gì?
23. Phương pháp 'sampling' (lấy mẫu) có thể hữu ích như thế nào khi làm việc với Big Data?
24. Công nghệ nào sau đây thường được sử dụng cho việc 'message queuing' (hàng đợi tin nhắn) trong các hệ thống Big Data phân tán?
25. Khái niệm 'Data Wrangling' (Chuẩn bị dữ liệu) trong Big Data bao gồm các công việc chính nào?
26. Điều gì có thể gây ra 'data silos' (tổ chức dữ liệu rời rạc) trong một tổ chức, và tại sao đó là một vấn đề trong bối cảnh Big Data?
27. Thuật ngữ 'Data Lake' (Hồ dữ liệu) trong Big Data dùng để chỉ điều gì?
28. Công nghệ nào sau đây thường được sử dụng để xử lý dữ liệu lớn với khối lượng cực lớn và tốc độ cao, đặc biệt trong các ứng dụng phân tích thời gian thực?
29. Công cụ nào sau đây thường được dùng để xây dựng quy trình ETL (Extract, Transform, Load) trong Big Data?
30. Điều gì KHÔNG phải là một thách thức phổ biến khi triển khai các dự án Big Data?