Đề thi, bài tập trắc nghiệm online Khai phá dữ liệu – Đề 8

Đề 8 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Trong khai phá dữ liệu chuỗi thời gian, mục tiêu chính thường là gì?
2. Trong khai phá dữ liệu mạng xã hội, 'community detection' (phát hiện cộng đồng) nhằm mục đích gì?
3. Trong khai phá dữ liệu văn bản, kỹ thuật 'TF-IDF' được sử dụng để làm gì?
4. Vấn đề 'curse of dimensionality' (lời nguyền chiều dữ liệu) thường gây ảnh hưởng tiêu cực đến thuật toán khai phá dữ liệu nào?
5. Thuật toán Apriori thường được sử dụng trong loại khai phá dữ liệu nào?
6. Trong khai phá dữ liệu, 'feature selection' và 'feature extraction' khác nhau như thế nào?
7. Trong khai phá dữ liệu không gian (spatial data mining), loại dữ liệu đặc biệt nào được quan tâm?
8. Trong khai phá dữ liệu y tế, ứng dụng nào sau đây KHÔNG phổ biến?
9. Thuật toán k-means được sử dụng cho bài toán khai phá dữ liệu nào?
10. Phương pháp nào sau đây thường được sử dụng để xử lý dữ liệu bị thiếu (missing values) trong tiền xử lý dữ liệu?
11. Đâu là một thách thức lớn trong khai phá dữ liệu trên dữ liệu lớn (big data)?
12. Kỹ thuật 'cross-validation' (kiểm định chéo) thường được sử dụng để làm gì trong khai phá dữ liệu?
13. Trong khai phá dữ liệu, vấn đề đạo đức và riêng tư dữ liệu ngày càng được quan tâm, đặc biệt trong bối cảnh nào?
14. Độ đo 'precision' trong đánh giá mô hình phân loại đo lường điều gì?
15. Phương pháp 'Principal Component Analysis' (PCA) thuộc loại kỹ thuật nào trong khai phá dữ liệu?
16. Trong khai phá dữ liệu, bước nào sau đây tập trung vào việc làm sạch và chuyển đổi dữ liệu thô sang định dạng phù hợp cho phân tích?
17. Phương pháp nào sau đây KHÔNG thuộc nhóm kỹ thuật tiền xử lý dữ liệu?
18. Trong ngữ cảnh khai phá dữ liệu, 'overfitting' đề cập đến vấn đề gì?
19. Trong ngữ cảnh khai thác luật kết hợp, độ đo 'support' (hỗ trợ) của một tập mục (itemset) thể hiện điều gì?
20. Mục tiêu chính của việc 'biểu diễn tri thức' (knowledge representation) trong quy trình khai phá dữ liệu là gì?
21. Kỹ thuật 'ensemble learning' (học tập hợp) trong khai phá dữ liệu là gì và mục đích chính của nó là gì?
22. Trong khai phá dữ liệu web, 'web usage mining' (khai thác sử dụng web) tập trung vào việc phân tích loại dữ liệu nào?
23. Kỹ thuật 'bootstrapping' thường được sử dụng trong khai phá dữ liệu để làm gì?
24. Mô hình 'cây quyết định' (decision tree) thuộc loại mô hình học máy nào và có ưu điểm gì?
25. Trong ngữ cảnh phân loại, ma trận nhầm lẫn (confusion matrix) được sử dụng để làm gì?
26. Kỹ thuật giảm chiều dữ liệu (dimensionality reduction) nhằm mục đích chính là gì?
27. Độ đo 'recall' (độ phủ) trong đánh giá mô hình phân loại đo lường điều gì?
28. Độ đo 'confidence' (độ tin cậy) trong khai thác luật kết hợp thể hiện điều gì?
29. Thuật toán DBSCAN được sử dụng cho bài toán khai phá dữ liệu nào và có ưu điểm gì so với k-means?
30. Phương pháp khai phá dữ liệu nào thường được sử dụng để phân nhóm khách hàng dựa trên hành vi mua hàng tương tự?