Đề thi, bài tập trắc nghiệm online Khai phá dữ liệu – Đề 7

Đề 7 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Độ đo 'Precision' (Độ chính xác) trong đánh giá mô hình phân loại được tính bằng công thức nào? (TP = True Positives, FP = False Positives)
2. Kỹ thuật 'Association Rule Mining' (Khai thác luật kết hợp) thường được ứng dụng trong lĩnh vực nào?
3. Kỹ thuật 'Ensemble Learning' (Học tập kết hợp) nhằm mục đích gì?
4. Thuật toán Apriori thường được sử dụng trong kỹ thuật khai phá dữ liệu nào?
5. Trong khai phá dữ liệu đa phương tiện (Multimedia Data Mining), dữ liệu có thể bao gồm:
6. Kỹ thuật 'Principal Component Analysis' (PCA) được sử dụng để làm gì?
7. Trong quy trình khai phá dữ liệu, bước nào sau đây thường được thực hiện **đầu tiên**?
8. Thuật toán 'Support Vector Machine' (SVM) đặc biệt hiệu quả trong bài toán nào?
9. Trong khai phá dữ liệu web (Web Mining), 'Web Usage Mining' (Khai phá sử dụng web) tập trung vào việc phân tích dữ liệu nào?
10. Trong khai phá dữ liệu, 'bias-variance tradeoff' (đánh đổi giữa độ chệch và phương sai) đề cập đến:
11. Trong ngữ cảnh khai phá dữ liệu không gian (Spatial Data Mining), loại dữ liệu nào được quan tâm đặc biệt?
12. Kỹ thuật 'Anomaly Detection' (Phát hiện bất thường) được sử dụng để làm gì?
13. Kỹ thuật khai phá dữ liệu nào thường được sử dụng để phân nhóm khách hàng dựa trên hành vi mua sắm?
14. Phương pháp 'K-Means' thuộc loại kỹ thuật khai phá dữ liệu nào?
15. Phương pháp 'Decision Tree' (Cây quyết định) thuộc loại thuật toán học máy nào?
16. Khai phá dữ liệu (Data Mining) được định nghĩa chính xác nhất là:
17. Kỹ thuật 'Feature Scaling' ( масштабирование характеристик ) thường được áp dụng trong bước tiền xử lý dữ liệu để:
18. Trong khai phá dữ liệu chuỗi thời gian (Time Series Data Mining), mục tiêu chính thường là:
19. Trong ngữ cảnh khai phá dữ liệu văn bản (Text Mining), 'TF-IDF' là viết tắt của:
20. Độ đo 'F1-score' là trung bình điều hòa của hai độ đo nào?
21. Phương pháp 'Gradient Descent' (Độ dốc xuống) thường được sử dụng để làm gì trong học máy?
22. Phương pháp 'Random Forest' thuộc loại thuật toán học máy nào?
23. Phương pháp 'Naive Bayes' dựa trên giả định quan trọng nào?
24. Kỹ thuật giảm chiều dữ liệu (Dimensionality Reduction) được sử dụng chủ yếu để:
25. Trong bối cảnh khai phá dữ liệu, 'dữ liệu nhiễu' (noisy data) thường đề cập đến:
26. Trong khai phá luật kết hợp, độ đo 'Support' (Độ hỗ trợ) của một tập mục (itemset) thể hiện điều gì?
27. Trong khai phá dữ liệu, 'overfitting' (quá khớp) đề cập đến vấn đề gì?
28. Độ đo 'Recall' (Độ phủ) trong đánh giá mô hình phân loại được tính bằng công thức nào? (TP = True Positives, FN = False Negatives)
29. Kỹ thuật 'Cross-validation' (Kiểm định chéo) được sử dụng để làm gì?
30. Trong khai phá dữ liệu, 'data warehouse' (kho dữ liệu) khác biệt với 'database' (cơ sở dữ liệu) thông thường chủ yếu ở điểm nào?