Đề thi, bài tập trắc nghiệm online Khai phá dữ liệu – Đề 14

Đề 14 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Đâu là định nghĩa chính xác nhất về Khai phá dữ liệu (Data Mining)?
2. Khi nào thì việc sử dụng 'dữ liệu tổng hợp' (aggregated data) có thể phù hợp trong khai phá dữ liệu?
3. So sánh giữa 'học có giám sát' (Supervised Learning) và 'học không giám sát' (Unsupervised Learning) trong khai phá dữ liệu, điểm khác biệt chính là gì?
4. Kỹ thuật giảm chiều dữ liệu (Dimensionality Reduction) nhằm mục đích gì?
5. Trong khai phá dữ liệu y tế, ứng dụng nào sau đây có tiềm năng lớn?
6. Trong quy trình khai phá dữ liệu, bước nào thường được thực hiện đầu tiên?
7. Phân biệt giữa 'dữ liệu định tính' (Qualitative data) và 'dữ liệu định lượng' (Quantitative data) trong khai phá dữ liệu.
8. Kỹ thuật 'ensemble learning' (học tập hợp) trong khai phá dữ liệu là gì?
9. Phương pháp 'xác thực chéo' (Cross-validation) được sử dụng để làm gì trong quá trình xây dựng mô hình khai phá dữ liệu?
10. Trong khai phá dữ liệu chuỗi thời gian, kỹ thuật nào thường được sử dụng để dự báo giá cổ phiếu?
11. Đâu là một thách thức lớn trong khai phá dữ liệu đối với dữ liệu lớn (Big Data)?
12. Đâu là mục tiêu chính của kỹ thuật 'phân tích cảm xúc' (Sentiment Analysis) trong khai phá dữ liệu văn bản?
13. Thuật ngữ 'mô hình hộp đen' (Black box model) trong học máy thường ám chỉ loại mô hình nào?
14. Khi dữ liệu có nhiều thuộc tính tương quan cao (multicollinearity), điều này có thể gây ra vấn đề gì trong mô hình hồi quy?
15. Trong khai phá dữ liệu không gian, ứng dụng nào sau đây là phổ biến?
16. Khi đánh giá mô hình phân loại, 'F1-score' là gì và tại sao nó quan trọng?
17. Thuật toán Apriori thường được sử dụng trong kỹ thuật khai phá dữ liệu nào?
18. Ưu điểm chính của việc sử dụng 'cây quyết định' (Decision Tree) trong phân loại là gì?
19. Trong khai phá dữ liệu, 'overfitting' (quá khớp) xảy ra khi nào?
20. Trong khai phá dữ liệu, 'bias' (thiên vị) trong dữ liệu huấn luyện có thể dẫn đến hậu quả gì?
21. Kỹ thuật khai phá dữ liệu nào thường được sử dụng để phân nhóm khách hàng dựa trên hành vi mua sắm tương tự?
22. Phương pháp 'PCA (Principal Component Analysis)' được sử dụng để làm gì trong tiền xử lý dữ liệu?
23. Trong khai phá dữ liệu web, 'web usage mining' (khai phá sử dụng web) tập trung vào việc phân tích dữ liệu nào?
24. Ứng dụng nào sau đây KHÔNG phải là ứng dụng điển hình của khai phá dữ liệu?
25. Trong ngữ cảnh khai phá dữ liệu, 'feature selection' (lựa chọn đặc trưng) có nghĩa là gì?
26. Kỹ thuật 'clustering' (phân cụm) thường được sử dụng để giải quyết loại bài toán khai phá dữ liệu nào?
27. Phương pháp 'K-Means' thuộc loại kỹ thuật khai phá dữ liệu nào?
28. Kỹ thuật 'Anomaly Detection' (phát hiện bất thường) được sử dụng để làm gì?
29. Trong mô hình phân loại, độ đo 'Độ chính xác' (Accuracy) được tính như thế nào?
30. Phương pháp nào sau đây KHÔNG thuộc nhóm kỹ thuật tiền xử lý dữ liệu?