Đề thi, bài tập trắc nghiệm online Khai phá dữ liệu – Đề 1

Đề 1 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Phương pháp khai phá dữ liệu nào thường được sử dụng để phân loại khách hàng thành các nhóm dựa trên hành vi mua sắm?
2. Trong bối cảnh 'khai phá luồng dữ liệu' (data stream mining), thách thức chính là gì?
3. Trong bài toán phân loại, 'ma trận nhầm lẫn' (confusion matrix) cung cấp thông tin gì?
4. Phương pháp khai phá dữ liệu nào phù hợp nhất để dự đoán giá nhà dựa trên các yếu tố như diện tích, vị trí, số phòng ngủ?
5. Đâu KHÔNG phải là một ứng dụng phổ biến của khai phá dữ liệu trong lĩnh vực y tế?
6. Phân biệt sự khác biệt chính giữa 'học có giám sát' (supervised learning) và 'học không giám sát' (unsupervised learning) trong khai phá dữ liệu.
7. Mục tiêu chính của khai phá luật kết hợp (Association Rule Mining) là gì?
8. Kỹ thuật 'cross-validation' (kiểm định chéo) được sử dụng để làm gì trong quá trình xây dựng mô hình khai phá dữ liệu?
9. Trong thuật toán Apriori để khai phá luật kết hợp, nguyên tắc 'Apriori property' phát biểu điều gì?
10. Trong tiền xử lý dữ liệu, 'chuẩn hóa dữ liệu' (data normalization) nhằm mục đích gì?
11. Kỹ thuật 'giảm chiều dữ liệu' (dimensionality reduction) được sử dụng để làm gì trong khai phá dữ liệu?
12. Khai phá dữ liệu (Data Mining) được định nghĩa chính xác nhất là:
13. Trong khai phá dữ liệu, 'mô hình hộp đen' (black box model) có đặc điểm gì?
14. Chọn phát biểu SAI về 'dữ liệu nhiễu' (noisy data) trong khai phá dữ liệu.
15. Đâu là một thách thức ĐẠO ĐỨC quan trọng trong ứng dụng khai phá dữ liệu?
16. Phương pháp nào sau đây KHÔNG thuộc nhóm kỹ thuật 'tiền xử lý dữ liệu'?
17. Phương pháp khai phá dữ liệu nào thường được sử dụng để phát hiện các giao dịch gian lận thẻ tín dụng?
18. Khi nào việc sử dụng kỹ thuật 'ensemble learning' (học tập kết hợp) trở nên đặc biệt hữu ích trong khai phá dữ liệu?
19. Phương pháp đánh giá mô hình phân loại nào đo lường tỷ lệ dự đoán đúng trên tổng số dự đoán?
20. Thuật toán K-means thường được sử dụng trong kỹ thuật khai phá dữ liệu nào?
21. Phân tích thành phần chính (Principal Component Analysis - PCA) là một kỹ thuật thuộc nhóm nào trong khai phá dữ liệu?
22. Trong khai phá dữ liệu văn bản (text mining), kỹ thuật 'bag-of-words' (túi từ) có vai trò gì?
23. Trong quy trình khai phá dữ liệu, bước nào sau đây thường diễn ra ĐẦU TIÊN?
24. Trong ngữ cảnh khai phá dữ liệu web, 'web usage mining' (khai phá sử dụng web) tập trung vào việc phân tích loại dữ liệu nào?
25. Trong khai phá dữ liệu, 'k-fold cross-validation' (kiểm định chéo k-lần) với k = 1 tương đương với phương pháp đánh giá mô hình nào?
26. Trong khai phá dữ liệu, 'overfitting' (quá khớp) đề cập đến vấn đề gì?
27. Trong khai phá dữ liệu không gian (spatial data mining), loại dữ liệu nào được quan tâm đặc biệt?
28. Độ đo 'lift' trong khai phá luật kết hợp được sử dụng để đánh giá điều gì?
29. Đâu là một ví dụ về công cụ khai phá dữ liệu mã nguồn mở?
30. Chọn phát biểu ĐÚNG về 'dữ liệu lớn' (Big Data) và mối liên hệ với khai phá dữ liệu.