Đề thi, bài tập trắc nghiệm online Khai phá dữ liệu – Đề 12

Đề 12 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Độ đo nào sau đây KHÔNG thường được sử dụng để đánh giá hiệu suất của mô hình phân loại?
2. Trong phân tích chuỗi thời gian (time series analysis), mục tiêu chính là:
3. Trong quy trình khai phá dữ liệu, bước nào sau đây thường được thực hiện ĐẦU TIÊN?
4. Trong khai phá dữ liệu, 'dữ liệu nhiễu' (noisy data) đề cập đến:
5. Kỹ thuật 'ensemble learning' (học tập kết hợp) trong khai phá dữ liệu nhằm mục đích:
6. Phương pháp 'cross-validation' (kiểm định chéo) được sử dụng trong khai phá dữ liệu để:
7. Loại dữ liệu nào sau đây KHÔNG thường được khai thác trong khai phá dữ liệu?
8. Thuật toán khai phá dữ liệu nào thường được sử dụng để tìm ra các tập mục phổ biến (frequent itemsets) trong phân tích giỏ hàng (market basket analysis)?
9. Vấn đề 'data drift' (trôi dữ liệu) trong khai phá dữ liệu đề cập đến:
10. Loại hình khai phá dữ liệu nào tập trung vào việc khám phá các mối quan hệ tuần tự hoặc mẫu theo thời gian trong dữ liệu?
11. Trong quá trình khai phá dữ liệu, bước 'data cleaning' (làm sạch dữ liệu) bao gồm công việc nào?
12. Trong ngữ cảnh khai phá dữ liệu, 'data warehouse' (kho dữ liệu) chủ yếu được sử dụng để:
13. Trong khai phá dữ liệu văn bản (text mining), kỹ thuật 'phân tích tình cảm' (sentiment analysis) được sử dụng để:
14. Trong ngữ cảnh dữ liệu lớn (big data), 'Hadoop' thường được sử dụng cho mục đích:
15. Trong khai phá dữ liệu, thuật ngữ 'feature engineering' (kỹ thuật đặc trưng) đề cập đến:
16. Phân biệt chính xác nhất giữa 'Khai phá dữ liệu' và 'Học máy' (Machine Learning) là:
17. Ứng dụng nào sau đây KHÔNG phải là ứng dụng phổ biến của khai phá dữ liệu?
18. Kỹ thuật khai phá dữ liệu nào phù hợp nhất để phát hiện các giao dịch gian lận trong hệ thống ngân hàng?
19. Thuật ngữ 'precision' (độ chính xác) trong đánh giá mô hình phân loại được tính bằng:
20. Phương pháp tiền xử lý dữ liệu nào sau đây được sử dụng để xử lý các giá trị thiếu (missing values)?
21. Kỹ thuật khai phá dữ liệu nào sau đây thường được sử dụng để phân nhóm khách hàng thành các phân khúc khác nhau dựa trên hành vi mua sắm?
22. Công cụ khai phá dữ liệu mã nguồn mở (open-source) phổ biến nào sau đây được viết bằng ngôn ngữ Python và cung cấp nhiều thuật toán học máy?
23. Kỹ thuật 'giảm chiều dữ liệu' (dimensionality reduction) trong khai phá dữ liệu nhằm mục đích:
24. Khai phá dữ liệu (Data Mining) được định nghĩa chính xác nhất là:
25. Khái niệm 'support' (độ hỗ trợ) trong khai thác luật kết hợp (association rule mining) thể hiện:
26. Trong mô hình phân loại, 'overfitting' (quá khớp) xảy ra khi:
27. Thuật toán 'k-Means' thuộc loại kỹ thuật khai phá dữ liệu nào?
28. Yếu tố nào sau đây KHÔNG phải là thách thức lớn trong khai phá dữ liệu?
29. Ưu điểm chính của việc sử dụng khai phá dữ liệu trong kinh doanh là:
30. Đâu là một thách thức đạo đức quan trọng liên quan đến khai phá dữ liệu?