Đề thi, bài tập trắc nghiệm online Thống kê ứng dụng – Đề 3

Đề 3 - Bài tập, đề thi trắc nghiệm online Thống kê ứng dụng

1. Khi nào thì nên sử dụng phân tích tương quan Spearman thay vì Pearson?
2. Ưu điểm chính của việc sử dụng phương pháp lấy mẫu phân tầng (stratified sampling) so với lấy mẫu ngẫu nhiên đơn giản là gì?
3. Phương pháp nào sau đây thường được sử dụng để xử lý dữ liệu thiếu (missing data)?
4. Bootstrap là phương pháp thống kê được sử dụng chủ yếu để làm gì?
5. Hệ số tương quan (correlation coefficient) đo lường điều gì giữa hai biến định lượng?
6. Trong kiểm định giả thuyết, giá trị p (p-value) thể hiện điều gì?
7. Sai số loại II (Type II error) trong kiểm định giả thuyết xảy ra khi nào?
8. Phương pháp thống kê nào được sử dụng để ước lượng giá trị trung bình của một tổng thể dựa trên dữ liệu từ một mẫu?
9. Trong thống kê ứng dụng, 'overfitting' (quá khớp) trong mô hình hóa có nghĩa là gì?
10. Trong phân tích phương sai (ANOVA), mục tiêu chính là gì?
11. Khi thực hiện kiểm định Chi-square cho tính độc lập, giả thuyết null (H0) thường là gì?
12. Biểu đồ hộp (boxplot) thường được sử dụng để thể hiện điều gì về phân phối của một tập dữ liệu?
13. Trong phân tích dữ liệu lớn (big data), thuật ngữ 'volume', 'velocity', 'variety', và 'veracity' thường được dùng để mô tả điều gì?
14. Khi nào thì nên sử dụng kiểm định phi tham số thay vì kiểm định tham số?
15. Trong thống kê Bayesian, 'prior probability' (xác suất tiên nghiệm) là gì?
16. Độ lệch chuẩn (standard deviation) đo lường điều gì?
17. Biến 'confounding variable' (biến gây nhiễu) gây ra vấn đề gì trong nghiên cứu quan sát?
18. Phương pháp nào sau đây là một kỹ thuật lấy mẫu xác suất?
19. Phương pháp nào sau đây được sử dụng để giảm chiều dữ liệu trong học máy và thống kê, bằng cách tìm ra các thành phần chính?
20. Trong phân tích sống sót (survival analysis), hàm Kaplan-Meier được sử dụng để làm gì?
21. Mục đích chính của việc chuẩn hóa dữ liệu (data normalization) trong tiền xử lý dữ liệu là gì?
22. Trong thống kê, 'power' của một kiểm định giả thuyết là gì?
23. Trong thống kê ứng dụng, loại biến nào thường được sử dụng để phân loại dữ liệu thành các nhóm hoặc danh mục mà không có thứ tự tự nhiên?
24. Khi nào thì việc sử dụng trung vị (median) thích hợp hơn so với trung bình cộng (mean) để đo lường xu hướng trung tâm của dữ liệu?
25. Phân tích hồi quy tuyến tính được sử dụng chủ yếu để làm gì?
26. Ý nghĩa của 'khoảng tin cậy 95%' là gì?
27. Trong phân tích Bayesian, 'posterior probability' (xác suất hậu nghiệm) được tính toán như thế nào?
28. Trong thiết kế thử nghiệm, 'randomization' (ngẫu nhiên hóa) quan trọng vì lý do chính nào?
29. Trong phân tích chuỗi thời gian, 'tính dừng' (stationarity) của chuỗi có nghĩa là gì?
30. Phương pháp thống kê nào thích hợp để phân tích mối quan hệ giữa hai biến phân loại?