Trắc nghiệm Khoa học máy tính 12 Chân trời bài F15: Khoa học dữ liệu

Trắc nghiệm Khoa học máy tính 12 Chân trời bài F15: Khoa học dữ liệu giúp bạn nhận biết điểm mạnh và điểm yếu của bản thân thông qua hệ thống câu hỏi đa dạng. Các câu hỏi được xây dựng theo lộ trình giúp bạn tiếp cận kiến thức từng bước. Đặc biệt phù hợp với người chuẩn bị cho các kỳ kiểm tra quan trọng. Thông qua quá trình làm bài, bạn có thể nhận ra lỗ hổng kiến thức. Điều này giúp việc học trở nên tiết kiệm thời gian hơn.

Trắc nghiệm Khoa học máy tính 12 Chân trời bài F15: Khoa học dữ liệu

⏱ Thời gian còn lại: --:--
Tiến độ hoàn thành 0/0 câu

🏆 BẢNG VÀNG TOP 5 ĐIỂM TỐT NHẤT

Đang tải bảng xếp hạng...

Câu 1: Tại sao việc trực quan hóa dữ liệu quan trọng đối với các nhà quản lý?

  • - Vì nó giúp trang trí báo cáo thêm đẹp
  • - Vì nó giúp đưa ra quyết định nhanh dựa trên thông tin tóm tắt trực quan
  • - Vì nó giúp giảm số lượng dữ liệu cần quản lý
  • - Vì nó bắt buộc phải thực hiện trong luật kinh doanh

Câu 2: Thông tin nào sau đây được coi là một ví dụ về dữ liệu cấu trúc?

  • - Một tệp video ghi lại sự kiện
  • - Danh sách nhân viên trong bảng tính với các cột: Họ tên, Tuổi, Chức vụ
  • - Một bài đăng trên Facebook chưa có khuôn mẫu
  • - Ghi âm giọng nói của khách hàng

Câu 3: Đâu là một ứng dụng phổ biến của khoa học dữ liệu trong thương mại điện tử?

  • - Tự động thiết kế logo cho công ty
  • - Hệ thống gợi ý sản phẩm phù hợp với sở thích khách hàng
  • - Sửa chữa các lỗi phần cứng của máy chủ
  • - Quản lý việc tuyển dụng nhân sự thủ công

Câu 4: Khai phá dữ liệu (Data Mining) là quá trình gì?

  • - Chỉ là việc xóa bỏ dữ liệu rác
  • - Việc tìm kiếm các quy luật, tri thức ẩn giấu trong tập dữ liệu lớn
  • - Quá trình nén dữ liệu để tiết kiệm bộ nhớ
  • - Việc cập nhật hệ điều hành cho máy chủ

Câu 5: Trong bối cảnh khoa học dữ liệu, 'nhiễu' (noise) là gì?

  • - Thông tin hữu ích giúp phân tích
  • - Các dữ liệu sai lệch hoặc không liên quan làm giảm chất lượng mô hình
  • - Kết quả dự báo của mô hình
  • - Tốc độ xử lý của máy tính

Câu 6: Mục đích chính của việc làm sạch dữ liệu trong khoa học dữ liệu là gì?

  • - Tăng dung lượng lưu trữ cho hệ thống
  • - Loại bỏ các nhiễu, giá trị sai lệch và dữ liệu thiếu
  • - Tự động hóa việc phân loại khách hàng
  • - Rút ngắn thời gian truy vấn dữ liệu

Câu 7: Khái niệm nào mô tả việc chuyển đổi dữ liệu từ dạng thô sang dạng dễ hiểu hơn thông qua biểu đồ hoặc sơ đồ?

  • - Khai phá dữ liệu
  • - Trực quan hóa dữ liệu
  • - Lưu trữ dữ liệu đám mây
  • - Mã hóa dữ liệu

Câu 8: Tại sao đạo đức dữ liệu lại quan trọng trong khoa học dữ liệu?

  • - Để ngăn chặn việc máy tính bị hỏng hóc
  • - Để đảm bảo quyền riêng tư và tránh sai lệch (bias) trong phân tích
  • - Để làm cho phần mềm chạy nhanh hơn
  • - Để tăng dung lượng ổ cứng

Câu 9: Thuật toán học máy (Machine Learning) chủ yếu hoạt động dựa trên cơ sở nào?

  • - Hệ thống quy tắc do con người viết tay hoàn toàn
  • - Khả năng học hỏi từ dữ liệu để tự cải thiện hiệu năng
  • - Việc copy dữ liệu từ các máy tính khác
  • - Ngẫu nhiên tạo ra các phản ứng dựa trên đầu vào

Câu 10: Dữ liệu cấu trúc khác với dữ liệu phi cấu trúc ở đặc điểm nào chính yếu?

  • - Dữ liệu cấu trúc có định dạng xác định như bảng, hàng, cột
  • - Dữ liệu cấu trúc khó lưu trữ hơn dữ liệu phi cấu trúc
  • - Dữ liệu phi cấu trúc luôn có độ chính xác cao hơn
  • - Dữ liệu phi cấu trúc chỉ tồn tại dưới dạng văn bản

Câu 11: Phân tích dữ liệu mô tả (Descriptive Analysis) nhằm mục đích gì?

  • - Dự báo tương lai xa
  • - Tổng hợp và tóm tắt những gì đã xảy ra trong quá khứ
  • - Đưa ra lời khuyên cho quyết định tương lai
  • - Viết mã cho ứng dụng di động

Câu 12: Khi phân tích dữ liệu, việc xác định giá trị ngoại lệ (outlier) có ý nghĩa gì?

  • - Để tăng độ phức tạp của bài toán
  • - Để làm cho biểu đồ đẹp hơn
  • - Để phát hiện các sai sót đo lường hoặc các trường hợp đặc biệt
  • - Để giảm bớt số lượng dữ liệu phải xử lý

Câu 13: Công việc nào sau đây là ứng dụng cụ thể của khoa học dữ liệu trong y tế?

  • - Dự đoán xác suất bệnh dựa trên dữ liệu bệnh nhân
  • - Thiết kế giường bệnh
  • - Sửa chữa các máy siêu âm
  • - Quản lý lương cho nhân viên y tế

Câu 14: Tại sao việc chia tách tập dữ liệu thành huấn luyện và kiểm thử là bắt buộc?

  • - Để làm cho chương trình chạy nhanh hơn
  • - Để tránh hiện tượng quá khớp (overfitting) và đánh giá độ chính xác thực tế
  • - Để giảm bớt dung lượng bộ nhớ sử dụng
  • - Để làm cho quá trình huấn luyện đơn giản hơn

Câu 15: Khái niệm 'Feature Engineering' trong khoa học dữ liệu là gì?

  • - Xây dựng các tính năng cho phần mềm ứng dụng
  • - Quá trình tạo, lựa chọn và biến đổi các đặc trưng từ dữ liệu thô
  • - Thiết kế phần cứng cho máy tính chạy mô hình
  • - Việc quảng cáo tính năng sản phẩm

Câu 16: Trong khoa học dữ liệu, việc 'huấn luyện mô hình' là quá trình gì?

  • - Nhập dữ liệu vào máy tính bằng tay
  • - Điều chỉnh các tham số để mô hình khớp với dữ liệu huấn luyện
  • - Việc xóa bỏ toàn bộ dữ liệu cũ
  • - Tạo giao diện người dùng cho ứng dụng

Câu 17: Trong lĩnh vực khoa học dữ liệu, hoạt động nào sau đây thường được thực hiện đầu tiên trong quy trình xử lý dữ liệu?

  • - Thu thập dữ liệu
  • - Trực quan hóa dữ liệu
  • - Xây dựng mô hình dự báo
  • - Đánh giá hiệu năng thuật toán

Câu 18: Yếu tố nào sau đây là thách thức lớn nhất của dữ liệu lớn (Big Data)?

  • - Sự đơn giản trong định dạng
  • - Khối lượng, tốc độ tăng trưởng và sự đa dạng của dữ liệu
  • - Tất cả dữ liệu đều nằm ở dạng văn bản đơn giản
  • - Máy tính hiện nay đã xử lý tức thời mọi loại dữ liệu

Câu 19: Lý do nào khiến dữ liệu phi cấu trúc ngày càng trở nên quan trọng?

  • - Nó dễ xử lý hơn dữ liệu cấu trúc
  • - Nó chiếm phần lớn lượng dữ liệu được tạo ra trên mạng xã hội và internet
  • - Nó yêu cầu máy tính cấu hình thấp để chạy
  • - Nó không cần phải lưu trữ

Câu 20: Trong các mô hình khoa học dữ liệu, 'dự báo' (prediction) chủ yếu dựa vào yếu tố nào?

  • - Ý kiến chủ quan của người lập trình
  • - Các mẫu hình và xu hướng rút ra từ dữ liệu quá khứ
  • - Sự ngẫu nhiên hoàn toàn của các con số
  • - Việc giả định các tình huống không có cơ sở

Câu 21: Việc chuẩn hóa dữ liệu (Data Normalization) có ý nghĩa gì?

  • - Để làm cho dữ liệu có cùng thang đo, tránh sự áp đảo của các biến có giá trị lớn
  • - Để xóa bỏ các dữ liệu trùng lặp
  • - Để tăng tốc độ tải dữ liệu từ internet
  • - Để thay đổi định dạng tệp từ Excel sang Word

Câu 22: Đâu là ngôn ngữ lập trình phổ biến nhất trong khoa học dữ liệu hiện nay?

  • - HTML
  • - Python
  • - CSS
  • - Assembly

Câu 23: Phát biểu nào sau đây mô tả đúng về vai trò của Nhà khoa học dữ liệu?

  • - Chỉ tập trung vào việc bảo trì phần cứng máy tính
  • - Sử dụng các phương pháp thống kê và thuật toán để trích xuất tri thức từ dữ liệu
  • - Chỉ thực hiện việc nhập liệu thủ công vào cơ sở dữ liệu
  • - Chỉ làm nhiệm vụ thiết kế giao diện ứng dụng

Câu 24: Trong khoa học dữ liệu, tập dữ liệu được dùng để đánh giá mô hình sau khi huấn luyện thường được gọi là gì?

  • - Tập huấn luyện
  • - Tập dữ liệu thô
  • - Tập kiểm thử
  • - Tập dữ liệu giả định

Câu 25: Một 'tập dữ liệu' (dataset) thường được coi là tốt khi nào?

  • - Khi nó có kích thước càng nhỏ càng tốt
  • - Khi nó có tính đại diện cao và chất lượng tin cậy
  • - Khi nó hoàn toàn không chứa các con số
  • - Khi nó chỉ gồm các hình ảnh