luyện tập trắc nhiệm nhập môn khdl

0

Kết quả bài làm

Trang chủ
Đã làm: 0/0 câu
Chưa làm
Đã làm
Nội dung bài đọc
Câu hỏi trắc nghiệm
Câu 1 Theo Điều 4 Luật Giao dịch điện tử (2005) được trích trong bài giảng, “dữ liệu” là thông tin phản ánh sự vật, hiện tượng, hành động dưới các dạng nào?
Câu 2 Quy trình làm khoa học dữ liệu trong bài giảng gồm 5 bước theo thứ tự nào?
Câu 3 Thông tin “Tên: Thông tin các sân bay của Mỹ; Người tạo: Nguyễn Văn A; Ngày tạo: 20/1/2012” đi kèm một tệp dữ liệu được gọi là gì?
Câu 4 Trong bảng dữ liệu khách hàng có các cột Name, CCCD, DoB, City, Gender, thì một DÒNG của bảng tương ứng với khái niệm nào?
Câu 5 Vì sao bước tiền xử lý dữ liệu (data preprocessing) được nhấn mạnh là rất quan trọng?
Câu 6 Việc gộp hai bảng — bảng (Name, CCCD, DoB, City, Gender) và bảng (Name, CCCD, University, City) thành một bảng duy nhất thuộc bước con nào của tiền xử lý?
Câu 7 Chuẩn hóa cột ngày phát hành từ {"12/2020", "2020", để trống} về cùng một định dạng tháng/năm thuộc bước con nào?
Câu 8 Nội dung nào KHÔNG thuộc nhóm “vấn đề đạo đức trong thu thập dữ liệu” mà bài giảng nêu?
Câu 9 Đâu là đặc điểm phân biệt cách tiếp cận data-driven với knowledge-driven?
Câu 10 Trong ví dụ xe tự lái của bài giảng, “Trợ lý thông minh phát hiện đèn đỏ tại nút giao” và “áp dụng luật giao thông để xe dừng lại” tương ứng với cách tiếp cận nào?
Câu 11 Loại Trợ lý thông minh nào có đặc điểm “không có trí nhớ, không dùng thông tin quá khứ, một đầu vào cố định luôn cho một đầu ra cố định”?
Câu 12 Một hệ thống gợi ý mua hàng ghi nhận lịch sử mua và tương tác của khách trên website rồi tự học lại để cải thiện gợi ý. Hệ thống này thuộc loại Trợ lý thông minh nào?
Câu 13 Phát biểu nào ĐÚNG về Narrow Trợ lý thông minh (Trợ lý thông minh hẹp) và General Trợ lý thông minh (Trợ lý thông minh rộng)?
Câu 14 "Text classification, sentiment analysis, dịch máy, chatbot" là các bài toán thuộc lĩnh vực nào của Trợ lý thông minh?
Câu 15 Trong ví dụ nhận diện cảm xúc câu nói, vì sao quy tắc “nếu câu chứa từ 'buồn' thì gán nhãn Sad” chưa được coi là một mô hình Trợ lý thông minh học từ dữ liệu?
Câu 16 Trong Exploratory Data Analysis (EDA), nhóm "measures of central tendency" (các đại lượng đo xu hướng trung tâm) gồm những đại lượng nào?
Câu 17 Biểu đồ nào phù hợp nhất để thể hiện TỈ LỆ PHẦN TRĂM của các thành phần trong một tổng thể?
Câu 18 Biểu đồ nào KẾT HỢP box plot với đường cong mật độ (kernel density) để thể hiện phân bố dữ liệu?
Câu 19 Mục tiêu chính của trực quan hóa dữ liệu (data visualization) là gì?
Câu 20 Phân biệt Population (quần thể) và Sample (mẫu) trong thống kê:
Câu 21 Đại lượng thống kê nào NHẠY CẢM NHẤT với giá trị ngoại lệ (outlier)?
Câu 22 Hệ số tương quan (correlation coefficient) nhận giá trị trong khoảng nào và đo điều gì?
Câu 23 Hai biến $x$ và $y$ có $\text{corr}(x, y) \approx 0$. Kết luận nào là ĐÚNG?
Câu 24 Trong ma trận hiệp phương sai (covariance matrix) của hai biến $x$ và $y$, các phần tử trên ĐƯỜNG CHÉO CHÍNH mang ý nghĩa gì?
Câu 25 Khi nào nên báo cáo TRUNG VỊ (median) thay vì TRUNG BÌNH (mean) để mô tả xu thế trung tâm?
Câu 26 Mục đích của thống kê trong quy trình nghiên cứu 5 bước của bài giảng là gì?
Câu 27 Phát biểu nào về quan hệ giữa phương sai và độ lệch chuẩn là ĐÚNG?
Câu 28 Quan hệ giữa Trí tuệ nhân tạo (Trợ lý thông minh) và Học máy (Machine Learning) là gì?
Câu 29 Học máy được phân thành bốn nhóm chính nào?
Câu 30 Đặc điểm cốt lõi của học có giám sát (supervised learning) là gì?
Câu 31 Bài toán “dự đoán giá nhà dựa trên diện tích, số phòng ngủ và vị trí địa lý” thuộc loại nào?
Câu 32 Bài toán “xác định loại hoa dựa trên màu sắc, hình dáng, kích thước” thuộc loại nào?
Câu 33 Bài toán “phân nhóm các sản phẩm trên trang thương mại điện tử dựa trên giá, nhãn hiệu, đánh giá của khách hàng, không có nhãn nhóm cho trước” thuộc loại nào?
Câu 34 Bài toán “dự đoán lượng mưa trong một ngày dựa trên nhiệt độ, độ ẩm và áp suất không khí” thuộc loại nào?
Câu 35 Bài toán “phân loại người dùng thành thường / VIP / premium dựa trên hành vi mua sắm, với dữ liệu đã gán sẵn ba loại này” thuộc loại nào?
Câu 36 Trong bài toán học có giám sát, “nhãn” (label) là gì?
Câu 37 Học tăng cường (reinforcement learning) hoạt động dựa trên nguyên tắc nào?
Câu 38 Bài toán “tìm luật dạng: khách mua bỉm thì thường mua thêm bia” thuộc nhóm nào của học không giám sát?
Câu 39 Điểm GIỐNG nhau giữa học có giám sát và học không giám sát là gì?
Câu 40 Thứ tự đúng của quy trình xây dựng và triển khai một mô hình phân loại theo bài giảng là gì?
Câu 41 Phát biểu nào mô tả ĐÚNG bản chất của học máy so với lập trình truyền thống?
Câu 42 Trong mô hình hồi quy tuyến tính đơn $Y = mX + b$, hai tham số $m$ và $b$ có ý nghĩa gì?
Câu 43 Giả định nào KHÔNG phải là giả định của hồi quy tuyến tính theo bài giảng?
Câu 44 Bài giảng nêu những phương pháp nào để giải bài toán hồi quy tuyến tính?
Câu 45 Bài toán Least squares regression (hồi quy bình phương tối thiểu) đặt mục tiêu tối ưu là gì?
Câu 46 Điểm yếu nào KHÔNG phải của hồi quy tuyến tính theo bài giảng?
Câu 47 Overfitting (quá khớp) là hiện tượng gì?
Câu 48 Underfitting (dưới khớp) xảy ra khi nào?
Câu 49 Một mô hình đạt $\text{MSE} = 0,05$ trên tập train nhưng $\text{MSE} = 8,20$ trên tập test. Chẩn đoán nào ĐÚNG?
Câu 50 Regularization L1 (Lasso) và L2 (Ridge) có tác dụng gì trong hồi quy tuyến tính?
Câu 51 Cross validation được dùng để làm gì?
Câu 52 Trong bối cảnh học máy, “gradient” của một hàm số là gì?
Câu 53 Công thức cập nhật của Gradient Descent là $x_{t+1} = x_t - \eta \cdot \nabla f(x_t)$. Vì sao dùng dấu TRỪ?
Câu 54 Ảnh hưởng của learning rate $\eta$ đến quá trình huấn luyện là gì?
Câu 55 Điều kiện dừng của thuật toán Gradient Descent theo bài giảng là gì?
Câu 56 Hàm Sigmoid $\sigma(z) = \frac{1}{1 + e^{-z}}$ có vai trò gì trong hồi quy logistic, và miền giá trị của nó là gì?
Câu 57 Trong 1.000 mẫu xét nghiệm ung thư chỉ có 10 mẫu dương tính. Một mô hình dự đoán TẤT CẢ đều âm tính. Accuracy và Recall của mô hình này lần lượt bằng bao nhiêu, và điều đó nói lên điều gì?
Câu 58 Về mặt toán học, học không giám sát được đặc trưng bởi điều gì?
Câu 59 Định nghĩa của một cụm (cluster) là gì?
Câu 60 Ba nhóm thuật toán phân cụm chính theo bài giảng là gì?
Câu 61 Phân biệt hai phương pháp agglomerative và divisive trong hierarchical clustering:
Câu 62 Ưu điểm nổi bật của DBSCAN (density clustering) so với k-means là gì?
Câu 63 Thứ tự đúng các bước của thuật toán k-means là gì?
Câu 64 Hai phương pháp nào được bài giảng nêu để chọn số cụm $k$ trong partition clustering?
Câu 65 Hạn chế quan trọng nào của thuật toán k-means được bài giảng cảnh báo?
Được tạo bởi công cụ tạo bài trắc nghiệm thông minh Trợ lý thông minh của diemdanh.app. Xem thêm tại: Kho công khai · Ngân hàng đề thi