Thẻ ghi nhớ: KHDL Ôn tập đề thi thử

0.0(0)
Studied by 0 people
call kaiCall Kai
learnLearn
examPractice Test
spaced repetitionSpaced Repetition
heart puzzleMatch
flashcardsFlashcards
GameKnowt Play
Card Sorting

1/93

encourage image

There's no tags or description

Looks like no tags are added yet.

Last updated 6:21 PM on 9/30/26
Name
Mastery
Learn
Test
Matching
Spaced
Call with Kai
Chat

No analytics yet

Send a link to your students to track their progress

94 Terms

1
New cards

Ứng dụng của blockchain, ngoại trừ

Chống bị tấn công từ bên ngoài

2
New cards

Đâu không phải là 1 công nghệ của Cloud

AaaS

3
New cards

Đặc trưng nổi bật của cuộc cách mạng công nghiệp 4.0 là gì?

Sử dụng rộng rãi các công nghệ mới như trí tuệ nhân tạo, máy học, dữ liệu lớn,...

4
New cards

Ứng dụng của khoa học dữ liệu trong lĩnh vực tài chính là gì, NGOẠI TRỪ

Dự đoán chính xác thị trường tài chính

5
New cards

Ứng dụng của khoa học dữ liệu trong lĩnh vực quản trị nhân sự là gì

Nâng cao trình độ nhân viên

6
New cards

Kết quả mà khoa học dữ liệu hướng tới

Thông tin và tri thức

7
New cards

Đâu một ứng dụng không sử dụng công nghệ Cloud

Baomoi

8
New cards

Ví dụ nào sau đây không phải là dữ liệu?

Số lượng học sinh trong lớp

9
New cards

Đâu là đặc điểm của CMCN 3.0

Giúp mọi người có thể liên lạc nhanh chóng và tạo ra thế giới phẳng

10
New cards

Định dạng dữ liệu nào sau đây khác với các loại dữ liệu còn lại

Dữ liệu số

11
New cards

Có thể so sánh Khai phá dữ liệu với việc 'đãi cát tìm vàng' vì

Không phải tập dữ liệu nào cũng ẩn chứa quy luật hữu ích

12
New cards

Để gom nhóm dữ liệu và có những chức năng để xem chi tiết dữ liệu thì dùng công cụ:

Tất cả đều đúng (Pivot Table, SubTotal, Pivot Chart)

13
New cards

Để dự đoán xu hướng tăng/giảm của một mã chứng khoán bất kỳ dựa trên thông tin về giá cả, lượng cổ phiếu mua vào và bán ra của các ngày trước đó. Ta sử dụng công cụ nào sau đây:

Hồi quy (Regression)

14
New cards

Công cụ nào trong Microsoft Excel hỗ trợ phân tích dự báo, Ngoại trừ

PivotTable

15
New cards

Đâu là phương pháp sử dụng giá trị của biến khác để dự báo:

Hồi quy

16
New cards

Pivot Table là công cụ

Lập báo cáo - tổng hợp dữ liệu

17
New cards

Unsupervised learning thường áp dụng thuật toán:

Clustering Algorithm

18
New cards

Supervised learning thường áp dụng thuật toán:

Classification Algorithm

19
New cards

Khi nào thì ta cần rời rạc hóa dữ liệu:

Dữ liệu thuộc kiểu số học

20
New cards

Trong Orange, "Data Table" được sử dụng để làm gì?

Quản lý và xem dữ liệu

21
New cards

Trong Orange, sử dụng chức năng nào để chuẩn hóa dữ liệu:

Preprocess

22
New cards

Chức năng Dataset của Orange dùng để làm gì?

Truy xuất dữ liệu từ một nguồn trực tuyến

23
New cards

Đâu là khác biệt của chức năng File và Datasets trong Orange

Dataset chỉ chọn từ nguồn có sẵn của Orange

24
New cards

Giá trị tại phần tử (i;j) trong ma trận nhầm lẫn cho biết

Số lượng mẫu i phân lớp nhầm vào mẫu j

25
New cards

Đâu là phương pháp phân chia dữ liệu trong bài toán phân lớp, ngoại trừ:

Hand-out

26
New cards

Phân lớp dữ liệu thuộc phương pháp

Có giám sát

27
New cards

Đâu là phương pháp để thấy được quy luật của dữ liệu trong Orange:

Cây quyết định

28
New cards

Đối với bài toán vay vốn với ma trận nhầm lẫn dưới đây thì sai lầm nghiêm trọng nhất ở giá trị nào:

47

29
New cards

Đâu không phải là thuật toán dùng trong bài toán phân lớp

Regression

30
New cards

Phương pháp tính khoảng cách Complete-link là khoảng cách:

Lớn nhất giữa 1 phần tử trong một cụm với một phần tử ở cụm khác

31
New cards

Quá trình gom cụm dữ liệu cần phải có

Thuật toán được sử dụng

32
New cards

Vì sao phải chạy Distances trước khi chạy Clustering trong Orange:

Để loại bỏ biến phụ thuộc

33
New cards

Thuật toán K-means thông thường dùng cho bài toán:

Phân cụm (Clustering)

34
New cards

Quá trình phân cụm theo thuật toán AGNES sẽ dừng lại một cách tự nhiên (không có tác động của user) khi

Đạt được 1 cụm duy nhất bao gồm tất cả các điểm dữ liệu

35
New cards

Tham số m tính lại tâm cụm trong thuật toán Fuzzy C-means thông thường được chọn là

m=2

36
New cards

Một số Phương pháp tính khoảng cách trong Phân cụm phân cấp (Hierarchical clustering) gồm:

Single-link; Complete-link; Average-link

37
New cards

Damping factor theo phương pháp San bằng mũ (Exponential Smoothing) trong phần mềm Excel mang ý nghĩa gì?

Giá trị điều chỉnh sự bất ổn của dữ liệu

38
New cards

Để đánh giá mối liên hệ của 2 biến, thường dùng chức năng nào của Orange

Lược đồ phân phối

39
New cards

Đâu không phải là kiểu dữ liệu được hỗ trợ trong Orange

Integer

40
New cards

Thuộc tính khách hàng gồm: Thường, Tiềm năng và VIP thì là loại dữ liệu:

Định danh

41
New cards

Kết quả đầu ra của workflow trên là gì? (File -> Scatter Plot -> Save Data)

Tập tin chứa đồ thị điểm của dữ liệu

42
New cards

Chức năng Select Row trong Orange để làm gì

Trích xuất dữ liệu có sẵn theo một số điều kiện cho trước

43
New cards

Trong bài toán Vay vốn, đâu là sai lầm nghiêm trọng nhất:

Dự báo nên cho vay nhưng thực tế không nên cho vay

44
New cards

Đâu là lưu ý quan trọng trước khi chạy phương pháp Hồi quy Logistic

Chuẩn hóa dữ liệu

45
New cards

Kết quả xếp loại sinh viên là

Thông tin

46
New cards

Ứng dụng của trí tuệ nhân tạo (AI) trong sản xuất công nghiệp là gì?

Tất cả các đáp án trên

47
New cards

Những bình luận trên mạng xã hội là

Dữ liệu

48
New cards

Đâu là nguồn năng lượng của CMCN 4.0

Dữ liệu

49
New cards

Đâu là đặc điểm của CMCN 1.0

Giúp cuộc sống con người tiện nghi hơn

50
New cards

Chọn phát biểu sai về Big Data

Big Data là chỉ quan tâm đến dữ liệu có dung lượng lớn (volume)

51
New cards

Trong Solver, mối quan hệ của các đối tượng, ngoại trừ

Tất cả đều sai

52
New cards

Để hợp nhất dữ liệu từ nhiều bảng có cấu trúc khác nhau ta sử dụng

Tự làm bằng tay

53
New cards

Workflow trên có ý nghĩa như thế nào? (File -> Data Table & Box plot)

Đọc dữ liệu từ File ra bảng rồi xem phân phối các dữ liệu thuộc tính

54
New cards

Orange có thể được sử dụng để phân tích các loại dữ liệu nào, NGOẠI TRỪ

Video

55
New cards

Biểu tượng trang giấy màu cam có nếp gấp trong Orange có ý nghĩa gì

Nhập dữ liệu từ một tệp tin

56
New cards

Tiền xử lý dữ liệu không bao gồm các bước nào sau đây:

Thu thập dữ liệu

57
New cards

Đâu không phải là 1 Role mà Orange hỗ trợ:

Ignore

58
New cards

Ý nghĩa của workflow sau là gì? (File/Sales Data + Forcast Data nối qua SVM/Tree vào Predictions)

Dữ liệu dự báo được dự báo dựa trên các mô hình của dữ liệu huấn luyện

59
New cards

Khác biệt giữa dữ liệu huấn luyện và dữ liệu kiểm thử là

Dữ liệu kiểm thử có thuộc tính phân lớp nhưng bị ẩn đi

60
New cards

Ưu điểm của thuật toán Cây quyết định (Decision tree):

Không đòi hỏi chuẩn hóa dữ liệu

61
New cards

SVM (Support Vector Machine) thông thường dùng cho bài toán:

Phân lớp (Classification)

62
New cards

Hàm hồi quy logistic (Logistic Regression) thông thường dùng cho bài toán:

Phân lớp (Classification)

63
New cards

Phân cụm phân cấp (Hierarchical clustering) bằng thuật toán Agnes được áp dụng chiến lược:

Bottom up

64
New cards

Chọn phát biểu đúng về phân cụm và phân lớp:

Đầu ra của bài toán phân cụm là đầu vào của bài toán phân lớp

65
New cards

Để tìm địa điểm trung tâm phân phối phù hợp nhất, nên dùng phương pháp:

Học không giám sát

66
New cards

Phân cụm dữ liệu thuộc phương pháp học:

Không giám sát

67
New cards

Đặc trưng Veracity của Big Data thể hiện về mặt:

Dữ liệu được xác minh

68
New cards

Công nghệ nào sau đây không thuộc về CMCN 4.0?

Lắp ráp ô tô

69
New cards

Đâu là đặc điểm của CMCN 4.0

Tạo ra sản phẩm thông minh hơn

70
New cards

Đặc điểm quan trọng của công nghệ điện toán đám mây là

Cho thuê các dịch vụ

71
New cards

Đây là biểu tượng của chức năng (Hình bảng tính có dấu cộng/trừ bên trái để thu gọn/mở rộng dòng)

SubTotal

72
New cards

Dữ liệu mới trong quá trình phân lớp dữ liệu là

Dữ liệu chưa được phân lớp

73
New cards

Có mấy cách xử lý khi dữ liệu bị thiếu trong Orange (widget Impute):

6

74
New cards

Trong Orange, bạn có thể kết hợp nhiều chức năng lại với nhau để tạo một quy trình làm việc phức tạp hơn. Điều này giúp làm gì?

Tạo ra một phân tích dữ liệu mạnh mẽ hơn

75
New cards

Định dạng tệp tin dữ liệu mặc định trong phần mềm Orange là gì?

.tab

76
New cards

Trong phần mềm Orange, Target là

Thuộc tính phân lớp của dữ liệu

77
New cards

Widget nào trong Orange được sử dụng để xử lý các biến số bị thiếu dữ liệu?

Impute

78
New cards

Orange có thể được sử dụng trên hệ điều hành nào?

Trên Windows, macOS và Linux

79
New cards

Hàm hồi quy logistic (Logistic Regression) trả về kết quả có miền giá trị trong khoảng?

[0; 1]

80
New cards

F1 - score là giá trị trung bình điều hòa (harmonic mean) của hai độ đo, gồm:

Precision và Recall

81
New cards

Vì sao phải sử dụng ma trận nhầm lẫn:

Mỗi sai lầm có giá trị khác nhau

82
New cards

Workflow trên có ý nghĩa như thế nào? (File dữ liệu đưa vào 3 mô hình Linear Regression, SVM, Tree rồi vào Predictions)

Dữ liệu đầu vào được dự báo bằng 3 mô hình khác nhau

83
New cards

Phát biểu nào sau đây là đúng với workflow trên: (File Sales Data qua 3 thuật toán so khớp bằng Test & Score và Predictions)

Dữ liệu dự báo được dự báo theo mô hình SVM của dữ liệu huấn luyện

84
New cards

Quá trình phân cụm theo thuật toán DIANA sẽ dừng một cách tự nhiên (không có tác động của user) khi

Đạt được số cụm bằng số điểm dữ liệu

85
New cards

Đâu là phương pháp thường dùng để đánh giá bài toán phân cụm:

Đánh giá ngoài

86
New cards

Bài toán tìm giá trị tối ưu của hàm mục tiêu với nhiều ràng buộc được giải quyết trong Excel bằng công cụ:

Solver

87
New cards

Công cụ nào trong Microsoft Excel hỗ trợ giải bài toán tối ưu kinh tế:

Solver

88
New cards

Bài toán 1 hàm mục tiêu, 1 biến quyết định được giải quyết trong Excel bằng công cụ gì

Goal seek

89
New cards

Công cụ nào trong Microsoft Excel hỗ trợ phân tích dự báo:

Tất cả các phát biểu đều đúng

90
New cards

Công việc khai khoáng dữ liệu đòi hỏi phải có hiểu biết về

Business và Data

91
New cards

Supervised learning có đặc điểm:

Dữ liệu học có đầu vào và có đầu ra tương ứng

92
New cards

Chọn thứ tự đúng nhất của hai bước sau đây trong quy trình khai khoáng dữ liệu

Xây dựng mô hình rồi đánh giá mô hình

93
New cards

Thuộc tính Target của biến dữ liệu có thể hiểu như thế nào?

Là biến chịu ảnh hưởng của một số biến khác trong mô hình

94
New cards

Muốn đọc dữ liệu từ một file dữ liệu thì ta thực hiện các bước như thế nào?

Data File -> Data Table