Ứng Dụng Khai Phá Dữ Liệu Để Dự Đoán Kết Quả Học Tập Của Sinh Viên

Tài liệu Dự đoán kết quả học tập sinh viên qua khai phá dữ liệu tổng hợp lý thuyết và thực hành, phục vụ học tập ngành tại Việt Nam

Trường đại học

Trường Đại Học Hồng Đức

Chuyên ngành

Công nghệ thông tin

Người đăng

Ẩn danh

Thể loại

khóa luận tốt nghiệp

2019

60
1
0

Phí lưu trữ

30 Point

Mục lục chi tiết

LỜI CAM ĐOAN

LỜI CẢM ƠN

1. CHƯƠNG 1: TỔNG QUAN VỀ KHAI PHÁ DỮ LIỆU

1.1. Khái niệm về khai phá dữ liệu

1.2. Mô hình khai phá dữ liệu tổng quát

1.3. Ứng dụng của khai phá dữ liệu

1.4. Nhiệm vụ của khai phá dữ liệu

1.5. Các phương pháp khai phá dữ liệu

1.6. Lợi thế của khai phá dữ liệu so với phương pháp cơ bản

1.7. Những thách thức trong ứng dụng và khai phá dữ liệu

2. CHƯƠNG II: NGHIÊN CỨU XÂY DỰNG ỨNG DỤNG DỰ ĐOÁN KẾT QUẢ HỌC TẬP CỦA SINH VIÊN TRÊN NỀN TẢNG MOBILE SỬ DỤNG CÔNG NGHỆ REACT NATIVE

2.1. Khái quát công nghệ React Native, MonggoDB, Heroku và API

2.2. Công nghệ React Native

2.3. Tổng quan MonggoDB

2.4. Tổng quan về Heroku

2.5. Application Programming Interface (API)

2.6. Mô tả ứng dụng

2.7. Xác định yêu cầu

2.8. Phạm vi bài toán

2.9. Yêu cầu ứng dụng. Phân tích yêu cầu của ứng dụng

2.10. Dự đoán kết quả học tập

2.11. Giới thiệu bài toán

2.12. Phân tích quy luật và chọn giải pháp cho bài toán

2.13. Mô hình bài toán. Thiết kế hệ thống

2.14. Đặc tả User case

2.15. Xây dựng sơ sở dữ liệu

2.16. Thu thập dữ liệu

2.17. Đánh giá chất lượng dữ liệu

2.18. Xử lí dữ liệu. Xây dựng cơ sở dữ liệu trong MonggoDB

2.19. Thiết kế cơ sở dữ liệu

2.20. Thiết kế cơ sở dữ liệu vật lý

2.21. Thuật toán ID3

2.22. Giải thuật ID3 xây dựng cây quyết định từ trên xuống

2.23. Ví dụ áp dụng thuật toán ID3

3. CHƯƠNG III: PHÁT TRIỂN ỨNG DỤNG DỰ ĐOÁN KẾT QUẢ HỌC TẬP TRÊN MOBILE

3.1. Thực hiện đăng nhập vào ứng dụng. Giao diện đăng nhập

3.2. Khi không nhập user hoặc password

3.3. Đăng nhập sai tài khoản (TK)

3.4. Đăng nhập sai mật khẩu (MK)

3.5. Đăng nhập đúng TK và MK chuyển đến trang chủ

3.6. Menu điều hướng trang

3.7. Tiến hành kéo từ trái sang phải

3.8. Bấm vào icon menu

3.9. Chọn điều hướng sang trang khác khi ấn tại thanh menu

3.10. Xem chi tiết trang chủ. Giao diện trang chủ

3.11. Click vào title để xem chi tiết tin mục Tin tức – sự kiện

3.12. Click vào title để xem chi tiết tin mục NCKH – thông báo

3.13. Click vào title để xem chi tiết tin mục NCKH – kết quả

3.14. Từ trang chi tiết thoát

3.15. Trang dự đoán kết quả học tập của sinh viên

3.16. Giao diện dự đoán

3.17. Không nhập điểm

3.18. Nhập điểm sai với gợi ý

3.19. Xem trang giới thiệu

3.20. Hướng phát triển

TÀI LIỆU THAM KHẢO

Tóm tắt

I. Tổng Quan Về Dự Đoán Kết Quả Học Tập Sinh Viên

Dự đoán kết quả học tập của sinh viên là một lĩnh vực nghiên cứu quan trọng trong giáo dục hiện đại. Việc áp dụng các phương pháp khai phá dữ liệu giúp các nhà quản lý giáo dục có thể đưa ra những quyết định chính xác hơn trong việc tư vấn học tập cho sinh viên. Thông qua việc phân tích dữ liệu, các mô hình dự đoán có thể cung cấp thông tin hữu ích về khả năng học tập của sinh viên, từ đó giúp họ lựa chọn lộ trình học phù hợp.

1.1. Khái Niệm Dự Đoán Kết Quả Học Tập

Dự đoán kết quả học tập là quá trình sử dụng dữ liệu để ước lượng khả năng thành công của sinh viên trong học tập. Các phương pháp như phân tích hành vi sinh viên và khai thác dữ liệu giáo dục được áp dụng để tạo ra các mô hình dự đoán chính xác.

1.2. Tầm Quan Trọng Của Dự Đoán Trong Giáo Dục

Dự đoán kết quả học tập không chỉ giúp sinh viên có định hướng học tập tốt hơn mà còn hỗ trợ các giảng viên và nhà quản lý trong việc xây dựng chương trình giảng dạy phù hợp. Điều này góp phần nâng cao chất lượng giáo dục và giảm thiểu tỷ lệ bỏ học.

II. Những Thách Thức Trong Dự Đoán Kết Quả Học Tập

Mặc dù có nhiều lợi ích, việc dự đoán kết quả học tập cũng gặp phải không ít thách thức. Các vấn đề như chất lượng dữ liệu, sự đa dạng trong hành vi học tập của sinh viên và sự thay đổi trong chương trình học đều có thể ảnh hưởng đến độ chính xác của các mô hình dự đoán.

2.1. Chất Lượng Dữ Liệu Trong Giáo Dục

Chất lượng dữ liệu là yếu tố quyết định đến độ chính xác của các mô hình dự đoán. Dữ liệu không đầy đủ hoặc không chính xác có thể dẫn đến những kết quả sai lệch, ảnh hưởng đến quyết định của sinh viên và giảng viên.

2.2. Đặc Điểm Hành Vi Học Tập Của Sinh Viên

Mỗi sinh viên có một phong cách học tập riêng, điều này tạo ra sự đa dạng trong dữ liệu. Việc không thể nắm bắt hết các yếu tố ảnh hưởng đến hành vi học tập có thể làm giảm hiệu quả của các mô hình dự đoán.

III. Phương Pháp Khai Phá Dữ Liệu Để Dự Đoán Kết Quả Học Tập

Các phương pháp khai phá dữ liệu như phân tích luật kết hợp và cây quyết định đã được chứng minh là hiệu quả trong việc dự đoán kết quả học tập. Những phương pháp này giúp phát hiện ra các mẫu và mối quan hệ trong dữ liệu, từ đó đưa ra những dự đoán chính xác hơn.

3.1. Phân Tích Luật Kết Hợp Trong Giáo Dục

Phân tích luật kết hợp giúp xác định các mối quan hệ giữa các yếu tố trong dữ liệu học tập. Ví dụ, việc kết hợp điểm số và thời gian học có thể chỉ ra những yếu tố nào ảnh hưởng đến kết quả học tập của sinh viên.

3.2. Cây Quyết Định Trong Dự Đoán Kết Quả

Cây quyết định là một trong những thuật toán phổ biến trong khai phá dữ liệu. Nó giúp phân loại và dự đoán kết quả học tập dựa trên các đặc điểm của sinh viên, từ đó đưa ra những khuyến nghị học tập phù hợp.

IV. Ứng Dụng Thực Tiễn Của Dự Đoán Kết Quả Học Tập

Việc ứng dụng các mô hình dự đoán kết quả học tập đã mang lại nhiều lợi ích cho sinh viên và các cơ sở giáo dục. Các hệ thống tư vấn học tập dựa trên dữ liệu giúp sinh viên lựa chọn lộ trình học phù hợp, từ đó nâng cao hiệu quả học tập.

4.1. Hệ Thống Tư Vấn Học Tập Dựa Trên Dữ Liệu

Hệ thống tư vấn học tập sử dụng dữ liệu để đưa ra các khuyến nghị cho sinh viên. Những khuyến nghị này dựa trên các mô hình dự đoán, giúp sinh viên có được thông tin cần thiết để đưa ra quyết định học tập đúng đắn.

4.2. Kết Quả Nghiên Cứu Về Dự Đoán Kết Quả Học Tập

Nghiên cứu cho thấy rằng việc áp dụng khai phá dữ liệu trong giáo dục không chỉ giúp cải thiện kết quả học tập mà còn tạo ra một môi trường học tập tích cực hơn cho sinh viên.

V. Kết Luận Và Tương Lai Của Dự Đoán Kết Quả Học Tập

Dự đoán kết quả học tập thông qua khai phá dữ liệu đang trở thành một xu hướng quan trọng trong giáo dục. Tương lai của lĩnh vực này hứa hẹn sẽ mang lại nhiều cải tiến và ứng dụng mới, giúp nâng cao chất lượng giáo dục.

5.1. Xu Hướng Phát Triển Trong Dự Đoán Kết Quả

Xu hướng phát triển trong lĩnh vực dự đoán kết quả học tập sẽ tập trung vào việc cải thiện chất lượng dữ liệu và phát triển các mô hình dự đoán chính xác hơn. Điều này sẽ giúp các cơ sở giáo dục đưa ra những quyết định tốt hơn.

5.2. Tương Lai Của Khai Phá Dữ Liệu Trong Giáo Dục

Khai phá dữ liệu sẽ tiếp tục đóng vai trò quan trọng trong giáo dục, giúp các nhà quản lý và giảng viên có được những thông tin quý giá để cải thiện chất lượng giảng dạy và học tập.

15/07/2025
Ứng dụng khai phá dữ liệu để dự đoán kết quả học tập của sinh viên

Trích đoạn nội dung tài liệu

phần mở đầu và kết luận, khóa luận gồm ba chƣơng: Chƣơng 1: Nghiên cứu tổng quan, chƣơng này giới thiệu tổng quan về quá trình khai phá dữ liệu, các kỹ thuật khai phá dữ liệu, giới thiệu thuật toán xây dựng mô hình khai phá dữ liệu. Giới thiệu công cụ xây dựng mô hình khai phá dữ liệu và các công cụ phát triển hệ thống. Chƣơng 2: Nghiên cứu xây dựng ứng dụng, trong chƣơng này các nội dung đề cập đến đó là: Mô tả ứng dụng, xây dựng bài toán liệt kê lộ trình học cho từng ngành học, phân tích thiết kế hệ thống, trình bày các bƣớc thu thập, xử lý dữ liệu. Chƣơng 3: Phát triển và Demo ứng dụng, trình bày giao diện hiển thị dự đoán kết quả học tập và các bài viết của khoa CNTT-TT.

TỔNG QUAN VỀ KHAI PHÁ DỮ LIỆU 1. Khái niệm về khai phá dữ liệu Khai phá dữ liệu đƣợc dùng để mô tả quá trình phát hiện ra tri thức trong CSDL. Quá trình này kết xuất ra các tri thức tiềm ẩn từ dữ liệu giúp cho việc dự báo trong kinh doanh, các hoạt động sản xuất,. Khai phá dữ liệu làm giảm chi phí về thời gian so với phƣơng pháp truyền thống trƣớc kia (ví dụ nhƣ phƣơng pháp thống kê) [1].

Sau đây là một số định nghĩa mang tính mô tả của nhiều tác giả về khai phá dữ liệu [1]: Định nghĩa của Ferruzza: “Khai phá dữ liệu là tập hợp các phƣơng pháp đƣợc dùng trong tiến trình khám phá tri thức để chỉ ra sự khác biệt các mối quan hệ và các mẫu chƣa biết bên trong dữ liệu”. Định nghĩa của Parsaye: “Khai phá dữ liệu là quá trình trợ giúp quyết định, trong đó chúng ta tìm kiếm các mẫu thông tin chƣa biết và bất ngờ trong CSDL lớn”. Định nghĩa của Fayyad: “Khai phá tri thức là một quá trình không tầm thƣờng nhận ra những mẫu dữ liệu có giá trị, mới, hữu ích, tiềm năng và có thể hiểu đƣợc” 1. Mô hình khai phá dữ liệu tổng quát Quy trình phát hiện tri thức thƣờng tuân theo các bƣớc sau [1]: Hình thành và Định nghĩa bài Thu thập và Tiền xử lí dữ liệu Khai phá dữ liệu và Rút ra tri Phân tích và Kiểm định kết quả Sử dụng các chi thức phát hiện Hình 1.

Quy trình phát hiện tri thức Bước thứ nhất: Hình thành, xác định và định nghĩa bài toán. Là tìm hiểu lĩnh vực ứng dụng từ đó hình thành bài toán, xác định các nhiệm vụ cần phải hoàn thành. Bƣớc này sẽ quyết định cho việc rút ra đƣợc các tri thức hữu ích và cho phép chọn các phƣơng pháp khai phá dữ liệu thích hợp với mục đích ứng dụng và bản chất của dữ liệu. Bước thứ hai: Thu thập và tiền xử lý dữ liệu.

Là thu thập và xử lý thô, còn đƣợc 5 gọi là tiền xử lý dữ liệu nhằm loại bỏ nhiễu (làm sạch dữ liệu), xử lý việc thiếu dữ liệu (làm giàu dữ liệu), biến đổi dữ liệu và rút gọn dữ liệu nếu cần thiết, bƣớc này thƣờng chiếm nhiều thời gian nhất trong toàn bộ qui trình phát hiện tri thức. Do dữ liệu đƣợc lấy từ nhiều nguồn khác nhau, không đồng nhất, … có thể gây ra các nhầm lẫn. Sau bƣớc này, dữ liệu sẽ nhất quán, đầy đủ, đƣợc rút gọn và rời rạc hoá. Bước thứ ba: Khai phá dữ liệu, rút ra các tri thức.

Là khai phá dữ liệu, hay nói cách khác là trích ra các mẫu hoặc/và các mô hình ẩn dƣới các dữ liệu. Giai đoạn này rất quan trọng, bao gồm các công đoạn nhƣ: chức năng, nhiệm vụ và mục đích của khai phá dữ liệu, dùng phƣơng pháp khai phá nào? Thông thƣờng, các bài toán khai phá dữ liệu bao gồm: các bài toán mang tính mô tả - đƣa ra tính chất chung nhất của dữ liệu, các bài toán dự báo - bao gồm cả việc phát hiện các suy diễn dựa trên dữ liệu hiện có. Tuỳ theo bài toán xác định đƣợc mà ta lựa chọn các phƣơng pháp khai phá dữ liệu cho phù hợp. Bước thứ tư: Sử dụng các tri thức phát hiện được.

Là hiểu tri thức đã tìm đƣợc, đặc biệt là làm sáng tỏ các mô tả và dự đoán. Các bƣớc trên có thể lặp đi lặp lại một số lần, kết quả thu đƣợc có thể đƣợc lấy trung bình trên tất cả các lần thực hiện. Các kết quả của quá trình phát hiện tri thức có thể đƣợc đƣa và ứng dụng trong các lĩnh vực khác nhau. Do các kết quả có thể là các dự đoán hoặc các mô tả nên chúng có thể đƣợc đƣa vào các hệ thống hỗ trợ ra quyết định nhằm tự động hoá quá trình này.

Ứng dụng của khai phá dữ liệu Phát hiện tri thức và khai phá dữ liệu liên quan đến nhiều ngành, nhiều lĩnh vực: thống kê, trí tuệ nhân tạo, cơ sở dữ liệu, thuật toán, tính toán song song và tốc độ cao, thu thập tri thức cho các hệ chuyên gia, quan sát dữ liệu. Đặc biệt phát hiện tri thức và khai phá dữ liệu rất gần gũi với lĩnh vực thống kê, sử dụng các phƣơng pháp thống kê để mô hình dữ liệu và phát hiện các mẫu, luật. Ngân hàng dữ liệu (Data Warehousing) và các công cụ phân tích trực tuyến (OLAP- On Line Analytical Processing) cũng liên quan rất chặt chẽ với phát hiện tri thức và khai phá dữ liệu [1]. Khai phá dữ liệu có nhiều ứng dụng trong thực tế, ví dụ nhƣ [1]:  Bảo hiểm, tài chính và thị trƣờng chứng khoán: Phân tích tình hình tài chính và dự báo giá của các loại cổ phiếu trong thị trƣờng chứng khoán.

Danh mục vốn và giá, lãi suất, dữ liệu thẻ tín dụng, phát hiện gian lận,.  Thống kê, phân tích dữ liệu và hỗ trợ ra quyết định.  Điều trị y học và chăm sóc y tế: Một số thông tin về chuẩn đoán bệnh lƣu trong các hệ thống quản lý bệnh viện. Phân tích mối liên hệ giữa các triệu chứng bệnh, 6 chuẩn đoán và phƣơng pháp điều trị (chế độ dinh dƣỡng, thuốc, .)  Sản xuất và chế biến: Quy trình, phƣơng pháp chế biến và xử lý sự cố.

 Text mining và Web mining: Phân lớp văn bản và các trang Web, tóm tắt văn bản,.  Lĩnh vực khoa học: Quan sát thiên văn, dữ liệu gene, dữ liệu sinh vật học, tìm kiếm, so sánh các hệ gene và thông tin di truyền, mối liên hệ gene và một số bệnh di truyền,.  Mạng viễn thông: Phân tích các cuộc gọi điện thoại và hệ thống giám sát lỗi, sự cố, chất lƣợng dịch vụ,. Nhiệm vụ của khai phá dữ liệu Quá trình khai phá dữ liệu là quá trình phát hiện ra mẫu thông tin.

Trong đó, giải thuật khai phá tìm kiếm các mẫu đáng quan tâm theo dạng xác định nhƣ các luật, phân lớp, hồi quy, cây quyết định,.  Phân lớp Là việc xác định một hàm ánh xạ từ một mẫu dữ liệu vào một trong số các lớp đã đƣợc biết trƣớc đó. Mục tiêu của thuật toán phân lớp là tìm ra mối quan hệ nào đó giữa thuộc tính dự báo và thuộc tính phân lớp. Nhƣ thế quá trình phân lớp có thể sử dụng mối quan hệ này để dự báo cho các mục mới.

Các kiến thức đƣợc phát hiện biểu diễn dƣới dạng các luật theo cách sau: “Nếu các thuộc tính dự báo của một mục thoả mãn điều kiện của các tiền đề thì mục nằm trong lớp chỉ ra trong kết luận” [1]. Ví dụ: Một mục biểu diễn thông tin về nhân viên có các thuộc tính dự báo là: họ tên, tuổi, giới tính, trình độ học vấn,… và thuộc tính phân loại là trình độ lãnh đạo của nhân viên.  Hồi quy Là việc học một hàm ánh xạ từ một mẫu dữ liệu thành một biến dự đoán có giá trị thực. Nhiệm vụ của hồi quy tƣơng tự nhƣ phân lớp, điểm khác nhau chính là ở chỗ thuộc tính để dự báo là liên tục chứ không phải rời rạc.

Việc dự báo các giá trị số thƣờng đƣợc làm bởi các phƣơng pháp thống kê cổ điển, chẳng hạn nhƣ hồi quy tuyến tính [1]. Tuy nhiên, phƣơng pháp mô hình hoá cũng đƣợc sử dụng, ví dụ: cây quyết định. Ứng dụng của hồi quy là rất nhiều, ví dụ: Dự đoán số lƣợng sinh vật phát quang hiện thời trong khu rừng bằng cách dò tìm vi sóng bằng các thiết bị cảm biến từ xa; ƣớc lƣợng sác xuất ngƣời bệnh có thể chết bằng cách kiểm tra các triệu chứng; dự báo nhu cầu của ngƣời dùng đối với một sản phẩm, … 7  Phân nhóm Là việc mô tả chung để tìm ra các tập hay các nhóm, loại mô tả dữ liệu. Các nhóm có thể tách nhau hoặc phân cấp hay gối lên nhau.

Có nghĩa là dữ liệu có thể vừa thuộc nhóm này lại vừa thuộc nhóm khác. Các ứng dụng khai phá dữ liệu có nhiệm vụ phân nhóm nhƣ phát hiện tập các khách hàng có phản ứng giống nhau trong CSDL tiếp thị; xác định các quang phổ từ các phƣơng pháp đo tia hồng ngoại, … Liên quan chặt chẽ đến việc phân nhóm là nhiệm vụ đánh giá dữ liệu, hàm mật độ xác suất đa biến các trƣờng trong CSDL [1].  Tổng hợp Là công việc liên quan đến các phƣơng pháp tìm kiếm một mô tả tập con dữ liệu. Kỹ thuật tổng hợp thƣờng áp dụng trong việc phân tích dữ liệu có tính thăm dò và báo cáo tự động.

Nhiệm vụ chính là sinh ra các mô tả đặc trƣng cho một lớp [1].  Mô hình hóa và sự phụ thuộc Là việc tìm kiếm một mô hình mô tả sự phụ thuộc giữa các biến, thuộc tính theo hai mức: Mức cấu trúc của mô hình mô tả (thƣờng dƣới dạng đồ thị). Trong đó, các biến phụ thuộc bộ phận vào các biến khác. Mức định lượng mô hình mô tả mức độ phụ thuộc.

Những phụ thuộc này thƣờng đƣợc biểu thị dƣới dạng theo luật “nếu - thì” (nếu tiền đề là đúng thì kết luận đúng). Về nguyên tắc, cả tiền đề và kết luận đều có thể là sự kết hợp logic của các giá trị thuộc tính. Trên thực tế, tiền đề thƣờng là nhóm các giá trị thuộc tính và kết luận chỉ là một thuộc tính. Hơn nữa hệ thống có thể phát hiện các luật phân lớp trong đó tất cả các luật cần phải có cùng một thuộc tính do ngƣời dùng chỉ ra trong kết luận [1].

Quan hệ phụ thuộc cũng có thể biểu diễn dƣới dạng mạng tin cậy Bayes. Đó là đồ thị có hƣớng, không chu trình. Các nút biểu diễn thuộc tính và trọng số của liên kết phụ thuộc giữa các nút đó.

Nội dung được bảo vệ bản quyền — Tải xuống đầy đủ

Tài liệu có tiêu đề Dự Đoán Kết Quả Học Tập Sinh Viên Qua Khai Phá Dữ Liệu tập trung vào việc sử dụng các phương pháp khai thác dữ liệu để dự đoán kết quả học tập của sinh viên. Bằng cách phân tích dữ liệu học tập, tài liệu này không chỉ giúp các nhà giáo dục hiểu rõ hơn về các yếu tố ảnh hưởng đến thành tích học tập mà còn cung cấp những công cụ hữu ích để cải thiện chất lượng giảng dạy và học tập.

Độc giả sẽ tìm thấy nhiều lợi ích từ tài liệu này, bao gồm khả năng áp dụng các kỹ thuật khai thác dữ liệu để tối ưu hóa quy trình học tập và đưa ra các quyết định giáo dục chính xác hơn. Để mở rộng kiến thức về chủ đề này, bạn có thể tham khảo thêm tài liệu Luận văn thạc sĩ khoa học máy tính educational data mining and learning analytics educational support for tutoring and learning, nơi cung cấp cái nhìn sâu sắc về khai thác dữ liệu trong giáo dục.

Ngoài ra, tài liệu Khóa luận tốt nghiệp khoa học dữ liệu nghiên cứu phương pháp cải thiện chất lượng dữ liệu nhằm nâng cao hiệu quả dự đoán kết quả môn học của sinh viên sẽ giúp bạn hiểu rõ hơn về cách nâng cao chất lượng dữ liệu để cải thiện dự đoán kết quả học tập.

Cuối cùng, bạn cũng có thể tìm hiểu về Thuật toán m2tqt ứng dụng trong khai phá dữ liệu tuyển sinh, tài liệu này sẽ cung cấp thêm thông tin về các thuật toán khai thác dữ liệu trong lĩnh vực tuyển sinh. Những tài liệu này sẽ giúp bạn mở rộng kiến thức và có cái nhìn toàn diện hơn về việc ứng dụng khai thác dữ liệu trong giáo dục.