Mô Hình Phát Hiện Tấn Công Web Dựa Trên Học Tăng Cường

Khóa luận trình bày mô hình phát hiện tấn công web dựa trên học tăng cường, góp phần nâng cao an toàn thông tin trong môi trường mạng.

Người đăng

Ẩn danh

Thể loại

khóa luận tốt nghiệp

2023

61
5
0

Phí lưu trữ

30 Point

Mục lục chi tiết

LỜI CẢM ƠN

1. CHƯƠNG 1: TỔNG QUAN ĐỀ TÀI

1.1. Giới thiệu đề tài

1.2. Mục tiêu đề tài

1.3. Đối tượng, phạm vi nghiên cứu

1.4. Tính mới và tính ứng dụng của đề tài

1.5. Tóm tắt chương

2. CHƯƠNG 2: CƠ SỞ LÝ THUYẾT VÀ CÁC NGHIÊN CỨU LIÊN QUAN

2.1. Các tấn công web thường gặp

2.2. Máy học - Học tăng cường

2.3. Các công nghệ sử dụng

2.4. Các nghiên cứu liên quan

3. CHƯƠNG 3: THIẾT KẾ HỆ THỐNG

3.1. Tổng quan về mô hình

3.2. Tiền xử lý dữ liệu

3.3. Chuẩn bị dữ liệu cho mô hình học tăng cường

3.4. Triển khai mô hình học tăng cường

3.5. Môi trường

4. CHƯƠNG 4: HIỆN THỰC MÔ HÌNH VÀ THỰC NGHIỆM

4.1. Cấu hình máy thực nghiệm

4.2. Hiện thực mô hình

4.3. Dữ liệu và tiền xử lý

4.4. Chuyển đổi dữ liệu thành dạng số

4.5. Tạo bộ dữ liệu huấn luyện mô hình

4.6. Triển khai mô hình

4.7. Thực nghiệm hệ thống

4.7.1. Tiêu chí đánh giá

4.7.2. Kịch bản thực nghiệm

4.8. Kết quả thực nghiệm

5. CHƯƠNG 5: KẾT LUẬN VÀ HƯỚNG PHÁT TRIỂN

5.1. Kết quả đạt được

5.2. Hướng phát triển của đề tài

TÀI LIỆU THAM KHẢO

Tóm tắt

I. Tổng quan về mô hình phát hiện tấn công web dựa trên học tăng cường

Mô hình phát hiện tấn công web dựa trên học tăng cường đang trở thành một giải pháp hiệu quả trong việc bảo vệ an ninh mạng. Với sự gia tăng của các cuộc tấn công mạng, việc áp dụng các công nghệ mới như học máy và học tăng cường là cần thiết. Mô hình này không chỉ giúp phát hiện các tấn công đã biết mà còn có khả năng nhận diện các tấn công mới, từ đó nâng cao khả năng bảo vệ thông tin và dữ liệu của người dùng.

1.1. Khái niệm về học tăng cường trong phát hiện tấn công

Học tăng cường là một nhánh của học máy, nơi mà các thuật toán học từ kinh nghiệm thông qua phản hồi từ môi trường. Điều này cho phép mô hình tự động cải thiện khả năng phát hiện tấn công qua thời gian.

1.2. Tầm quan trọng của phát hiện tấn công web

Phát hiện tấn công web là một phần quan trọng trong an ninh mạng. Các cuộc tấn công ngày càng tinh vi, đe dọa đến an toàn thông tin và dữ liệu của người dùng. Việc phát hiện kịp thời giúp ngăn chặn thiệt hại nghiêm trọng.

II. Các thách thức trong việc phát hiện tấn công web hiện nay

Các cuộc tấn công mạng ngày càng trở nên phức tạp và tinh vi, khiến cho việc phát hiện trở nên khó khăn hơn. Những thách thức này bao gồm sự đa dạng của các loại tấn công, tốc độ phát triển của công nghệ và sự thay đổi liên tục trong hành vi của kẻ tấn công. Điều này đòi hỏi các mô hình phát hiện phải liên tục được cập nhật và cải tiến.

2.1. Đặc điểm của các cuộc tấn công mạng hiện đại

Các cuộc tấn công hiện đại thường sử dụng nhiều kỹ thuật khác nhau, từ SQL Injection đến XSS, làm cho việc phát hiện trở nên khó khăn. Sự kết hợp của các phương pháp tấn công này tạo ra những thách thức lớn cho các hệ thống bảo mật.

2.2. Tốc độ phát triển của công nghệ và hành vi kẻ tấn công

Công nghệ phát triển nhanh chóng, kẻ tấn công cũng không ngừng cải tiến kỹ thuật của mình. Điều này tạo ra áp lực lớn cho các hệ thống phát hiện tấn công, yêu cầu phải có những giải pháp linh hoạt và hiệu quả.

III. Phương pháp phát hiện tấn công web bằng học tăng cường

Mô hình phát hiện tấn công web dựa trên học tăng cường sử dụng các thuật toán học máy để phân tích và nhận diện các mẫu tấn công. Phương pháp này cho phép mô hình học từ dữ liệu và cải thiện khả năng phát hiện theo thời gian. Việc áp dụng học tăng cường giúp tăng cường khả năng phát hiện các tấn công mới và chưa biết.

3.1. Quy trình xây dựng mô hình học tăng cường

Quy trình này bao gồm việc thu thập dữ liệu, tiền xử lý dữ liệu, xây dựng mô hình và huấn luyện mô hình. Mỗi bước đều quan trọng để đảm bảo mô hình hoạt động hiệu quả trong việc phát hiện tấn công.

3.2. Các thuật toán học tăng cường phổ biến

Một số thuật toán học tăng cường phổ biến bao gồm Q-learning, Deep Q-Networks (DQN) và Double DQN. Những thuật toán này giúp mô hình học từ kinh nghiệm và cải thiện khả năng phát hiện tấn công.

IV. Ứng dụng thực tiễn của mô hình phát hiện tấn công web

Mô hình phát hiện tấn công web dựa trên học tăng cường đã được áp dụng thành công trong nhiều lĩnh vực. Các ứng dụng này không chỉ giúp bảo vệ thông tin mà còn nâng cao độ tin cậy của các hệ thống. Kết quả nghiên cứu cho thấy mô hình có khả năng phát hiện cao và hiệu quả trong việc ngăn chặn các cuộc tấn công.

4.1. Kết quả thực nghiệm với mô hình học tăng cường

Các kết quả thực nghiệm cho thấy mô hình có khả năng phát hiện tấn công với tỷ lệ chính xác cao. Điều này chứng tỏ tính khả thi của việc áp dụng học tăng cường trong phát hiện tấn công web.

4.2. Các lĩnh vực ứng dụng mô hình phát hiện tấn công

Mô hình này có thể được áp dụng trong nhiều lĩnh vực như ngân hàng, thương mại điện tử và các dịch vụ trực tuyến khác. Việc bảo vệ thông tin nhạy cảm trong các lĩnh vực này là rất quan trọng.

V. Kết luận và hướng phát triển tương lai của mô hình

Mô hình phát hiện tấn công web dựa trên học tăng cường đã chứng minh được hiệu quả trong việc bảo vệ an ninh mạng. Tuy nhiên, để đáp ứng được các thách thức trong tương lai, cần tiếp tục nghiên cứu và phát triển các phương pháp mới. Hướng phát triển này sẽ giúp nâng cao khả năng phát hiện và bảo vệ thông tin trong môi trường mạng ngày càng phức tạp.

5.1. Tầm quan trọng của việc cải tiến mô hình

Việc cải tiến mô hình là cần thiết để đáp ứng với sự thay đổi nhanh chóng của các cuộc tấn công mạng. Các nghiên cứu mới sẽ giúp nâng cao hiệu quả của mô hình trong việc phát hiện tấn công.

5.2. Hướng nghiên cứu trong tương lai

Hướng nghiên cứu trong tương lai có thể bao gồm việc áp dụng các công nghệ mới như trí tuệ nhân tạo và học sâu để cải thiện khả năng phát hiện tấn công. Điều này sẽ mở ra nhiều cơ hội mới trong lĩnh vực an ninh mạng.

10/07/2025
Khóa luận tốt nghiệp an toàn thông tin một mô hình phát hiện tấn công web dựa trên học tăng cường

Trích đoạn nội dung tài liệu

Chương 1: Tổng quan dé tài Trong chuong dau tién, tac giả giới thiệu tổng quan về đề tài cũng như lý do chọn đề tài để nghiên cứu và những mục tiêu thực hiện nghiên cứu. - _ Chương 2: Cơ sở lý thuyết và các nghiên cứu liên quan Tại chương thứ hai, tác giả giới thiệu những lý thuyết được nghiên cứu trong quá trình thực hiện và những bài báo khoa học được sử dụng để tham khảo và nghiên cứu. -_ Chương 3: Thiết kế hệ thống Trong chương này, tác giả sẽ mô tả về mô hình được đề xuất. Bao gồm tổng quan mô hình đề xuất, các luồng hoạt động của mô hình và phương pháp tiền xử lý dữ liệu đưa vào mô hình, định nghĩa các thành phần trong mô hình học tăng cường được dé xuất.

- _ Chương 4: Hiện thực mô hình và thực nghiệm Trong chương thứ tư, tác giả sẽ trình bày chỉ tiết các bước dé hiện thực hệ thống đã được đề xuất. Tiếp theo sẽ là hiện thực các kịch bản thực nghiệm với mô hình bằng ngôn ngữ Python. Cuối cùng là đưa ra kết quả và nhận xét chung cho các kịch bản thực nghiệm đã đề ra. - _ Chương 5: Kết luận và hướng phát triển Ở chương cuối, nhóm tác giả hệ thống lại những gì đã làm được trong khoá luận này, đồng thời đưa ra những mục tiêu và các hướng phát triển dé có thể cải thiện kết quả, tăng thêm tính khả quan của đề tài khi áp dụng vào thực tiễn.

CƠ SỞ LÝ THUYET VA CÁC NGHIÊN CỨU LIEN QUAN 2. Các tin công web thường gặp Tân công mạng hay còn gọi là chiến tranh trên không gian mạng. Có thê hiểu tấn công mang là hình thức tan công xâm nhập vào một hệ thống mạng máy tính, cơ sở dữ liệu, hạ tầng mạng, website, thiết bị của một cá nhân hoặc một tổ chức thông qua mạng internet với những mục đích bất hợp pháp. Đề có thể ngăn chặn các cuộc tan công mạng, ta cần tìm hiéu và phân tích các cuộc tan công thường gap, từ đó có thé tìm ra dấu hiệu của cuộc tan công và thực hiện ngăn chặn chúng.

Tấn công SQL Injection Tần công SQL Injection là loại tấn công mà attacker có thé tận dụng các lỗ hồng và các lỗi logic trong source code đề chèn các câu truy vấn nguy hiểm nhằm khai thác thông tin từ server hoặc database.1: Minh họa tan công SQL Injection Dau hiệu của tan công SQL injection thông thường sẽ thêm những ký tự đặc biệt như #, --, %00, ‘, “. hoặc các từ union, and, or, order by,. vào sau input hay URL của trang web. Những ký tự này kết hợp với dữ liệu được đưa vào sẽ được máy chủ chuyền thành một câu truy vấn trong cơ sở dữ liệu và thực thi nó.

Tấn công Local File Inclusion Local File Inclusion là kỹ thuật tan công cho phép kẻ tan công đọc hoặc thực thi file trên ứng dụng web. Điều này có thể rất nguy hiểm vì nếu máy chủ web bị định cấu hình sai và chạy với đặc quyền cao, kẻ tan công có thé có quyền truy cập vào thông tin nhạy cảm. Nếu kẻ tấn công có thể đặt mã trên máy chủ web thông qua các phương tiện khác, thì chúng có thể thực thi các lệnh tùy ý. Local File Inclusion (LFI) 1.

Hacker identifies web 2. Hacker modifies URL application with insufficient string using “./“ directive filtering or validation of to ensure Directory (Path) browser input from users. Traversal is possible.php HACKER SERVER filename.php https: //example. Hacker backdoor uploads 4.

Request is improperly malicious .php file to host server validated and hacker is and attempts to locate script permitted to run malicious using same method as Step 2. script on host application.2: Minh họa tan công Local File Inclusion Kẻ tấn công sẽ thực hiện tấn công bằng cách thêm những từ khóa sau vào URL của trang web là: etc, htpasswd, passwd. Tấn công Remote File Inclusion Khi các ứng dụng web cho phép người dùng nhập dữ liệu, chang han như URL, giá trị tham số, v. và chuyển những thông tin trên nhờ cơ chế “includeFile” ma không được làm sạch đúng cách, kẻ tan công có thé lợi dụng lỗ hong Remote File Inclusion trong các ứng dụng web để tải lên các tệp hoặc tập lệnh độc hại bên ngoài, từ đó thao túng ứng dụng web thực thi các tệp từ xa bằng các tập lệnh độc hại.

Remote File Inclusion (RFI) 1. Hacker identifies web 2. Hacker modifies URL application with insufficient string using “./“ directive filtering or validation of to ensure Directory (Path) browser input from users. Traversal is possible.

https: //axezBifEcees/?page=£++4fBBx.txt https: //example.exe J HACKER SERVER 3. Hacker uploads malicious .php file to hacker-controlled server © and attempts to locate script using same method as step 2.php file is located and host server executes remote server-side code from hacker-controlled server.php oo HACKER SERVER filename.php --> https://hacksite. php https: //example.com/?page=https://hacksite.3: Minh họa tắn công Remote File Inclusion Dấu hiệu nhận biết tan công RFI thường thấy trong payload của request sẽ xuất hiện các đường dẫn URL tới web server khác. Tấn công Command Injection Lỗ hồng Command Injection là loại lỗ hổng mà kẻ tắn công có thé lợi dụng dé thực thi các lệnh tùy ý trên hệ điều hành máy chủ (OS), từ đó thu thập thông tin bí mật hoặc lấy quyền truy cập vào hệ thống.

ad UPLOAD/ DOWNLOAD. DATA $(curl https://web-attacker.sh | sh) > SERVER ACCESS & EDIT USER —> SECURITY LEVELS ‘ADMIN APPLICATION T1 ACCESS ACCESS LOCAL ” NETWORK SENSITIVE ACCESS DATA ey Hinh 2.4: Minh hoa tan céng Command Injection Kẻ tan công lợi dung lỗ hồng nay dé thực thi những câu lệnh dé thực hiện tấn công. Sau đây là những câu lệnh thường được sử dụng dé kẻ tan công có thé lẫy được nhiều thông tin VỀ server: pwd, Is, where, cd, ssh, ||, &&, echo, whoami. Tấn công Open Redirect Lỗ héng Open Redirect phát sinh khi một ứng dụng kết hợp dit liệu do người dùng kiểm soát vào mục tiêu chuyển hướng theo cách không an toàn.

Kẻ tan công có thể tạo một URL trong ứng dụng gây ra chuyền hướng đến một miền bên ngoài tùy ý. Hành vi này có thể được tận dụng để tạo điều kiện cho các cuộc tấn công lừa đảo chống lại người dùng ứng dụng. Khả năng sử dụng URL ứng dụng xác thực, nhắm mục tiêu đúng tên miền và có chứng chỉ SSL hợp lệ (nếu SSL được sử dung), tạo độ tin cậy cho cuộc tan công lừa đảo vì nhiều người dùng, ngay cả hi họ xác minh các tính năng này, sẽ không nhận thấy chuyển hướng tiếp theo tới một miền khác.com” is giving free movie tickets at : www.com/2url-www.abcin Grab them fast. Example’s Login !! uxemame C—— Password 302 Found !! Opens up the URL asit seems to be the genuine one.5: Minh họa tắn công Open Redirect Những từ khóa thường thấy trong tấn công Open redirect: redirect to, checkout_url, domain_name,.

Tấn công Carriage Return and Line Feed (CRLF) Tổ hợp ký tự xuống dòng của header HTTP và nội dung trang web HTML được gọi là CRLF. Máy chủ web sử dung CRLF dé hiểu khi nào tiêu đề HTTP mới bắt đầu và một tiêu đề khác kết thúc. CRLF cũng có thể cho ứng dụng web hoặc người dùng biết rằng một dòng mới bắt đầu trong một tệp hoặc trong một khối văn bản. Các ký tự CRLF là một thông báo HTTP/1.1 tiêu chuẩn, do đó, nó được sử dụng bởi bất kỳ loại máy chủ web nào, bao gồm Apache, Microsoft IIS và tất cả các loại máy chủ khác.

Trong một cuộc tan công bằng lỗ hong chèn CRLF, kẻ tan công chèn cả ký tự xuống vào input của người dùng dé lừa máy chủ, ứng dụng web hoặc người dùng nghĩ rằng một đối tượng đã kết thúc và một đối tượng khác đã bắt đầu. Do đó, các chuỗi CRLF không phải là các ký tự độc hại, tuy nhiên chúng có thé được sử dụng 10 cho mục đích xấu, dé phân tách phản hồi HTTP, v. Trong các ứng dụng web, việc tiêm CRLF có thể có tác động nghiêm trọng, tùy thuộc vào ứng dụng thực hiện với các mục đơn lẻ. Các tác động có thé tir tiết lộ thông tin đến thực thi mã, 16 hồng bảo mật ứng dụng web tác động trực tiếp.

Trên thực tế, một cuộc tấn công tiêm CRLF có thể gây ra hậu quả rất nghiêm trọng đối với ứng dụng web, mặc dù nó chưa bao giờ được liệt kê trong danh sách Top 10 của OWASP. Tan công Cross Site Scripting (XSS) Tan công XSS dựa vào lỗ hong XSS dé thực hiện tan công. Với lỗ héng XSS, attacker sẽ thao túng trang web gửi đoạn mã JavaScript độc hại tới người dùng. Doan mã JavaScript đó sẽ thực thi trên browser của người ding và đánh cắp các thông tin của người dùng như cookie, password và các thông tin nhạy cảm khác.

Thông thường, kẻ tan công sẽ sử dụng XSS và các kỹ thuật lừa đảo khác dé đánh lừa người dùng thực thi đoạn mã JavaScript nhằm đánh cắp thông tin. 11 #4 https://insecure-website.com/comment?message=<script src=https:/levil-user.js><!script> (&Password 3] @ Sensitive data) 4 + (G Wire transfer) `) (@ Mother's maiden name Hình 2.7: Minh họa tan công XSS Những từ khóa phô biến thường thấy trong tan công XSS là: script, onerror, onmouseover, onload, &\#X41, alert, <>. Tấn công Path traversal Đây là một dang tan công thường được sử dung với mục dich là truy cập các thư mục, đường dẫn không công khai trên Internet được lưu trữ tại thư mục gốc của Web. Bằng cách thao túng biến tham chiếu đến file “./” và các biến thể của nó để truy cập các tệp và thư mục tùy ý được lưu trữ trên hệ thống tệp bao gồm mã nguồn ứng dụng hoặc cầu hình và các tệp hệ thống quan trọng.

12 x x¬ < › œ_ Iloadlmage?filename=gift.etcipasswd| 0:root: /root: bin/bash +1:đaemon: /usr/sbin: /bin/sh pin: /bin/sh dev: /bản/sh sync: /bin: /bin/syne 60:ganes : /usr/ganes: /bin/sh 12:man: /var/cache/nan: /bin/sh :X:7:7:1p:/var/spoe1/1p4: /bin/sh 8:8:mail: /var/mail: /bin/sh 9:news: /var/spool/news: /bin/sh icp: /var/spool/wucp: /bin/sh roxy: /bin: /bin/sh we 3 :www-data: /var/wew: bin/sh TL» tạ Hình 2.8: Minh họa tan công Path traversal Những ký tự thường được sử dụng trong tan công Path traversal là. kẻ tấn công sé lặp lại những ký tự này nhiêu lần đề thực hiện tan công. Máy học - Học tăng cường 2. Giới thiệu về học tăng cường Hoc tăng cường (RL) là một nhánh của Máy học (ML) được định nghĩa bằng cách lập chiến lược khi có một cơ chế đánh giá từng hành động (cơ chế đó có thé không biết trước nhưng ta được phép thử.

Mục tiêu cuối cùng của việc học tăng cường là ta sẽ lập được một chiến lược các hành động dé có thé đạt được tối đa số điểm thưởng. Học tăng cường có thể được xem là một cách hiện thực hoá thí nghiệm Pavlov dưới dạng kỹ thuật số, là một đại diện trực tiếp của khái niệm củng cố được sử dụng cho việc học. Học tăng cường được áp dụng trong nhiều tình huống trong cuộc sống.

Nội dung được bảo vệ bản quyền — Tải xuống đầy đủ

Tài liệu có tiêu đề Mô Hình Phát Hiện Tấn Công Web Dựa Trên Học Tăng Cường trình bày một phương pháp tiên tiến trong việc phát hiện các cuộc tấn công trên web thông qua việc áp dụng học tăng cường. Nội dung chính của tài liệu tập trung vào việc xây dựng mô hình có khả năng học hỏi từ các dữ liệu tấn công trước đó, từ đó cải thiện khả năng phát hiện và phản ứng nhanh chóng với các mối đe dọa mới. Lợi ích mà tài liệu mang lại cho độc giả bao gồm việc hiểu rõ hơn về cách thức hoạt động của các cuộc tấn công web, cũng như cách mà học máy có thể được áp dụng để bảo vệ hệ thống một cách hiệu quả hơn.

Để mở rộng kiến thức của bạn về lĩnh vực này, bạn có thể tham khảo tài liệu Luận văn thạc sĩ nâng cao hiệu quả bảo mật của mạng truyền tin uav ứng dụng học tăng cường, nơi cung cấp cái nhìn sâu sắc về việc ứng dụng học tăng cường trong bảo mật mạng, một chủ đề liên quan mật thiết đến việc phát hiện tấn công web. Những tài liệu này sẽ giúp bạn có cái nhìn toàn diện hơn về các phương pháp bảo mật hiện đại và cách chúng có thể được áp dụng trong thực tiễn.