Luận văn Thạc sĩ: Ứng dụng mạng học sâu cho nhận diện khuôn mặt - HVTH: Trần Giang Nam

Luận văn thạc sĩ ứng dụng mạng học sâu (VGG-16) cho nhận diện khuôn mặt. Phân tích và so sánh thuật toán, đạt độ chính xác trên 95%.

Trường đại học

Cao đẳng Lý Tự Trọng Tp

Người đăng

Ẩn danh

Thể loại

Luận văn Thạc sĩ

2023

107
0
0

Phí lưu trữ

35 Point

Mục lục chi tiết

Tóm tắt

Abstract

Quyết định giao đề tài

Biên bản hội đồng chấm luận văn tốt nghiệp thạc sĩ

Phiếu nhận xét luận văn thạc sĩ của giảng viên phản biện 1

Phiếu nhận xét luận văn thạc sĩ của giảng viên phản biện 2

Lý lịch khoa học

Lời cam đoan

Lời cảm ơn

Danh sách hình ảnh

Danh sách bảng

Danh sách từ viết tắt

Thuật ngữ Anh – Việt

1. CHƯƠNG 1: TỔNG QUAN

1.1. Đặt vấn đề

1.2. Các nghiên cứu đã được công bố

1.3. Mục tiêu

1.4. Nhiệm vụ và giới hạn

1.4.1. Nhiệm vụ

1.4.2. Giới hạn

1.5. Phương pháp nghiên cứu

1.6. Tóm tắt các chương

2. CHƯƠNG 2: CƠ SỞ LÝ THUYẾT

2.1. Những ứng dụng nhận dạng mặt người

2.2. Một số phương pháp nhận dạng khuôn mặt

2.3. Một số thuật toán tối ưu dùng trong huấn luyện mạng nơ-ron

3. CHƯƠNG 3: TIỀN XỬ LÝ ẢNH KHUÔN MẶT

3.1. Chuẩn hóa hình ảnh

3.2. Lấy mẫu ảnh khuôn mặt

3.3. Lọc ảnh dùng phương pháp tích chập

4. CHƯƠNG 4: NHẬN DẠNG KHUÔN MẶT SỬ DỤNG MẠNG NƠ-RON TÍCH CHẬP

4.1. Giới thiệu mô hình mạng nơ-ron tích chập VGG-16

4.1.1. Cấu trúc mạng nơ-ron tích chập

4.1.2. Tính toán cho các lớp mạng

4.1.3. Mô hình mạng nơ-ron tích chập VGG-16

4.1.4. Thuật toán tối ưu dùng trong huấn luyện

4.2. Áp dụng mạng nơ-ron tích chập VGG-16 cho nhận diện khuôn mặt

4.2.1. Giới thiệu tập dữ liệu

4.2.2. Mô tả phương pháp huấn luyện

4.2.3. Mô tả phương pháp nhận dạng

4.3. Đánh giá độ chính xác kết quả nhận dạng

5. CHƯƠNG 5: KẾT QUẢ VÀ THẢO LUẬN

5.1. Minh họa tập dữ liệu

5.2. Kết quả phân tích ảnh qua các lớp tích chập

5.3. Kết quả huấn luyện mạng

5.3.1. Áp dụng thuật toán RMSProp

5.3.2. Áp dụng thuật toán Adam

5.4. Kết quả nhận dạng

5.5. So sánh hiệu suất với các mạng khác

6. CHƯƠNG 6: KẾT LUẬN VÀ HƯỚNG PHÁT TRIỂN

6.1. Kết luận

6.2. Hướng phát triển

TÀI LIỆU THAM KHẢO

Tóm tắt

I. Tổng Quan Về Nhận Diện Khuôn Mặt Bằng Mạng Học Sâu

Nhận diện khuôn mặt đã trở thành một trong những ứng dụng công nghệ quan trọng nhất trong thế kỷ 21. Luận văn năm 2023 về mạng học sâu nhận diện khuôn mặt tập trung vào việc ứng dụng các mạng nơ-ron tích chập (CNN) để cải thiện độ chính xác trong nhận dạng. Sự phát triển của công nghệ học sâu đã mang lại những tiến bộ vượt bậc, cho phép các hệ thống nhận diện đạt độ chính xác trên 95%. Luận văn này nghiên cứu cách thiết kế và điều chỉnh cấu trúc mạng CNN phù hợp với các mục đích sử dụng khác nhau. Thông qua việc phân tích các lớp mạng và tối ưu hóa các tham số, các tác giả đã chứng minh hiệu quả của nhận diện khuôn mặt bằng CNN trong các ứng dụng thực tế.

1.1. Ứng Dụng Thực Tiễn Của Nhận Diện Khuôn Mặt

Nhận diện khuôn mặt được ứng dụng rộng rãi trong an ninh, xác minh danh tính, và công nghệ sinh trắc học. Các hệ thống này được tích hợp trong các thiết bị di động, camera giám sát, và các ứng dụng kiểm soát truy cập. Mạng học sâu cho phép xử lý hình ảnh khuôn mặt phức tạp với độ chính xác cao, giúp phát hiện các đặc điểm khuôn mặt dù trong điều kiện ánh sáng xấu hoặc góc chụp khác nhau.

1.2. Sự Phát Triển Của Công Nghệ Nhận Diện

Từ những phương pháp truyền thống như Viola-JonesLBP, ngành công nghệ nhận diện đã tiến tới sử dụng mạng nơ-ron tích chập hiện đại như VGG-16ResNet. Mạng học sâu đã cách mạng hóa lĩnh vực này bằng cách tự động học các đặc trưng từ dữ liệu, thay vì dựa vào các tính năng được thiết kế thủ công.

II. Kiến Trúc Mạng VGG 16 Cho Nhận Diện Khuôn Mặt

Mạng VGG-16 là một mô hình mạng nơ-ron tích chập được thiết kế với 16 lớp, được sử dụng rộng rãi trong nhận diện khuôn mặt. Luận văn 2023 tập trung vào việc phân tích cấu trúc chi tiết của mạng này, bao gồm các lớp tích chập, lớp pooling, và lớp kết nối đầy đủ. Mạng VGG-16 được huấn luyện trên ba tập dữ liệu: FEI Face, CASIA-WebFace và tập ảnh tự thu thập. Quá trình chuẩn hóa hình ảnh đầu vào là bước quan trọng để đảm bảo dữ liệu phù hợp với yêu cầu của mạng. Việc điều chỉnh số lớp mạngtham số siêu được thực hiện để tối ưu hóa hiệu suất nhận diện.

2.1. Cấu Trúc Và Hoạt Động Của Lớp Tích Chập

Lớp tích chập là thành phần cốt lõi của mạng CNN, thực hiện phép toán tích chập trên ảnh đầu vào để trích xuất các đặc trưng từ bậc thấp đến bậc cao. Các bộ lọc (kernel) trong lớp này được huấn luyện để phát hiện các mô hình như cạnh, góc, và các cấu trúc phức tạp hơn. Tính toán tích chập cho phép mạng tự động học các đặc trưng liên quan tới nhận diện khuôn mặt mà không cần sự can thiệp thủ công.

2.2. Lớp Pooling Và Chuẩn Hóa Dữ Liệu

Lớp pooling giảm kích thước dữ liệu và giữ lại các thông tin quan trọng, giúp mạng hoạt động hiệu quả hơn. Chuẩn hóa hình ảnh là quá trình chuẩn bị ảnh đầu vào để đảm bảo sự nhất quán trong quá trình huấn luyện. Việc xử lý tiền xử lý ảnh khuôn mặt bao gồm căn chỉnh, cắt xén và điều chỉnh độ sáng để tối ưu hóa kết quả nhận diện.

III. Phương Pháp Huấn Luyện Và Tối Ưu Hóa Mạng

Luận văn so sánh hai thuật toán tối ưu chính là RMSpropAdam để huấn luyện mạng VGG-16. Quá trình huấn luyện mạng sử dụng ba tập dữ liệu khuôn mặt để đảm bảo khả năng tổng quát hóa tốt. Thuật toán Adam được chứng minh là hiệu quả hơn trong nhiều trường hợp nhờ vào cơ chế điều chỉnh tốc độ học động. Kết quả huấn luyện cho thấy độ chính xác đạt trên 95% trên cả ba tập dữ liệu, chứng tỏ hiệu quả của phương pháp. Đánh giá mô hình được thực hiện bằng cách so sánh các số liệu như precision, recallaccuracy trên từng tập kiểm tra tương ứng.

3.1. Thuật Toán Tối Ưu RMSprop Và Adam

Thuật toán RMSprop sử dụng bình phương trung bình chuyển động để điều chỉnh tốc độ học từng tham số. Thuật toán Adam kết hợp ưu điểm của RMSprop và Momentum, cung cấp hội tụ nhanhổn định trong quá trình huấn luyện. Cả hai thuật toán tối ưu được kiểm tra trên mạng VGG-16 để xác định hiệu quả huấn luyện và tốc độ hội tụ.

3.2. Quá Trình Huấn Luyện Và Kiểm Tra

Quá trình huấn luyện được chia thành các epoch với việc điều chỉnh tham số mạng liên tục. Tập dữ liệu kiểm tra được sử dụng để đánh giá hiệu suất mà mạng chưa từng thấy. Đánh giá độ chính xác dựa trên tỷ lệ nhận diện đúng so với tổng số ảnh, giúp xác định hiệu quả thực tế của mô hình.

IV. Kết Quả Và Hướng Phát Triển Trong Tương Lai

Luận văn năm 2023 đạt được độ chính xác nhận diện trên 95% trên cả ba tập dữ liệu FEI Face, CASIA-WebFace và tập tự thu thập. So sánh với các mô hình mạng khác trên tập FEI Face cho thấy ưu điểm cạnh tranh của phương pháp đề xuất. Các phát hiện chỉ ra rằng độ sâu của mạng có ảnh hưởng đáng kể đến hiệu suất nhận diện. Hướng phát triển trong tương lai tập trung vào việc kết hợp kỹ thuật học sâu với các phương pháp khác để cải thiện thêm độ chính xác. Ứng dụng thực tế của mạng này có tiềm năng lớn trong an ninh mạng, điều khiển truy cập và xác minh danh tính.

4.1. Kết Quả Đạt Được Và Phân Tích

Kết quả nhận diện menunjukkan bahwa mô hình đạt độ chính xác cao hơn các phương pháp truyền thống. Phân tích chi tiết các lớp tích chập cho thấy cách mạng học các đặc trưng khuôn mặt. Mô hình VGG-16 được cải tiến qua việc điều chỉnh số lớp và tham số siêu để đạt hiệu suất tối ưu.

4.2. Định Hướng Nghiên Cứu Tiếp Theo

Hướng phát triển bao gồm việc sử dụng các kiến trúc mạng hiện đại hơn như ResNet hoặc EfficientNet. Mở rộng tập dữ liệuxử lý dữ liệu không cân bằng là những thách thức cần giải quyết. Tích hợp học chuyển giao (transfer learning)kỹ thuật tăng cường dữ liệu sẽ giúp cải thiện hiệu suất nhận diện trong các tình huống phức tạp hơn.

Tóm tắt và mô tả trên trang này được tạo với sự hỗ trợ của AI. Nếu bạn thấy nội dung không chính xác hoặc có vấn đề, vui lòng Báo lỗi nội dung.

22/12/2025
Ứng dụng mạng học sâu cho nhận diện khuôn mặt luận văn thạc sĩ ngành kỹ thuật điện tử