Khóa Luận Tốt Nghiệp: Tối Ưu Hóa Kiến Trúc Mạng Neural Đa Mục Tiêu Với Thuật Toán Tiến Hóa

Khóa luận tốt nghiệp khoa học máy tính nghiên cứu kiến trúc mạng neural đa mục tiêu bằng thuật toán tiến hóa kết hợp phương pháp dự đoán hiệu năng.

Chuyên ngành

Khoa học máy tính

Người đăng

Ẩn danh

Thể loại

khóa luận tốt nghiệp

2022

77
1
0

Phí lưu trữ

30 Point

Mục lục chi tiết

LỜI CAM ĐOAN

LỜI CẢM ƠN

1. CHƯƠNG 1: TỔNG QUAN

1.1. Giới thiệu bài toán

1.2. Mô tả bài toán

1.3. Phạm vi nghiên cứu

1.4. Mục tiêu và đối tượng nghiên cứu

1.5. Phương pháp thực hiện

1.6. Cấu trúc khóa luận

2. CHƯƠNG 2: CÁC CÔNG TRÌNH LIÊN QUAN VÀ KIẾN THỨC NỀN TẢNG

2.1. Các công trình liên quan

2.2. Bài toán Tối ưu hóa đa mục tiêu

2.3. Bài toán Tìm kiếm kiến trúc mạng neural

2.4. Bài toán Tìm kiếm kiến trúc mạng neural đa mục tiêu

2.5. Chỉ số Synaptic Flow không qua huấn luyện

3. CHƯƠNG 3: MÔ HÌNH HÓA BÀI TOÁN TÌM KIẾM KIẾN TRÚC MẠNG NEURAL ĐA MỤC TIÊU

3.1. Tìm kiếm kiến trúc mạng neural đa mục tiêu

3.2. Cấp độ cao (upper level)

3.3. Tìm kiếm kiến trúc mạng neural đa mục tiêu không qua huấn luyện

3.4. Tìm kiếm kiến trúc mạng neural nhiều mục tiêu

4. CHƯƠNG 4: PHƯƠNG PHÁP

4.1. Thiết lập thực nghiệm

4.2. Đánh giá độ thích nghi

4.3. Kết quả hội tụ IGD và độ chính xác

4.4. Khả năng chuyển giao của các kiến trúc

5. CHƯƠNG 5: THỰC NGHIỆM

6. CHƯƠNG 6: KẾT LUẬN

DANH SÁCH HÌNH VẼ

DANH SÁCH BẢNG

DANH MỤC TỪ VIẾT TẮT

Tóm tắt

I. Giới thiệu về kiến trúc mạng neural và thuật toán tiến hóa

Kiến trúc mạng neural (Neural Architecture Search - NAS) là một quy trình tự động hóa việc thiết kế các mạng neural, nhằm tìm ra các kiến trúc có hiệu năng cao. Thuật toán tiến hóa (Evolutionary Algorithm) được sử dụng để tối ưu hóa quá trình tìm kiếm này, giúp giảm thiểu chi phí tính toán. Bài toán NAS thường yêu cầu đánh giá nhiều kiến trúc ứng viên, điều này đòi hỏi nguồn tài nguyên lớn. Dự đoán hiệu năng (Performance Prediction) là một phương pháp giúp ước lượng hiệu năng của các kiến trúc mà không cần huấn luyện đầy đủ, từ đó giảm thiểu thời gian và chi phí.

1.1. Bài toán tìm kiếm kiến trúc mạng neural

Bài toán NAS là một phần của AutoML, tập trung vào việc tự động hóa quy trình thiết kế mạng neural. Mục tiêu chính là tìm ra các kiến trúc có hiệu năng cao mà không cần sự can thiệp thủ công. Các kiến trúc được tạo ra bằng NAS thường vượt trội so với các kiến trúc thiết kế thủ công trong các tác vụ như phân loại hình ảnh và phát hiện đối tượng.

1.2. Thuật toán tiến hóa trong NAS

Thuật toán tiến hóa như NSGA-II được sử dụng để giải quyết bài toán NAS đa mục tiêu. Các thuật toán này giúp tìm kiếm các kiến trúc tối ưu bằng cách đánh giá và chọn lọc các giải pháp dựa trên nhiều tiêu chí như độ chính xác và độ phức tạp. Phương pháp này giúp giảm thiểu chi phí tính toán và thời gian tìm kiếm.

II. Mô hình hóa bài toán tìm kiếm kiến trúc mạng neural đa mục tiêu

Bài toán tìm kiếm kiến trúc mạng neural đa mục tiêu (Multi-Objective NAS) liên quan đến việc tối ưu hóa nhiều tiêu chí cùng lúc, bao gồm hiệu năng và độ phức tạp của mạng. Mạng neural đa mục tiêu (Many-Objective NAS) mở rộng bài toán này bằng cách xem xét nhiều hơn hai tiêu chí. Tối ưu hóa mạng neural (Neural Network Optimization) là quá trình tìm kiếm các kiến trúc cân bằng giữa hiệu năng và độ phức tạp, phù hợp với các thiết bị có tài nguyên hạn chế.

2.1. Bài toán tối ưu hóa đa mục tiêu

Bài toán tối ưu hóa đa mục tiêu trong NAS yêu cầu cân bằng giữa độ chính xác và các chỉ số độ phức tạp như FLOPs, số lượng tham số và độ trễ. Thuật toán di truyền (Genetic Algorithm) như NSGA-II được sử dụng để tìm kiếm các giải pháp tối ưu trên nhiều tiêu chí.

2.2. Mô hình dự đoán hiệu năng

Mô hình dự đoán hiệu năng như Synaptic Flow được sử dụng để ước lượng hiệu năng của các kiến trúc mà không cần huấn luyện đầy đủ. Phương pháp này giúp giảm thiểu chi phí tính toán và thời gian tìm kiếm, đồng thời duy trì độ chính xác cao.

III. Phương pháp và kết quả thực nghiệm

Phương pháp TF-MaOENAS (Training-Free Many-Objective Evolutionary NAS) được đề xuất để giải quyết bài toán tìm kiếm kiến trúc mạng neural nhiều mục tiêu. Phương pháp này sử dụng thuật toán tiến hóa kết hợp với các chỉ số dự đoán hiệu năng không qua huấn luyện. Kết quả thực nghiệm trên bộ benchmark NATS-Bench cho thấy các kiến trúc được tìm thấy có hiệu năng cạnh tranh và chi phí tính toán hợp lý.

3.1. Thiết lập thực nghiệm

Thực nghiệm được thực hiện trên bộ dữ liệu CIFAR-10, CIFAR-100 và ImageNet. Các kiến trúc được đánh giá dựa trên độ chính xác và các chỉ số độ phức tạp như FLOPs và số lượng tham số. Chỉ số IGD (Inverted Generational Distance) được sử dụng để đánh giá hiệu quả của các phương pháp.

3.2. Kết quả và phân tích

Kết quả cho thấy phương pháp TF-MaOENAS đạt được các kiến trúc có hiệu năng cao và độ phức tạp thấp. Các kiến trúc này có thể triển khai trên các thiết bị nhúng với tài nguyên hạn chế. Phương pháp này cũng giảm thiểu đáng kể thời gian và chi phí tính toán so với các phương pháp truyền thống.

21/02/2025
Khóa luận tốt nghiệp khoa học máy tính tìm kiếm kiến trúc mạng neural nhiều mục tiêu bằng thuật toán tiến hóa với các phương pháp dự đoán hiệu năng

Trích đoạn nội dung tài liệu

Chương 1. TONG QUAN 3 năng tìm ra những kiến trúc với hiệu năng cao và giảm được đáng kể chỉ phí tính toán. Mặt khác, những nghiên cứu hiện nay hau hết chỉ tối ưu kiến trúc mang neural cho một mục tiêu, ví dụ như độ chính xác mạng. Trong khi đó, việc triển khai mạng neural trong thực tế thường đòi hỏi nhiều khía cạnh cần phải quan tâm đến như độ phức tạp (FLOPs, số lượng tham số) hay hiệu năng phan cứng (độ trễ).

Việc tìm ra các kiến trúc với độ chính xác cao thường chỉ có thể triển khai trên các máy trạm (workstation) nhưng lại quá phức tạp và lớn để triển khai trên các thiết bị nhúng hạn chế về mặt tài nguyên. Những nghiên cứu gần đây cũng đã đề xuất nhiều mô hình cho bài toán tìm kiếm kiến trúc mạng neural đa mục tiêu (multi-objective NAS, hay MONAS) nhằm tính đến nhiều khía cạnh khác nhau trong quá trình tối ưu hóa 14 Phạm vi nghiên cứu Trong khóa luận này, chúng tôi tập trung vào việc tìm kiếm các kiến trúc mạng neural tích chap (Convolutional neural networks - CNNs) nhiéu muc tiéu. Khoa luận cũng trình bay các phương pháp cải thiện hiệu quả của quá trình tìm kiếm kiến trúc mang neural bang các phương pháp dự đoán hiệu năng. Chúng tôi kiểm tra hiệu quả của các phương pháp được đề xuất thông qua bộ benchmark NATS- Bench.

NATS-Bench có hơn 15,000 kiến trúc mạng neural tích chập, mỗi kiến trúc bao gồm các thông tin về hiệu năng, độ phức tạp, thời gian huấn luyện,. trên nhiều bộ dữ liệu chuẩn như CIFAR-10, CIFAR-100, ImageNet.5 Mục tiêu và doi tượng nghiên cứu Các mục tiêu tiêu của khóa luận gồm: © Tim hiểu và cài đặt thuật toán tiến hóa cho bài toán NAS đa mục tiêu. s Sử dụng các phương pháp dự đoán hiệu năng nhằm cải thiện hiệu quả tìm kiếm của bài toán NAS. ¢ Giảm chi phí tính toán cho bài toán NAS nhưng van đảm bảo đạt được hiệu năng tốt.

TONG QUAN 4 ¢ Thu được một biên xấp xỉ bao gồm các kiến trúc đánh đổi về mặt hiệu năng và độ phức tạp, giúp người dùng có thể chọn ra kiến trúc phù hợp với nhu cầu và thiết bị của mình. Đối tượng nghiên cứu: Bài toán Tìm kiếm mạng neural nhiều mục tiêu (Many- Objective Neural Architecture Search) 1.6 Phương pháp thực hiện Các phương pháp thực hiện nghiên cứu của chúng tôi bao gồm: s Sử dụng các phương pháp dự đoán hiệu năng của mạng neural tích chập mà không tốn kém quá nhiều chỉ phí về mặt tính toán như độ chính kiểm định (validation accuracy) tại epoch 12 và chỉ số dư đoán hiệu năng không qua huấn luyện Synaptic Flow (synf1ow). ¢ Thử nghiệm bài toán tìm kiếm kiến trúc mang neural với hai mục tiêu và nhiều hơn hai mục tiêu (cụ thể là năm mục tiêu), sau đó đổ về các không gian từ 1-2 mục tiêu để so sánh với hiệu năng của thuật toán khi chỉ tối tru hóa từ 1-2 mục tiêu. * Áp dụng các phương pháp trên bộ benchmark NATS-bench để kiểm tra hiệu quả và so sánh.

¢ Sử dụng chỉ số đánh giá hiệu năng IGD để kiểm tra hiệu quả của các phương pháp dưới góc độ bài toán tối ưu hóa đa mục tiêu.7 Cấu trúc khóa luận Khóa luận của chúng tôi bao gồm 6 phần chính như sau: * Chuong[I} Tổng quan. ° Chương [2} Các công trình liên quan và kiến thức nền tảng. * Chương |3} Mô hình hóa bài toán tìm kiếm kiến trúc mang neural đa mục tiêu. TONG QUAN * Chương} Phương pháp.

° Chuong 5} Thuc nghiém. « Chương|6} Kết luận. Chương 2 CÁC CÔNG TRÌNH LIÊN QUAN VÀ KIÊN THUC NÊN TANG 2.1 Các công trình liên quan Model-based / trainable Learning curve-based __Deep Nets _ BANANAS | Extrapolation Trees BOHAMIANN LGBoost || BONAS DNGO NGBoost GCN MLP RF Z Metrics XGBoost NAO SemiNAS arly Stop (Acc. GP's arly Stop (Loss) Bayes.

GP SoTL SoTL-E Sparse GP Var. Sparse GP OneShot Random Search WS HINH 2.1: Phân loại các phương pháp dự đoán hiệu nang hiện nay. Những vùng được đỏ chính là phạm vi nghiên cứu của khoá luận này, bao gồm: zero-cost proxies (synflow) va early stop- ping (độ chính xác kiểm định tai epoch thứ 12). CÁC CÔNG TRÌNH LIEN QUAN VÀ KIÊN THÚC NỀN TANG 7 © Sampled architectures Negative @ Selected architectures Synaptic Flow HINH 2.2: Minh hoa bước chon lọc trong quá trình khởi tao cho thuật toán tiến hóa do Phan và cộng sự dé xuất.

Trong ví dụ này, số lượng các kiến trúc được chọn va được lay mẫu lần lượt là 17 và 7. Nhiều phương pháp dự đoán hiệu năng kiến trúc mạng neural đã được đề xuất để sử dụng trong bài toán NAS trong những năm trở lại đây như ngoại suy đường cong huấn luyện (learning curve extrapolation) {11|2|23], chia sẻ trọng số (weight-sharing) Bị 86], học có giám sát (supervised learning) | 9] hay các chỉ số không huấn luyện (zero-cost proxies) (ij. Trong đó, các chỉ số không qua huấn luyện đã thể hiện được nhiều ưu điểm như không có thời gian khởi tạo và thời gian truy vấn để rút ra hiệu năng của kiến trúc cũng rất ngắn (vài giây). Những chỉ số này được tính thông qua việc truyền một batch dữ liệu duy nhất vào mạng hoặc thậm chí không cần dữ liệu nào.

Do bởi chỉ cần tính toán cho một kiến trúc cụ thể, thời gian khởi tao của các chỉ số không qua huấn luyện là không. Các chỉ số không qua huấn luyện gần đây cũng được sử trong quá trình khởi tạo các thuật toán NAS. Công trình của Phan và các cộng sự [37] bat dau với việc lây mẫu ngẫu nhiên một lượng lớn kiến trúc. Độ phức tap của các kiến trúc được đánh giá thông qua FLOPs và số lượng tham số, trong khi hiệu năng được ước Chương 2.

CÁC CÔNG TRÌNH LIEN QUAN VÀ KIÊN THUC NEN TANG — 8 Encoding Evaluator Multi-Obj GA BOA [1-01-001] tL ww Ệ = -L y h Wor : 9 og0 © - [0-00-111-0111-00000-0) ) HÌNH 2.3: Tổng quan các giai đoạn của NSGA-Net 30) lương bằng chỉ số Synaptic Flow (synflow). Tập các kiến trúc không bị thống tri về hiệu năng và độ phức tạp sẽ được trích xuất để làm quan thể khởi tạo cho thuật toán tiến hóa đa mục tiêu với hiệu năng được tính bằng độ chính xác thông qua quá trình huấn luyện (Xem hình |2. Chỉ số không qua huấn luyện synf1ow do đó chỉ được sử dụng trong giai đoạn khởi tạo (warm-up phase) và các kiến trúc ứng viên vẫn cần phải huấn luyện thật để thu về độ chính xác trong giai đoạn tìm kiếm. Việc này giúp nâng cao hiệu năng của thuật toán tiến hóa nhưng quá trình huần luyện thật vẫn đòi hỏi nhiều chi phí tính toán.

Chỉ số synf1ow cũng có thể được tận dụng để xây dựng thuật toán tìm kiếm địa phương đa mục tiêu không qua huấn luyện nhằm cải thiện hiệu năng của NSGA-II để giải quyết bài toán NAS đa mục tiêu như trong [38]. Tại mỗi thé hệ, một lượng các kiến trúc tiềm năng nhất định sẽ được cải thiện bởi quá trình tìm kiếm địa phương với synflow được sử dụng để kiểm tra việc cải thiện, do đó không đòi hỏi bất kỳ quá trình huấn luyện nào. Những kiến trúc ứng viên được khám phá trong quá trình tìm kiếm địa phương sau đó sẽ được huấn luyện thật và đánh giá bởi độ chính xác kiểm định (validation accuracy) trước khi được thêm vào trong quan thể của NSGA-II. Lu và các cộng sự đã giới thiệu cách tiếp cận NSGA-Net với các giai đoạn như trong Hinh|2.3} trong đó mô hình hóa bài toán NAS đa mục tiêu với hai mục t éu đối lập là độ lỗi phân loại (classfication error) và FLOPs.

Họ cũng sử dụng giải thuật di truyền sắp xếp không bị thống trị II (non-dominated sorting genetic algorithm II, hay NSGA-I) để giải quyết mô hình NAS đa mục tiêu này. Ngoài ra, Lu và các cộng sự [31] cũng đã dé xuất mô hình bài toán NAS nhiều mục tiêu (many-objective NAS, hay MaOENAS) với năm mục tiêu (xem hinh[2.4) là độ chính xác, số lượng tham số, số lượng toán tử nhân-cộng (Multipy-Add operations), độ trễ của CPU va GPU. Để cải thiện hiệu năng của NSGA-II nhằm Chương 2. CÁC CÔNG TRINH LIEN QUAN VÀ KIÊN THUC NEN TANG 9 Evolutionary Multi.

Objective Surrogate- Assisted NAS HINH 2.4: Tổng quan phương pháp NSGANetV2B1] giải quyết bài toán NAS nhiều mục tiêu, họ đã xây dựng một mô hình thay thế (surrogate model) để dự đoán độ chính xác của các kiến trúc ứng viên và công cụ dự đoán này sẽ được tinh chỉnh lại trong suốt quá trình tìm kiếm. Dau tiên, mô hình thay thế được khởi tạo bằng cách lấy mẫu lấy mẫu một lượng nhỏ các kiến trúc từ không gian tìm kiếm. Sau đó, họ sử dụng NSGA-II để tìm kiếm kiến trúc trúc bằng cách sử dụng công cụ dự đoán này để ước lượng độ chính xác như là một mục tiêu cùng với các mục tiêu khác vẻ độ phức tạp, hiệu quả phan cứng. Tuy nhiên, phương pháp này vẫn phải đi huấn luyện các kiến trúc được thuật toán NSGA-II tim ra và xem sau đó xem các kiến trúc này và độ chính xác sau khi huấn luyện của chúng là các mẫu huấn luyện để tinh chỉnh công cụ dự đoán.

Sự khác biệt chính giũa công trình của chúng tôi và những công trình được đề cập ở trên là chúng tôi sử dụng chỉ số synf1ow để đánh giá hiệu năng của toàn bộ kiến trúc được khám phá trong suốt quá trình tìm kiếm và không huấn luyện bat kỳ kiến trúc nào. Do và các cộng sự cũng đã dé xuất một phương pháp NAS đa mục tiêu bằng thuật toán tiền hóa với việc sử dụng các chỉ số không qua huấn luyện trong toàn bộ quá trình tìm kiếm. Họ sử dụng hai chỉ số là số lượng vùng tuyến tinh (linear region) Ry va số điều kiện của neural tangent kernel (NTK) Ky để đánh giá hiệu năng của các kiến trúc ứng viên. Tuy vậy, cả hai chỉ số Ry va Ky đều phụ thuộc vào dữ liệu, chúng được tính bằng cách truyền những mini-batch dir liệu được lay mẫu từ tap dữ liệu huấn luyện vào mạng.

Trong khi đó, synflow có thể được tính mà không đòi hỏi tập dữ liệu cụ thể nào (data-agnostic). Các phương pháp dự đoán hiệu năng được phân loại trong Hình .T| Trong khóa luận này, chúng tôi thực nghiệm và so sánh hai phương pháp dự đoán hiệu Chương 2. CÁC CÔNG TRÌNH LIEN QUAN VÀ KIÊN THUC NEN TANG 10 năng là độ chính xác kiểm định (validation accuracy) tại epoch thứ 12 (đòi hỏi quá trình huấn luyện) và chỉ số dự đoán hiệu năng synf1ow (không qua quá trình huấn luyện).

Nội dung được bảo vệ bản quyền — Tải xuống đầy đủ

Tìm Kiếm Kiến Trúc Mạng Neural Đa Mục Tiêu Bằng Thuật Toán Tiến Hóa Và Dự Đoán Hiệu Năng là một tài liệu chuyên sâu tập trung vào việc tối ưu hóa kiến trúc mạng neural thông qua thuật toán tiến hóa, nhằm đạt được hiệu suất đa mục tiêu. Nghiên cứu này không chỉ giúp cải thiện độ chính xác của mô hình mà còn tối ưu hóa thời gian tính toán và tài nguyên sử dụng. Đây là một hướng tiếp cận tiên tiến, phù hợp cho những ai đang tìm kiếm giải pháp để nâng cao hiệu quả của các hệ thống AI.

Nếu bạn quan tâm đến việc tối ưu hóa mạng neural, đặc biệt là trong lĩnh vực ước lượng siêu tham số, bạn có thể tham khảo thêm Luận văn thạc sĩ khoa học máy tính ước lượng siêu tham số cho mạng nơron học sâu sử dụng giải thuật harmony search. Tài liệu này cung cấp một góc nhìn khác về việc áp dụng các thuật toán tối ưu hóa để cải thiện hiệu suất mạng neural, giúp bạn mở rộng kiến thức và ứng dụng trong các dự án của mình.