Lớp thần kinh
Một lớp thần kinh là khối xây dựng cơ bản trong Mạng Nơ-ron Nhân tạo (ANN). Nó là một tập hợp các nút (nơ-ron) được kết nối với nhau, nhận đầu vào từ lớp trước, thực hiện một phép biến đổi toán học cụ thể và truyền đầu ra kết quả đến lớp tiếp theo. Các lớp này được xếp chồng lên nhau theo trình tự để tạo thành các mô hình học sâu.
Độ sâu và độ phức tạp của các lớp quyết định khả năng học các mẫu phức tạp từ các tập dữ liệu khổng lồ của mô hình. Mỗi lớp chuyên biệt trong việc trích xuất các đặc trưng ngày càng trừu tượng từ dữ liệu đầu vào thô. Ví dụ, trong nhận dạng hình ảnh, các lớp ban đầu có thể phát hiện các cạnh, trong khi các lớp sâu hơn kết hợp các cạnh này thành các bộ phận đối tượng phức tạp.
Về cơ bản, một lớp thực hiện phép tính tổng có trọng số của các đầu vào, cộng thêm một số hạng thiên vị (bias), và sau đó truyền tổng này qua một hàm kích hoạt. Các trọng số và thiên vị là các tham số mà mô hình học được trong quá trình huấn luyện. Hàm kích hoạt (ví dụ: ReLU, Sigmoid) đưa vào tính phi tuyến, điều này rất quan trọng vì nếu không có nó, toàn bộ mạng sẽ chỉ là một phép biến đổi tuyến tính duy nhất, làm hạn chế nghiêm trọng sức mạnh của nó.
Các lớp thần kinh là lõi hoạt động của hầu hết các ứng dụng AI hiện đại. Chúng được sử dụng rộng rãi trong:
Kiến trúc phân lớp cho phép học đặc trưng theo cấp bậc. Điều này có nghĩa là mô hình không chỉ học các mối tương quan; nó xây dựng một sự hiểu biết có cấu trúc, đa cấp độ về dữ liệu, dẫn đến độ chính xác và khả năng tổng quát hóa cao hơn so với các mô hình đơn giản hơn.
Việc huấn luyện các mạng sâu đặt ra những thách thức như vấn đề gradient biến mất, nơi các gradient trở nên quá nhỏ để cập nhật trọng số một cách hiệu quả ở các lớp đầu. Chi phí tính toán và sự cần thiết của các tập dữ liệu lớn, được gán nhãn cũng là những rào cản đáng kể.
Các khái niệm chính liên quan chặt chẽ đến các lớp thần kinh bao gồm Hàm kích hoạt (đưa vào tính phi tuyến), Trọng số và Thiên vị (các tham số được học bởi lớp), và Độ sâu mạng (tổng số lớp trong chồng).