Tất cả những điều bạn cần biết về AI có thể giải thích (XAI)
Khám phá cách AI có thể giải thích (XAI) xây dựng niềm tin bằng cách giúp các dự đoán AI trở nên minh bạch và đáng tin cậy trong các lĩnh vực y tế, bảo mật, lái xe tự động, và hơn thế nữa.

Bạn đã bao giờ nhìn thấy phản hồi từ một công cụ artificial intelligence (AI) như ChatGPT và tự hỏi nó đưa ra kết luận đó bằng cách nào chưa? Khi đó, bạn đã gặp phải vấn đề "hộp đen" của AI. Đây là thuật ngữ chỉ sự thiếu minh bạch về cách các mô hình AI xử lý và phân tích dữ liệu. Ngay cả các kỹ sư và nhà khoa học AI làm việc với các thuật toán AI tiên tiến hàng ngày đôi khi cũng thấy khó khăn trong việc hiểu rõ hoàn hảo cơ chế hoạt động bên trong của chúng. Trên thực tế, only 22% of IT professionals thực sự hiểu rõ các khả năng của công cụ AI.
Sự không chắc chắn xoay quanh cách các mô hình AI đưa ra quyết định có thể tiềm ẩn rủi ro, đặc biệt là trong các lĩnh vực quan trọng như computer vision in healthcare và AI in finance. Tuy nhiên, những tiến bộ đáng kể đang được thực hiện để giải quyết các thách thức này và nâng cao tính minh bạch.
Cụ thể, explainable AI (XAI) tập trung hoàn toàn vào việc giải quyết vấn đề này. Nói một cách đơn giản, đây là tập hợp các quy trình và phương pháp giúp người dùng là con người hiểu và tin tưởng vào các kết quả hoặc đầu ra do các thuật toán machine learning phức tạp tạo ra.
XAI có thể giúp các nhà phát triển đảm bảo rằng các hệ thống AI hoạt động đúng như mong đợi. Nó cũng có thể giúp các công ty AI đáp ứng các tiêu chuẩn regulatory. Trong bài viết này, chúng ta sẽ khám phá AI giải thích được và các trường hợp sử dụng đa dạng của nó. Hãy cùng bắt đầu nhé!
Tầm quan trọng của trí tuệ nhân tạo có thể giải thích#
Khả năng giải thích là yếu tố then chốt khi làm việc với AI. Điều này đặc biệt đúng đối với lĩnh vực con của AI là computer vision, vốn được sử dụng rộng rãi trong các ứng dụng thuộc các ngành công nghiệp như y tế. Khi sử dụng vision models trong các ngành nhạy cảm như vậy, điều quan trọng là hoạt động của mô hình phải minh bạch và có thể giải thích được đối với tất cả mọi người.
Khả năng diễn giải trong các mô hình computer vision giúp người dùng hiểu rõ hơn về cách thức một prediction được tạo ra và logic đằng sau nó. Tính minh bạch bổ sung cho điều này bằng cách làm cho hoạt động của mô hình trở nên rõ ràng đối với mọi người thông qua việc phác thảo rõ ràng các giới hạn của mô hình và đảm bảo dữ liệu được sử dụng có đạo đức. Chẳng hạn, computer vision có thể giúp các radiologists xác định hiệu quả các biến chứng sức khỏe trong hình ảnh X-quang.

Fig 1. Ảnh chụp X-quang ngực được phân tích bằng AI thị giác hiển thị các phân loại lao lành tính, mắc bệnh, hoạt động và tiềm ẩn.
Tuy nhiên, một hệ thống thị giác chỉ đạt độ chính xác cao là chưa đủ. Hệ thống đó cũng cần phải có khả năng giải thích các quyết định của mình. Giả sử hệ thống có thể chỉ ra phần nào của hình ảnh đã dẫn đến kết luận của nó - khi đó, mọi kết quả đầu ra sẽ trở nên rõ ràng hơn. Mức độ minh bạch như vậy sẽ giúp các chuyên gia y tế kiểm tra chéo các phát hiện của họ và đảm bảo rằng patient care đáp ứng các tiêu chuẩn y tế.
Một lý do khác khiến khả năng giải thích trở nên thiết yếu là nó tạo ra trách nhiệm giải trình cho các công ty AI và xây dựng niềm tin ở người dùng. AI đáng tin cậy mang lại cho người dùng sự tự tin rằng các đổi mới AI hoạt động đáng tin cậy, đưa ra các quyết định công bằng và handle data responsibly.
Các kỹ thuật XAI quan trọng trong thị giác máy tính#
Bây giờ chúng ta đã thảo luận tại sao khả năng giải thích lại quan trọng trong thị giác máy tính, hãy cùng xem xét các kỹ thuật XAI then chốt được sử dụng trong thị giác AI.
Saliency maps#
Neural networks là các mô hình lấy cảm hứng từ bộ não con người, được thiết kế để nhận dạng các mẫu và đưa ra quyết định bằng cách xử lý dữ liệu qua các lớp nút (nơ-ron) được kết nối với nhau. Chúng có thể được sử dụng để giải quyết các bài toán computer vision phức tạp với độ chính xác cao. Ngay cả với độ chính xác này, chúng vẫn là các hộp đen theo thiết kế.
Saliency maps là một kỹ thuật XAI có thể được sử dụng để giúp hiểu rõ những gì mạng thần kinh đang thấy khi chúng phân tích hình ảnh. Nó cũng có thể được sử dụng để xử lý sự cố cho các model trong trường hợp chúng không hoạt động như mong đợi.
Saliency map hoạt động bằng cách tập trung vào các phần nào của hình ảnh (các pixel) xác định các dự đoán của mô hình. Quá trình này rất giống với backpropagation, trong đó mô hình truy ngược từ các dự đoán về phía đầu vào. Nhưng thay vì cập nhật trọng số của mô hình dựa trên các lỗi, chúng ta chỉ đang xem xét mức độ "quan trọng" của mỗi pixel đối với dự đoán. Saliency map rất hữu ích cho các computer vision tasks như phân loại hình ảnh.
Ví dụ: nếu một mô hình image classification dự đoán rằng một hình ảnh là chó, chúng ta có thể xem saliency map của nó để hiểu tại sao mô hình nghĩ đó là con chó. Điều này giúp chúng ta xác định pixel nào ảnh hưởng đến đầu ra nhiều nhất. Saliency map sẽ làm nổi bật tất cả các pixel đã đóng góp vào dự đoán cuối cùng rằng hình ảnh đó là con chó.

Fig 2. Góc nhìn song song giữa hình ảnh đầu vào và saliency map của chúng.
Class Activation Mapping (CAM)#
Class Activation Mapping là một kỹ thuật XAI khác được sử dụng để hiểu những phần nào của hình ảnh mà mạng nơ-ron tập trung vào khi thực hiện các dự đoán phân loại hình ảnh. Nó hoạt động tương tự như saliency map nhưng tập trung vào việc xác định các đặc trưng quan trọng trong hình ảnh thay vì các pixel cụ thể. Features là các mẫu hoặc chi tiết, chẳng hạn như hình dạng hoặc kết cấu, mà mô hình phát hiện được trong hình ảnh.
Các phương pháp như Gradient Weighted Class Activation Mapping (Grad-CAM) và Grad-CAM++ xây dựng dựa trên cùng một ý tưởng, với một số cải tiến.
Dưới đây là cách CAM hoạt động:
- Trước khi mạng thần kinh đưa ra quyết định cuối cùng, nó sử dụng một bước gọi là gộp trung bình toàn cục (GAP) để đơn giản hóa thông tin. GAP kết hợp tất cả các pixel trong một mẫu được phát hiện thành một giá trị trung bình duy nhất, tạo ra một bản tóm tắt cho mỗi bản đồ đặc trưng (biểu diễn trực quan của các mẫu được phát hiện).
- Mỗi bản đồ đặc trưng sau đó được gán một trọng số cho thấy mức độ quan trọng của nó đối với việc dự đoán một lớp nhất định (như "chim" hoặc "mèo").
- Tuy nhiên, một hạn chế của CAM là bạn có thể cần phải retrain the model để tính toán các trọng số này, việc này có thể tốn nhiều thời gian.
Grad-CAM cải thiện điểm này bằng cách sử dụng các gradients, đóng vai trò như các tín hiệu cho biết mỗi bản đồ đặc trưng ảnh hưởng đến dự đoán cuối cùng ở mức độ nào. Phương pháp này tránh được nhu cầu sử dụng GAP và giúp việc quan sát những gì mô hình tập trung vào trở nên dễ dàng hơn mà không cần huấn luyện lại. Grad-CAM++ tiến thêm một bước nữa bằng cách chỉ tập trung vào các ảnh hưởng tích cực, giúp kết quả trở nên rõ ràng hơn nữa.

Fig 3. So sánh CAM, Grad-CAM và Grad-CAM++.
Giải thích phản thực (Counterfactual explanations)#
Giải thích phản thực là một yếu tố quan trọng của trí tuệ nhân tạo có thể giải thích. Giải thích phản thực liên quan đến việc mô tả một tình huống hoặc kết quả bằng cách xem xét các kịch bản thay thế hoặc các sự kiện không xảy ra nhưng có thể đã xảy ra. Nó có thể chứng minh các thay đổi trong các biến đầu vào cụ thể dẫn đến các kết quả khác nhau như thế nào, ví dụ như: "Nếu X không xảy ra, thì Y đã không xuất hiện."
Khi nói đến AI và computer vision, một lời giải thích phản thực tế (counterfactual explanation) xác định sự thay đổi nhỏ nhất cần thiết trong dữ liệu đầu vào (chẳng hạn như an image or data) để khiến mô hình AI tạo ra một kết quả cụ thể khác. Ví dụ: việc thay đổi màu sắc của một đối tượng trong hình ảnh có thể thay đổi image classification model’s prediction từ "mèo" thành "chó."
Một ví dụ hay khác là thay đổi góc độ hoặc ánh sáng trong một facial recognition system. Điều này có thể khiến mô hình nhận diện ra một cá nhân khác, qua đó cho thấy những thay đổi nhỏ trong đầu vào có thể ảnh hưởng đến các dự đoán của mô hình như thế nào.
Cách đơn giản nhất để tạo ra các giải thích này là thử và sai: bạn có thể thay đổi ngẫu nhiên các phần của đầu vào (như các đặc trưng của hình ảnh hoặc dữ liệu) cho đến khi mô hình AI đưa ra kết quả mong muốn. Các phương pháp khác bao gồm các cách tiếp cận bất khả tri về mô hình, sử dụng các kỹ thuật optimization và tìm kiếm để tìm ra các thay đổi, và các cách tiếp cận phụ thuộc vào mô hình, dựa vào các thiết lập hoặc phép tính bên trong để xác định các thay đổi cần thiết.
Các ứng dụng của trí tuệ nhân tạo có thể giải thích trong thị giác máy tính#
Bây giờ chúng ta đã khám phá XAI là gì và các kỹ thuật then chốt của nó, chúng ta có thể đi sâu vào cách nó được sử dụng trong thực tế. XAI có nhiều ứng dụng đa dạng trên nhiều lĩnh vực. Hãy đi sâu vào một số trường hợp sử dụng làm nổi bật tiềm năng của nó:
- Security systems: XAI có thể được sử dụng để nâng cao hệ thống bảo mật bằng cách phát hiện các hình ảnh bị biến đổi (morphed) trong các tài liệu định danh như hộ chiếu và giấy phép lái xe. Điều này đảm bảo tính xác thực của hình ảnh, củng cố các quy trình xác minh danh tính và ngăn chặn các hoạt động gian lận trong các ứng dụng nhạy cảm.

Fig 4. Cách XAI hoạt động để phát hiện các hình ảnh bị biến đổi.
-
Autonomous driving: Hiểu rõ các khả năng và giới hạn của hệ thống AI thị giác tích hợp trên xe tự hành có thể là một phần quan trọng trong việc kiểm thử xe trước khi nó được đưa vào vận hành trên các con đường thực tế. XAI có thể giúp các hãng xe xác định và giải quyết các vấn đề một cách rõ ràng hơn.
-
Legal systems: Các hệ thống document analysis hỗ trợ thị giác đang được sử dụng ngày càng nhiều trong việc ra quyết định tư pháp. XAI hỗ trợ các kết quả công bằng và cho phép xem xét kỹ lưỡng các phán quyết tự động. Nó cũng giúp các chuyên gia pháp lý hiểu cách một mô hình AI đưa ra các quyết định của mình.
-
Wildlife monitoring: Các bẫy ảnh (camera trap) thường được sử dụng để giám sát động vật hoang dã và thu thập dữ liệu về các loài động vật. XAI có thể được sử dụng để giải thích cách AI phân loại các loài này trong hình ảnh. Bằng cách đó, các nỗ lực bảo tồn có thể trở nên đáng tin cậy và chính xác hơn.
Các điểm chính về trí tuệ nhân tạo có thể giải thích#
Trí tuệ nhân tạo có thể giải thích giúp việc hiểu cách các hệ thống AI hoạt động và lý do tại sao chúng đưa ra các quyết định nhất định trở nên dễ dàng hơn. Tính minh bạch về các model AI xây dựng lòng tin và trách nhiệm giải trình. Tri thức là sức mạnh và giúp các đổi mới AI được sử dụng một cách có trách nhiệm hơn. Trong các lĩnh vực quan trọng như y tế, an ninh, lái xe tự động và hệ thống pháp luật, XAI có thể được sử dụng để giúp các nhà phát triển và người dùng hiểu các dự đoán của AI, xác định sai sót, và đảm bảo việc sử dụng công bằng và có đạo đức. Bằng cách làm cho AI trở nên minh bạch hơn, XAI thu hẹp khoảng cách giữa công nghệ và lòng tin của con người, khiến nó trở nên an toàn và đáng tin cậy hơn cho các ứng dụng trong thế giới thực.
Để tìm hiểu thêm, hãy truy cập GitHub repository của chúng tôi và tương tác với community của chúng tôi. Khám phá các AI applications in self-driving cars và agriculture trên các trang giải pháp của chúng tôi. 🚀






