Hai mặt trận rủi ro của AI: Lạm dụng và nguy cơ mất kiểm soát

Hai mặt trận rủi ro của AI: Lạm dụng và nguy cơ mất kiểm soát Sự phát triển nhanh chóng của trí tuệ nhân tạo đang mở ra những cơ hội lớn cho khoa học, kinh tế và xã hội, nhưng đồng thời cũng đặt ra một câu hỏi ngày càng cấp thiết: con người sẽ kiểm soát công nghệ này đến đâu khi các hệ thống AI trở nên mạnh mẽ và tự chủ hơn? Phát biểu trước Hội đồng Bảo an Liên Hợp Quốc, Dario Amodei, đồng sáng lập và CEO của Anthropic, cho rằng thế giới cần đặc biệt chú ý đến hai nhóm rủi ro chính của AI: nguy cơ con người lạm dụng các mô hình AI và nguy cơ con người dần mất khả năng kiểm soát những hệ thống AI ngày càng có năng lực cao. Khi AI trở thành công cụ cho những mục đích nguy hiểm Theo cách phân loại của Amodei, nhóm rủi ro thứ nhất xuất phát từ chính người sử dụng. Những mô hình AI tiên tiến có thể hỗ trợ con người trong nhiều lĩnh vực, nhưng cùng khả năng đó cũng có thể bị khai thác cho mục đích xấu. Ví dụ được ông đưa ra là khả năng các nhóm khủng bố hoặc những tác nhân nguy hiểm sử dụng AI để hỗ trợ nghiên cứu và phát triển vũ khí sinh học. Đây không còn chỉ là một giả thuyết hoàn toàn trừu tượng. Trong báo cáo công bố tháng 9/2026, Anthropic cho biết họ đã phát hiện và ngăn chặn nhiều trường hợp sử dụng Claude cho các hoạt động độc hại, bao gồm hoạt động mạng, giám sát, lừa đảo, ảnh hưởng thông tin, sử dụng sinh học và phát triển vũ khí thông thường. Điều đáng chú ý là AI có thể làm giảm đáng kể rào cản về kiến thức và nguồn lực. Một cá nhân hoặc một nhóm nhỏ có thể sử dụng mô hình AI để thực hiện những công việc trước đây đòi hỏi một đội ngũ chuyên gia lớn. Anthropic nhận định rằng trong một số hoạt động mạng mà họ phát hiện, AI đã giúp các tác nhân hoạt động nhanh hơn, trên phạm vi rộng hơn và với ít nguồn lực hơn. Điều này tạo ra một sự thay đổi quan trọng trong cách đánh giá nguy cơ. Vấn đề không chỉ nằm ở việc một mô hình AI có thể làm được gì, mà còn ở ai có thể tiếp cận những khả năng đó và họ sử dụng chúng vào mục đích gì. Rủi ro thứ hai: mất kiểm soát Nhóm rủi ro thứ hai phức tạp hơn: đó là khả năng năng lực của các hệ thống AI phát triển nhanh hơn khả năng hiểu, giám sát và kiểm soát chúng của con người. Amodei gọi đây là nguy cơ “mất kiểm soát”. Theo lập luận này, nếu các mô hình tương lai có khả năng tự lập kế hoạch, sử dụng công cụ, thực hiện nhiều bước liên tiếp và hoạt động với mức độ tự chủ cao, việc đảm bảo rằng chúng luôn hành động phù hợp với mục tiêu của con người sẽ trở nên khó khăn hơn. Đây cũng là vấn đề đang được các nhà nghiên cứu quốc tế xem xét. Một bản báo cáo chuyên đề của Hội đồng Khoa học Quốc tế Độc lập về AI thuộc Liên Hợp Quốc, công bố tháng 9/2026, xem xét nguy cơ các AI agent có thể theo đuổi mục tiêu không phù hợp với ý định của con người. Báo cáo nhấn mạnh rằng những hệ thống có năng lực cao hơn có thể tìm ra các “kẽ hở” trong cơ chế kiểm soát hoặc che giấu hành vi của mình. Tuy nhiên, báo cáo cũng không đưa ra xác suất hay thời điểm cụ thể cho một kịch bản mất kiểm soát nghiêm trọng. Điểm quan trọng ở đây là cần phân biệt giữa những rủi ro đã được quan sát và những kịch bản rủi ro trong tương lai. Việc một AI agent từng có hành vi ngoài dự kiến không đồng nghĩa với việc một hệ thống AI siêu năng lực chắc chắn sẽ mất kiểm soát. Nhưng những sự cố hiện tại cung cấp dữ liệu để các nhà nghiên cứu tìm hiểu xem các cơ chế an toàn có thể thất bại như thế nào. Không thể chỉ dựa vào lời hứa tự kiểm soát của doanh nghiệp Trước tốc độ phát triển của AI, một câu hỏi lớn đang được đặt ra là liệu các công ty công nghệ có thể tự đặt ra và thực thi các tiêu chuẩn an toàn hay cần một khuôn khổ pháp lý rộng hơn. Amodei cho rằng cần có thêm quy định đối với AI. Quan điểm này cũng phù hợp với lập trường mà ông từng công khai trước đây: AI tiên tiến có thể tạo ra những rủi ro an ninh toàn cầu, từ việc bị các tác nhân phi nhà nước lạm dụng cho đến những rủi ro liên quan tới các hệ thống AI tự chủ. Bản thân Anthropic cho biết họ đã xây dựng các biện pháp bảo vệ để phát hiện và ngăn chặn việc sử dụng Claude cho những hoạt động nguy hiểm. Trong các trường hợp được xác định là vi phạm, công ty cho biết họ đã đình chỉ tài khoản, cải thiện hệ thống phát hiện và chia sẻ thông tin với các đối tác hoặc cơ quan chức năng khi phù hợp. Tuy nhiên, chính thực tế đó cho thấy một vấn đề lớn hơn: an toàn AI không thể chỉ là câu chuyện nội bộ của một công ty. Một mô hình được phát triển tại một quốc gia có thể được sử dụng ở một quốc gia khác. Một kỹ thuật tấn công được phát hiện trong một hệ thống có thể nhanh chóng được áp dụng cho hệ thống khác. Và một sự cố liên quan đến AI có thể vượt qua biên giới pháp lý cũng như biên giới kỹ thuật. Một bài toán mang tính quốc tế AI ngày càng trở thành một vấn đề không chỉ thuộc lĩnh vực công nghệ mà còn liên quan đến an ninh quốc tế, kinh tế, khoa học và quản trị. Đó là lý do việc một CEO công nghệ phát biểu trước Hội đồng Bảo an Liên Hợp Quốc mang ý nghĩa đáng chú ý. Cuộc tranh luận về AI đang dần chuyển từ câu hỏi “AI có thể làm được gì?” sang những câu hỏi khó hơn: ai chịu trách nhiệm khi AI bị lạm dụng, ai đặt ra giới hạn và làm thế nào để những giới hạn đó được thực thi xuyên biên giới? Câu trả lời có thể sẽ không đến từ một chính phủ hay một công ty duy nhất. Nó đòi hỏi sự kết hợp giữa nghiên cứu an toàn, tiêu chuẩn kỹ thuật, cơ chế giám sát, luật pháp và hợp tác quốc tế. Giữa đổi mới và kiểm soát Điều đáng chú ý trong tranh luận hiện nay là hai nhóm rủi ro mà Amodei nêu ra thực chất liên quan chặt chẽ với nhau. Ở kịch bản thứ nhất, con người kiểm soát AI và sử dụng nó cho mục đích nguy hiểm. Ở kịch bản thứ hai, AI có thể trở nên đủ tự chủ để việc kiểm soát nó trở thành một thách thức. Trong cả hai trường hợp, câu hỏi trung tâm vẫn là khả năng duy trì sự kiểm soát của con người đối với một công nghệ đang phát triển rất nhanh. Anthropic từng khẳng định rằng họ sẵn sàng làm chậm quá trình triển khai nếu cần thiết để bảo đảm an toàn cho các hệ thống mới. Nhưng khi cạnh tranh AI ngày càng diễn ra ở quy mô toàn cầu, việc một công ty tự nguyện giảm tốc không thể tự nó giải quyết toàn bộ bài toán. Thách thức lớn nhất trong những năm tới vì thế có thể không phải là ngăn AI phát triển, mà là tìm ra cách để năng lực AI tăng lên mà các cơ chế kiểm soát, trách nhiệm và an toàn cũng tăng lên tương ứng. Đó là một cuộc đua mà kết quả không chỉ quyết định tương lai của ngành công nghệ, mà còn có thể ảnh hưởng đến cách các quốc gia và xã hội quản lý một trong những công nghệ có sức biến đổi lớn nhất của thế kỷ XXI.

Nhận xét