
“Chúng ta đang bước sang một chương, một giai đoạn khác của AI”, Chris Lehane, Giám đốc phụ trách các vấn đề toàn cầu của OpenAI, nói với Guardian khi cảnh báo về nguy cơ các hệ thống AI tiến hành những cuộc tấn công mạng “liên tục, dai dẳng”.
Theo ông, khi các mô hình AI tiên tiến ngày càng có khả năng lập kế hoạch và thực hiện nhiệm vụ phức tạp, con người cần chuẩn bị cho một môi trường an ninh mạng khác trước.
Cảnh báo được đưa ra sau khi một số tác nhân AI đang trong quá trình huấn luyện của OpenAI bất ngờ thoát khỏi môi trường sandbox vốn được thiết kế để cô lập chúng, truy cập Internet và xâm nhập hệ thống của Hugging Face vào cuối tháng 7.
OpenAI cũng cho biết chưa thể loại trừ khả năng mô hình mới Astra sở hữu “năng lực an ninh mạng ở mức nghiêm trọng”. Theo định nghĩa của công ty, mức năng lực này có thể cho phép AI thực hiện các cuộc tấn công gây hậu quả thảm khốc, như xâm nhập hệ thống quân sự, công nghiệp hoặc hạ tầng của chính OpenAI.
Trước những rủi ro trên, OpenAI đã tạm dừng huấn luyện một số mô hình AI tiên tiến để triển khai các biện pháp bảo vệ mới. Mia Glaese, người phụ trách an toàn, cho biết công ty “còn rất xa” mới có thể trở lại trạng thái hoạt động bình thường. CEO Sam Altman khẳng định bảo đảm an toàn cho AI quan trọng hơn tốc độ phát triển của bất kỳ công ty nào.
Gần một nửa cảnh báo tấn công tại Việt Nam có yếu tố AI

Nguy cơ AI hỗ trợ tấn công mạng không chỉ được ghi nhận tại các phòng thí nghiệm AI. Tại Việt Nam, công nghệ này cũng đang được sử dụng để tự động hóa nhiều công đoạn trong các chiến dịch tấn công.
“Trong 6 tháng đầu năm 2026, VNCERT phát hiện khoảng hai triệu cảnh báo tấn công mạng, trong đó gần 50% các vụ có gắn với AI”, Thượng tá Nguyễn Đình Đỗ Thi, Phó trưởng phòng 1, Cục An ninh mạng và phòng, chống tội phạm sử dụng công nghệ cao (A05), Bộ Công an, cho biết.
Theo ông Thi, AI có thể tự động hóa quá trình dò quét, lây nhiễm mã độc và xâm nhập hệ thống, giúp cuộc tấn công diễn ra nhanh hơn, đồng thời gây khó khăn cho công tác điều tra, xử lý.
Xu hướng này cũng được phản ánh qua các báo cáo an ninh mạng quốc tế. Kaspersky ghi nhận sự gia tăng mạnh các chiến dịch phát tán mã độc núp bóng công cụ AI. Năm 2026, hãng phát hiện hơn 92.000 cuộc tấn công trên toàn cầu giả mạo các dịch vụ AI phổ biến như ChatGPT (49%), Claude (18%) và Gemini (18%).
Bên cạnh đó, Kaspersky phát hiện hơn 15.000 mẫu mã độc ngụy trang dưới dạng phần mềm AI Agent, bao gồm trojan, phần mềm gián điệp, mã khai thác, mã tải mã độc, mã cài đặt mã độc và cửa hậu.
AI vì vậy đang tạo ra một vòng nguy cơ mới. Công nghệ có thể được sử dụng để tăng tốc quá trình dò tìm mục tiêu, phát hiện lỗ hổng và triển khai mã độc, nhưng đồng thời chính những công cụ AI phổ biến cũng bị lợi dụng làm vỏ bọc để đưa mã độc đến người dùng.
Lehane cho rằng một trong những vấn đề đáng lo là các mô hình AI nguồn mở, trong đó nhiều mô hình được phát triển tại Trung Quốc, đang ngày càng thu hẹp khoảng cách với các mô hình đóng tiên tiến.
“Người dùng sẽ có thể tiếp cận những mô hình nguồn mở và thực hiện các cuộc tấn công liên tục. Bạn sẽ cần những mô hình thực sự vượt trội để chống lại và tự bảo vệ mình”, ông nói.
Đây cũng là nhận định của ông Sojun Ryu từ Kaspersky. Ông đánh giá “các vụ tấn công chuỗi cung ứng phần mềm nhắm vào các thành phần mã nguồn mở vẫn là một trong những mối đe dọa nghiêm trọng nhất hiện nay”.
Nguy cơ AI được sử dụng để tấn công mạng đang thúc đẩy các chính phủ và doanh nghiệp xem xét lại cách kiểm soát những hệ thống có mức độ tự chủ cao.
Trung tâm An ninh mạng Quốc gia Anh gần đây cảnh báo các tác nhân AI có thể vượt qua một số cơ chế kiểm soát an toàn và khuyến nghị tổ chức hạn chế quyền tự chủ của chúng. Theo cơ quan này, con người phải luôn có khả năng “rút phích cắm” để dừng ngay hoạt động của tác nhân AI.
Lehane cũng kêu gọi Mỹ xây dựng các tiêu chuẩn an toàn bắt buộc đối với những mô hình AI tiên tiến, theo đó hệ thống chỉ được phát hành hoặc triển khai sau khi chứng minh mức độ an toàn cần thiết.
