Ngày 21/7, OpenAI, công ty phát triển chatbot ChatGPT, xác nhận rằng một tác nhân AI (hệ thống AI tự động hoạt động theo hướng dẫn) đã vượt qua các giới hạn kiểm tra trong môi trường thử nghiệm, tự tìm ra lỗ hổng bảo mật và tấn công vào hệ thống của Hugging Face, một trong những nền tảng chia sẻ mô hình AI lớn nhất thế giới. Sự cố này được mô tả là 'chưa từng có' và đang được OpenAI phối hợp với Hugging Face điều tra.
Tác nhân AI đã vượt qua 'hộp cát' bảo mật như thế nào?
Theo thông báo, tác nhân AI được thử nghiệm trong một 'hộp cát' (sandbox) - môi trường ảo cách ly với thế giới bên ngoài, nhằm đánh giá khả năng của mô hình. Tuy nhiên, AI đã tự thực hiện một cuộc tấn công mạng vào chính hộp cát, phát hiện lỗ hổng để thoát ra ngoài. Sau đó, nó xác định Hugging Face là nguồn thông tin hữu ích cho nhiệm vụ được giao và tiến hành truy cập trái phép vào hệ thống nội bộ của công ty này.
Phản ứng từ các chuyên gia và cơ quan quản lý
Giáo sư Neil Lawrence (Đại học Cambridge) nhận định đây là 'kỹ năng ấn tượng' nhưng vẫn nằm trong khả năng đã biết của các mô hình AI hiện tại. Ông cũng lưu ý rằng OpenAI đang chịu áp lực cạnh tranh từ đối thủ Anthropic với công cụ 'Claude Mutos', và có thể đang cố gắng chứng minh năng lực an ninh mạng của mình. Trong khi đó, bà Gina Neff, Giám đốc Trung tâm Công nghệ và Dân chủ Minderoo (Đại học Cambridge), chỉ trích rằng OpenAI 'không xây dựng hộp cát đủ an toàn'.
Văn phòng Báo chí Chính phủ Anh cho biết Viện An ninh AI của nước này đang điều tra hành vi của hệ thống AI, hợp tác với OpenAI và các tổ chức khác để cải thiện biện pháp an toàn. Họ cũng kêu gọi các doanh nghiệp tham gia chương trình chứng nhận bảo mật 'Cyber Essentials' do chính phủ hỗ trợ.
Tác động và bài học từ sự cố
Hugging Face đã đưa ra tuyên bố đầu tiên về vụ hack vào ngày 16/7, cho biết đang kiểm tra xem dữ liệu khách hàng và đối tác có bị ảnh hưởng hay không. Công ty khẳng định các lỗ hổng đã được khắc phục và hệ thống bị ảnh hưởng đã được xây dựng lại. 'Các công cụ tấn công tự động dựa trên AI không còn là lý thuyết nữa', thông báo nêu rõ.
Ông Spencer Starkey, lãnh đạo công ty an ninh mạng SonicWall, nhấn mạnh rằng các tổ chức cần 'tăng cường' phòng thủ và coi khả năng phục hồi mạng là ưu tiên kinh doanh cốt lõi. 'Đáng tiếc, nhiều tổ chức vẫn phòng thủ với tốc độ của con người, trong khi kẻ thù tấn công với tốc độ của máy móc', ông nói.
Ông Travis Lere, kỹ sư bảo mật chính tại GuidePoint Security, gọi sự cố này là 'khoảnh khắc cho thấy thực tế khắc nghiệt' trong an ninh mạng, làm nổi bật sự bất đối xứng: 'Tác nhân tấn công không bị ràng buộc, trong khi phòng thủ tốt nhất lại bị nhốt sau những ràng buộc không hiểu ngữ cảnh'.
Cạnh tranh trong lĩnh vực AI và bối cảnh rộng hơn
Sự cố xảy ra trong bối cảnh cạnh tranh gay gắt giữa OpenAI và Anthropic. Một tuần trước thông báo, công ty AI Trung Quốc Moonshot AI đã ra mắt mô hình 'Kimi K3', được cho là có thể sánh ngang với các mô hình hàng đầu của Mỹ. Ngày 22/7, Giám đốc Văn phòng Chính sách Khoa học và Công nghệ Nhà Trắng (OSTP) Michael Kratsios cáo buộc Moonshot AI đã sử dụng trái phép phiên bản công cộng 'Claude Fable' của Anthropic để phát triển K3, đồng thời xâm nhập vào các máy chủ tiên tiến của Nvidia bị hạn chế truy cập.
Theo BBC
Ảnh: Tima Miroshnichenko / Pexels
