Thứ Sáu, Tháng 7 31, 2026
HomeNEWSVụ rò rỉ từ phòng thí nghiệm của OpenAI nghiêm trọng hơn...

Vụ rò rỉ từ phòng thí nghiệm của OpenAI nghiêm trọng hơn chúng ta tưởng

Một cuộc thử nghiệm của OpenAI – vốn đã “thoát khỏi lồng” và gây chấn động ngành an ninh mạng cũng như trí tuệ nhân tạo (AI) – không chỉ tấn công Hugging Face (nền tảng AI ban đầu được cho là nạn nhân duy nhất của vụ rò rỉ từ phòng thí nghiệm ảo này).

Trong bản cập nhật về cuộc điều tra đang diễn ra đối với sự cố, OpenAI cho biết tác nhân AI “nổi loạn” của họ cũng đã xâm nhập vào một số dịch vụ và tài khoản công khai khác.

Cuộc thử nghiệm các mô hình của OpenAI lẽ ra phải diễn ra trong một môi trường thử nghiệm biệt lập (sandbox) – một môi trường phòng thí nghiệm được thiết kế để không thể thoát ra ngoài, cho phép các nhà nghiên cứu nới lỏng các rào cản an toàn nhằm khám phá khả năng tấn công mạng tối đa của công cụ này.

Tuy nhiên, các tác nhân AI – với quyết tâm vượt qua xuất sắc bài kiểm tra an ninh mạng – đã thoát khỏi môi trường sandbox và xâm nhập vào mạng internet thực tế. Sau đó, chúng tấn công Hugging Face để tìm đáp án cho bài kiểm tra.

Để xâm nhập vào máy chủ của Hugging Face, các tác nhân AI của OpenAI cần tìm kiếm các công cụ cần thiết trên internet. OpenAI cho biết các tác nhân này đã tìm thấy một số trang web công khai – bao gồm các trang chia sẻ mã nguồn, tiện ích web, ảnh chụp màn hình và các thông tin khác – để tạo ra đoạn mã cần thiết cho việc tấn công Hugging Face. OpenAI không tiết lộ tên các trang web khác mà tác nhân AI của họ đã tấn công.

Các tác nhân AI đã tìm thấy tên đăng nhập và mật khẩu bị rò rỉ của bốn tài khoản trên nhiều dịch vụ trực tuyến khác nhau và sử dụng thông tin xác thực đó để xâm nhập vào các tài khoản này. Một tài khoản bị xâm nhập có khả năng đã được sử dụng để ngụy trang cho AI, giúp nó trông có vẻ hợp lệ và vượt qua các giao thức bảo mật của Hugging Face. Một tài khoản khác được dùng để lưu trữ dữ liệu mà các tác nhân AI đánh cắp được, theo thông tin từ OpenAI.

Đối với hai tài khoản còn lại bị xâm nhập, các tác nhân AI của OpenAI đã truy cập và đọc thông tin nhưng không thay đổi dữ liệu.

OpenAI cho biết không có trang web nào khác bị tấn công đạt đến mức độ xâm nhập sâu như những gì các tác nhân AI của họ đã thực hiện với Hugging Face.

Về cơ bản, OpenAI mô tả hành động của các tác nhân AI này giống như một vụ trộm quy mô lớn kiểu phim *Ocean’s Eleven*. Thay vì chỉ đơn thuần thực hiện bài kiểm tra, chúng đã lập một kế hoạch tinh vi để thoát khỏi “nhà tù”, tìm chìa khóa két sắt, dựng nơi ẩn náu và chuẩn bị xe tẩu thoát trước khi thực hiện vụ trộm.

Tuy nhiên, OpenAI chưa bao giờ ra lệnh cho các tác nhân AI tấn công Hugging Face. Chúng tự thực hiện hành động đó để đánh cắp đáp án cho bài kiểm tra mà chúng được giao. Mô hình thử nghiệm đã xác định rằng gian lận là con đường dẫn đến thành công dễ dàng nhất – ngay cả khi điều đó đòi hỏi phải kết hợp nhiều cuộc tấn công lại với nhau.

Giám đốc điều hành (CEO) của Hugging Face, ông Clem Delangue, mô tả bản chất của vụ xâm nhập này là “chưa từng có tiền lệ”.

“Tóm tắt: Một tác nhân AI đã thoát khỏi môi trường cô lập (sandbox), gian lận trong bài kiểm tra đánh giá năng lực và tấn công vào cơ sở hạ tầng của chúng tôi để đánh cắp đáp án,” Hugging Face cho biết trong một bài đăng trên blog chi tiết về sự cố.

Tin tốt là mặc dù vụ xâm nhập này đánh dấu một cột mốc quan trọng trong lĩnh vực AI và an ninh mạng, nhưng thiệt hại thực tế lại không đáng kể. Hugging Face cho biết dữ liệu khách hàng duy nhất mà các tác nhân “nổi loạn” này tiếp cận được chỉ là một số truy vấn tìm kiếm được sử dụng để đánh cắp bộ lời giải cho các bài thử thách, vốn được lưu trữ rải rác trong nhiều tập dữ liệu của công ty. OpenAI khẳng định rằng các tác nhân của họ không hề xâm phạm hay truy cập vào bất kỳ mô hình hoặc dữ liệu nào dành cho khách hàng.

OpenAI cho biết họ vẫn đang tiếp tục điều tra sự cố và sẽ đưa ra các khuyến nghị về cách phòng tránh những vấn đề tương tự trong tương lai sau khi hiểu rõ hơn về quy mô của vụ xâm nhập.

“Chúng tôi rất coi trọng trách nhiệm xác định và chuẩn bị ứng phó với các rủi ro từ những hệ thống AI ngày càng có năng lực mạnh mẽ,” công ty tuyên bố. “Sau khi hoàn tất quá trình đánh giá, chúng tôi sẽ xem xét lại vấn đề cùng với Ủy ban An toàn & An ninh cũng như Nhóm Cố vấn An toàn theo Khung Chuẩn bị sẵn sàng (Preparedness Framework) của công ty.”

Nguồn : CNN

RELATED ARTICLES

Most Popular