Mô hình của OpenAI 'nổi loạn', gây ra vụ tấn công mạng chưa từng có

1 시간 전 7

OpenAI thừa nhận mô hình AI của mình đã "nổi loạn" và gây ra vụ tấn công mạng chưa từng có nhắm vào hạ tầng của start-up Hugging Face, vốn nổi tiếng trong cộng đồng AI.

Mô hình AI của OpenAI 'nổi loạn', gây nên vụ tấn công mạng chưa từng có - Ảnh 1.

Cuộc tấn công không lường trước của một mô hình AI đang được OpenAI thử nghiệm nhắm vào hạ tầng mạng dấy lên không ít lo ngại - Ảnh: REUTERS

Theo Hãng tin Reuters, ngày 21-7 (giờ Mỹ), OpenAI thừa nhận một tác nhân (agent) AI tự hành chạy trên các mô hình tiên tiến nhất của hãng đã "nổi loạn" trong một cuộc thử nghiệm bảo mật và gây ra cuộc tấn công mạng "vô tiền khoáng hậu" hồi tuần trước.

Cuộc tấn công chưa từng có

Trong bài đăng chính thức, OpenAI cho biết hãng đang thử nghiệm năng lực của một số mô hình tiên tiến nhất của mình trong môi trường được kiểm soát, bao gồm GPT‑5.6 Sol vừa ra mắt và một mô hình mạnh mẽ hơn chưa được công bố.

Mục đích của cuộc thử nghiệm nhằm đánh giá khả năng về an ninh mạng. Theo công ty này, tác nhân trên đã tìm được cách thoát khỏi môi trường cách ly, kết nối vào Internet và đột nhập vào hạ tầng của start-up AI nổi tiếng trong giới là Hugging Face.

OpenAI cho biết tác nhân trên đã tập trung tối đa nguồn lực, tiến hành những biện pháp cực đoan chỉ để đạt một mục tiêu kiểm thử khá hẹp, đó là loại bỏ thứ nó xem là lỗ hổng bảo mật ExploitGym trên Hugging Face.

OpenAI mô tả sự cố là "một vụ tấn công mạng chưa từng có, liên quan đến những năng lực tấn công mạng thuộc hàng tối tân", đồng thời cho biết đang siết chặt các biện pháp bảo vệ.

Đáng chú ý, start-up AI này dự đoán những sự cố tương tự sẽ diễn ra thường xuyên hơn trong tương lai khi các mô hình AI ngày càng cải thiện năng lực an ninh mạng.

Hugging Face là nền tảng chuyên lưu trữ và phân phối các mô hình ngôn ngữ lớn (LLM) và bộ dữ liệu mã nguồn mở. 

Đây là nơi các công ty AI và giới chuyên môn thường đăng tải các mô hình AI hoặc công cụ mã nguồn mở của mình, cho phép người dùng Internet tự do truy cập và tải về chúng miễn phí.

Nền tảng này từng gây xôn xao trong giới an ninh mạng hồi tuần trước khi đăng bài xác nhận mình là mục tiêu của một vụ tấn công "khác với mọi thứ từng xử lý trước đây". Hugging Face cho biết nó "được điều khiển từ đầu đến cuối bởi một hệ thống tác nhân AI tự hành".

Phản hồi lời thừa nhận của OpenAI, đồng sáng lập Hugging Face Clement Delangue viết trên nền tảng X: "Chúng tôi đã nghi ngờ vụ tấn công có thể đến từ một phòng thí nghiệm AI tiên phong, xét mức độ tinh vi của tác nhân này. Hóa ra đúng là như vậy! Thật choáng váng khi tất cả những chuyện này diễn ra một cách hoàn toàn tự động!".

Chuyên gia cảnh báo

Mô hình AI của OpenAI 'nổi loạn', gây nên vụ tấn công mạng chưa từng có - Ảnh 2.

Công ty OpenAI (đứng sau ChatGPT) và Anthropic (Claude) đang phải hứng chịu ngày một nhiều ngờ vực về tính an toàn của các mô hình tiên tiến nhất mà họ phát triển và thử nghiệm - Ảnh: AFP

Việc OpenAI thừa nhận mô hình tiên tiến của hãng phải chịu trách nhiệm cho vụ xâm nhập, dù chúng đã được đặt trong "môi trường cô lập ở mức độ cao", nhiều khả năng sẽ càng khiến lo ngại về sức mạnh và rủi ro của các mô hình AI tiên phong thêm gay gắt.

Hạ nghị sĩ Mỹ Greg Casar khẳng định sự cố trên là hồi chuông báo động. Ông Casar tuyên bố: "AI đang phát triển cực nhanh mà gần như không có quy định thực chất nào để bảo vệ chúng ta".

Ông đồng thời kêu gọi bắt buộc kiểm định an toàn độc lập, bắt buộc công bố các sự cố an ninh và thúc đẩy hợp tác quốc tế "để bảo vệ con người trước một thảm họa toàn diện".

Bà Katie Moussouris, Giám đốc điều hành Công ty Luta Security, cho rằng sự cố là điềm báo cho những vụ xâm nhập sắp tới. Theo bà, các mô hình hiện nay giống như "những con bạch tuộc đào tẩu tài tình nhất thế giới, với vô số xúc tu có thể luồn lách qua bất kỳ khe hở nào".

Ông Matt Suiche - kỹ sư tại công ty an ninh mạng chuyên về AI Tolmo - cũng nhận định sự cố cho thấy các mô hình AI tiên phong đang "thu hẹp khoảng cách với những tin tặc tối tân nhất".

Tuy nhiên, ông cũng chỉ ra rằng các dạng tấn công được nêu trong bài blog của OpenAI hoàn toàn có thể thực hiện bằng công nghệ đã phổ biến rộng rãi bên ngoài các phòng thí nghiệm nghiên cứu tiên phong.

"Đây là điều chúng tôi đã tự chứng kiến trong nội bộ. Với các tác nhân của mình, chúng tôi cũng đã có những kết quả tương tự. Thậm chí chúng tôi còn không cần dùng đến những mô hình mới nhất", ông Suiche nói.

Trở thành người đầu tiên tặng sao cho bài viết 0 0 0

Chuyển sao tặng cho thành viên

  • x1
  • x5
  • x10

Hoặc nhập số sao

Tuổi Trẻ Online Newsletters

Đăng ký ngay để nhận gói tin tức mới

Tuổi Trẻ Online sẽ gởi đến bạn những tin tức nổi bật nhất

Đăng ký

전체 기사 읽기