Nỗi bất an khi AI vượt vòng kiểm soát

2 giờ trước 11

Các chuyên gia bày tỏ lo ngại AI có thể gây hại trên Internet, sau các sự cố thoát khỏi môi trường kiểm soát tại OpenAI và Anthropic.

Ngày 21/7, OpenAI công khai thừa nhận một trong những tác nhân của họ bị mất kiểm soát, đột nhập nền tảng Hugging Face. Đến 31/7, Reuters dẫn lời hai nguồn tin am hiểu vấn đề cho biết trong quá trình điều tra, OpenAI tiếp tục phát hiện thêm nhiều trường hợp tác nhân vượt ra ngoài môi trường thử nghiệm.

Phát ngôn viên OpenAI không trực tiếp bình luận thông tin, nhưng nhắc lại thông cáo ngày 28/7, trong đó cho biết công ty đang đánh giá "những hoạt động rộng khắp của các mô hình".

Anthropic hôm 30/7 cũng thừa nhận 3 phiên bản của mô hình Claude đã vượt khỏi biện pháp kiềm tỏa, vốn dùng để ngăn chúng tiếp cận mạng Internet, sau đó truy cập vào hệ thống của 3 công ty chưa được nêu tên

 Bảo Lâm

Giao diện website OpenAI. Ảnh: Bảo Lâm

Theo các chuyên gia về an toàn AI, loạt sự cố đang vẽ nên bức tranh về những phòng thí nghiệm hàng đầu với khả năng phát triển tác nhân tự động tiềm ẩn nhiều nguy hiểm, vượt xa những biện pháp kiểm soát chúng.

"Cả một ngành công nghiệp đang thiết kế, phát triển và phát hành những công cụ tiên tiến mà không có trách nhiệm bảo đảm chúng không gây nguy hiểm", Maurice Chiodo, nhà toán học tại Trung tâm Nghiên cứu Rủi ro Hiện sinh thuộc Đại học Cambridge ở Anh, cho hay.

Chưa rõ OpenAI đã phát hiện bao nhiêu trường hợp mô hình vượt vòng kiểm soát, cũng như thời gian và tình huống dẫn đến sự việc. "OpenAI và nhóm chuyên gia độc lập đang rà soát dữ liệu từ đầu năm để tìm hiểu những gì đã xảy ra", nguồn tin cho hay.

Chiodo cho biết các lo ngại của ông càng trở nên nghiêm trọng vì những dấu hiệu cho thấy OpenAI và Anthropic đều không giám sát những mô hình vượt kiểm soát. Reuters trước đó đưa tin OpenAI chỉ phát hiện mô hình thoát ra ngoài sau khi vụ tấn công đã xảy ra hơn một tuần, tức Hugging Face đã kiểm soát được tình hình, liên lạc với Cục Điều tra Liên bang Mỹ (FBI) và công bố thông tin. OpenAI nói thông tin "có nhiều điểm chưa chính xác", nhưng từ chối nêu chi tiết.

Anthropic cũng thừa nhận không giám sát mô hình AI theo thời gian thực khi nó tấn công hệ thống bên ngoài, cho rằng hoạt động theo dõi dữ liệu thử nghiệm sẽ giúp phát hiện vấn đề sớm hơn.

Chiodo nhấn mạnh những tuyên bố trên cho thấy cả hai công ty đã không bảo đảm biện pháp giám sát cần thiết. "Dường như họ còn chẳng nhìn vào chúng", ông nói.

 AFP

Logo Anthropic và mô hình Claude của công ty hiển thị trên màn hình. Ảnh: AFP

Giới lập pháp và quan chức tại Mỹ cùng châu Âu cũng đang gia tăng áp lực nhằm xây dựng biện pháp giám sát những phòng thí nghiệm AI hàng đầu.

"Chúng tôi đang xem xét phương thức kiểm soát", Tổng thống Mỹ Donald Trump nói với các phóng viên hôm 30/7.

"Xét về mặt lập pháp, yêu cầu bắt buộc thử nghiệm tính năng của các mô hình tiên tiến là điều đúng đắn", nghị sĩ Mark Warner, thành viên hàng đầu của đảng Dân chủ tại Ủy ban Tình báo Thượng viện Mỹ, cho hay.

Ủy ban châu Âu, cơ quan điều hành Liên minh châu Âu, ngày 31/7 thông báo đã đối thoại với OpenAI và Anthropic về những vụ AI tấn công hệ thống bên ngoài.

Trong khi đó, hơn 1.000 người làm việc tại các công ty AI hàng đầu Mỹ, bao gồm cả CEO Anthropic Dario Amodei, hôm 27/8 ký tên vào văn bản kiến nghị, kêu gọi chính phủ hạn chế tốc độ phát hành các mô hình hiện đại nhất. Văn bản đề xuất chính phủ Mỹ "hỗ trợ nỗ lực quốc tế nhằm phát triển công cụ kỹ thuật và điều hành để giám sát, kiểm soát tốc độ phát triển những hệ thống AI tự động".

Sam Altman không ký, nhưng cho rằng ngành công nghệ cần giảm tốc độ xây dựng các mô hình tiên tiến, giúp xã hội có thêm thời gian củng cố trước những năng lực mới của AI.

Điệp Anh (Theo Reuters, AFP)

Đọc toàn bộ bài viết