(TAP) - Công ty Anthropic cho biết, 3 mô hình trí tuệ nhân tạo (AI) Claude thuộc hãng đã truy cập trái phép vào hệ thống nội bộ của 3 tổ chức trong đợt diễn tập an ninh mạng. Sự cố xảy ra vì lỗi thiết lập khiến AI vô tình được cấp quyền truy cập internet.
Thông tin trên do Anthropic công bố ngày 30/7 sau khi công ty rà soát hơn 141.000 bài đánh giá hiệu năng Claude. Đây trở thành vụ thứ hai liên tiếp ghi nhận mô hình AI tự ý “vượt rào” kiểm soát. Hôm 21/7, 2 tác nhân AI từ OpenAI từng xâm nhập hệ thống bên thứ ba là công ty Hugging Face.
Riêng vụ việc mới nhất, Anthropic tuyên bố, 3 vụ xâm nhập nêu trên xuất phát từ 3 AI khác nhau, gồm: Claude Opus 4.7, Claude Mythos và một mô hình nghiên cứu internet chưa ra mắt. Bất đồng về thiết lập giữa Anthropic và Irregular (đối tác đánh giá) khiến các mô hình có quyền truy cập internet, thay vì chỉ hoạt động trong môi trường thử nghiệm cách ly.

Công ty Anthropic cho biết, 3 mô hình trí tuệ nhân tạo Claude thuộc hãng đã truy cập trái phép vào hệ thống nội bộ của 3 tổ chức. Nguồn: anthropic.com
Khi thực hiện bài diễn tập đóng vai “hacker” để chiếm dữ liệu mục tiêu, Claude nhầm tưởng mọi hệ thống kết nối internet đều thuộc phạm vi thử nghiệm. Mô hình AI phía Anthropic tự ý xâm nhập hạ tầng, mạng nội bộ của 3 tổ chức ngoài đời thực (chưa tiết lộ tên). Mặc dù vậy, các mô hình AI chỉ sử dụng phương thức tấn công cơ bản như khai thác mật khẩu yếu hoặc điểm truy cập không yêu cầu xác thực, chưa thật sự biết lợi dụng lỗ hổng bảo mật phức tạp.
Phía Anthropic giải thích, Claude không cố gắng tự sao chép, đánh cắp dữ liệu hay chủ động tìm cách thoát khỏi môi trường thử nghiệm. Một số phiên bản cũ vẫn tiếp tục làm nhiệm vụ dù phát hiện đang kết nối internet thật, trong khi phiên bản mới nhất đã lập tức dừng lại ngay lúc nhận ra điều này. Anthropic cũng gửi thông báo đến 3 tổ chức chịu ảnh hưởng, khẳng định hãng đã chủ động tắt hàng rào bảo vệ nhằm phục vụ kiểm tra. Như vậy, sự cố hoàn toàn không ảnh hưởng đến những sản phẩm Claude thương mại trên thị trường.

OpenAI hôm 21/7 thông báo, 2 tác nhân AI thuộc hãng từng xâm nhập vào hệ thống nội bộ công ty Hugging Face. Nguồn: openai.com
Danny Tran











