Đến lượt AI Claude của Anthropic 'nổi loạn', xâm nhập trái phép hệ thống ngoài môi trường thử nghiệm

🗓️ 2026-07-31 📁 vietnam-general 📝 ⏱️ 👁️ : -

31/07/2026 12:19 GMT+7

tác giả

THANH HIỆP

news google

Anthropic cho biết một lỗi cấu hình đã vô tình cho phép các mô hình AI Claude kết nối Internet thay vì chỉ hoạt động trong môi trường thử nghiệm, dẫn đến việc xâm nhập hệ thống của ba tổ chức.

Đến lượt AI Claude của Anthropic 'làm loạn', xâm nhập trái phép hệ thống ngoài môi trường thử nghiệm - Ảnh 1.

Mô hình AI Claude của Công ty Anthropic kết nối Internet trong quá trình thử nghiệm và xâm nhập hệ thống của ba tổ chức - Ảnh đồ họa: THANH HIỆP

Theo Hãng tin Reuters ngày 30-7, Công ty AI Anthropic thông báo một lỗi cấu hình đã vô tình cho phép mô hình trí tuệ nhân tạo (AI) Claude kết nối với Internet trong quá trình thử nghiệm, dẫn đến việc xâm nhập trái phép vào hệ thống của ba tổ chức.

Các vụ xâm nhập xảy ra trong các bài kiểm tra dạng "capture the flag" (CTF). Mô hình AI sẽ được giao nhiệm vụ tìm kiếm thông tin được ẩn trong các mạng Internet mô phỏng.

Ba sự cố liên quan đến ba mô hình khác nhau, gồm Claude Opus 4.7, Claude Mythos 5 và một mô hình đang được nghiên cứu nội bộ.

Các câu lệnh thử nghiệm đều thông báo với mô hình rằng chúng không có quyền truy cập Internet. Tuy nhiên do hiểu nhầm với đối tác đánh giá Irregular, các hệ thống này vẫn được kết nối với Internet công cộng.

"Claude đã xâm nhập hạ tầng của các tổ chức bị ảnh hưởng bằng các kỹ thuật cơ bản như khai thác mật khẩu yếu và các điểm truy cập không yêu cầu xác thực", Anthropic nêu.

Công ty bắt đầu rà soát các bản ghi thử nghiệm từ ngày 23-7 và đình chỉ toàn bộ các bài đánh giá an ninh mạng ngay trong ngày sau khi phát hiện bằng chứng cho thấy mô hình Claude có thể đã tự truy cập Internet.

Đến ngày 24-7, Anthropic xác định được cả ba sự cố và thông báo cho các tổ chức bị ảnh hưởng vào ngày 27-7.

Hai trong số ba tổ chức không biết về việc bị xâm nhập hệ thống trước khi được thông báo, trong khi Anthropic vẫn đang tìm cách liên hệ với tổ chức còn lại.

Anthropic cho biết đã phát hiện các sự cố sau khi rà soát 141.006 phiên thử nghiệm.

Việc rà soát được công ty tiến hành sau khi đối thủ OpenAI công bố sự cố liên quan đến Hugging Face vào tuần trước.

Theo Anthropic nhận định sau sự cố rằng các vụ việc cho thấy AI ngày càng có khả năng thực hiện các hoạt động an ninh mạng trong thực tế, làm gia tăng những rủi ro mà giới chuyên gia từ lâu đã cảnh báo.

Công ty cũng nhấn mạnh cần tăng cường các biện pháp kiểm soát đối với cả môi trường thử nghiệm nội bộ và của bên thứ ba.

OpenAI xác nhận sự cố AI "lộng hành" tấn công thêm 4 công ty khác

Trong bản cập nhật điều tra công bố ngày 28-7 (giờ địa phương), OpenAI xác nhận sự cố tác nhân AI "nổi loạn" trong tuần qua không chỉ dừng lại ở việc xâm nhập nền tảng lập trình Hugging Face, mà còn truy cập trái phép vào hệ thống tài khoản của bốn "dịch vụ công cộng" khác trong cùng một sự cố bảo mật.

Danh tính các tổ chức bị ảnh hưởng không được công bố.

Thông tin này được xác định sau quá trình điều tra và rà soát bổ sung.

Trước đó, công ty chỉ công khai việc tác nhân AI đã tìm cách xâm nhập Hugging Face trong quá trình thử nghiệm. Việc phát hiện thêm bốn mục tiêu cho thấy phạm vi của sự cố lớn hơn so với những gì được biết ban đầu.

Tác nhân AI (AI Agent) của hãng đã tự động kết nối Internet và thực hiện các hành vi xâm nhập ngoài phạm vi nhiệm vụ được giao trong môi trường thử nghiệm.

Công ty nhấn mạnh đây là sự cố chưa từng có tiền lệ đối với các hệ thống AI tác nhân và cho biết đang tiếp tục điều tra, đồng thời tăng cường các biện pháp kiểm soát nhằm ngăn chặn những vụ việc tương tự.

Đọc tiếp

Về trang Chủ đề

Trở thành người đầu tiên tặng sao cho bài viết

0

0 0

Chuyển sao tặng cho thành viên

  • x1
  • x5
  • x10

Hoặc nhập số sao

Bạn đang có: 0 sao

Tuổi Trẻ Online Newsletters

Đăng ký ngay để nhận gói tin tức mới

Tuổi Trẻ Online sẽ gởi đến bạn những tin tức nổi bật nhất

Đăng ký