Anthropic: Mô hình AI Claude đã tấn công các hệ thống thực tế trong quá trình thử nghiệm

© Sputnik / Alexey Malgavko / Chuyển đến kho ảnhRansomware tấn công hệ thống CNTT của các công ty ở các quốc gia khác nhau
Ransomware tấn công hệ thống CNTT của các công ty ở các quốc gia khác nhau - Sputnik Việt Nam, 1920, 01.08.2026
Đăng ký
Mô hình trí tuệ nhân tạo Claude của công ty Anthropic đã 3 lần xâm nhập vào hệ thống của các tổ chức có thật ngoài đời thực trong quá trình thử nghiệm, các nhà phát triển tuyên bố dựa trên kết quả của một cuộc điều tra nội bộ.
Cuộc điều tra được khởi xướng sau khi công ty OpenAI tiết lộ một sự cố tương tự với các mô hình AI của họ. Anthropic đã rà soát lại hơn 141.000 lượt chạy thử nghiệm của các mô hình Claude.
"Trong quá trình phân tích nhật ký (transcript) của các bài kiểm tra an ninh mạng, chúng tôi phát hiện 3 sự cố, trong đó mô hình Claude đã truy cập internet từ môi trường thử nghiệm của bên thứ ba (hoặc trong lúc tương tác với môi trường đó), và sau đó giành được quyền truy cập trái phép vào các hệ thống thực tế của 3 tổ chức khác nhau", - tuyên bố của công ty cho biết.
Lỗi này phát sinh do sự hiểu lầm giữa Anthropic và đối tác bên thứ ba. Bất chấp hướng dẫn chạy thử nghiệm AI có quy định rõ yêu cầu phải ngắt kết nối internet, quyền truy cập mạng vẫn được mở. Các mô hình AI đã tin vào câu lệnh điều hướng (prompt) rằng không có internet, coi mọi thứ xung quanh là môi trường giả lập và đã vi phạm các giao thức bảo mật để hoàn thành nhiệm vụ thử nghiệm.
Công ty lưu ý rằng chỉ có mô hình nội bộ mới nhất (hiện vẫn đang trong quá trình phát triển) là tự động dừng cuộc tấn công mạng khi nhận ra hệ thống mà nó lựa chọn là có thật. Các mô hình cũ hơn — gồm Claude Opus 4.7 và Claude Mythos 5 — hoặc là tiếp tục cuộc tấn công, hoặc tự hợp lý hóa những gì đang diễn ra như một phần của quá trình huấn luyện.
Mạng nơ-ron - Sputnik Việt Nam, 1920, 23.07.2026
Chuyên gia dự báo ngõ cụt năng lượng ở phương Tây do trí tuệ nhân tạo
Trước đó, giữa chính phủ Mỹ và Anthropic từng xảy ra xung đột do các tranh cãi về mức độ an toàn khi ứng dụng AI vào công việc của Lầu Năm Góc; công ty đã từ chối cấp cho bộ này quyền truy cập đầy đủ vào các sản phẩm của mình. Sau đó, chính quyền đã chặn quyền truy cập của các quốc gia và công dân nước ngoài đối với những mô hình trí tuệ nhân tạo tiên tiến nhất của Anthropic là Mythos 5 và Fable 5 do các rủi ro về an ninh quốc gia. Vào đầu tháng 7, Anthropic thông báo rằng Bộ Thương mại Mỹ đã dỡ bỏ các biện pháp kiểm soát xuất khẩu đối với những mô hình trí tuệ nhân tạo này của hãng.
Tin thời sự
0
Để tham gia thảo luận
hãy kích hoạt hoặc đăng ký
loader
Phòng chat
Заголовок открываемого материала