https://kevesko.vn/20260801/anthropic-mo-hinh-ai-claude-da-tan-cong-cac-he-thong-thuc-te-trong-qua-trinh-thu-nghiem-43552658.html
Anthropic: Mô hình AI Claude đã tấn công các hệ thống thực tế trong quá trình thử nghiệm
Anthropic: Mô hình AI Claude đã tấn công các hệ thống thực tế trong quá trình thử nghiệm
Sputnik Việt Nam
Mô hình trí tuệ nhân tạo Claude của công ty Anthropic đã 3 lần xâm nhập vào hệ thống của các tổ chức có thật ngoài đời thực trong quá trình thử nghiệm, các nhà... 01.08.2026, Sputnik Việt Nam
2026-08-01T07:18+0700
2026-08-01T07:18+0700
2026-08-01T07:18+0700
ai
tấn công
lầu năm góc
bộ thương mại hoa kỳ (doc)
thế giới
hoa kỳ
trí tuệ nhân tạo
chính phủ
https://cdn.img.kevesko.vn/img/07e6/0c/0f/20056713_0:159:3076:1889_1920x0_80_0_0_d454e5b31b7799ac0202940eeeab443d.jpg
Cuộc điều tra được khởi xướng sau khi công ty OpenAI tiết lộ một sự cố tương tự với các mô hình AI của họ. Anthropic đã rà soát lại hơn 141.000 lượt chạy thử nghiệm của các mô hình Claude.Lỗi này phát sinh do sự hiểu lầm giữa Anthropic và đối tác bên thứ ba. Bất chấp hướng dẫn chạy thử nghiệm AI có quy định rõ yêu cầu phải ngắt kết nối internet, quyền truy cập mạng vẫn được mở. Các mô hình AI đã tin vào câu lệnh điều hướng (prompt) rằng không có internet, coi mọi thứ xung quanh là môi trường giả lập và đã vi phạm các giao thức bảo mật để hoàn thành nhiệm vụ thử nghiệm.Công ty lưu ý rằng chỉ có mô hình nội bộ mới nhất (hiện vẫn đang trong quá trình phát triển) là tự động dừng cuộc tấn công mạng khi nhận ra hệ thống mà nó lựa chọn là có thật. Các mô hình cũ hơn — gồm Claude Opus 4.7 và Claude Mythos 5 — hoặc là tiếp tục cuộc tấn công, hoặc tự hợp lý hóa những gì đang diễn ra như một phần của quá trình huấn luyện.Trước đó, giữa chính phủ Mỹ và Anthropic từng xảy ra xung đột do các tranh cãi về mức độ an toàn khi ứng dụng AI vào công việc của Lầu Năm Góc; công ty đã từ chối cấp cho bộ này quyền truy cập đầy đủ vào các sản phẩm của mình. Sau đó, chính quyền đã chặn quyền truy cập của các quốc gia và công dân nước ngoài đối với những mô hình trí tuệ nhân tạo tiên tiến nhất của Anthropic là Mythos 5 và Fable 5 do các rủi ro về an ninh quốc gia. Vào đầu tháng 7, Anthropic thông báo rằng Bộ Thương mại Mỹ đã dỡ bỏ các biện pháp kiểm soát xuất khẩu đối với những mô hình trí tuệ nhân tạo này của hãng.
https://kevesko.vn/20260723/chuyen-gia-du-bao-ngo-cut-nang-luong-o-phuong-tay-do-tri-tue-nhan-tao-43447030.html
Sputnik Việt Nam
moderator.vn@sputniknews.com
+74956456601
MIA „Rossiya Segodnya“
2026
Sputnik Việt Nam
moderator.vn@sputniknews.com
+74956456601
MIA „Rossiya Segodnya“
tin thời sự
vn_VN
Sputnik Việt Nam
moderator.vn@sputniknews.com
+74956456601
MIA „Rossiya Segodnya“
https://cdn.img.kevesko.vn/img/07e6/0c/0f/20056713_174:0:2903:2047_1920x0_80_0_0_1b27f5766828d4a3849119793b46970a.jpgSputnik Việt Nam
moderator.vn@sputniknews.com
+74956456601
MIA „Rossiya Segodnya“
ai, tấn công, lầu năm góc, bộ thương mại hoa kỳ (doc), thế giới, hoa kỳ, trí tuệ nhân tạo, chính phủ
ai, tấn công, lầu năm góc, bộ thương mại hoa kỳ (doc), thế giới, hoa kỳ, trí tuệ nhân tạo, chính phủ
Anthropic: Mô hình AI Claude đã tấn công các hệ thống thực tế trong quá trình thử nghiệm
Mô hình trí tuệ nhân tạo Claude của công ty Anthropic đã 3 lần xâm nhập vào hệ thống của các tổ chức có thật ngoài đời thực trong quá trình thử nghiệm, các nhà phát triển tuyên bố dựa trên kết quả của một cuộc điều tra nội bộ.
Cuộc điều tra được khởi xướng sau khi công ty OpenAI tiết lộ một sự cố tương tự với các mô hình AI của họ. Anthropic đã rà soát lại hơn 141.000 lượt chạy thử nghiệm của các mô hình Claude.
"Trong quá trình phân tích nhật ký (transcript) của các bài kiểm tra an ninh mạng, chúng tôi phát hiện 3 sự cố, trong đó mô hình Claude đã truy cập internet từ môi trường thử nghiệm của bên thứ ba (hoặc trong lúc tương tác với môi trường đó), và sau đó giành được quyền truy cập trái phép vào các hệ thống thực tế của 3 tổ chức khác nhau", - tuyên bố của công ty cho biết.
Lỗi này phát sinh do sự hiểu lầm giữa Anthropic và đối tác bên thứ ba. Bất chấp hướng dẫn chạy thử nghiệm AI có quy định rõ yêu cầu phải ngắt kết nối internet, quyền truy cập mạng vẫn được mở. Các mô hình AI đã tin vào câu lệnh điều hướng (prompt) rằng không có internet, coi mọi thứ xung quanh là môi trường giả lập và đã vi phạm các giao thức bảo mật để hoàn thành nhiệm vụ thử nghiệm.
Công ty lưu ý rằng chỉ có mô hình nội bộ mới nhất (hiện vẫn đang trong quá trình phát triển) là tự động dừng cuộc tấn công mạng khi nhận ra hệ thống mà nó lựa chọn là có thật. Các mô hình cũ hơn — gồm Claude Opus 4.7 và Claude Mythos 5 — hoặc là tiếp tục cuộc tấn công, hoặc tự hợp lý hóa những gì đang diễn ra như một phần của quá trình huấn luyện.
Trước đó, giữa chính phủ Mỹ và Anthropic từng xảy ra xung đột do các tranh cãi về mức độ an toàn khi ứng dụng AI vào công việc của Lầu Năm Góc; công ty đã từ chối cấp cho bộ này quyền truy cập đầy đủ vào các sản phẩm của mình. Sau đó, chính quyền đã chặn quyền truy cập của các quốc gia và công dân nước ngoài đối với những mô hình
trí tuệ nhân tạo tiên tiến nhất của Anthropic là Mythos 5 và Fable 5 do các rủi ro về an ninh quốc gia. Vào đầu tháng 7, Anthropic thông báo rằng Bộ Thương mại Mỹ đã dỡ bỏ các biện pháp kiểm soát xuất khẩu đối với những mô hình trí tuệ nhân tạo này của hãng.