Các mô hình AI ChatGPT tỏ ra gian lận trong bài kiểm tra

© Sputnik / AI generatedBảo vệ quyền sở hữu trí tuệ
Bảo vệ quyền sở hữu trí tuệ - Sputnik Việt Nam, 1920, 23.07.2026
Đăng ký
Hai mô hình trí tuệ nhân tạo của công ty OpenAI, vốn được biết đến là nhà phát triển chatbot ChatGPT, đã "trốn" lên internet trong quá trình thử nghiệm để tìm câu trả lời có sẵn cho một bài kiểm tra. Dịch vụ báo chí của công ty khởi nghiệp Mỹ đã đưa tin về điều này.
Sự việc xảy ra vào tuần trước. Hugging Face, công ty cho phép các nhà tạo mô hình AI trao đổi dữ liệu và điều chỉnh các phát triển của họ dựa trên đó, đã ghi nhận một cuộc xâm nhập trái phép vào cơ sở hạ tầng sản xuất của mình, cuộc xâm nhập mà họ gọi là chưa từng có vì nó được tổ chức "từ đầu đến cuối" bởi một tác nhân AI. Vào thứ Tư, OpenAI thông báo rằng cuộc tấn công vào Hugging Face được thực hiện bởi mô hình GPT 5.6 Sol và một mô hình không được nêu tên, "mạnh mẽ hơn nữa", hiện vẫn chưa được giới thiệu công khai.
"Chúng tôi coi những gì đã xảy ra là một sự kiện chưa từng có trong lĩnh vực an ninh mạng sử dụng các khả năng mạng tiên tiến, và chúng tôi đang phản ứng tương ứng. Chúng tôi chia sẻ kết quả điều tra sơ bộ để giúp các chuyên gia an ninh mạng hiểu những gì đã xảy ra và cho phép họ điều chỉnh các công cụ của mình phù hợp với khả năng mới của các mô hình", - OpenAI thông báo.
Có sự khác biệt cơ bản trong cách tiếp cận Nga, Trung Quốc và phương Tây đối với sự phát triển AI - Sputnik Việt Nam, 1920, 17.07.2026
Có sự khác biệt cơ bản trong cách tiếp cận Nga, Trung Quốc và phương Tây đối với sự phát triển AI
Công ty giải thích rằng các mô hình của họ đang được thử nghiệm về khả năng xảy ra tấn công mạng. Thông thường, các bài kiểm tra như vậy diễn ra trong "môi trường được cách ly cao với khả năng truy cập mạng hạn chế, chỉ giới hạn ở việc tải xuống các gói dữ liệu thông qua phần mềm của bên thứ ba trên các máy chủ nội bộ đóng vai trò là máy chủ proxy lưu trữ cho các kho lưu trữ gói". Các mô hình đã xác định các lỗ hổng trong môi trường phần mềm của OpenAI và cơ sở hạ tầng của Hugging Face, đồng thời có được quyền truy cập trực tiếp vào cơ sở dữ liệu của Hugging Face. OpenAI cho biết các mô hình "đã tập trung cao độ vào việc tìm kiếm giải pháp cho [bài kiểm tra] ExploitGym, nỗ lực phi thường để giải quyết một nhiệm vụ khá hẹp".

"Sau khi có được quyền truy cập vào internet, các mô hình đã đi đến kết luận rằng Hugging Face có khả năng lưu trữ các mô hình, dữ liệu và giải pháp cho ExploitGym. Biết được điều này, các mô hình bắt đầu tìm kiếm và đã tìm thấy thành công con đường để truy cập vào thông tin bí mật có thể được sử dụng để gian lận khi vượt qua bài kiểm tra", - OpenAI cho biết.

Công ty đang tiếp tục điều tra cùng với Hugging Face. Tại Hugging Face cũng xác nhận rằng họ đã ngăn chặn được cuộc tấn công của các mô hình AI vào cơ sở hạ tầng của mình bằng cách sử dụng công cụ AI do chính họ phát triển. OpenAI thông báo rằng họ đã thông báo cho khách hàng của mình về lỗ hổng mà các mô hình đã sử dụng để "trốn" lên mạng.
Tin thời sự
0
Để tham gia thảo luận
hãy kích hoạt hoặc đăng ký
loader
Phòng chat
Заголовок открываемого материала