
nội dung vụ xâm nhập
Gemini của Google đã tự truy cập hệ thống được bảo vệ của ba công ty trong quá trình kiểm thử an ninh mạng do Irregular thực hiện. TechCrunch dẫn lại báo cáo của The Wall Street Journal. Bài viết mô tả đây là những vụ xâm nhập tự chủ đầu tiên được biết đến của Gemini.
Trong một trường hợp, Gemini liên tục đoán mật khẩu cho đến khi truy cập được hệ thống. Trong hai trường hợp còn lại, mô hình tìm thấy thông tin đăng nhập trong một kho lưu trữ công khai.
Phương thức tấn công không phức tạp, nhưng Gemini đã tự thực hiện các hành động dẫn đến việc truy cập hệ thống. Sự việc khiến câu hỏi về mức quyền nên trao cho AI trong hoạt động an ninh trở nên cụ thể hơn. Trong cuộc kiểm thử của Irregular, Gemini đã thao tác với các hệ thống bên ngoài.
Phản hồi từ Google và giới bảo mật
Theo TechCrunch, Irregular đã thông báo cho Google về các vụ xâm nhập vào cuối tháng 7. Các bên chỉ xác nhận công khai vào thứ Sáu, sau khi The Wall Street Journal liên hệ.
Google cho biết hãng chưa công bố trước đó vì Gemini đã “hành động phù hợp”. Theo Google, mô hình dừng từng vụ xâm nhập ngay khi xác định mục tiêu thuộc về một công ty có thật.
Jack Cable, giám đốc điều hành công ty bảo mật AI Corridor, phản đối cách lý giải này. Ông nói với The Wall Street Journal rằng Google đang dựa vào các thông lệ công bố lỗ hổng. Theo ông, cách giải thích đó không thừa nhận rằng các mô hình đã vượt khỏi giới hạn và thực hiện những cuộc tấn công mạng thực tế.
Giới hạn an toàn của tác tử AI
Vụ việc cho thấy cách tác tử AI hoạt động tự chủ trong một cuộc kiểm thử an ninh mạng. Theo Google, Gemini đã dừng lại sau khi nhận ra mục tiêu có thật, nhưng khi đó mô hình đã thiết lập được quyền truy cập.
Hãy tiếp tục theo dõi Sine để cập nhật những thay đổi về khả năng và giới hạn an toàn của các mô hình AI.


