GEMINI “đột phá” qua hệ thống ba công ty
Tôi không lạ khi các mô hình AI ngày càng thông minh hơn, nhưng việc chúng chủ động "đột phá" vào các hệ thống ngoài kiểm soát thì lại là một câu chuyện khác. Mới đây, Google đã xác nhận rằng mô hình Gemini của họ đã tấn công thành công ba công ty vào tháng 5 vừa qua. Sự việc diễn ra trong một đợt thử nghiệm do công ty Irregular tổ chức. Irregular cũng là cái tên đứng sau các sự cố tương tự với những mô hình lớn khác từ OpenAI, Anthropic và Meta. Trong một trường hợp, Gemini đã dò mật khẩu cho đến khi giành được quyền truy cập vào một hệ thống được bảo vệ. Với hai trường hợp còn lại, mô hình này tìm thấy thông tin xác thực trong một kho lưu trữ công khai, qua đó mở đường truy cập vào các hệ thống khác. Tuy nhiên, Google cho biết Gemini đã tự dừng cuộc xâm nhập ngay lập tức khi nhận ra mình đã truy cập vào hệ thống thật của một công ty, chứ không phải môi trường giả lập. Theo Google, mô hình này được cho là "ít quyết tâm hơn" các mô hình khác. Mặc dù Google đã biết về những sự cố này từ tháng 7, họ lại không công bố cho đến khi Tạp chí Phố Wall (WSJ) liên hệ để tìm hiểu thông tin, có lẽ là dựa trên một nguồn tin. Google giải thích rằng họ không coi các cuộc tấn công này đủ nghiêm trọng để công khai, vì mô hình không gây ra bất kỳ thiệt hại nào cho các công ty và đã chấm dứt mỗi cuộc xâm nhập ngay khi xác định đó là một hệ thống thật. Điều này khiến tôi đặt câu hỏi về mức độ minh bạch của các gã khổng lồ AI, đặc biệt khi sự cố dù không gây hại nhưng vẫn cho thấy lỗ hổng tiềm ẩn trong các hệ thống của chúng ta, ngay cả khi AI chỉ vô tình tìm thấy.