Các mô hình trí tuệ nhân tại đạt khả năng tấn công mạng tự động
ĐÁNH GIÁ KHẢ NĂNG KHai THÁC LỖ HỔNG CỦA MÔ HÌNH AI
Đội ngũ đánh giá an ninh biên giới của Anthropic vừa công bố kết quả thử nghiệm trên một trăm tác vụ được chọn ngẫu nhiên từ bộ dữ liệu nội bộ về khai thác lỗ hổng nhị phân. Kết quả cho thấy các mô hình trí tuệ nhân tạo thế hệ mới bắt đầu có khả năng tự động tạo ra các chuỗi chiếm quyền điều khiển luồng thực thi hoàn toàn trong các bài kiểm tra thực tế. Cụ thể, mô hình GLM-5.3 đạt tỷ lệ thành công bốn phần trăm trong các lần thử nghiệm, trong khi phiên bản Claude Mythos Preview đạt sáu phần trăm. Sự xuất hiện của các năng lực kỹ thuật này đánh dấu một ngưỡng tiến hóa mới về an ninh mạng đối với các hệ thống trí tuệ nhân tạo tiên tiến hiện nay.
SỰ CHUYỂN BIẾN SO VỚI CÁC THẾ HỆ MÔ HÌNH TRƯỚC
Khoảng cách năng lực giữa các thế hệ mô hình đang nới rộng rõ rệt khi xét đến các tác vụ tấn công mạng phức tạp. Trong cùng bộ dữ liệu kiểm thử, các phiên bản tiền nhiệm gồm Claude Opus 4.6 và GLM-5.2 hoàn toàn không thể thực hiện thành công bất kỳ tác vụ nào trong số một trăm nhiệm vụ được giao. Việc các mô hình như GLM-5.3 và Claude Mythos Preview vượt qua được giới hạn này cho thấy năng lực tự động hóa các thao tác kỹ thuật chuyên sâu đang dần phổ biến hơn, đặt ra những bài toán mới về quản trị rủi ro và kiểm soát an toàn công nghệ trong thời gian tới.