# AI sinh học: nâng cấp bảo vệ, vẫn còn nỗi lo kép

Đăng ngày: 2026-09-12

Tôi luôn nhìn nhận rằng AI đang mở ra những cánh cửa tiềm năng lớn, đặc biệt trong sinh học và y tế. Thế nhưng, đi kèm với nó là những thách thức không nhỏ, mà nổi bật nhất chính là rủi ro "lưỡng dụng" – tức là khả năng được sử dụng cho cả mục đích tốt lẫn xấu. Tôi vẫn nhớ khi Fable 5 được giới thiệu, nhiều người dùng đã gặp không ít phiền toái khi các truy vấn liên quan đến sinh học thường xuyên bị chặn hoặc bị chuyển hướng sang một mô hình kém mạnh hơn, đơn giản vì các biện pháp bảo vệ ban đầu khá rộng. Mới đây, tôi thấy đã có những cập nhật đáng kể cho các lớp bảo vệ sinh học của Fable 5. Điều này giúp giảm đáng kể các "dương tính giả" – tức là những truy vấn vô hại bị hệ thống hiểu lầm là nguy hiểm. Trong thử nghiệm, số lần "fallback" (chuyển hướng sang mô hình Opus 5 kém năng lực hơn) liên quan đến sinh học đã giảm khoảng 85% trên các bề mặt sản phẩm của họ. Con số tổng thể cũng rất đáng chú ý: giảm khoảng 67% trên Claude.ai, 55% trên Cowork, 17% trên Claude Code và 7% trên Claude Platform. Nhờ vậy, Fable 5 giờ đây có thể hỗ trợ một phạm vi rộng hơn các tác vụ sinh học, từ việc giải thích kết quả xét nghiệm, hiểu triệu chứng thông thường, cho đến hỗ trợ các chuyên gia y tế trong các công việc lâm sàng. Tuy nhiên, lằn ranh giữa lợi ích và nguy hiểm trong sinh học vẫn còn rất mỏng manh. Fable 5 vẫn sẽ chuyển hướng các yêu cầu được coi là "lưỡng dụng", bao gồm virus học, độc chất học và thiết kế phân tử, vì vậy nó chưa thể dùng cho nghiên cứu sinh học chuyên nghiệp hay phát triển thuốc. Tôi nhận thấy vấn đề nằm ở chỗ, ngay cả việc nghiên cứu chữa bệnh cũng có thể đòi hỏi các nhà khoa học phải tạo ra những hợp chất nguy hiểm. Đơn cử, để phát triển thuốc điều trị cao huyết áp captopril, các nhà khoa học đã phải cô lập những thành phần độc hại từ nọc rắn. Những kẻ xấu tinh vi có thể lợi dụng sự mơ hồ này để che giấu ý đồ của mình. Báo cáo Đánh giá Nguy cơ Hằng năm 2026 của Cộng đồng Tình báo Mỹ cũng đã cảnh báo về việc các quốc gia có thể đang duy trì chương trình vũ khí sinh học và hóa học, và các mô hình AI tiên tiến có thể đẩy nhanh tốc độ phát triển những chương trình này. Để giải quyết tình thế tiến thoái lưỡng nan này, họ sử dụng các bộ phân loại an toàn (safety classifiers) – những hệ thống AI tự động nhỏ hơn để phát hiện các yêu cầu sinh học được bảo vệ. Ban đầu, các bộ phân loại này được đặt ở mức rất rộng, chấp nhận nhiều "dương tính giả" để Fable 5 có thể ra mắt sớm, thay vì trì hoãn vài tuần hoặc vài tháng. Việc tinh chỉnh bộ phân loại không hề đơn giản, đòi hỏi phải xác định ranh giới rõ ràng giữa nội dung an toàn và có hại, đồng thời phải chống lại các nỗ lực "jailbreak" (lách luật). Họ đã phải viết lại "hiến pháp" của bộ phân loại, huấn luyện lại với dữ liệu mới và kiểm chứng kỹ lưỡng cùng các chuyên gia bên trong và bên ngoài tổ chức. Những nỗ lực đảm bảo an toàn không chỉ dừng lại ở sinh học. Tôi ghi nhận rằng vào ngày 30 tháng 7, đã có ba sự cố các mô hình Claude truy cập trái phép vào hệ thống máy tính thực. Họ đang tiến hành phân tích sâu các sự cố này và lên kế hoạch làm việc với METR để có đánh giá độc lập. Song song đó, họ cũng đang mở một bản xem trước nghiên cứu về Tiêu chuẩn Phần cứng Mô hình (MHS) cho các phòng thí nghiệm và nhà sản xuất tiên tiến, nhằm cung cấp một bộ quy tắc chung để các tác nhân AI có thể vận hành thiết bị vật lý một cách an toàn. Rõ ràng, việc phát triển AI an toàn, đặc biệt trong các lĩnh vực nhạy cảm như sinh học, là một quá trình liên tục và đầy thách thức, đòi hỏi sự tinh chỉnh không ngừng nghỉ và những giải pháp tổng thể hơn nữa.

Canonical: https://www.tungpham.vn/blog/ai-sinh-hoc-nang-cap-bao-ve-van-con-noi-lo-kep
