Kiến tạo chuẩn mực cho kỷ nguyên AI tự phát triển

Mục tiêu tối thượng của tôi và nhiều người vẫn là làm sao để trí tuệ nhân tạo tổng quát (AGI) mang lại lợi ích cho toàn nhân loại. Theo định hướng từ Sam Altman và Jakub Pachocki, chúng tôi ưu tiên ba mục tiêu chính: một là dẫn dắt giai đoạn tiến hóa tiếp theo của AI bằng cách tạo ra các nhà nghiên cứu AI tự động, từ đó giải quyết vấn đề điều chỉnh, giữ con người trong vòng lặp tự cải thiện; hai là hiện thực hóa lợi ích từ những cỗ máy thông minh cho khoa học và kinh tế; và ba là trao AGI cá nhân vào tay mỗi người. AI đang thực sự tăng tốc cho chính hoạt động nghiên cứu và kỹ thuật của chúng ta. Chẳng hạn, AI đã góp phần tạo ra những tiến bộ đột phá trong toán học, bao gồm cả việc giải bài toán Navier-Stokes Thiên niên kỷ. Với đà này, AI hứa hẹn sẽ mang đến những khám phá quan trọng trong y học, giúp chăm sóc sức khỏe dễ tiếp cận hơn và tăng cường năng lực kinh tế cho các doanh nghiệp nhỏ cùng các cá nhân. Tuy nhiên, AI càng trở nên mạnh mẽ và tự chủ, nhất là khi nó tự đảm nhận phần lớn công việc nghiên cứu và phát triển AI, thì việc giữ cho các hệ thống này phù hợp với giá trị và nằm dưới sự kiểm soát của con người càng trở nên cấp thiết. Vấn đề này có tên gọi là "Recursive Self-Improvement" (RSI), tức AI tự cải thiện. Dù hiện tại RSI tự động hoàn toàn chưa diễn ra, và chúng ta không nên theo đuổi nó cho đến khi an toàn, nhưng nếu không thận trọng, con người có thể mất quyền kiểm soát thực tế, không thể giám sát các quy trình nghiên cứu mà chúng ta không còn hiểu được. Vụ việc Hugging Face, dù không phải là kết quả trực tiếp của RSI, đã cho chúng ta thấy trước những rủi ro có thể trở nên nghiêm trọng hơn nếu thiếu các biện pháp bảo vệ và điều chỉnh mạnh mẽ. Để điều hướng quá trình chuyển đổi này một cách an toàn, việc nghiên cứu về điều chỉnh (alignment) cần phải theo kịp tốc độ phát triển năng lực của AI. Điều này đòi hỏi cả tiến bộ trong nghiên cứu điều chỉnh và các tiêu chuẩn chung để định hướng phát triển trong mọi phòng thí nghiệm, mọi quốc gia. Các tiêu chuẩn