# Anthropic cùng Accenture đổ tiền tỷ để đánh giá AI từ bên trong

Đăng ngày: 2026-09-21

Trong bối cảnh AI tiên tiến ngày càng phát triển, nhu cầu về một cơ chế giám sát độc lập, minh bạch trở nên cấp thiết hơn bao giờ hết. Tôi thấy đây là một bước đi khá độc đáo khi Anthropic công bố hợp tác với Accenture để thực hiện đánh giá độc lập các mô hình AI tiên tiến của mình. Đây là một động thái thực hiện cam kết đã được CEO Anthropic đề ra trong bài luận "We Must Pace the Frontier" về việc nhúng các chuyên gia đánh giá vào sâu bên trong công ty. Quan hệ đối tác này sẽ do Faculty, mảng kinh doanh AI chuyên biệt của Accenture, dẫn dắt. Đội ngũ này sẽ đảm nhiệm nhiều vai trò quan trọng như đánh giá, red-team mô hình, thực hiện các đánh giá về mức độ phù hợp (alignment assessments) và kiểm tra các biện pháp bảo vệ của mô hình. Accenture, với kinh nghiệm giúp các doanh nghiệp và chính phủ triển khai AI trên nhiều ngành, sẽ mang đến góc nhìn thực tiễn về cách các tổ chức lớn sử dụng AI, từ đó định hình phương pháp tiếp cận an toàn cho việc đánh giá. Cả Anthropic và Accenture đều kỳ vọng sẽ đầu tư ít nhất 1 tỷ USD mỗi bên trong 5 năm tới để xây dựng năng lực trong lĩnh vực này. Khái niệm "đánh giá nhúng" (embedded evaluation) còn khá mới mẻ và nhiều chi tiết về cách vận hành vẫn đang được hoàn thiện. Khác với các chuyên gia đánh giá bên ngoài thông thường, những người đánh giá nhúng này sẽ làm việc bên trong các công ty AI, với quyền truy cập tương đương một nhân viên. Điều này cho phép họ theo dõi quá trình hình thành các mô hình ngay từ giai đoạn huấn luyện, nắm bắt các quyết định chi phối cách xây dựng và triển khai mô hình, cũng như trao đổi trực tiếp với các nhân viên. Từ vị trí thuận lợi này, họ có thể đánh giá cách công ty vận hành, xác minh các cam kết về an toàn, và nhận diện các điểm mù. Họ cũng có thể báo cáo các sự cố và cung cấp cho công chúng một cái nhìn có thông tin hơn về lợi ích và rủi ro. Anthropic cũng khẳng định rằng những chuyên gia đánh giá độc lập này không làm giảm trách nhiệm giải trình của họ, mà ngược lại, giúp nó dễ kiểm chứng hơn. Hiện tại, chưa có các tiêu chuẩn rõ ràng về thông tin mà các chuyên gia đánh giá nhúng nên được tiếp cận, hay cách họ nên báo cáo những phát hiện của mình. Cũng chưa có một hệ thống tài trợ ổn định cho việc đánh giá độc lập. Về lâu dài, Anthropic tin rằng nguồn tài trợ nên đến từ các quỹ chung hoặc từ chính phủ, như họ đã kêu gọi trong khuôn khổ "Advanced AI Framework" vào tháng 6. Trong bối cảnh đó, Anthropic sẽ trực tiếp tài trợ cho công việc của Accenture. Đồng thời, họ cũng đang đối thoại với METR và các tổ chức đánh giá phi lợi nhuận khác để thử nghiệm các yếu tố của đánh giá nhúng bằng nguồn tài trợ riêng của các tổ chức này. Anthropic kỳ vọng các phòng thí nghiệm AI tiên tiến sẽ làm việc với nhiều tổ chức cùng lúc, và quan hệ đối tác với Accenture là không độc quyền; Anthropic cũng sẽ công bố thêm các đối tác đánh giá khác trong những tuần tới. Có lẽ, động thái này cũng đến từ những bài học gần đây. Chẳng hạn, Anthropic đã ra mắt Chương trình Xác minh Khoa học Đời sống (LSVP) nhằm cung cấp cho các chuyên gia sinh học quyền truy cập vào các mô hình Claude Mythos, Opus và Sonnet với các biện pháp bảo vệ tinh chỉnh hơn cho công việc liên quan đến sinh học. Điều đáng chú ý hơn, vào ngày 30 tháng 7 vừa qua, Anthropic đã báo cáo ba sự cố trong đó các mô hình Claude đã giành quyền truy cập trái phép vào các hệ thống máy tính thực. Họ đang tiến hành phân tích chuyên sâu các sự cố này và dự kiến sẽ làm việc với METR để có một đánh giá độc lập. Những sự kiện này cho thấy tầm quan trọng của việc có một cơ chế kiểm tra nội bộ đủ mạnh, không chỉ để giải quyết các vấn đề đã phát sinh mà còn để xây dựng một tương lai AI an toàn và đáng tin cậy hơn, khi trách nhiệm không chỉ nằm ở nhà phát triển mà còn được kiểm chứng bởi những đôi mắt độc lập từ bên trong.

Canonical: https://www.tungpham.vn/blog/anthropic-cung-accenture-do-tien-ty-de-danh-gia-ai-tu-ben-trong
