# Claude Sonnet 5: đưa khả năng tác nhân của AI lên tầm cao mới

Đăng ngày: 2026-07-05

Tôi để ý rằng Anthropic vừa giới thiệu Claude Sonnet 5, một bước tiến đáng kể khi đưa khả năng tác nhân (agentic) lên một tầm cao mới trong dòng Sonnet của họ. Mô hình này được xây dựng để trở thành Sonnet có khả năng tác nhân cao nhất, có thể tự mình lập kế hoạch, sử dụng các công cụ như trình duyệt hay terminal, và vận hành một cách tự chủ ở mức độ mà vài tháng trước, chỉ những mô hình Opus lớn hơn và đắt đỏ hơn mới làm được. Điều này gợi nhớ lại cách các mô hình Sonnet 3.5, 3.6 và 3.7 đã từng mở ra kỷ nguyên AI tác nhân cho nhiều nhà phát triển với kỹ năng mã hóa và sử dụng công cụ ấn tượng. Điều đáng chú ý là Sonnet 5 đã thu hẹp đáng kể khoảng cách về hiệu suất so với Opus 4.8, nhưng lại có mức giá phải chăng hơn. Đây là một cải tiến đáng kể so với người tiền nhiệm Sonnet 4.6 trên các khía cạnh quan trọng của hiệu suất tác nhân như khả năng lý luận, sử dụng công cụ, mã hóa và xử lý công việc tri thức. Phản hồi từ các đối tác thử nghiệm sớm của Anthropic cũng nhất quán: Sonnet 5 vượt trội hơn nhiều so với các mô hình Sonnet trước đó, có thể hoàn thành những nhiệm vụ phức tạp mà các phiên bản cũ thường dừng lại, thậm chí tự kiểm tra kết quả đầu ra mà không cần được yêu cầu rõ ràng, tất cả ở một mức giá hấp dẫn. Trên các đánh giá như BrowseComp và OSWorld-Verified, Sonnet 5 là một cải tiến rõ rệt so với Sonnet 4.6, và ở mức độ nỗ lực cao hơn, nó có thể sánh ngang Opus 4.8 trên một số tác vụ. Về mặt kinh tế, Claude Sonnet 5 đã có mặt trên tất cả các gói dịch vụ của Anthropic ngay từ hôm nay. Nó trở thành mô hình mặc định cho các gói Free và Pro, đồng thời cũng có sẵn cho người dùng Max, Team và Enterprise. Các nhà phát triển có thể sử dụng Sonnet 5 qua API với mức giá giới thiệu là 2 USD cho mỗi triệu token đầu vào và 10 USD cho mỗi triệu token đầu ra, áp dụng đến hết ngày 31 tháng 8 năm 2026. Sau thời gian này, giá sẽ là 3 USD cho mỗi triệu token đầu vào và 15 USD cho mỗi triệu token đầu ra. Anthropic cũng đã tăng giới hạn tốc độ trên Chat, Cowork, Claude Code và Claude Platform để người dùng có thể tùy chỉnh mức độ "nỗ lực" của mô hình cho phù hợp với dự án của mình, nhằm cân bằng giữa chi phí và hiệu suất. Tuy nhiên, Anthropic cũng rất thẳng thắn về khía cạnh an toàn. Các đánh giá nội bộ cho thấy Sonnet 5 có tỷ lệ hành vi không mong muốn thấp hơn Sonnet 4.6 và nhìn chung an toàn hơn khi sử dụng trong các ngữ cảnh tác nhân. Mô hình này tốt hơn trong việc từ chối các yêu cầu độc hại và chống lại các cuộc tấn công injection prompt. Tỷ lệ ảo giác và nịnh nọt cũng thấp hơn Sonnet 4.6. Về an ninh mạng, Sonnet 5 thể hiện khả năng thực hiện các nhiệm vụ nguy hiểm (như phát triển khai thác lỗ hổng phần mềm) kém hơn đáng kể so với các mô hình Opus hiện tại. Mặc dù có tỷ lệ thành công một phần cao hơn Sonnet 4.6 trong việc khai thác lỗ hổng trình duyệt Firefox (do cải thiện trí thông minh chung), Sonnet 5 chưa bao giờ phát triển được một khai thác hoàn chỉnh. Vì lý do này, các biện pháp bảo vệ an ninh mạng được kích hoạt mặc định ngay khi ra mắt, tương tự như trong Claude Opus 4.7 và 4.8, nhưng ít nghiêm ngặt hơn Fable 5. Nhìn chung, sự ra đời của Claude Sonnet 5 cho thấy một xu hướng quan trọng: khả năng tác nhân ngày càng mạnh mẽ không còn là đặc quyền của những mô hình đắt đỏ nhất. Bằng cách thu hẹp khoảng cách với Opus 4.8 trong khi giữ mức giá phải chăng, Anthropic đang dân chủ hóa quyền tiếp cận các AI có khả năng lập kế hoạch và tự chủ hành động. Điều này có ý nghĩa lớn đối với doanh nghiệp và nhà phát triển, mở ra cánh cửa cho việc ứng dụng AI vào nhiều quy trình phức tạp hơn mà không phải đối mặt với rào cản chi phí quá lớn. Đây không chỉ là một mô hình mới, mà còn là một dấu hiệu cho thấy cuộc đua về hiệu quả chi phí trong kỷ nguyên AI tác nhân đang ngày càng nóng bỏng.

Canonical: https://www.tungpham.vn/blog/claude-sonnet-5-dua-kha-nang-tac-nhan-cua-ai-len-tam-cao-moi
