Mặt trái của sức mạnh AI trong ghép ảnh
Khả năng hoán đổi khuôn mặt trong ảnh đã trở nên quá đỗi quen thuộc, nhưng ít ai để ý đến những chi tiết nhỏ làm nên sự khác biệt giữa một tác phẩm "ảo" và một sản phẩm công nghệ thực sự tinh vi. Mục tiêu không chỉ là ghép mặt vào ảnh chân dung với trang phục, kiểu tóc hay trang điểm khác, mà còn là giữ nguyên những yếu tố còn lại của bức hình gốc. Đó là lúc những công cụ như Kling IMAGE 3.0 thể hiện vai trò, khi nó không chỉ đơn thuần đặt một khuôn mặt lên ảnh khác, mà còn cho phép người dùng đưa ra các chỉ dẫn rõ ràng về những gì cần thay đổi và những gì nên giữ nguyên. Để đạt được kết quả như ý, chúng ta cần bắt đầu với ảnh gốc và cung cấp một ảnh tham chiếu khuôn mặt rõ ràng, dễ nhìn, ít vật cản, và có góc độ, biểu cảm tương đồng với ảnh mục tiêu. Điều thú vị là Kling IMAGE 3.0 còn hỗ trợ tới 10 ảnh tham chiếu, giúp mô hình thu thập thông tin đầy đủ về cấu trúc khuôn mặt từ nhiều góc độ và biểu cảm khác nhau. Chẳng hạn, một ảnh chụp chính diện giúp xác định tổng thể khuôn mặt, trong khi ảnh chụp nghiêng bổ sung chi tiết về đường nét, sống mũi và hàm. Các biểu cảm đa dạng còn giúp AI nắm bắt những thay đổi quanh mắt, miệng, đảm bảo khuôn mặt được hoán đổi chân thực và gần với bản gốc nhất có thể. Khi chỉ muốn thay đổi khuôn mặt, người dùng cần hướng dẫn Kling IMAGE 3.0 một cách rõ ràng: xác định người cần thay thế và khẳng định rằng kiểu tóc, quần áo, tư thế, ánh sáng và phông nền phải được giữ nguyên. Nếu ảnh tham chiếu có nhiều người, việc chỉ rõ khuôn mặt cần dùng sẽ giúp mô hình chọn đúng mà không làm ảnh hưởng đến các chi tiết khác. Sau khi các đầu vào đã sẵn sàng, mô hình sẽ tạo ra ảnh hoán đổi, đồng thời bảo toàn tư thế, ánh sáng và bối cảnh gốc. Sản phẩm cuối cùng có thể xuất ở độ phân giải lên đến 2K với Kling IMAGE 3.0, hoặc lên đến 4K với Kling IMAGE 3.0 Omni, đáp ứng nhu cầu chi tiết cao. Ngay cả sau khi hoán đổi, chúng ta vẫn có thể tiếp tục chỉnh sửa biểu cảm, kiểu tóc, ánh sáng và các chi tiết khác ngay trong Kling IMAGE 3.0. Tuy nhiên, không phải