Loading, please wait..

Mẹo giữ nhất quán nhân vật trong AI Video với thủ thuật “vòng tròn trắng”

Khi tạo video bằng AI từ hình ảnh (Image-to-Video), một trong những lỗi phổ biến nhất là Character Drift – hiện tượng khuôn mặt nhân vật bị biến dạng, mờ hoặc thay đổi qua từng khung hình.

Nhiều người sử dụng “Character Sheet” (bảng thiết kế nhân vật gồm nhiều góc độ) để nạp cho AI, nhưng lại vô tình làm giảm chất lượng khuôn mặt. Giải pháp khắc phục lại nằm ở một chi tiết cực kỳ đơn giản: Một vòng tròn màu trắng che đi khuôn mặt ở góc toàn thân.

Tại sao thủ thuật này lại hiệu quả?

Các mô hình AI video hoạt động dựa trên cơ chế nội suy và trích xuất đặc điểm (feature extraction) từ ảnh đầu vào:

  • Vấn đề của cách làm cũ: Khi bạn cung cấp một character sheet thông thường, AI sẽ nhận diện tất cả các khuôn mặt có trong ảnh. Khuôn mặt ở góc chụp toàn thân thường rất nhỏ, ít pixel và thiếu chi tiết. Khi AI cố gắng “trộn” dữ liệu từ khuôn mặt mờ này với khuôn mặt sắc nét ở góc cận cảnh, kết quả đầu ra sẽ bị nhiễu và mất ổn định.
  • Sức mạnh của “Vòng tròn trắng”: Bằng cách che hoàn toàn khuôn mặt ở góc toàn thân (front view), bạn đang “ép” AI chỉ được phép học dữ liệu khuôn mặt từ MỘT nguồn duy nhất: bức ảnh cận cảnh (macro) sắc nét nhất.

Cấu trúc của một character sheet tối ưu

Một bức ảnh tham chiếu hoàn hảo cho AI Video theo phương pháp này sẽ bao gồm 3 phần:

  1. Toàn thân chính diện (Khuôn mặt bị che): Cung cấp dữ liệu về trang phục, vóc dáng và tỷ lệ cơ thể.
  2. Toàn thân từ phía sau: Cung cấp dữ liệu về kiểu tóc, chiều dài tóc và chi tiết mặt lưng của trang phục.
  3. Cận cảnh macro khuôn mặt: Nguồn dữ liệu nhận diện danh tính (identity) duy nhất, sắc nét, rõ lỗ chân lông và kết cấu da.

Hướng dẫn áp dụng

Bạn có thể tạo ra bức ảnh character sheet tối ưu này thông qua các công cụ tạo ảnh AI (như Midjourney hoặc Stable Diffusion) bằng cách sử dụng ảnh gốc (Image Reference) kết hợp với cấu trúc prompt sau:

Film character sheet, photorealistic commercial studio photography. Three views of the exact same person from the attached reference image, standing in a row on a seamless neutral grey [#B8B8B8] background: full-body front view, full-body back view, and a macro close-up portrait of the face. Identical person, outfit, hairstyle and styling in all three views, matched true to the reference photo.

In the full-body front view the person stands upright in a relaxed neutral pose facing the camera, head level, and a flat opaque solid white circle graphic is placed directly over the face, completely covering it from forehead to chin, like an anonymized casting photo — crisp clean circle edge, pure white fill.

The full-body back view shows the person from behind, feet to head fully in frame. The macro close-up shows the face fully and clearly, looking straight into the lens, sharp focused eyes, natural skin texture with visible pores. Soft even studio lighting with smooth falloff, clean commercial catalogue look, crisp fabric detail, accurate face, body proportions and clothing carried over exactly from the reference image.


Chỉ với một thao tác che mặt đơn giản ở góc chụp xa, bạn đã giúp mô hình AI Video loại bỏ được dữ liệu nhiễu, từ đó khóa chặt đặc điểm nhận dạng và tạo ra các thước phim mượt mà, chân thực hơn.