• Ở mảng video AI, EntityBench đặt ra một bài kiểm tra quan trọng: mô hình tạo video không chỉ cần hình ảnh đẹp, mà phải giữ đúng nhân vật, vật thể và địa điểm qua nhiều cảnh. Benchmark gồm 140 episode, 2.491 shot, với độ khó lên tới 50 shot, 13 nhân vật, 8 địa điểm và 22 vật thể trong cùng một chuỗi. Cũng trong video, Causal Forcing++ hướng tới tạo video tương tác thời gian thực bằng cơ chế autoregressive theo từng frame, chỉ cần 1–2 sampling steps. Điều này mở ra viễn cảnh người dùng có…