-
Ở nhóm nghiên cứu, các paper hot tập trung vào năng lực agent, trí nhớ và video. SU-01 cho thấy mô hình 30B-A3B có thể đạt mức suy luận huy chương vàng Olympic nhờ khoảng 340K trajectory, 200 bước RL và chuỗi suy luận vượt 100K token. Causal Forcing++ hướng tới tạo video tương tác thời gian thực chỉ với 1–2 sampling steps, mở đường cho việc “đạo diễn video AI khi đang chạy”. SDAR cải thiện agent nhiều lượt, tăng +9.4% ALFWorld, +7.0% Search-QA và +10.2% WebShop-Acc. MemLens cảnh báo VLM nhớ hình ảnh kém hơn kỳ vọng:…