• Các mô hình ngôn ngữ – thị giác ngày nay có thể mô tả ảnh, đọc tài liệu, phân tích biểu đồ và hỗ trợ nhiều tác vụ đa phương thức. Nhưng bài báo Online Self-Calibration Against Hallucination in Vision-Language Models cho thấy một điều quan trọng: AI nhìn ảnh rất giỏi, nhưng vẫn có thể “ảo giác” — tức mô tả những chi tiết không hề tồn tại trong ảnh. Vấn đề này đặc biệt nguy hiểm trong y tế, xe tự lái, robot và các hệ thống cần độ tin cậy cao. Điểm sâu sắc của nghiên…