• MulTaBench nhấn mạnh rằng dữ liệu thật hiếm khi chỉ là văn bản hoặc bảng số liệu đơn lẻ. Benchmark này gồm 40 bộ dữ liệu, chia cho hai nhóm image-tabular và text-tabular, phản ánh các tình huống như hồ sơ bệnh án kèm ảnh X-quang, sản phẩm kèm ảnh và mô tả. Đây là hướng quan trọng cho AI ứng dụng trong y tế, giáo dục, thương mại và phân tích dữ liệu. Ở tầng hạ tầng, MinT cho thấy cuộc đua LLM không chỉ nằm ở mô hình lớn, mà còn ở cách triển khai tiết kiệm.…