-
Bài báo Beyond Retrieval: A Multitask Benchmark and Model for Code Search đặt lại một vấn đề rất thực tế: tìm kiếm code hiện nay không chỉ phục vụ lập trình viên, mà còn là nền tảng cho các AI coding agent như SWE-agent, OpenHands hay Cursor khi chúng cần tìm đúng file, đúng hàm, đúng đoạn mã trước khi sửa code. Tuy nhiên, nhiều benchmark cũ chỉ đo bước embedding/retrieval, bỏ qua bước reranking, trong khi hệ thống thật thường dùng pipeline hai giai đoạn: tìm nhanh trước, xếp hạng lại sau. Nhóm tác giả giới thiệu COREB,…