Huấn luyện hiệu quả hơn, lập trình tự động hơn và yêu cầu kiểm soát chặt hơn
Mười nội dung dưới đây được chọn theo đóng góp kỹ thuật, khả năng ứng dụng và ý nghĩa đối với cộng đồng phát triển AI; ngày ghi theo nguồn gốc, các paper tính theo ngày nộp bản đầu tiên trên arXiv, không lấy ngày được chia sẻ lại.
- 09/9 — NCP-ArchPreview: LLM học dự đoán cả khái niệm.
Báo cáo giới thiệu mô hình 8,9 tỷ tham số kết hợp dự đoán token với dự đoán khái niệm gồm nhiều token, đạt mức lỗi tiền huấn luyện cuối cùng của OLMo-3-7B khi sử dụng 51,3% lượng token, cho thấy tiềm năng nâng hiệu quả học của LLM. Paper gốc — arXiv - 09/9 — NVIDIA công khai quy trình suy luận toán đạt ngưỡng huy chương vàng IMO.
Nghiên cứu công bố mô hình chuyên biệt, dữ liệu, mã huấn luyện và suy luận cho hệ thống Nemotron đạt 30/42 điểm trên đề IMO 2026 bằng vòng lặp tạo–kiểm tra–chỉnh sửa chứng minh, tạo điều kiện tái lập nghiên cứu suy luận toán bằng mô hình mở. Paper gốc — arXiv - 10/9 — SenseNova-U1.5 hợp nhất hiểu, suy luận và tạo ảnh.
Mô hình đa phương thức 8 tỷ tham số sử dụng kiến trúc không cần bộ mã hóa ảnh hay VAE riêng, đồng thời cải thiện tạo chữ, bố cục phức tạp và chỉnh sửa nhiều ảnh tham chiếu trong một hệ thống thống nhất. Paper gốc — arXiv - 10/9 — Hugging Face: Tăng tốc huấn luyện GRPO bằng LoRA.
Hướng dẫn tách huấn luyện và sinh dữ liệu trên các HF Jobs, chỉ đồng bộ bộ tham số LoRA nhỏ qua kho lưu trữ dùng chung, đồng thời minh họa cách tối ưu để giảm thời gian chạy 500 bước từ 3 giờ 27 phút xuống 53 phút trong cấu hình thử nghiệm. Bài kỹ thuật gốc — Hugging Face - 10/9 — Gradio Workflow biến quy trình xử lý ảnh thành ứng dụng có thể chỉnh sửa trực quan.
Bản hướng dẫn Workflow1111 kết nối tạo ảnh, nhận diện vật thể, tạo mặt nạ chỉnh sửa, xóa nền và chuyển ảnh thành video trên cùng một giao diện luồng xử lý, cung cấp ví dụ thực hành cụ thể để xây ứng dụng AI đa phương thức. Hướng dẫn gốc — Hugging Face - 11/9 — GitHub Copilot rà soát mã bằng thực thi và nhiều tác nhân.
Copilot code review bổ sung khả năng chạy lệnh build, kiểm thử và script để xác minh mã, đồng thời dùng nhiều tác nhân ở mức Lite với kết quả thử nghiệm tăng 47% số nhận xét mức nghiêm trọng cao được xử lý và giảm khoảng 8% chi phí rà soát. Công bố gốc — GitHub - 14/9 — Copilot cho phép chọn ưu tiên chi phí, cân bằng hoặc chất lượng.
Chế độ tự chọn mô hình bổ sung ba mức Efficiency, Balance và Intelligence, giúp người lập trình điều chỉnh cách hệ thống cân nhắc chi phí, chất lượng và thời gian phản hồi cho từng yêu cầu. Công bố gốc — GitHub - 09/9 — Anthropic công bố phân tích mới về các sự cố Claude truy cập hệ thống ngoài phạm vi.
Báo cáo xác định hai vấn đề nổi bật là suy luận thiên lệch và hành động liều lĩnh để hoàn thành nhiệm vụ, cung cấp bằng chứng rằng kiểm tra an toàn cần đánh giá hành vi thực tế khi môi trường bị cấu hình sai. Báo cáo gốc — Anthropic - 10/9 — Anthropic công bố báo cáo mới về lạm dụng AI.
Các trường hợp điều tra cho thấy AI đang được dùng để điều phối nhiều bước trong hoạt động tấn công mạng, lừa đảo và gây ảnh hưởng, đồng thời báo cáo cung cấp dấu hiệu nhận diện nhằm hỗ trợ các nền tảng tăng khả năng phát hiện và ngăn chặn. Báo cáo gốc — Anthropic - 14/9 — Microsoft đưa quyền kiểm soát của con người vào dự thảo quy tắc AI.
Microsoft công bố dự thảo Humanist AI Code of Conduct để lấy ý kiến, đặt quyền kiểm soát có ý nghĩa của con người làm mục tiêu trung tâm cho việc huấn luyện và quản trị các mô hình MAI trong tương lai. Công bố gốc — Microsoft AI
Ba paper arXiv trên là các bản công bố nghiên cứu ban đầu; kết quả định lượng được dẫn theo nhóm tác giả, chưa được xem là kết luận đã xác nhận độc lập.