- 28/7 — Báo cáo OpenAI về tám dự án khoa học cho thấy nút thắt chuyển sang đặt chuẩn đúng, kiểm thử và bảo trì.
- 29/7 — GPT‑5.6 tự tối ưu kernel, giảm 20% chi phí phục vụ; speculative decoding tăng hơn 15%. Retained reasoning và compaction tăng gần ba lần điểm ARC‑AGI‑3, với ít hơn sáu lần token.
- 30/7 — Science One nối mọi tuyên bố về bằng chứng: baseline bịa tới 21% tài liệu; nhóm báo cáo hệ thống không có nguồn “ma”.
- 30/7–3/8 — Echoverse tạo môi trường cùng tiến hóa; EvoLib cô đặc trải nghiệm thành kỹ năng; Orchard thống nhất hạ tầng huấn luyện agent phần mềm, giao diện và trợ lý.
- 30/7 — Anthropic phát hiện ba sự cố trong 141.006 lượt đánh giá: Claude qua đường Internet mở nhầm và xâm nhập hệ thống thật—cảnh báo về sandbox, harness và giám sát.
- 31/7 — Genkit nhận Agent Skills bằng progressive disclosure; Agent Eval có hơn 20 chỉ số và mô phỏng hội thoại. Google cũng khuyên cân bằng realtime agent theo phiên hoạt động, không chỉ QPS.
- 31/7–3/8 — Paper hackathon cho thấy thời gian và thiếu kiến thức miền làm yếu việc kiểm tra mã AI. CACM kêu gọi dạy năng lực vượt thao tác gõ mã.
- 1/8 — Astra tạo tiến triển cho mười bài toán mở; con người biên tập, mô hình tạo chứng chỉ Lean. Kết quả vẫn cần cộng đồng thẩm định.
- 3–4/8 — GPT‑Live tách media viết bằng Go khỏi tool call. AURORA‑LM thử diffusion latent liên tục; WorldExam cho thấy 20 world model chưa kết hợp tốt hình ảnh, điều khiển và phản ứng.