ĐIỂM TIN AI NÓNG - 04/07/2026
Model Releases & Đột phá Công nghệ
- Anthropic / Claude Fable 5: Trong cửa sổ quét lần này không xuất hiện thêm một model frontier hoàn toàn mới từ OpenAI, Anthropic, Google DeepMind hay Hugging Face; tín hiệu model đáng chú ý nhất vẫn là phần hậu kiểm kỹ thuật Anthropic đăng ngày
02/07/2026choClaude Fable 5. Điểm quan trọng không nằm ở “ra model mới” mà ở chỗ Anthropic bắt đầu công khai hóa spec an toàn đủ chi tiết để đội dev và security map thẳng vào quy trình vận hành: hệ thống phân loại tách bốn nhómprohibited use,high-risk dual use,low-risk dual usevàbenign use, đồng thời dùng thangCyber Jailbreak SeveritytừCJS-0đếnCJS-4để chấm mức độ bypass. Với các team đang đưa model agentic vào workflow thực chiến, đây là thay đổi đáng theo dõi vì nó biến câu chuyện jailbreak từ mức “tin tức an toàn” sang một khung đánh giá có thể dùng để rà policy, false positive và quy trình allowlist nội bộ.Nguồn: Anthropic - More details on Fable 5’s cyber safeguards and our jailbreak framework, Anthropic Newsroom, OpenAI - How ChatGPT adoption has expanded.
Cập nhật Sản phẩm & Công cụ
- GitHub Copilot / Session Limits: GitHub đã thêm cơ chế chặn chi phí theo phiên cho
Copilot CLIvàGitHub Copilot SDK, cho phép đặt giới hạn bằng lệnh/limitstrong phiên tương tác hoặc cờ--max-ai-creditscho chạy không tương tác. Điểm đáng chú ý là GitHub nói rõ giới hạn này theo dõi toàn bộ chi phí phát sinh trong một phiên, gồmmodel calls,subagentsvà cả nềnbackground work like compaction, tức là đã bắt đầu xem agent như một job có budget thay vì một prompt đơn lẻ. Với đội automation hoặc agent chạy nền, đây là thay đổi rất thực dụng vì nó giúp giới hạn burn-rate mà không phải tự viết lớp guardrail riêng từ đầu. Tính năng đang ởpublic preview, hỗ trợ từCopilot CLI 1.0.66+vàCopilot SDK 1.0.5+.
Nguồn: GitHub Changelog - Set AI credit session limits in Copilot CLI and SDK. - GitHub Copilot / Gemini model deprecation: GitHub tiếp tục cảnh báo rằng
Gemini 2.5 ProvàGemini 3 Flashsẽ bị gỡ khỏi toàn bộ trải nghiệm Copilot vào ngày31/07/2026, bao gồmCopilot Chat,inline edits,ask and agent modesvàcode completions; model thay thế được đề xuất lần lượt làGemini 3.1 ProvàGemini 3.5 Flash. Tác động chính ở đây là vận hành hơn là tính năng: nếu team đang pin model trong promptbook, extension nội bộ hoặc policy enterprise, họ phải đổi sớm để tránh gãy workflow cuối tháng. Đây cũng là tín hiệu rõ rằng model lifecycle trong IDE đang ngắn gần như API lifecycle, nên đội dùng AI cho coding không thể coi model picker là tầng hạ tầng “ổn định mặc định” nữa.
Nguồn: GitHub Changelog - Upcoming deprecation of Gemini 2.5 Pro and Gemini 3 Flash.
Nghiên cứu & Học thuật (Báo cáo nổi bật)
- Hugging Face / Distillation trong kỷ nguyên open models: Bài viết mới trên Hugging Face ngày
03/07/2026không công bố benchmark mới, nhưng có giá trị kỹ thuật vì nó tổng hợp distillation như một lớp post-training đang quay lại trung tâm cuộc chơi open model. Luận điểm chính là distillation không còn là mẹo nén model cổ điển mà đang trở thành cách để chuyển hành vi từ frontier hoặc large model xuống những model nhỏ hơn, rẻ hơn và dễ triển khai hơn; bài viết liên hệ trực tiếp đến các dòng model gần đây nhưGLM-5.2,Qwen3vàDeepSeek. Với developer, điểm đáng chú ý là chiến lược cạnh tranh đang dịch từ “train một model to hơn” sang “tái sử dụng năng lực của model mạnh qua pipeline huấn luyện thông minh hơn”, điều này ảnh hưởng trực tiếp tới cách đánh giá open-weight stack và chi phí triển khai local/private inference.
Nguồn: Hugging Face - A brief history of distillation in AI.
🏷️ Từ khóa Xu hướng (Keywords)
copilot-budget-guards, gemini-deprecation, fable-5-safeguards, distillation, agent-cost-control
