ĐIỂM TIN AI NÓNG - 09/07/2026
Model Releases & Đột phá Công nghệ
- OpenAI / GPT-Live: Trong cửa sổ quét 24 giờ tính đến
09/07/2026, phát hành mô hình đáng chú ý nhất làGPT-Live, thế hệ voice model mới hiện đang chạy phía sauChatGPT Voicetheo công bố ngày08/07/2026. Điểm khác biệt cốt lõi là kiến trúcfull-duplex, cho phép model nghe và nói đồng thời thay vì chờ hết lượt như voice stack kiểu cũ; đồng thời nó có thể ủy quyền các tác vụ cần web search, reasoning sâu hoặc agentic work sang model frontier phía sau, hiện tại làGPT-5.5, mà vẫn giữ mạch hội thoại. OpenAI cho biếtGPT-Live-1vàGPT-Live-1 miniđược người đánh giá ưu tiên hơnAdvanced Voice Modetrong các phiên đối thoại ghép cặp dài5-10 phút, đồng thời có cải thiện trênGPQA,BrowseCompvà bài test nội bộτ³-Voice Telecom. Với team xây giao diện thoại hoặc trợ lý voice-first, đây là tín hiệu rõ rằng tầng hội thoại thời gian thực đang được tách khỏi tầng suy luận sâu để vừa giảm độ trễ vừa giữ được năng lực agentic. Nguồn: OpenAI - Introducing GPT-Live.
Cập nhật Sản phẩm & Công cụ
- Anthropic / Claude Cowork trên web và mobile: Theo release notes cập nhật ngày
07/07/2026,Claude Coworkđã khả dụng trên web và mobile ngoài bản desktop, rollout trước cho góiMaxrồi mở rộng dần. Điểm quan trọng với workflow là phiên làm việc chạy từ xa, nên session và file được gắn với tài khoản Claude thay vì phụ thuộc vào một máy cụ thể; Anthropic cũng nêu rõ tác vụ có thể tiếp tục chạy khi người dùng đóng laptop và scheduled tasks không cần thiết bị online. Với người dùng agent cho công việc dài hơi, đây là bước dịch chuyển rõ từ “agent bám máy local” sang “agent roaming đa thiết bị”. Nguồn: Anthropic Release Notes. - Hugging Face / native-speed vLLM transformers backend: Bài viết ngày
08/07/2026cho biết backendtransformerstrongvLLMhiện đã đạt tốc độ ngang hoặc nhanh hơn các implementationvLLMviết tay trên nhiều kiến trúc LLM. Theo Hugging Face, model author chỉ cần dùng cờ--model-impl transformersđể tận dụng serving tốc độ cao, trong khi benchmark công bố cho thấy backend mới đạt hoặc vượt native throughput trên ba cấu hình Qwen3 khác nhau, từ4Bdense một GPU đến235BFP8 MoE trên8xH100. Tác động thực tế là cùng một codebase model trongtransformersgiờ có thể đi thẳng sang serving hiệu năng cao mà không phải duy trì thêm một bản port tối ưu riêng cho suy luận. Nguồn: Hugging Face - Native-speed vLLM transformers modeling backend. - Hugging Face + AWS / một-click sang SageMaker Studio: Công bố ngày
07/07/2026từ Hugging Face và Amazon bổ sung deep-link cho phép đi từ trang model trên Hugging Face sang đúng luồngSageMaker Studiochỉ bằng một lựa chọn. Theo mô tả chính thức, người dùng có thể nhảy thẳng vào workflow fine-tune quaJumpStarthoặc deploy vàoSageMaker Inference, thay vì phải tự đi qua các bước mở console, dựng domain, cấu hình IAM và xin quota GPU như trước. Với nhóm triển khai model mở trong môi trường AWS, thay đổi này không phải “AI mới” nhưng là cải tiến deployment path rất thực dụng vì nó giảm đáng kể phần việc hạ tầng lặp lại trước khi bắt đầu thử nghiệm. Nguồn: Hugging Face - From Hugging Face to Amazon SageMaker Studio in one click.
Nghiên cứu & Học thuật (Báo cáo nổi bật)
- OpenAI / audit benchmark SWE-Bench Pro: Trong bài nghiên cứu công bố ngày
08/07/2026, OpenAI báo cáo rằng sau một đợt audit chi tiết, họ ước tính khoảng~30%tác vụ trongSWE-Bench Prolà bị lỗi hoặc không còn cho tín hiệu đánh giá đáng tin cậy. Bài viết nêu bốn nhóm lỗi chính: test quá chặt vào chi tiết cài đặt, prompt thiếu yêu cầu mà hidden tests lại đòi, test coverage thấp và prompt gây hiểu sai hướng giải. Điểm kỹ thuật đáng chú ý không chỉ là việc benchmark có vấn đề, mà còn là quy trình kiểm tra chất lượng dữ liệu bằng agent pipeline kết hợp review của kỹ sư phần mềm giàu kinh nghiệm. Với các team dùng benchmark coding để chọn model hoặc chứng minh năng lực agent, đây là lời nhắc mạnh rằng số điểm benchmark cần được kiểm toán dataset và phương pháp chấm trước khi dùng làm căn cứ sản phẩm hay an toàn triển khai. Nguồn: OpenAI - Separating signal from noise in coding evaluations.
🏷️ Từ khóa Xu hướng (Keywords)
gpt-live, chatgpt-voice, claude-cowork, vllm, sagemaker-studio, swe-bench-pro
