Skip to content

ĐIỂM TIN AI NÓNG - 09/07/2026

Model Releases & Đột phá Công nghệ

  • OpenAI / GPT-Live: Trong cửa sổ quét 24 giờ tính đến 09/07/2026, phát hành mô hình đáng chú ý nhất là GPT-Live, thế hệ voice model mới hiện đang chạy phía sau ChatGPT Voice theo công bố ngày 08/07/2026. Điểm khác biệt cốt lõi là kiến trúc full-duplex, cho phép model nghe và nói đồng thời thay vì chờ hết lượt như voice stack kiểu cũ; đồng thời nó có thể ủy quyền các tác vụ cần web search, reasoning sâu hoặc agentic work sang model frontier phía sau, hiện tại là GPT-5.5, mà vẫn giữ mạch hội thoại. OpenAI cho biết GPT-Live-1GPT-Live-1 mini được người đánh giá ưu tiên hơn Advanced Voice Mode trong các phiên đối thoại ghép cặp dài 5-10 phút, đồng thời có cải thiện trên GPQA, BrowseComp và bài test nội bộ τ³-Voice Telecom. Với team xây giao diện thoại hoặc trợ lý voice-first, đây là tín hiệu rõ rằng tầng hội thoại thời gian thực đang được tách khỏi tầng suy luận sâu để vừa giảm độ trễ vừa giữ được năng lực agentic. Nguồn: OpenAI - Introducing GPT-Live.

Cập nhật Sản phẩm & Công cụ

  • Anthropic / Claude Cowork trên web và mobile: Theo release notes cập nhật ngày 07/07/2026, Claude Cowork đã khả dụng trên web và mobile ngoài bản desktop, rollout trước cho gói Max rồi mở rộng dần. Điểm quan trọng với workflow là phiên làm việc chạy từ xa, nên session và file được gắn với tài khoản Claude thay vì phụ thuộc vào một máy cụ thể; Anthropic cũng nêu rõ tác vụ có thể tiếp tục chạy khi người dùng đóng laptop và scheduled tasks không cần thiết bị online. Với người dùng agent cho công việc dài hơi, đây là bước dịch chuyển rõ từ “agent bám máy local” sang “agent roaming đa thiết bị”. Nguồn: Anthropic Release Notes.
  • Hugging Face / native-speed vLLM transformers backend: Bài viết ngày 08/07/2026 cho biết backend transformers trong vLLM hiện đã đạt tốc độ ngang hoặc nhanh hơn các implementation vLLM viết tay trên nhiều kiến trúc LLM. Theo Hugging Face, model author chỉ cần dùng cờ --model-impl transformers để tận dụng serving tốc độ cao, trong khi benchmark công bố cho thấy backend mới đạt hoặc vượt native throughput trên ba cấu hình Qwen3 khác nhau, từ 4B dense một GPU đến 235B FP8 MoE trên 8xH100. Tác động thực tế là cùng một codebase model trong transformers giờ có thể đi thẳng sang serving hiệu năng cao mà không phải duy trì thêm một bản port tối ưu riêng cho suy luận. Nguồn: Hugging Face - Native-speed vLLM transformers modeling backend.
  • Hugging Face + AWS / một-click sang SageMaker Studio: Công bố ngày 07/07/2026 từ Hugging Face và Amazon bổ sung deep-link cho phép đi từ trang model trên Hugging Face sang đúng luồng SageMaker Studio chỉ bằng một lựa chọn. Theo mô tả chính thức, người dùng có thể nhảy thẳng vào workflow fine-tune qua JumpStart hoặc deploy vào SageMaker Inference, thay vì phải tự đi qua các bước mở console, dựng domain, cấu hình IAM và xin quota GPU như trước. Với nhóm triển khai model mở trong môi trường AWS, thay đổi này không phải “AI mới” nhưng là cải tiến deployment path rất thực dụng vì nó giảm đáng kể phần việc hạ tầng lặp lại trước khi bắt đầu thử nghiệm. Nguồn: Hugging Face - From Hugging Face to Amazon SageMaker Studio in one click.

Nghiên cứu & Học thuật (Báo cáo nổi bật)

  • OpenAI / audit benchmark SWE-Bench Pro: Trong bài nghiên cứu công bố ngày 08/07/2026, OpenAI báo cáo rằng sau một đợt audit chi tiết, họ ước tính khoảng ~30% tác vụ trong SWE-Bench Pro là bị lỗi hoặc không còn cho tín hiệu đánh giá đáng tin cậy. Bài viết nêu bốn nhóm lỗi chính: test quá chặt vào chi tiết cài đặt, prompt thiếu yêu cầu mà hidden tests lại đòi, test coverage thấp và prompt gây hiểu sai hướng giải. Điểm kỹ thuật đáng chú ý không chỉ là việc benchmark có vấn đề, mà còn là quy trình kiểm tra chất lượng dữ liệu bằng agent pipeline kết hợp review của kỹ sư phần mềm giàu kinh nghiệm. Với các team dùng benchmark coding để chọn model hoặc chứng minh năng lực agent, đây là lời nhắc mạnh rằng số điểm benchmark cần được kiểm toán dataset và phương pháp chấm trước khi dùng làm căn cứ sản phẩm hay an toàn triển khai. Nguồn: OpenAI - Separating signal from noise in coding evaluations.

🏷️ Từ khóa Xu hướng (Keywords)

gpt-live, chatgpt-voice, claude-cowork, vllm, sagemaker-studio, swe-bench-pro