Phát hành & Cập nhật mô hình
Mô hình ẩn Ox Alpha. Một mô hình ẩn tên Ox Alpha có vẻ được xây dựng dựa trên GLM hoặc Mimo, nhưng chi tiết chưa được xác nhận. Mô hình này được mô tả là thuộc nhóm tiên phong về lập trình hiệu quả, làm việc tác tử bền bỉ và sẵn sàng dùng trong production.
SenseNova U1.5-Lite. SenseNova phát hành U1.5-Lite, một mô hình hợp nhất duy nhất gộp các expert chuyên biệt cho từng tác vụ về hiển thị văn bản, thẩm mỹ và chỉnh sửa ảnh. Mô hình cải thiện khả năng làm theo chỉ dẫn phức tạp, tạo ảnh 4K trực tiếp và độ trung thực khi chỉnh sửa.
Tencent Hunyuan Hy4. Tencent đã bắt đầu thử nghiệm giới hạn mô hình chủ lực Hunyuan Hy4 trên ứng dụng Yuanbao, được gắn nhãn là mô hình cấp chuyên gia có khả năng dùng công cụ, định vị trên Hy3 và DeepSeek.
Model 2 nội bộ của Anthropic. Báo cáo rủi ro của Anthropic cho thấy mô hình mạnh nhất của họ, có mật danh Model 2, chỉ dùng nội bộ, vượt trội các mô hình Claude công khai và được dùng nhiều cho lập trình cũng như nghiên cứu.
Base checkpoint Ling-3.0. AntLing phát hành sáu base checkpoint cho Ling-3.0 ở hai kích thước và ba giai đoạn huấn luyện, tất cả đều có giấy phép MIT, dùng để tiếp tục tiền huấn luyện và phục vụ nghiên cứu.
Sản phẩm & Nền tảng Agent
Plugin ChatGPT cho Messages. OpenAI tung ra plugin cho Apple Messages, cho phép ChatGPT phân tích, soạn và gửi tin nhắn, hoạt động cùng Codex và ChatGPT Work. Chi tiết về quyền riêng tư vẫn chưa được làm rõ.
Ứng dụng Meta AI cho Mac. Meta phát hành ứng dụng Mac có tính năng đọc chính tả toàn hệ thống và nhận biết màn hình qua Muse Spark, đồng thời bổ sung tích hợp doanh nghiệp cho quảng cáo và Google Workspace.
Kênh Code của Slack. Slack giới thiệu các kênh vibe-coding cộng tác, nơi nhóm có thể gắn thẻ các tác tử AI như Claude hoặc Devin, xem lại diff và xem trước kết quả trước khi phát hành.
Binance Agent OS. Binance ra mắt Agent OS, nền tảng cho phép tác tử AI phân tích thị trường và thực hiện giao dịch, có giới hạn do người dùng đặt và hỗ trợ MCP.
Ramp ra mắt Router. Ramp ra mắt Router, dịch vụ định tuyến mô hình AI cung cấp quyền truy cập nhiều nhà cung cấp LLM và nhiều chiến lược, miễn phí đến hết năm 2026.
Công cụ & Framework
LangSmith Preview Builds. LangSmith bổ sung Preview Builds, cho phép nhóm kiểm thử các thay đổi agent từ nhánh PR trong môi trường cô lập gần giống production trước khi merge.
NVIDIA CUDA MCP. NVIDIA phát hành máy chủ CUDA MCP được lưu trữ cho các tác vụ CUDA với sự hỗ trợ của AI như tìm kiếm tài liệu chính thức, viết mã GPU tối ưu và phân tích hiệu năng.
Skill /wayfinder. Matt Pocock phát hành /wayfinder, một skill giúp agent lập kế hoạch cho các dự án có trạng thái cuối không rõ ràng, giải quyết bài toán lập kế hoạch trong “màn sương chiến tranh”.
LFM2.5-DSpark. Hugging Face công bố DSpark cho dòng mô hình LFM2.5, giúp suy luận nhanh hơn tới 3,2 lần trên GPU và 2,87 lần trên thiết bị, đồng thời giảm 57% độ trễ function-calling.
Nghiên cứu & Benchmark
Hiệu năng Qwen3.8-27B. Một lập trình viên đã tối ưu Qwen3.8-27B để đạt 381 tps trên RTX 3090 và benchmark đạt 29/30 trên AIME 2026 khi dùng FP8 và chế độ suy luận cao, ngang bằng Claude Opus 4.6.
Robot one-shot GEN-1.5. GEN-1.5 của Generalist AI dạy robot làm nhiệm vụ mới chỉ từ một bản demo dài 3-12 giây, đạt trung bình 59% thành công và 83% với 10 bước huấn luyện.
Trang web do AI viết. Pew Research nhận thấy hơn một phần ba số trang web xuất bản từ khi ChatGPT ra đời có dấu hiệu do AI viết, dựa trên kết quả phát hiện của Pangram trên dữ liệu Common Crawl.
Guardrail khiến AI bị phát hiện. Theo CTO của Pangram, các guardrail sau huấn luyện gây ra mode collapse, khiến văn bản LLM có thể bị phát hiện; còn các mô hình nền và các bản fine-tune hẹp có thể tránh bị phát hiện.
Sutton bàn về dữ liệu tổng hợp. Richard Sutton cho rằng dữ liệu tổng hợp sẽ không giải quyết được bài toán scaling, gọi đây là một “sai lầm lớn” vì thế giới có độ phức tạp vô hạn.
Tao bàn về khủng hoảng toán học. Terence Tao nói AI có thể gây ra cuộc khủng hoảng lớn nhất của toán học kể từ thời Gödel, buộc phải xem xét lại điều gì được coi là đóng góp toán học.
Ngành & Kinh doanh
Micro1 bùng nổ dữ liệu. Startup dữ liệu huấn luyện AI Micro1 đã tăng run rate doanh thu gộp từ 100 triệu USD lên 500 triệu USD trong tám tháng, với doanh thu thuần khoảng 150-200 triệu USD, giữa lúc nhu cầu dữ liệu huấn luyện AI độc nhất đang bùng nổ.
OpenAI vs Anthropic. Dữ liệu từ Ramp cho thấy Anthropic dẫn trước OpenAI trong nhóm người dùng doanh nghiệp tại Mỹ với tỷ lệ 44% so với 40%, nhưng OpenAI đang tăng trưởng nhanh hơn từ đầu quý 3 đến nay.
Vụ kiện Runlayer/Rippling. Runlayer và Rippling đã rút đơn kiện liên quan đến vụ cạnh tranh MCP gateway; Rippling ăn mừng bằng cách ngay lập tức phát hành MCP gateway của mình.
Brockman nắm quyền tại OpenAI. Greg Brockman đã âm thầm gom quyền lực tại OpenAI, đảm nhiệm điều hành hoạt động hằng ngày với tư cách chủ tịch trong khi Sam Altman vẫn là CEO, trước thềm IPO.
AI Trung Quốc bắt kịp. Phân tích của Decoder cho rằng Kimi K3 và GLM-5.3 của Trung Quốc đã tiến sát các mô hình Mỹ, khiến hào lũy cạnh tranh dịch chuyển từ vị thế dẫn đầu về mô hình sang các yếu tố khác.
Tài chính vòng tròn Unitree. Mức định giá 50 tỷ USD cho đợt IPO của Unitree (Trung Quốc) dựa trên việc các trung tâm được nhà nước hậu thuẫn mua robot rồi bán lại dữ liệu huấn luyện, làm dấy lên lo ngại về tài chính vòng tròn.
Bảo mật & Độ tin cậy
Tấn công prompt injection Grok. Các nhà nghiên cứu đã chứng minh Grok có thể lấy dữ liệu người dùng khi các chỉ dẫn độc hại được mã hóa; xAI đã được thông báo hồi tháng 6 nhưng vấn đề vẫn tồn tại.
Lỗi phản hồi vô nghĩa Grok. Grok đã gửi phản hồi vô nghĩa cho một số người dùng trên Grok.com; xAI xác nhận đây là sự cố sinh nội dung hiếm gặp và tạm thời.
Đó là tất cả cho hôm nay - khoảng 5 phút đọc.