Mô hình & giao diện
Claude Haiku 5.5. Mẫu nhanh và rẻ mới của Anthropic có context 1 triệu token, hạ giá prompt xuống 0,10 USD/triệu token cho 100K token đầu tiên, ngang ngửa GPT-6 Luna. Đổi lại, tokenizer của nó đếm nhiều hơn khoảng 25-30% token và giá tăng gấp 5 lần khi vượt mốc 100K. Các benchmark cho thấy bước nhảy lớn so với Haiku 4.5 cùng năng lực lập trình agentic khá cạnh tranh.
Mistral Large 4 "Le Chonk". Mistral phát hành bản xem trước mô hình open-weight 1.000 tỷ tham số, tối ưu cho lập trình, an ninh mạng và một số ngành cụ thể, đồng thời khẳng định năng lực đã tiệm cận các mô hình hàng đầu của Mỹ và Trung Quốc.
Mô hình quyết định Liquid AI. Liquid AI mở mã nguồn d1-3B và d1-omni-600M, những mô hình quyết định đa phương thức trả về câu trả lời có/không, lựa chọn hoặc điểm số đã hiệu chỉnh mà không tốn token đầu ra. d1-3B được cho là tốt nhất phân khúc dưới 10B trên Decision Index và chạy chỉ trong 16 ms trên phần cứng NVIDIA Jetson, kèm một bản chạy trên trình duyệt qua WebGPU.
API Decisions của OpenAI. OpenAI ra mắt bản beta API Decisions cho các bài đánh giá dạng có/không, phân loại và thang điểm trên văn bản hoặc hình ảnh, nhanh hơn Responses khoảng 10 lần. API hỗ trợ GPT-6 Luna với giá đầu vào 0,10 USD/triệu token và token đầu ra miễn phí.
UI thông minh của ChatGPT. Với GPT-6, ChatGPT có thể xuất ra biểu đồ tương tác, nút bấm, biểu mẫu và mini app thay vì chỉ văn bản thuần. OpenAI cho biết reasoning bắt đầu ngay trong bước thinking để cắt thời gian chờ; người dùng trả phí được dùng GPT-6 Sol, còn bản miễn phí dùng Luna.
Kandinsky 6.0 sinh video. Kandinsky Lab phát hành Kandinsky 6.0 Pro (29B) và Lite (3B), hỗ trợ ComfyUI lẫn Diffusers và bổ sung thêm bộ nâng cấp video.
Kết quả thi đấu Nemotron. Các mô hình Nemotron sau fine-tune đạt kết quả không chính thức mức huy chương vàng tại IOI 2026 (535,4/600) và điểm vàng chính thức tại IMO 2026 là 30/42, nhờ SFT, RL cùng quy trình generate-verify-refine.
Agent & framework
Agent của Nous Research. Nous Research huy động được 90 triệu USD với định giá 1,5 tỷ USD và ra mắt Hermes for Businesses, nhắm vào agent AI cho doanh nghiệp. Hermes Agent mã nguồn mở của công ty đã được clone 24 triệu lần, chiếm khoảng 2,5% lượng token AI toàn cầu.
Deep Agents của LangChain. LangChain giới thiệu bản cập nhật Skills giúp gắn công cụ với kỹ năng để giữ context gọn nhẹ, cùng Managed Deep Agents v0.9 với lịch chạy do agent tự tạo, cấu hình riêng cho từng lần chạy và reaction trên Slack.
Copilot hành động trên Windows. Hybrid Intelligence của Microsoft sẽ cho phép Copilot truy cập file cục bộ và thao tác khắp Windows, chẳng hạn tìm, đổi tên, nén và gửi email tài liệu thay người dùng.
Meta Muse lên iPad. Trợ lý agent Muse của Meta nay có bản native cho iPad sau khi đạt 6,6 triệu lượt cài đặt, đồng thời bổ sung connector cho các công cụ như Canva, GitHub và QuickBooks.
Agent Lightning RL. Microsoft Research mở mã nguồn Agent Lightning v1.0, framework RL cho agent gồm 3.500 dòng code, dùng chính harness triển khai thực tế và Kubernetes gốc. Trong một ví dụ, nó nâng Pass@1 của Qwen3.5-9B trên SWE-bench Verified từ 41,8% lên 56,4% với khoảng 6.000 mẫu huấn luyện.
AI local & công cụ lập trình
ROCm 10.1. ROCm 10.1 của AMD nhắm vào nút thắt truyền dữ liệu khi chạy inference local; bản phát hành này đang được người dùng AI local bàn tán trên Reddit.
llama.cpp tăng tốc MoE. llama.cpp bổ sung cache GPU cho các expert MoE nằm trong bộ nhớ host, hứa hẹn tăng tốc đáng kể với những mô hình không vừa hết VRAM, và thêm hỗ trợ GLM5Next MTP.
Unsloth Studio kiểm tra repo. Unsloth Studio nay kiểm tra lại các repository mô hình đáng tin cậy trước khi chạy, sau khi những phiên bản LiteLLM bị xâm nhập trên PyPI cho thấy tấn công chuỗi cung ứng có thể len vào công cụ AI.
GLM-5.3-Flash chạy 2 GPU. Một cấu hình gồm hai CMP 170HX 64GB chạy GLM-5.3-Flash ở context 384K, đạt khoảng 90 token/giây nhờ EXL3; mô hình MoE 320B giữ trọng số active trong HBM và được benchmark với Qwen3.8-Flash-Next.
Đánh giá Qwen chạy local. Các đánh giá gần đây của cộng đồng so sánh những bản fine-tune Qwen3.8-27B và Qwen3.8-Flash-Next với mô hình hàng đầu trên tác vụ chuyên ngành và lập trình. Một bài đánh giá 469 câu hỏi cho thấy mô hình local có thể tiệm cận kết quả của mô hình frontier nhờ riêng tư và chi phí thấp hơn, dù việc lạm dụng thinking token vẫn là vấn đề.
Phần cứng & Windows
Phần cứng AI Surface. Microsoft công bố Surface Laptop Ultra và Surface RTX Spark Dev Box, cả hai dựa trên chip RTX Spark kiến trúc Arm của Nvidia. Laptop có giá từ 2.599 USD, tối đa 128GB bộ nhớ hợp nhất, lên kệ ngày 16/10; Dev Box giá từ 5.999 USD, nhắm tới việc chạy các mô hình local từ 120B trở lên.
Ngành & doanh nghiệp
Khoảng cách hiểu code AI. Một khảo sát với 300 lãnh đạo kỹ thuật cấp cao cho thấy agent lập trình AI đã đẩy nút thắt sang khâu gỡ lỗi và thấu hiểu code: các nhóm nay mất 9,8 giờ/tuần để viết code nhưng tới 16,9 giờ/tuần để gỡ lỗi. Báo cáo cảnh báo rủi ro ngày càng lớn với những codebase trọng yếu.
Sáng kiến tế bào ảo. Biohub đang điều phối nỗ lực trị giá 1,8 tỷ USD nhằm xây dựng các mô hình AI dự đoán hành vi tế bào. Google DeepMind, Meta và Isomorphic Labs góp 300 triệu USD, còn Bộ Năng lượng Mỹ rót hơn 500 triệu USD cho đo đạc trong phòng thí nghiệm và compute.
Clone Adobe mã nguồn mở. Lập trình viên Brandon Thomas dùng Claude Opus 5.5 để dựng Artcraft, bộ bảy ứng dụng Rust/WebAssembly mã nguồn mở nhái lại Photoshop, Illustrator, Premiere cùng nhiều phần mềm khác của Adobe. Các ứng dụng còn sơ khai và nhiều hạn chế, nhưng dự án cho thấy khả năng tái hiện phần mềm theo kiểu clean-room nhờ AI hỗ trợ.
SynthID mở cho công chúng. Google mở công cụ dò SynthID cho tất cả mọi người, cho phép kiểm tra hình ảnh, video và âm thanh xem có gắn watermark của Google hay đối tác không. Hệ thống này đã đánh dấu hơn 180 tỷ nội dung và cũng được tích hợp sẵn trong Chrome lẫn Gemini.
Google Playground tạo game. Google Labs ra mắt Playground, nền tảng chạy trên trình duyệt cho phép người lớn ở Mỹ tạo game từ prompt văn bản, sử dụng Gemini, Nano Banana và Lyria. Unity cũng công bố Unity Spark cho phát triển game chuyên nghiệp có AI hỗ trợ.
Đó là tất cả cho hôm nay - khoảng 5 phút đọc.