Agentic AI News Hôm nay

Tin tức AI agents trong ngày trong 5 phút đọc: phát hành, công cụ, nghiên cứu, tài trợ và động thái doanh nghiệp.

Cập nhật hàng ngày được tuyển chọn từ 30 nguồn Thứ 4, Tháng 8 19, 2026

Mô hình cục bộ & Phần cứng

Cải thiện tốc độ Qwen3.8-27B. Giải mã spec DFlash2 đẩy Qwen3.8-27B lên 218 tok/s trên hai 3090, khoảng 200 trên 5090 và 124 trên một 3090 với engine tối ưu. Có sẵn các bản lượng tử GGUF DFlash2.

Qwen cỡ trung tiếp theo. Quản lý cộng đồng của Qwen cho biết một mô hình open-weight cỡ trung mới dự kiến ra mắt vào tuần tới, có thể hơn 100B tham số, không có truy cập sớm.

Hỗ trợ edge cho Ling-3.0. llama.cpp hiện chính thức hỗ trợ Ling-3.0 (BailingMoE3). Biến thể tiny chạy toàn bộ ngữ cảnh 128K trên Orin Nano 8GB giá $249 ở tốc độ 33 tok/s, trong khi Arc B580 đạt ~114 tok/s.

Tốc độ DeepSeek V4 Flash. Các kernel tối ưu và làm nóng KV-cache giảm thời gian phản hồi chat trên Mac Studio M3 Ultra từ 6-20 giây xuống 1,6 giây. Cấu hình 4x RTX 3060 xử lý prompt ở ~100 tok/s với lượng tử 144GiB.

Tổng hợp mô hình bit thấp. Bonsai 27B ternary hiện hoạt động trên CUDA/Vulkan chính thống; Mach-1 Additive 35B chạy tới 120 t/s trên laptop tiêu dùng. Các biến thể mới dựa trên Qwen3.8-27B đang được phát triển.

Công cụ & Khung tác nhân

Bộ đánh giá tác nhân tinh chỉnh. LangChain giới thiệu Tuned Evaluators tự động gắn phản hồi Perceived Error vào các trace sản xuất. Nó sử dụng mô hình chuyên dụng, cắt giảm chi phí đánh giá tới 82%.

Điểm chuẩn tìm kiếm tác nhân. Chỉ số Tìm kiếm của Artificial Analysis xếp hạng Parallel, Exa, Firecrawl và các đơn vị khác theo chất lượng, chi phí và tốc độ cho tác nhân. Chất lượng tìm kiếm tốt hơn giảm sử dụng token trên 40%.

WriteGuard cho MCP. WriteGuard của Cloudflare, hiện đang ở bản beta riêng, bổ sung các chính sách tập trung, quy gán và nhật ký kiểm toán cho các hành động ghi qua máy chủ MCP.

Nhà máy phần mềm Warp. Warp Factories là lớp cơ sở hạ tầng giúp các công ty nhỏ hơn triển khai tác nhân mã AI bằng mô hình nhà máy phần mềm.

Bản mô phỏng Claude Code. Lệnh /design của Anthropic trong Claude Code tạo bản mô phỏng UI trong terminal, khớp với phong cách codebase hiện có trước khi phát triển.

An toàn, Bảo mật & Chính sách

Đại tu bảo mật OpenAI. Sau sự cố Hugging Face và bằng chứng Astra có thể chạm tới năng lực an ninh mạng nguy cấp, OpenAI đã tạm dừng RL trong hai tuần và củng cố sandbox. Đợt chạy RL tiên phong lớn nhất dự kiến vẫn bị hoãn.

Copilot tiết lộ các rào chắn. Các nhà nghiên cứu yêu cầu Microsoft 365 Copilot giải thích các rào chắn xác nhận người dùng của chính nó, sau đó xây dựng exploit nhấp liên kết để đánh cắp dữ liệu mà không cần xác nhận.

ChatGPT for Teens. ChatGPT for Teens tự động áp dụng cho người dùng dưới 18 tuổi, với các hạn chế nội dung chặt chẽ hơn, Chế độ học tập và kiểm soát của phụ huynh. Nó nhằm giảm gian lận và nội dung có hại.

Tranh luận mô hình mở của Amodei. CEO Anthropic Dario Amodei lập luận rằng các mô hình mở chuyển quyền lực cho chủ sở hữu chip và bảo vệ các đề xuất quản lý AI. Các nhà phê bình bao gồm LeCun và Sacks cáo buộc ông gieo rắc sự sợ hãi.

Ngành công nghiệp & Kinh doanh

Cursor ra mắt Origin. Cursor ra mắt Origin, đối thủ của GitHub để lưu trữ mã, với các tính năng gốc tác nhân và hệ sinh thái ứng dụng được lên kế hoạch.

Định giá Etched tăng gấp đôi. Etched huy động được 700 triệu USD ở mức định giá 21 tỷ USD, tăng gấp đôi trong một tháng, sau khi Jane Street thử nghiệm chip suy luận prefill/decode của công ty.

Nhu cầu định tuyến mô hình. Việc Stripe mua OpenRouter với giá 7 tỷ USD và ARR 300 triệu USD của Glean làm nổi bật nhu cầu ngày càng tăng đối với định tuyến mô hình khi các mô hình open-weight ngày càng được ưa chuộng.

Nghiên cứu & Khảo sát

Hiệu chuẩn bộ nhớ tác nhân. Nghiên cứu của Hugging Face cho thấy hiệu quả bộ nhớ tác nhân khác nhau theo tầng mô hình: gpt-oss-120b tăng +16,1 điểm phần trăm hoàn thành nhiệm vụ với hướng dẫn đầy đủ, trong khi các mô hình yếu hơn cần truy xuất nhỏ gọn.

Dữ liệu sử dụng AI độc lập. Đài quan sát AI của Stanford tổng hợp các cuộc trò chuyện thực tế và phát hiện việc sử dụng AI khác nhau đáng kể giữa các mô hình, với các trường hợp sử dụng công việc ít phổ biến hơn so với tuyên bố của các công ty.

Nén ngữ cảnh làm rơi hướng dẫn. Các nhà nghiên cứu Penn State phát hiện chỉ 17% ràng buộc phiên tồn tại sau khi nén ngữ cảnh; một LLM bổ trợ nhỏ khôi phục hầu hết các hướng dẫn bị mất.

Tự cải thiện không sớm xảy ra. Nghiên cứu do Princeton dẫn đầu cho thấy các tác nhân AI có thể giải quyết các vấn đề kỹ thuật nhưng thiếu khả năng phán đoán cho nghiên cứu AI mở, gợi ý rằng tự cải thiện đệ quy có thể mất nhiều thời gian hơn.

Đó là tất cả cho hôm nay - khoảng 5 phút đọc.

Đọc mỗi sáng, ngay trong trình duyệt của bạn

Tiện ích mở rộng mở bản tin này trong bảng điều khiển bên của Chrome — một cú nhấp, không cần tài khoản.

Thêm vào Chrome — Miễn phí