Agentic AI News Hôm nay

Tin tức AI agents trong ngày trong 5 phút đọc: phát hành, công cụ, nghiên cứu, tài trợ và động thái doanh nghiệp.

Cập nhật hàng ngày được tuyển chọn từ 30 nguồn Thứ 5, Tháng 8 13, 2026

Phát hành Mô hình & Agent

Grok 4.6 và Grok Bot. SpaceXAI đã phát hành Grok 4.6, mô hình này ngang bằng với GPT-5.6 Sol của OpenAI và chỉ xếp sau Claude Opus 5 trên chỉ số Artificial Analysis, đồng thời có giá thấp hơn các mô hình tiên phong, và giới thiệu Grok Bot, một trợ lý AI luôn hoạt động, làm việc từ máy tính đám mây riêng của nó để hoàn thành các nhiệm vụ được giao.

Qwen 3.8 lớn và nhỏ. Qwen3.8-2.4T-A95B hiện đã có sẵn, và một trang Qwen3.8 27B đã xuất hiện ngắn trên ModelScope trước khi bị gỡ xuống, cho thấy bản phát hành sắp diễn ra. Những người đam mê chạy cục bộ đã lên kế hoạch phân chia phần cứng cho mô hình 2.4T.

Cập nhật DeepSeek V4 Pro. DeepSeek V4 Pro 0813 có sẵn qua API trên OpenRouter, chưa có trang công bố chính thức; việc mở trọng số là khả năng cao dựa trên các bản phát hành trước. Hành vi suy luận của nó khác biệt rõ rệt giữa các mức suy luận thấp, trung bình và cao.

Mô hình thị giác biên. LFM2.5-VL-3B của Liquid AI mang lại khả năng gắn kết giao diện người dùng (UI grounding) mạnh mẽ hơn nhiều và có thể chạy trên điện thoại, trong khi North Micro Vision của Cohere theo giấy phép Apache-2.0 cung cấp hỗ trợ ảnh độ phân giải gốc trong gói tham số nhỏ gọn 2.4B.

Mô hình nghìn tỷ tham số của Nvidia. Nvidia được báo cáo đang xây dựng Nemotron 4 với ít nhất một nghìn tỷ tham số và tăng gấp ba chi phí đào tạo đám mây lên 28 tỷ USD đến năm 2031, nhằm cạnh tranh với các mô hình open-weight của Trung Quốc.

Phát triển & Công cụ Agent

Managed agents và BYOC. LangChain đã ra mắt Managed Deep Agents như bước tiếp theo sau các framework, và đưa LangSmith BYOC lên AWS dưới dạng phát hành rộng rãi, cho phép doanh nghiệp giữ các dấu vết và dữ liệu của agent bên trong VPC riêng của họ.

Ứng dụng ChatGPT trên Linux. OpenAI đã phát hành ứng dụng desktop Linux gói gồm ChatGPT, ChatGPT Work và Codex, nhưng tính năng điều khiển máy tính nguyên bản không có sẵn khi ra mắt.

Suy luận cục bộ & Phần cứng

Giá RTX PRO 6000 tăng gấp đôi. Nvidia gần như tăng gấp đôi MSRP của RTX PRO 6000 Blackwell 96GB lên 16.000 USD, sau khi các đơn đặt trước năm ngoái dưới 8.000 USD.

DSpark chạy trên một GPU. Một RTX PRO 6000 96GB duy nhất có thể chạy DeepSeek V4 Flash 284B với tốc độ khoảng 31 token mỗi giây nhờ drafter của DSpark trong RAM hệ thống, nhanh hơn khoảng 15-17% so với mức cơ sở không có drafter khi sử dụng cùng mức VRAM.

Muse Glimmer trên Mac. Muse Glimmer 30B của Meta hiện chạy nhanh hơn tới khoảng 3,3 lần trên Apple Silicon nhờ mlx-dspark, mang lại chất lượng 8-bit với tốc độ gần 4-bit trên Mac 48GB.

Lượng tử hóa bộ nhớ đệm KV Gemma 4. Huấn luyện nhận biết lượng tử hóa giúp Gemma 4 31B giữ chất lượng dưới lượng tử hóa bộ nhớ đệm KV mạnh mẽ, giúp suy luận ngữ cảnh lớn thực tế hơn.

Ngành công nghiệp & Kinh doanh

Cognition gọi vốn ở mức 40 tỷ USD. Công ty tạo agent viết mã AI Cognition được báo cáo đang đàm phán để gọi vốn với định giá 40 tỷ USD sau khi đạt tốc độ doanh thu hàng năm 1 tỷ USD, tăng từ 492 triệu USD ba tháng trước.

Lovable đạt 13,3 tỷ USD. Startup vibe-coding Lovable đã gọi vốn 400 triệu USD với định giá 13,3 tỷ USD sau khi vượt qua 500 triệu USD doanh thu hàng năm, với 60 triệu dự án được lưu trữ.

AI doanh nghiệp của Thrive Holdings. Thrive Holdings, được hỗ trợ bởi OpenAI, đã gọi vốn 2 tỷ USD với định giá 12 tỷ USD để mua lại các doanh nghiệp truyền thống và triển khai AI, mở rộng ngoài kế toán và CNTT.

Thị phần Gemini giảm. Dữ liệu thị trường từ Pangram, OpenRouter và Similarweb cho thấy việc sử dụng Gemini đang giảm, với Pangram ghi nhận giảm xuống 1,9% nội dung do AI viết trong khi OpenAI nắm giữ hơn 50%.

Claude tiến vào lĩnh vực pháp lý. Anthropic đã thuê nhà sáng lập AI pháp lý Robert Mahari làm Trưởng bộ phận Claude cho lĩnh vực pháp lý đầu tiên, tiếp nối các plugin và quan hệ đối tác pháp lý trước đó.

Chính sách, An ninh & Xã hội

Rò rỉ chuỗi cung ứng LiteLLM. Một cuộc tấn công chuỗi cung ứng vào LiteLLM đã làm lộ hàng terabyte thông tin đăng nhập của hơn 2.500 tổ chức, bao gồm Microsoft, Amazon và Samsung, thông qua các gói PyPI độc hại.

Hình mờ đầu ra Claude. Anthropic hiện đánh dấu hình mờ lên đầu ra của Claude để tuân thủ Đạo luật AI của EU, gây khó chịu cho những người dùng lo sợ nó sẽ lộ việc dùng AI trong công việc hoặc học tập.

Twitch mặc định dùng dữ liệu để huấn luyện. Twitch sẽ huấn luyện các mô hình AI của Amazon trên nội dung streamer theo mặc định, với tùy chọn từ chối hiện đã có; chính sách này đã gây phản ứng dữ dội.

ShieldFont thay thế văn bản. Các nhà thiết kế đã phát hành ShieldFont, một phông chữ hiển thị văn bản bình thường cho người dùng nhưng thay thế các từ trong HTML cơ bản để gây nhiễu cho các công cụ thu thập dữ liệu.

Hinton, Li, Ng về AI mở. Tại Ai4, Geoffrey Hinton, Fei-Fei Li và Andrew Ng đã tranh luận về việc giữ AI mở để tránh một số ít công ty kiểm soát quyền truy cập, bất chấp những lo ngại về an toàn đối với trọng số mở.

Sách quý bị tiêu hủy. Các nhà bán sách lo ngại rằng các công ty AI đang mua sách quý và tiêu hủy chúng để huấn luyện, bất chấp các giải pháp quét không phá hủy.

Nghiên cứu & Điểm chuẩn

Lý luận cấu trúc liên kết MindTopo. Bộ điểm chuẩn MindTopo của Microsoft Research cho thấy các mô hình đa phương thức giỏi nhận dạng cấu trúc liên kết tĩnh nhưng gặp khó khăn với lập kế hoạch tương tác đòi hỏi duy trì mối quan hệ theo thời gian.

Tái tạo prompt từ đầu ra. IIT Bombay và Adobe Research đã phát triển Previous-Token Prediction, công cụ có thể tái tạo prompt của LLM từ văn bản đầu ra với độ chính xác gần như hoàn hảo mà không cần trọng số mô hình.

Đó là tất cả cho hôm nay - khoảng 5 phút đọc.

Đọc mỗi sáng, ngay trong trình duyệt của bạn

Tiện ích mở rộng mở bản tin này trong bảng điều khiển bên của Chrome — một cú nhấp, không cần tài khoản.

Thêm vào Chrome — Miễn phí