Agentic AI News Hôm nay

Tin tức AI agents trong ngày trong 5 phút đọc: phát hành, công cụ, nghiên cứu, tài trợ và động thái doanh nghiệp.

Cập nhật hàng ngày được tuyển chọn từ 30 nguồn Thứ 3, Tháng 9 1, 2026

Phát hành mô hình và trọng số mở

DeepSeek V4 Flash Vision. Bản trọng số thị giác thử nghiệm cho DeepSeek V4 Flash đã có trên Hugging Face, giúp mô hình đạt tương đương đa phương thức với Moonshot và GLM. Điều này mở rộng dòng trọng số mở cho nhu cầu chạy local và nghiên cứu.

Qwen coding có thị giác. Chạy Qwen3.8-27B với hỗ trợ thị giác cho phép mô hình chủ động chụp màn hình khi đang tự động lập trình, phát hiện các lỗi UI âm thầm và lặp lại cho đến khi xác nhận trực quan rằng đã sửa xong.

GLM 5.3 dựng 3D local. Một người dùng đã chạy GLM-5.3 và GLM-5.3 Flash lượng tử hóa trên máy local, dùng BlenderMCP để dựng căn penthouse đầy đủ nội thất từ số đo chi tiết, cho thấy khả năng tạo 3D agentic trên GPU local cao cấp.

Nanbeige 4.2 mô hình nhỏ. Bản phát hành Nanbeige4.2-3B-DSpark với 3B tham số nhắm đến người dùng GPU hạn chế, với tuyên bố hiệu năng mạnh hơn Qwen 3.5 9B và tốc độ sinh nhanh, khoảng 35 token/giây.

Mô hình local và suy luận

Hiệu năng Qwen3.8 Flash Next. Thử nghiệm Qwen3.8 Flash Next trên llama.cpp cho tốc độ từ 8,5 đến 109 token/giây, từ cấu hình CPU thuần túy đến 96GB VRAM. Theo cài đặt mặc định mới, bảng n-gram lớn được giữ trên đĩa, khiến xử lý prompt chậm tới 50% và sinh token chậm 15%, trừ khi truyền tham số --lazy-mode off.

Tăng tốc kvarn KV quants. Một bản fork beellama được tối ưu ngăn kvarn KV quantization suy giảm chất lượng ở ngữ cảnh dài, báo cáo tốc độ sinh token nhanh hơn tới 76% so với bản triển khai trước.

Tăng tốc prompt trên CPU. Một pull request trong llama.cpp giúp tăng tốc xử lý prompt theo lô lớn cho các mô hình IQ trên CPU AVX2.

Agent, công cụ và nền tảng

Luồng video AI vô tận. Fal tối ưu MiniMax H3 để suy luận nhanh gấp 35 lần và biến nó thành luồng video trực tiếp; SlopTV chạy MiniMax H3 trên máy local với hai GPU 5090 để tạo clip YouTube theo điều khiển bằng chat. Các nền tảng đã gỡ luồng của Fal, vì vậy Fal tự ra mắt dịch vụ riêng.

OpenClaw 2.0 và sự cố agent. OpenClaw 2.0 bổ sung cài đặt đơn giản hơn, ứng dụng trình duyệt được xây dựng lại và phiên nhiều người chơi. Một nhà nghiên cứu bảo mật của Meta cho biết agent OpenClaw của cô đã xóa email trong hộp thư đến sau khi các instruction bị nén, một lời nhắc về những lỗ hổng kiểm soát agent tự động.

DoorDash dùng agent Flux cloud. DoorDash đã chuyển các agent kỹ thuật từ laptop lên nền tảng đám mây Flux. Nền tảng này tự động hóa 130.000 tác vụ kỹ thuật trong một tháng và chạy hơn 25.000 lượt review code mỗi tuần dưới các guardrail doanh nghiệp.

Thư viện tracing Wrapture. Wrapture là công cụ Python mới dùng để bọc hàm phục vụ tracing và ghi đè giá trị, có hỗ trợ OpenTelemetry; toàn bộ công cụ được tạo ra bởi một trợ lý AI dưới sự chỉ đạo của con người.

Mở rộng Foundry Model Router. Microsoft đã mở rộng model router của Foundry từ 2 khu vực lên 28 khu vực, làm mới nhóm mô hình với Claude Opus 4.8 và GPT-5.6, đồng thời tự động cung cấp bản cập nhật cho các deployment mặc định.

Debian cho phép mã AI. Debian đã bỏ phiếu không ủng hộ cũng không cấm việc sử dụng AI tạo sinh trong các đóng góp. Nhà phát triển không bắt buộc khai báo việc AI hỗ trợ, nhưng vẫn chịu trách nhiệm với mã của mình.

Kinh doanh và thị trường

Quảng cáo ChatGPT vượt 1 tỷ USD. Mảng quảng cáo của OpenAI đã đạt tốc độ doanh thu quy đổi 1 tỷ USD/năm trong chưa đầy 200 ngày và đang mở rộng quảng cáo self-serve sang nhiều quốc gia hơn.

Tính phí theo kết quả. OpenAI đã bắt đầu cho một số khách hàng lớn chỉ trả tiền khi AI thực hiện thành công một nhiệm vụ, chẳng hạn xử lý yêu cầu hỗ trợ, không còn bó hẹp trong thuê bao cố định.

Mac mini cho AI agent. OpenAI và các đối thủ đang mua hàng chục nghìn Mac mini và Mac Studio để huấn luyện agent thao tác máy tính; Anthropic thuê Mac mini qua AWS, và bộ nhớ hợp nhất của Apple đang thúc đẩy việc dùng AI local.

Nvidia đầu tư MediaTek. Nvidia đang đầu tư 3,5 tỷ USD vào MediaTek để hỗ trợ sản xuất chip AI tùy chỉnh kết nối với các trung tâm dữ liệu dùng nền tảng Nvidia, nhằm giữ vị thế trung tâm khi các hyperscaler tự phát triển chip.

Chip HBM3E đầu tiên của Trung Quốc. CXMT đang sản xuất chip nhớ HBM3E đầu tiên của Trung Quốc với số lượng nhỏ. Alibaba và Cambricon dự kiến sử dụng chúng từ năm 2027, dù tỷ lệ đạt yêu cầu còn thấp và công nghệ vẫn thua kém các hãng dẫn đầu.

Ngân hàng Anh cảnh báo AI. Chủ tịch FSB Andrew Bailey cảnh báo các bộ trưởng tài chính G20 rằng định giá AI bị thổi phồng và mức đòn bẩy tăng cao có thể khuếch đại cú sốc tài chính tiếp theo, trong khi nhiều quốc gia vẫn thiếu các quy định AI tiên tiến.

OpenAI chia tay Cursor. OpenAI dự định chấm dứt hợp đồng với Cursor sau khi SpaceX mua lại Cursor, với lý do các công ty của Elon Musk vi phạm hợp đồng; việc cắt dịch vụ được ấn định vào tháng 11.

Chính sách, an toàn và nghiên cứu

EU xếp ChatGPT là VLOSE. EU đã phân loại ChatGPT là công cụ tìm kiếm trực tuyến rất lớn theo DSA, đồng thời xếp Reddit và Roblox vào nhóm nền tảng trực tuyến rất lớn. Các nền tảng này phải thực hiện đánh giá rủi ro, bảo vệ trẻ em và cho phép truy cập dữ liệu, với mức phạt lên tới 6% doanh thu toàn cầu.

Nhãn hồ sơ AI của Instagram. Instagram đã đổi nhãn AI creator thành AI-generated profile và sẽ giảm mức tiếp cận của các hồ sơ hiển thị người do AI tạo ra mà không khai báo. Người dùng thường không thể phân biệt những hồ sơ này với người thật.

Apple nộp bằng chứng chống OpenAI. Apple đã nộp bằng chứng mà họ gọi là gây sốc chống lại cựu nhân viên Chang Liu, cáo buộc anh ta sử dụng sơ đồ kỹ thuật bảo mật của Apple tại OpenAI và cố tiêu hủy bằng chứng; OpenAI bị cáo buộc đã biết về quyền truy cập của anh ta.

Anthropic bị kiện bản quyền. Sony, EMI và Warner Chappell đã kiện Anthropic, cho rằng khoản dàn xếp 1,5 tỷ USD trong vụ vi phạm bản quyền sách là quá nhỏ và dữ liệu huấn luyện lấy từ torrent cũng chứa hàng nghìn bài hát có bản quyền của họ.

Hugging Face bị hack. Các nhà bình luận cho rằng vụ hack Hugging Face gần đây cho thấy OpenAI cần xem xét các yếu tố con người và văn hóa đã khiến việc huấn luyện vẫn tiếp diễn bất chấp những cảnh báo nội bộ, chứ không chỉ các nguyên nhân kỹ thuật.

Mô hình bệnh lý hiệu quả. Microsoft Research đã phát hành GigaPath-Flash và GigaTIME-Flash, hai mô hình nền bệnh lý được chưng cất, giúp giảm chi phí tính toán trong khi vẫn hỗ trợ phân tích toàn bộ tiêu bản và vi môi trường khối u ở quy mô dân số.

Đó là tất cả cho hôm nay - khoảng 5 phút đọc.

Đọc mỗi sáng, ngay trong trình duyệt của bạn

Tiện ích mở rộng mở bản tin này trong bảng điều khiển bên của Chrome — một cú nhấp, không cần tài khoản.

Thêm vào Chrome — Miễn phí