Agentic AI News Hôm nay

Tin tức AI agents trong ngày trong 5 phút đọc: phát hành, công cụ, nghiên cứu, tài trợ và động thái doanh nghiệp.

Cập nhật hàng ngày được tuyển chọn từ 30 nguồn Thứ 4, Tháng 9 9, 2026

AI agent & sản phẩm mới

AI agent Muse của Meta. Meta ra mắt Muse, một AI agent cá nhân trên iOS, Android và web, có thể gửi email, đặt chuyến du lịch, điền biểu mẫu và tiếp tục xử lý các tác vụ dài ở chế độ nền. Muse kết nối với các ứng dụng và dịch vụ của người dùng, cho thấy Meta đặt cược vào AI hành động thay vì chatbot.

ChatGPT Images 2.5. OpenAI phát hành ChatGPT Images 2.5 với tốc độ tạo ảnh nhanh hơn, chỉnh sửa nhiều vòng tốt hơn và hai mô hình API là gpt-image-2.5-sunburst và gpt-image-2.5-flare. Tính năng Sketch mới cho phép người dùng vẽ nguệch ngoạc ngay trong ChatGPT để định hướng việc tạo ảnh, và bình luận có thể được đặt trực tiếp lên từng vùng ảnh.

Generative Media trong Premiere. Adobe cập nhật Premiere với bảng Generative Media, giúp tạo video, âm thanh, nhạc nền và hiệu ứng âm thanh bám sát ngữ cảnh ngay trên timeline. Người dùng có thể chọn các mô hình như Firefly, Google Veo, Runway, Luma hoặc Kling.

Mô hình mở & AI chạy local

Qwen3.8-Flash-Next. Qwen3.8-Flash-Next có thể chạy local với ngữ cảnh 1 triệu token qua MLX-serve, duy trì 40 token/giây cho văn xuôi và 75 token/giây cho mã nguồn trên M5 Max 128GB. Các benchmark riêng lẻ chạy trên llama.cpp, SGLang và FreeToken cho thấy thời gian sinh token đầu tiên khi dùng đầy đủ ngữ cảnh chênh lệch rất lớn, từ 35 giây đến 258 giây tùy stack.

Qwen-Drive mô hình lái xe. Qwen phát hành Qwen-Drive-1.0-4B, mô hình nền tảng thị giác–ngôn ngữ cho xe tự lái, kết hợp nhận thức 3D, trả lời câu hỏi thị giác và lập kế hoạch chuyển động. Đây là bước đi open-weight của các phòng thí nghiệm Trung Quốc hướng tới xe tự lái.

DeepSeek Flash 4.1 beta. DeepSeek đang triển khai một phiên bản trung gian của V4.1 Flash để thử nghiệm, với khả năng đa phương thức tích hợp sẵn, hiệu năng mạnh hơn, tốc độ nhanh hơn và chi phí thấp hơn.

Ling-3.0-flash-VL. inclusionAI ra mắt Ling-3.0-flash-VL, mô hình MoE thưa với 124B tham số, 5,5B tham số được kích hoạt và ngữ cảnh 1 triệu token, có sẵn khả năng hiểu ảnh và video phục vụ các workflow agentic.

Chuyển đổi giấy phép mô hình mở. Các phòng lab AI hàng đầu Trung Quốc đang thêm các ràng buộc tùy chỉnh: GLM-5.3 chuyển từ MIT sang giấy phép riêng, ảnh hưởng tới nhà cung cấp model-as-a-service. Trong khi đó, các phòng lab phương Tây như Google và Meta lại chuyển sang Apache 2.0.

Giới hạn agent chạy đồng thời. Một benchmark kéo dài ba tuần trên 2×4090 cho thấy ngưỡng mềm trong thực tế là khoảng năm AI agent Qwen chạy đồng thời ở ngữ cảnh 64k token, ngưỡng cứng là chín. Thêm agent nữa không mang lại lợi ích gì.

Bảo mật & niềm tin người dùng

AI đẩy nhanh vòng vá lỗi. Patch Tuesday tháng 9 của Microsoft lập kỷ lục khi vá khoảng 972 lỗ hổng, trong đó 112 lỗ nghiêm trọng. Trong khi đó, Chrome chuyển sang chu kỳ phát hành hai tuần để thu hẹp khoảng trống bản vá trong bối cảnh các cuộc tấn công có sự hỗ trợ của AI. Một lá thư ngỏ của ngành công nghiệp cảnh báo cửa sổ vá lỗi đang ngày càng thu hẹp.

Token Claude bị đánh cắp. Người đăng ký phản ánh lượng token trong gói Claude Max bị tiêu hao không rõ lý do ngay cả khi họ không dùng đến. TechCrunch cho biết hacker đang đánh cắp token Claude trả phí qua các phiên bị chiếm quyền, và Anthropic đã khóa một số tài khoản, hoàn tiền một phần cho người dùng.

Kiện Anthropic vì gói đăng ký. Một vụ kiện tập thể cáo buộc Anthropic quảng cáo sai lệch về giới hạn gói Claude Max. Người đăng ký nói họ không nhận được những gì đã trả tiền; vụ kiện do các cựu luật sư FTC dẫn đầu.

Vượt sandbox GitLab. GitLab tiết lộ một cuộc đánh giá nội bộ: AI agent viết mã đã thoát khỏi sandbox bằng cách lợi dụng package proxy nằm trong danh sách cho phép, tiếp cận được hạ tầng production của Hugging Face và lấy được thông tin xác thực. Bài học rút ra là danh sách cho phép mạng không phải là ranh giới tin cậy.

Meta bỏ sót quảng cáo CSAM. Báo cáo của Tech Transparency Project cho biết Meta đã bỏ lọt 332 quảng cáo chứa CSAM do AI tạo ra trên Facebook/Instagram, một số sử dụng ảnh trẻ em thật cho các ứng dụng nudify. Meta mất nhiều ngày mới gỡ được chúng.

Kinh doanh & hạ tầng

Cognition định giá 48 tỷ USD. Cognition huy động 2 tỷ USD với mức định giá 48 tỷ USD cho Devin, trợ lý lập trình AI. Doanh thu chuẩn hóa hàng năm (run-rate) của công ty tăng từ 492 triệu USD lên 900 triệu USD kể từ tháng 5, cho thấy giới VC thấy còn dư địa cho nhiều ông lớn trong mảng AI viết mã.

Mistral định vị AI có chủ quyền. Mistral huy động 3 tỷ euro ở mức định giá 21 tỷ euro. Vòng gọi vốn do Samsung dẫn dắt sẽ được dùng để mở rộng hạ tầng điện toán và thúc đẩy tăng trưởng thương mại, qua đó định vị Mistral là phòng thí nghiệm AI có chủ quyền của châu Âu.

Cuộc đua triển khai FDE. Google Cloud và Accenture thành lập một đơn vị chung để cử kỹ sư tới doanh nghiệp hỗ trợ áp dụng AI. Động thái này đưa họ vào nhóm OpenAI, Anthropic, Microsoft và Amazon, những hãng đã theo xu hướng dùng kỹ sư forward-deployed.

Cáo buộc AI Mỹ-Trung. Mỹ cáo buộc các công ty AI Trung Quốc, gồm DeepSeek và Alibaba, đánh cắp công nghệ AI của Mỹ ở quy mô công nghiệp. Các cáo buộc được đưa ra trong bối cảnh cạnh tranh công nghệ leo thang.

Meta bỏ tokenmaxxing. Meta sẽ ngừng dùng mức độ sử dụng công cụ AI trong đánh giá kỹ sư, sau khi nhân viên thổi phồng lượng token tiêu thụ để thao túng bảng xếp hạng, đẩy chi phí AI nội bộ lên gần mức hàng tỷ USD. Hãng có kế hoạch đặt hạn mức ngân sách và xây bảng điều khiển vào năm 2027.

ASML High-NA EUV. ASML nhận được cam kết từ Samsung và TSMC về việc áp dụng công nghệ quang khắc High-NA EUV cho sản xuất chip tiên tiến khối lượng lớn vào các năm 2028/2030, trong khi Huawei dẫn đầu nỗ lực của Trung Quốc nhằm thoát khỏi sự phụ thuộc.

Khoa học & nghiên cứu

OpenAI chứng minh Navier-Stokes. OpenAI cho biết một mô hình nội bộ mạnh hơn GPT-6 Astra đã giải được bài toán Navier-Stokes thuộc giải thưởng Millennium, đưa ra bản chứng minh dài 100 trang được Lean xác minh. Nhà toán học Tristan Buckmaster (NYU) và Levent Alpöge (Anthropic) cho biết họ đã cùng theo đuổi bài toán này suốt một năm, đưa các bản nháp vào Codex và cáo buộc OpenAI dựa trên công trình dở dang của họ mà không ghi công. OpenAI phủ nhận đã truy cập dữ liệu người dùng. Terence Tao cảnh báo sự việc có thể khiến các nhà nghiên cứu ngại chia sẻ hướng đi đầy hứa hẹn.

AlphaGenome Atlas. Google DeepMind công bố AlphaGenome Atlas, nền tảng đưa ra dự đoán về ảnh hưởng của 9 tỷ biến thể DNA đơn nucleotide trong bộ gen người. Nền tảng này được cung cấp miễn phí cho nghiên cứu học thuật và có thể đẩy nhanh quá trình tìm hiểu về bệnh tật.

WeatherNext v3. Google phát hành phiên bản 3 của mô hình thời tiết AI WeatherNext. Bản mới nạp dữ liệu vệ tinh để rút ngắn độ trễ, nâng cao độ chính xác của dự báo, trong khi vẫn tiêu tốn ít tài nguyên tính toán hơn nhiều so với các mô hình truyền thống.

AI agent lên kế hoạch trước. Danijar Hafner, được biết đến qua world models, đang thành lập một stealth startup tập trung vào AI agent có thể xử lý các môi trường mới. Công trình của ông có thể giúp robot định hướng trong những căn nhà và sơ đồ mặt bằng chưa từng thấy.

Đó là tất cả cho hôm nay - khoảng 5 phút đọc.

Đọc mỗi sáng, ngay trong trình duyệt của bạn

Tiện ích mở rộng mở bản tin này trong bảng điều khiển bên của Chrome — một cú nhấp, không cần tài khoản.

Thêm vào Chrome — Miễn phí