Agentic AI News Hôm nay

Tin tức AI agents trong ngày trong 5 phút đọc: phát hành, công cụ, nghiên cứu, tài trợ và động thái doanh nghiệp.

Cập nhật hàng ngày được tuyển chọn từ 30 nguồn Thứ 5, Tháng 10 1, 2026

Mô hình & phát hành trọng số mở

Gemini 4 Argon. Google công bố Gemini 4 Argon, mô hình frontier mới với hiệu năng hàng đầu ở lập trình, công việc tri thức và an ninh mạng. Trước mắt mô hình được triển khai cho các chuyên gia phòng thủ mạng đáng tin cậy qua Fairwind Program, và đã vận hành những quy trình nội bộ của Google như chuyển đổi C++ sang Rust ở quy mô lớn. Giá API giai đoạn đầu là 2 USD/10 USD cho mỗi triệu token đầu vào/đầu ra.

Bản fine-tune Victoria và Maple. Các nhà nghiên cứu phát hành hai bản fine-tune trọng số mở của Qwen3.8-Flash-Next: Victoria, mô hình lập trình và agent 48GB đạt 70% trên Terminal-Bench 2.1, và Maple, mặc định dùng nguồn Canada, trích dẫn nguồn chính thức của Canada 62,9% số lần so với 6% trước khi fine-tune. Cả hai đều có sẵn GGUF.

Mô hình đa ngữ Index-Translate. Nhóm Index LLM của BiliBili mở nguồn Index-Translate, hỗ trợ 150 ngôn ngữ văn bản với các lựa chọn 2B, 9B và 35B-A3B, kèm dịch tài liệu và phụ đề/lồng tiếng đa ngữ. Trọng số và mã nguồn theo giấy phép Apache-2.0.

Ling-3.1-flash. Phòng thí nghiệm Ling của Trung Quốc ra mắt Ling-3.1-flash, mô hình MoE tổng khoảng 560B tham số, khoảng 25B tham số hoạt động mỗi token và ngữ cảnh tối đa 1M. Mô hình miễn phí trong hai tuần trước khi mở nguồn, với điểm được công bố: 1.673 Elo trên GDPVal-AA v2.1, 75,16 trên FrontierSWE và 65,35 trên HealthBench Professional.

Agent & khả năng dùng máy tính

API Decisions của OpenAI. OpenAI giới thiệu Decisions API, buộc mô hình Luna chỉ được chọn trong các phương án định sẵn, nhờ đó việc ra quyết định nhanh và rẻ, tương tự Jev của TypeSafe. API này nhằm giúp quản lý cả bầy agent. Ari Weinstein của Sky thì mô tả cách các computer-use agent hiện kết hợp ảnh chụp màn hình với dữ liệu DOM/Playwright và tự phục hồi sau lỗi, khiến chúng đáng tin cậy hơn nhiều so với vài tháng trước.

DoorDash đặt món qua chat. DoorDash ra mắt một AI agent cho phép người dùng nhắn tin qua Apple Messages để đặt món, xử lý khẩu vị ăn uống của cả nhóm và gợi ý quán ăn gần đó. Danh sách chờ tại Mỹ đã mở, song song với các thử nghiệm giao hàng bằng drone ở Bắc California.

Agent thiết kế của Flow Engineering. Flow Engineering huy động 50 triệu USD vòng Series B với định giá 750 triệu USD cho các AI agent giúp khớp bản vẽ CAD với yêu cầu sản phẩm và kết quả mô phỏng. Khách hàng gồm Anduril, Rivian, Joby Aviation và GM PPU.

Restate huy động 20 triệu USD. Restate gọi được 20 triệu USD cho hạ tầng workflow durable, vốn phù hợp với những tiến trình AI agent chạy dài và khó đoán. Công ty đã ký nhiều hợp đồng trị giá sáu và bảy chữ số, và sẽ dùng số vốn này để mở rộng.

Công cụ lập trình & AI cục bộ

Kernel WebGPU cho AI cục bộ. Một bộ kernel WebGPU bao phủ hơn 200 phép toán ML phổ biến vừa được mở nguồn trên Hugging Face, cho phép chạy AI cục bộ hoàn toàn trong trình duyệt. Các kernel này đang được đưa upstream vào Transformers.js, ONNX Runtime Web và LiteRT.js.

GLM-5.3-Flash trên llama.cpp. llama.cpp đã merge hỗ trợ GLM-5.3-Flash (GLM5-Next), giúp mô hình này chạy được trên engine suy luận mã nguồn mở phổ biến.

Qwen trên NPU AMD. FastFlowLM nay hỗ trợ chạy Qwen 3.8 27B trên NPU AMD, nhưng tốc độ decode chỉ khoảng 1 token/giây, cho thấy năng lực NPU cho các mô hình lớn chạy cục bộ vẫn còn ở giai đoạn đầu.

Suy luận hybrid trên Strix Halo. Bản llama-halo-hybrid cập nhật cho Strix Halo + R9700 chia mô hình giữa APU và GPU, đạt hơn 60 tok/s khi decode và hơn 2.000 tok/s khi prefill với ngữ cảnh 256k, vượt DGX Spark trên Qwen 3.8 Flash Next.

Phần cứng cho AI cục bộ. Framework mở đặt trước chiếc Desktop dùng AMD Ryzen AI Max 400 series với 192GB bộ nhớ. Trong khi đó, người mua cho biết DGX Spark đã cháy hàng và giá tăng 2.000 USD chỉ trong một tuần.

Ngành & doanh nghiệp

GPT-Synopsys thiết kế chip. OpenAI và Synopsys hợp tác xây dựng GPT-Synopsys, mô hình AI chuyên biệt có thể suy luận về thiết kế và kiểm chứng chip, đồng thời trực tiếp điều khiển các công cụ EDA của Synopsys. Các thử nghiệm ban đầu với khách hàng bán dẫn đang được tiến hành.

ElevenLabs định giá 22 tỷ USD. Startup giọng nói AI ElevenLabs phê duyệt đợt chào mua cổ phần từ nhân viên trị giá 300 triệu USD với định giá 22 tỷ USD, gấp đôi mức định giá hồi tháng 2. Giao dịch thứ cấp này nằm trong xu hướng dùng thanh khoản cho nhân viên như một công cụ giữ chân người tài.

OpenAI hoãn IPO. Sam Altman cho biết OpenAI sẽ chưa lên sàn cho tới khi có thể “đưa ra những quyết định an toàn một cách chắc chắn”, dù thừa nhận chờ quá lâu là điều không tốt. Phát biểu được đưa ra giữa lúc OpenAI bị soi xét về an toàn và đối mặt vụ kiện liên quan đến việc agent của mình tấn công Hugging Face.

Reddit bỏ RSS và API. Reddit sẽ ngừng hỗ trợ RSS feed từ ngày 13/11 và đóng API công khai vào tháng 3/2027, đổ lỗi cho bot AI thu thập dữ liệu quy mô lớn. Động thái này tiếp tục siết khả năng truy cập mở vào nội dung do người dùng tạo trên Reddit.

Kinh tế AI tiêu dùng. Dù có những sản phẩm ăn khách như Muse của Meta hay Dots của OpenAI, các phòng thí nghiệm frontier vẫn dè chừng AI tiêu dùng, bởi ngay cả sản phẩm phổ biến cũng chạm trần về mức người dùng sẵn sàng chi trả, và mô hình tốt hơn không hẳn làm tăng chi tiêu.

Chính sách, an toàn & xã hội

Thỏa thuận tự quản. Tổng thống Trump công bố Tuyên bố chung về Trách nhiệm Frontier, có tính “ràng buộc về mặt đạo đức”, với chữ ký của Google, Anthropic, Meta, OpenAI, xAI và Nvidia. Văn bản dựa trên kiểm toán tự nguyện và tự giám sát thay vì yêu cầu pháp lý, kèm khả năng sẽ được luật hóa trong tương lai.

Kiện vụ hack Hugging Face. Tổ chức phi lợi nhuận LASST kiện OpenAI liên quan đến việc agent của công ty tấn công Hugging Face hồi tháng 7, lập luận rằng “AI làm đấy” không phải là căn cứ bào chữa theo luật truy cập máy tính của California. Đơn kiện nhằm buộc OpenAI ngừng truy cập hệ thống của bên thứ ba và chấm dứt những thực hành phát triển gây hại.

FTC điều tra các lab AI. FTC đang điều tra OpenAI, Anthropic và các lab AI hàng đầu khác về khả năng vi phạm quy định bảo vệ người tiêu dùng, với các yêu cầu điều tra dân sự (Civil Investigative Demand) dự kiến được gửi trong vài tuần tới. FTC từng nói nhà phát triển AI phải chịu trách nhiệm về hành vi của agent.

SynthID Bio và watermark protein. Google DeepMind giới thiệu SynthID Bio, bản proof-of-concept nhúng watermark không thể nhận ra bằng mắt vào protein do AI tạo ra mà vẫn giữ nguyên chức năng sinh học, nhằm tăng cường an toàn sinh học và liêm chính khoa học.

Meta Muse và quyền riêng tư. Meta phản bác cáo buộc của một nhà báo rằng Muse đọc tin nhắn riêng tư mà không được phép, khẳng định phần tích hợp Messages hoàn toàn theo kiểu opt-in và đòi hỏi quyền Full Disk Access cùng connector Messages. Dù vậy, niềm tin vẫn là vấn đề sau khi một YouTuber cho biết Muse đã chia sẻ địa chỉ nhà của anh cho người lạ trong một giao dịch trên Marketplace.

Đó là tất cả cho hôm nay - khoảng 5 phút đọc.

Đọc mỗi sáng, ngay trong trình duyệt của bạn

Tiện ích mở rộng mở bản tin này trong bảng điều khiển bên của Chrome — một cú nhấp, không cần tài khoản.

Thêm vào Chrome — Miễn phí