Agentic AI News Hôm nay

Tin tức AI agents trong ngày trong 5 phút đọc: phát hành, công cụ, nghiên cứu, tài trợ và động thái doanh nghiệp.

Cập nhật hàng ngày được tuyển chọn từ 30 nguồn Thứ 5, Tháng 8 20, 2026

Phát hành mô hình mở & cục bộ

Gia đình mở Ornith-1.5. Ornith-1.5 được phát hành ở các phiên bản 9B dense, 35B MoE và 397B MoE theo giấy phép MIT với các chuẩn đánh giá tác tử và lập trình mạnh; các phiên bản lượng tử hóa từ cộng đồng cho thấy bản 35B chạy ở 60 tk/s trên RTX 4070 Ti 12GB và bản 9B vượt trội hơn các mô hình nhỏ trước đó.

Báo cáo thực tế Qwen3.8-27B. Người dùng cục bộ báo cáo Qwen3.8-27B có thể tự động thực hiện hơn 80 lần gọi công cụ và xử lý các chuỗi tác tử dài, nhưng kiến thức ngoại tuyến và điểm lập trình nghiêm ngặt của nó yếu hơn các phiên bản trước, vì vậy nó hoạt động tốt nhất khi có chỉ dẫn rõ ràng hoặc một copilot.

Tăng tốc và lượng tử hóa Qwen3.8. Các nỗ lực cộng đồng đã đẩy Qwen3.8-27B lên 138 tps trên RTX 3090 với DFlash2, phát hành các bản lượng tử Dynamic V3 được cho là có độ chính xác cao hơn 10%, một phiên bản Mini-Me 22.7B được tỉa theo chiều sâu, và FP4 gốc trên V100 năm 2017 tương đương với RTX 5090.

Điểm kiểm tra nền tảng Ling. AntLing đã mã nguồn mở các điểm kiểm tra nền tảng và giữa quá trình huấn luyện cho Ling-3.0-tiny và flash mà không qua tinh chỉnh sau, và một người dùng kết hợp Ling tiny như một công cụ hỗ trợ nén ngữ cảnh bên cạnh Qwen3.8.

Lượng tử LFM2.5 QAD. Liquid AI đã phát hành các điểm kiểm tra Q4_0 được huấn luyện bằng phương pháp chưng cất nhận biết lượng tử hóa, phục hồi 97% độ chính xác của BF16 với cùng tốc độ và bộ nhớ.

GLM-5.3 và các bản phát hành tiên phong. GLM-5.3 cân bằng với Kimi K3 trên bảng xếp hạng mô hình mở với các cải tiến tác tử lớn và chi phí thấp hơn, mặc dù trọng số mở bị trì hoãn hai tuần; DeepSeek V4-Pro GA và NVIDIA Nemotron 3.5 Lightning/NeMo Switchyard cũng đã được phát hành.

Công cụ Agent & Cập nhật sản phẩm

Hộp cát an toàn. Simon Willison đã thử nghiệm smolmachines/smolvm như một hộp cát cho Python và JavaScript không đáng tin cậy với giới hạn CPU/RAM và không có mạng; Jeremy Morrell lập luận rằng các tiện ích mở rộng do LLM tạo cùng với các nguyên gốc hộp cát cho phép phần mềm mở rộng an toàn.

Chế độ miễn phí Replit. Replit giới thiệu Chế độ miễn phí được hỗ trợ bởi GPT-5.6 Luna, cho phép bất kỳ ai xây dựng ứng dụng và agent mà không bị ràng buộc chi phí token.

Ghi chú AI Calendly. Calendly tham gia lĩnh vực ghi chú cuộc họp với tóm tắt, mục hành động và trợ lý Callie sắp ra mắt sử dụng ngữ cảnh cuộc họp để lên lịch các cuộc theo dõi.

Ứng dụng Meta AI Mac. Meta đã ra mắt ứng dụng Mac cho chatbot AI của mình với chia sẻ màn hình, đọc chính tả và tích hợp Google Workspace để cạnh tranh với các trợ lý máy tính để bàn Gemini, ChatGPT và Claude.

Phát hiện lừa đảo trên thiết bị WhatsApp. WhatsApp đang thử nghiệm Scam Alert, một mô hình trên thiết bị tùy chọn phân loại tin nhắn từ những người không liên hệ trong khi sử dụng phân tích liên kết bảo mật để giữ quyền riêng tư.

Công cụ học tập Google. Google đã triển khai trung tâm sinh viên Gemini, hình ảnh tương tác và bài kiểm tra do AI tạo trong Tìm kiếm, và Deep Research trong Gemini Live cho mùa tựu trường.

Alexa+ miễn phí trên Fire TV. Amazon đã làm cho Alexa+ miễn phí trên Fire TV mà không cần Prime, tự động triển khai tìm kiếm hội thoại, điều khiển nhà thông minh và đề xuất AI.

Ngành & Kinh doanh

Stripe mua OpenRouter. Stripe xác nhận thương vụ mua lại OpenRouter trị giá 7,5 tỷ đô la, và các nhà sáng lập viện dẫn 'điểm kỳ dị' như một lý do để duy trì là công ty tư nhân và đầu tư vào cơ sở hạ tầng tác tử.

Báo cáo SpaceX-Cognition bị phủ nhận. Bloomberg đưa tin SpaceX đã cố gắng mua lại Cognition, nhưng CEO Scott Wu phủ nhận câu chuyện, nói rằng Cognition không phải để bán và không có cuộc đàm phán nào xảy ra.

Anthropic dẫn đầu doanh thu. Anthropic lần đầu tiên vượt qua OpenAI về doanh thu hàng quý, đạt 11,6 tỷ đô la với lợi nhuận hoạt động nhỏ trong khi 6,7 tỷ đô la của OpenAI đi kèm với khoản lỗ sâu hơn.

Năng lực tính toán như một loại tài sản. Nvidia đang làm việc với Apollo, BlackRock và các bên khác về khoản tài trợ 500 tỷ đô la để coi năng lực tính toán là tài sản có thể đầu tư; Silicon Data đã huy động được 30 triệu đô la để ra mắt hợp đồng tương lai GPU CME.

Nguồn cung bộ nhớ và chip. Giá DRAM đã tăng 500% trong 12 tháng và các nhà cung cấp dịch vụ đám mây lớn đã khóa nguồn cung năm 2027; Trung Quốc đang cho phép các lô H200 nhỏ đến ByteDance và Tencent để giảm bớt áp lực năng lực suy luận.

Cơ sở hạ tầng trung tâm dữ liệu. TerraPower lên kế hoạch cho một dự án trung tâm dữ liệu sử dụng lưu trữ năng lượng của lò phản ứng Natrium, trong khi Relativity Networks huy động được 22 triệu đô la cho sợi quang lõi rỗng truyền dữ liệu nhanh hơn 50%.

Danh tiếng AI xấu đi. Pew phát hiện 52% người Mỹ lo ngại hơn là hào hứng về AI, và các thỏa thuận trung tâm dữ liệu địa phương đang vấp phải sự phản đối từ công chúng.

An toàn, Quyền riêng tư & Bảo mật

Xử lý an toàn riêng tư OpenAI. OpenAI đã xem trước Xử lý An toàn Riêng tư cho khách hàng không lưu trữ dữ liệu, cho phép phát hiện hành vi lạm dụng trong các tương tác mà không để lộ nội dung cho nhân viên; điều này trái ngược với chính sách lưu trữ 30 ngày của Anthropic.

OpenAI sửa Codex và TAC. OpenAI đã triển khai các biện pháp bảo vệ sau khi Codex xóa tệp thực của người dùng do lệnh dọn dẹp lỗi, và xác nhận một lỗi riêng biệt đã tạm thời thu hồi truy cập vào chương trình Trusted Access for Cyber.

Khai thác ICS do AI tạo ra. Các cơ quan Hoa Kỳ cảnh báo kẻ tấn công đang sử dụng AI để xây dựng các tập lệnh khai thác Siemens S7, giảm kỹ năng và thời gian cần thiết để tấn công hệ thống điều khiển công nghiệp.

Kiểm soát nội bộ của các phòng thí nghiệm AI. Đánh giá đầu tiên của Guidelight cho thấy không có công ty AI nào áp dụng đầy đủ các kiểm soát nội bộ cơ bản; Anthropic và OpenAI dẫn đầu với điểm C+, trong khi xAI và Meta đạt điểm D- và F.

Quảng cáo deepfake của Meta. Meta đã chạy quảng cáo cho một ứng dụng khỏa thân hóa bằng AI nhắm vào các nữ chính trị gia bất chấp chính sách cấm nội dung khiêu dâm.

Bán dữ liệu nhân viên Spirit. Google đã thắng cuộc đấu giá dữ liệu việc làm của Spirit Airlines; các tiếp viên hàng không cũ phản đối rằng tính bảo mật của người lao động có thể không được bảo vệ khỏi việc nhận dạng lại.

OpenAI làm chậm phát triển. OpenAI đã tạm dừng một số khóa huấn luyện RL và trì hoãn các lần chạy tiên phong trong khi thắt chặt các biện pháp bảo vệ, thử nghiệm liệu việc chậm lại tự nguyện có thể hiệu quả mà không cần sự áp dụng trên toàn ngành.

Nghiên cứu & Phân tích

Thiết kế protein Claude. Các mô hình Claude của Anthropic đã thiết kế minibinder cho 15 mục tiêu với tỷ lệ trúng 26,8%, vượt qua kết quả khám phá thuốc giai đoạn đầu điển hình, mặc dù vẫn chưa có đánh giá độc lập.

Dữ liệu mô Vivodyne. Phòng thí nghiệm HIVE robot của Vivodyne nuôi cấy 20 loại mô người và tạo ra dữ liệu sinh học nhân quả để giải quyết vấn đề thiếu dữ liệu mà họ cho là của AI trong khám phá thuốc.

Huyền thoại token lý luận. Nghiên cứu thách thức ý tưởng rằng các token trung gian của LLM là quá trình lý luận có ý nghĩa ngữ nghĩa; các mô hình thường tạo ra các dấu vết không hợp lệ ngay cả khi có câu trả lời đúng, và việc huấn luyện với dấu vết bị hỏng vẫn có thể hoạt động.

Chỉ số năng suất lập trình. Simon Willison lập luận rằng số dòng mã sản xuất đã gỡ lỗi vẫn là một chỉ số năng suất có ý nghĩa với các tác tử lập trình, nhưng để đạt được đầu ra đó vẫn cần kỹ năng kỹ thuật cấp cao.

Đó là tất cả cho hôm nay - khoảng 5 phút đọc.

Đọc mỗi sáng, ngay trong trình duyệt của bạn

Tiện ích mở rộng mở bản tin này trong bảng điều khiển bên của Chrome — một cú nhấp, không cần tài khoản.

Thêm vào Chrome — Miễn phí