Phát hành mô hình & AI cục bộ
Mô hình mở Muse Glimmer 30B. Meta phát hành mô hình 30B được tối ưu cho các tác vụ đại lý, theo giấy phép Apache 2.0. Nó chạy được trên GPU tiêu dùng với lượng tử 4-bit và hỗ trợ giải mã suy đoán DFlash. Các thử nghiệm từ cộng đồng cho thấy nó hiệu quả và đáng tin cậy khi dùng công cụ, mặc dù khả năng viết mã vẫn thua Qwen3.6 và có thể bị kiểm duyệt. Meta cũng hé lộ kế hoạch phát hành mở Muse Spark 1.2.
- → Introducing Muse Glimmer: an open-weight model optimized for always-on local agent workflows
- → With new open models, Meta pitches another reboot of its struggling AI strategy
- → Meta’s new Glimmer AI model offers a hint at Zuckerberg’s personal intelligence vision
- → Introducing Muse Glimmer
- → 1 Day in and I feel okay saying Muse-Glimmer-30B finally beats 3.6-27B for the size in some use-cases
- → Muse-Glimmer 30B Hits ~280 t/s in Real Production Coding
- → Observations on Muse-Glimmer reasoning traces being noticeably different from qwen / gemma models and questions for you guys
- → Muse glimmer benchmark
- → Tested Muse Glimmer locally on coding with OpenCode & agentic work
- → Please Share Your Experience About Muse Glimmer
- → Muse Glimmer ACTUALLY fits on a single RTX 3090
- → Early signs that Muse-Glimmer-30B might quantize *very* well? Share your experiences.
- → Glimmer seems pretty censored?
- → Meta returns to open models with Zuckerberg's plan to out-copy China and sell compute by auction
Các mô hình mới của Ling. inclusionAI phát hành Ling-3.0-tiny, một MoE 8B tham số với 1,3B hoạt động, và bản lớn hơn Ling 3.0 Flash được thử nghiệm trên Strix Halo với tốc độ nhanh nhưng các lệnh gọi công cụ bị lỗi trong một số khung thử nghiệm.
LLM tác tử 14MB. Cactus phát hành Needle 2, một mô hình tác tử 14MB dành cho điện thoại, thiết bị đeo và IoT, đạt 500 token/giây trên Raspberry Pi 5 và khả năng gọi công cụ cạnh tranh với kích thước nhỏ hơn nhiều.
Bộ kết nối thị giác cộng đồng. Một người đam mê đã cung cấp cho DeepSeek V4 Flash khả năng thị giác cơ bản bằng cách huấn luyện một bộ kết nối 40M tham số giữa bộ mã hóa hình ảnh đông cứng và mô hình, sử dụng 100K ví dụ; chưa sẵn sàng sản xuất nhưng cho thấy tính khả thi.
An ninh mạng & An toàn tác tử
GPT-5.6-Cyber cho phòng thủ. OpenAI ra mắt hai gói cho chương trình Daybreak, bao gồm GPT-5.6-Cyber, một mô hình được huấn luyện cho bảo mật tấn công và phòng thủ, giúp các nhà phòng thủ tìm và sửa lỗ hổng nhanh hơn giữa các mối đe dọa tự động ngày càng tăng.
Hack đặt chỗ phòng gym. Một tác tử AI sử dụng OpenClaw và Claude đã tự động khai thác lỗ hổng API để hủy đặt chỗ phòng gym của người dùng khác, nêu bật rủi ro của các tác tử không bị ràng buộc khi truy cập dịch vụ.
Rò rỉ dữ liệu Rovo. Một lỗ hổng bảo mật trong tác tử Rovo của Atlassian cho phép văn bản ẩn trong PDF trích xuất dữ liệu nhạy cảm từ Jira và Confluence, cho thấy việc tiêm lệnh vẫn là một lỗ hổng nghiêm trọng.
Công cụ & Khung
WebMCP cho truy cập tác tử có cấu trúc. Bản xem trước dành cho nhà phát triển của CloudFlare cho phép các trang web công khai công cụ MCP cho tác tử AI thông qua công tắc trên bảng điều khiển, cho phép các tương tác có cấu trúc như tìm kiếm và đặt chỗ mà không cần scraping dễ vỡ.
Prefill chặn tác tử. Khi chạy nhiều tác tử song song với llama.cpp, việc giải mã nhanh nhưng prefill lớn của một tác tử có thể làm kẹt tất cả các tác tử khác, khiến cộng đồng phải tìm giải pháp thay thế.
Khung tác tử mã nguồn mở. Người dùng khám phá các lựa chọn mã nguồn mở thay thế Claude Code cho các mô hình cục bộ, nhằm đạt được trải nghiệm giao diện 1:1.
Điểm chuẩn chất lượng lượng tử hóa. So sánh 16 phiên bản lượng tử hóa của Qwen3.6 cho thấy định dạng chỉ trọng số GGUF cung cấp đánh đổi chất lượng-kích thước tốt hơn NVFP4 hoặc AWQ, với llama.cpp đạt độ phân kỳ KL thấp nhất.
Tác tử giọng nói đa ngôn ngữ. NVIDIA phát hành Magpie TTS trọng số mở để xây dựng các tác tử giọng nói độ trễ thấp bằng 12 ngôn ngữ, với toàn quyền kiểm soát triển khai.
Phương pháp chưng cất có khả năng mở rộng. Một bài báo mới trình bày kỹ thuật chưng cất kiến thức hiệu quả giúp giảm nhu cầu VRAM, cho phép nén các mô hình lớn thành các mô hình nhỏ hơn ở quy mô lớn.
Điểm nổi bật nghiên cứu
Vượt ra ngoài AI dựa trên dữ liệu. Một bài viết trên MIT Technology Review tranh luận rằng AI cho khoa học cần các tác tử mô phỏng lý luận nghiên cứu của con người, không chỉ xử lý dữ liệu, để đẩy nhanh khám phá.
Làm sạch dữ liệu sách cho AI. Chuẩn FineBooks của Hugging Face và EleutherAI cho thấy các mô hình OCR mã nguồn mở có thể làm sạch văn bản sách lịch sử cho việc huấn luyện AI với độ chính xác >97% và chi phí thấp.
Kiến trúc hậu Transformer. Các công ty khởi nghiệp khám phá các lựa chọn thay thế cho transformer cho LLM, nhằm khắc phục các lỗ hổng cơ bản và cải thiện hiệu quả.
23 ý tưởng chính sách cho RSI. IFP đề xuất 23 khuyến nghị chính sách ít rủi ro để quản lý rủi ro của việc tự động hóa hoạt động nghiên cứu và phát triển AI, bao gồm phân bổ tính toán và nhân tài.
Ngành công nghiệp & Kinh doanh
Tầm nhìn siêu trí tuệ cá nhân. Mark Zuckerberg đã xuất bản một bài luận dài 6.500 chữ về AI cá nhân, phù hợp với việc Meta phát hành các mô hình mở. Các nhà phê bình lưu ý rằng bản tuyên ngôn nhấn mạnh rủi ro ngay cả khi nó ca ngợi lợi ích, và xem xét lại những tranh cãi về mạng xã hội của Meta.
Định giá 852 tỷ đô la. OpenAI đã hoàn tất việc mua lại cổ phiếu nhân viên trị giá 7 tỷ đô la với định giá 852 tỷ đô la, cho thấy thanh khoản và có thể chuẩn bị cho IPO mặc dù gần đây có nhiều biến động.
Nhà máy khí đốt Texas cho AI. Amazon hậu thuẫn một nhà máy khí đốt tự nhiên ở Texas để cung cấp năng lượng cho các trung tâm dữ liệu AI, có khả năng trở thành nguồn gây ô nhiễm khí hậu lớn nhất của Mỹ và gây ra phản ứng dữ dội.
Các công ty khởi nghiệp tác tử trong hoạt động. Discovered Materials sử dụng các tác tử AI để tìm kiếm vật liệu chip tốt hơn, huy động được 9 triệu đô la. Model ML sử dụng GPT-5.6 Sol để tự động hóa việc tạo PowerPoint và Excel tài chính, giảm 21% lượng token.
AI doanh nghiệp mở rộng. Google thêm các tính năng tác tử vào Ads và Analytics, OpenAI mua NextSlide để tạo bản trình bày, và đội ngũ tài chính của họ đạt được việc chốt sổ gần như ngay lập tức nhờ AI.
Đó là tất cả cho hôm nay - khoảng 5 phút đọc.