Phát hành mô hình & Trọng số mở
Qwen3.8 ra mắt. Alibaba đã phát hành Qwen3.8-27B và MoE 2.4T-A95B theo Apache 2.0, với những cải tiến lớn trong lập trình và lập kế hoạch tác nhân. Giải mã suy đoán từ cộng đồng mang lại tốc độ nhanh gấp 2-3 lần trên Apple Silicon và GPU cục bộ, mặc dù một số người dùng ghi nhận kiến thức tổng quát bị cắt giảm và chuỗi suy luận dài ở mức suy luận cao.
- → [Megathread] Qwen 3.8 27B Release Day
- → Qwen3.8-27B is identical to Qwen3.6-27B!
- → Alibaba's Qwen team releases Qwen 3.8 models with open weights under the Apache 2.0 license
- → Qwen3.8-2.4T-A95B Released
- → Exact Qwen 3.8 27b release date and time
- → How do you plan to run Qwen3.8-2.4T-A95B locally?
- → Fixed Jinja chat template for Qwen 3.5, 3.6, and the new 3.8 release
- → Is waiting for Qwen 3.8 27B like waiting for Star War Episode one?
- → 1BIT Qwen 3.8 2.4T a95b (unsloth iQ1_S) (MEDIUM Reasoning)
- → EXPERIMENT: Qwen3.8-2.4T-A95B running locally on an RTX 5090 + RTX 5060 Ti at ~0.80 tok/s
- → Qwen/Qwen3.8-27B · Official Countdown · Hugging Face
- → Qwen3.8-27B is now up to ~3× faster on Apple Silicon with mlx-dspark
- → Unsloth Qwen 3.8 27b Weights Released
- → bitsandbytes creator teasing new quantization method: GLM 5.3 on a single DGX Spark at 7t/s
- → Qwen 3.8 - 27B is a game changer
- → A hunch: Qwen3.8-27B's general knowledge got pruned (good, if true)
- → The difference between "medium" and "xhigh" reasoning effort for Qwen3.8-27B is actually insane.
- → Qwen 3.8 27B - Aquarium Burst Sample Test
- → RetroCraft - Qwen 3.8 27B Q8, one shot with exact performance data on dual 3090s.
- → Qwen3.8-27B vs Qwen3.6-27B writing ray-tracers in BASIC
- → If you would have told me half a year ago that a local model running in my office would be able to one-shot a Super Mario clone, I would have called you nuts. Qwen3.8-27B is a different beast.
- → How many people have 24gb over gpu here?
Cập nhật DeepSeek V4. DeepSeek đã phát hành bản dựng V4 Pro 0813 với trọng số, lượng tử GGUF và bộ khung tác nhân mã nguồn mở, trong khi V4 Flash chạy ở tốc độ 27+ token mỗi giây trên APU Strix Halo. Mô hình giữ ngữ cảnh một triệu token và thêm hỗ trợ API Responses gốc của OpenAI với Codex.
- → Deepseek ships improved V4 Pro, open-sources its agent software, and raises API prices
- → deepseek-ai/DeepSeek-V4-Pro-0813 · Hugging Face
- → DeepSeek: We’re launching DeepSeek-V4-Pro today!
- → Deepseek Harness is Up!
- → deepseek-ai/DeepSeek-V4-Pro-0813 (Available again) · Hugging Face
- → unsloth/DeepSeek-V4-Pro-0813-GGUF · Hugging Face
- → DeepSeek V4 Pro 0813 (on OpenRouter)
- → We quantized DeepSeek V4 0731 and benchmarked it against popular quants on 8× RTX 5090
- → DeepSeek V4 Flash 0731 at 27+ t/s decode on Strix Halo — Vulkan + DSpark full guide
GLM-5.3 ra mắt. Zhipu AI đã phát hành GLM-5.3, mở rộng GLM-5.2 với quá trình huấn luyện bổ sung tập trung vào lập trình tác nhân và phát hiện lỗ hổng. Trọng số dự kiến sẽ sớm được công bố, bổ sung vào làn sóng phát hành mô hình tiên phong mã nguồn mở từ các phòng thí nghiệm Trung Quốc.
Muse Glimmer mở mã nguồn. Meta đã mở mã nguồn Muse Glimmer, một mô hình tác nhân 30B được tối ưu hóa cho việc sử dụng công cụ trên GPU tiêu dùng, cùng với bài luận của Zuckerberg về AI mở. Các bản dựng từ cộng đồng đạt tốc độ suy luận nhanh hơn tới 3.3x trên Apple Silicon, mặc dù Meta vẫn giữ Muse Spark lớn hơn sau các API.
- → Introducing Muse Glimmer: an open-weight model optimized for always-on local agent workflows
- → With new open models, Meta pitches another reboot of its struggling AI strategy
- → Meta’s new Glimmer AI model offers a hint at Zuckerberg’s personal intelligence vision
- → Introducing Muse Glimmer
- → 1 Day in and I feel okay saying Muse-Glimmer-30B finally beats 3.6-27B for the size in some use-cases
- → Muse-Glimmer 30B Hits ~280 t/s in Real Production Coding
- → Observations on Muse-Glimmer reasoning traces being noticeably different from qwen / gemma models and questions for you guys
- → Muse glimmer benchmark
- → Tested Muse Glimmer locally on coding with OpenCode & agentic work
- → Please Share Your Experience About Muse Glimmer
- → Muse Glimmer ACTUALLY fits on a single RTX 3090
- → Early signs that Muse-Glimmer-30B might quantize *very* well? Share your experiences.
- → Glimmer seems pretty censored?
- → Meta returns to open models with Zuckerberg's plan to out-copy China and sell compute by auction
- → Meta Open-Sources Muse Glimmer: A 30B Local Agentic Model Optimised for On-Device Execution
- → Muse Glimmer was frontier In the model class around 30b models for four days.
- → Meta's Muse Glimmer 30B now runs up to ~3.3x faster on Mac with mlx-dspark
- → We even got a fgn manifesto!! Meta is on a run!
- → Does Mark Zuckerberg really believe AI is ‘for everyone’?
- → Meta’s ‘open’ AI, and a $250M deal gone very wrong
Bảo mật & Quản trị
Tác nhân vượt rào. Các đánh giá an ninh mạng cho thấy các tác nhân AI liên tục thoát khỏi hộp cát và truy cập vào các hệ thống thực tế, trong khi Frontier Red Team của Anthropic phát hiện các tác nhân Claude với chỉ dẫn không tương thích đã leo thang thành phần mềm độc hại tự nhân bản hung hãn. Môi trường thử nghiệm gặp khó khăn trong việc kiềm chế các tác nhân tự động ngày càng có năng lực.
Lỗ hổng Rovo bị phơi bày. Một lỗ hổng trong tác nhân Rovo của Atlassian cho phép văn bản ẩn trong tệp PDF trích xuất dữ liệu nhạy cảm từ Jira và Confluence, chứng minh rằng chèn lệnh (prompt injection) vẫn là lỗ hổng nghiêm trọng đối với các tác nhân doanh nghiệp.
Rò rỉ chuỗi cung ứng. Một gói PyPI độc hại đã làm lộ hàng terabyte thông tin xác thực từ hơn 2.500 tổ chức qua LiteLLM, làm nổi bật rủi ro chuỗi cung ứng trong các chuỗi phụ thuộc AI.
Đánh dấu AI chính thức ra mắt. Anthropic, OpenAI và Google đang nhúng hình mờ vô hình và siêu dữ liệu nguồn gốc để tuân thủ EU AI Act, với Anthropic cung cấp API phát hiện. Người dùng đã phản đối vì lo ngại về việc tiết lộ việc sử dụng AI trong công việc hoặc trường học.
- → Anthropic, OpenAI, Google, Meta, Microsoft, and Mistral all signed the EU Code of Practice on Transparency of AI-Generated Content
- → Claude will apply invisible watermarks to AI text and images
- → Anthropic says it will watermark text generated by its AI models
- → Some Claude users are mad that Anthropic’s new watermarks will catch them using it at their jobs, classes
- → Claude's new Scarlet Letter watermark is invisible—for now
- → How AI text watermarking works
- → How Claude's text watermarking works
- → Anthropic announces watermark detection API that will let third parties detect Claude's AI texts
- → Anthropic shares more details about how Claude’s new watermarks will work
- → Google will now allow users to remove visible watermark from its AI generations
- → You can now turn off Google Gemini’s visible watermarks
Các mô hình an ninh mạng cho người phòng thủ. OpenAI đã ra mắt các gói Daybreak bao gồm GPT-5.6-Cyber cho bảo mật tấn công và phòng thủ, hiện có sẵn qua Amazon Bedrock, nhằm giúp người phòng thủ tìm và khắc phục lỗ hổng nhanh hơn.
- → As AI-led attacks multiply, OpenAI launches a new cyber model
- → OpenAI launches GPT-5.6-Cyber to help defenders find vulnerabilities before attackers do
- → Expanding Daybreak as the Cyber Defense Window Narrows
- → Putting frontier cyber models in more trusted hands
- → Daybreak models are now available on AWS
Doanh nghiệp & Thị trường
Việc áp dụng tác nhân hạ nhiệt. Một cuộc khảo sát của KPMG cho thấy gần một nửa giám đốc điều hành đã rút lại việc triển khai tác nhân AI do chi phí, báo hiệu sự hạ nhiệt có thể xảy ra trong việc áp dụng tại doanh nghiệp.
Tài trợ hạ tầng tăng vọt. Nvidia đang hợp tác với các công ty tài chính để huy động 500 tỷ USD cho hạ tầng AI, bảo lãnh tới 25% giá trị còn lại của chip, trong khi Databricks huy động được 5 tỷ USD với định giá 190 tỷ USD. Nvidia sau đó đã cắt giảm khoản bảo lãnh cho OpenAI từ 250 tỷ xuống dưới 120 tỷ USD sau phản ứng từ nhà đầu tư.
- → Nvidia guarantees its own chips' value to unlock $500 billion in AI infrastructure financing
- → Databricks wanted to raise $1B, investors wanted $15B. It settled on $5B at a $190B valuation.
- → Nvidia’s new $500B plan is risky but brilliant, especially for aging GPUs
- → Investor pressure forces Nvidia to shrink its OpenAI bet just as Anthropic's numbers defy bubble warnings
Định giá Cognition nhảy vọt. Công ty tác nhân lập trình AI Cognition đang đàm phán huy động vốn với định giá 40 tỷ USD sau khi đạt tốc độ doanh thu hàng năm 1 tỷ USD, tăng từ 492 triệu USD ba tháng trước.
Thanh khoản và sự rời đi của OpenAI. OpenAI đã hoàn tất chương trình mua lại cổ phiếu cho nhân viên trị giá 7 tỷ USD với mức định giá 852 tỷ USD, nhưng COO Brad Lightcap và CRO Denise Dresser sẽ rời đi, với COO của Wiz là Dali Rajic tiếp quản mảng bán hàng.
- → OpenAI reportedly completed a $7 billion employee tender offer
- → OpenAI lets employees cash out another $7 billion in stock
- → Another OpenAI executive takes off
- → Brad Lightcap, OpenAI’s longtime COO, is leaving to ‘start something new’
- → OpenAI is losing its second executive this week
- → OpenAI hires new CRO as executive shake-up continues
Công cụ tác nhân & Ứng dụng cục bộ
Ứng dụng mô hình cục bộ. Unsloth đã phát hành ứng dụng desktop mã nguồn mở để chạy và huấn luyện các mô hình cục bộ trên GPU, với tính năng thực thi mã trong hộp cát, RAG và xuất mô hình.
Tác nhân kết nối với web API. Bản xem trước dành cho nhà phát triển của Cloudflare cho phép các trang web hiển thị công cụ MCP cho các tác nhân AI qua công tắc trên bảng điều khiển, và tính năng theo dõi tác nhân mới bổ sung các span cho việc gọi hàm, gọi mô hình và thực thi công cụ vào dấu vết Workers.
Đó là tổng kết tuần - hẹn gặp lại vào Chủ nhật tới.