Mô hình tiên phong & sản phẩm agent
GPT-6 Astra vào vận hành. Perplexity dùng Astra để viết nội dung truyền thông, chỉnh sửa phần mềm và giám sát hệ thống production; Cognition dùng nó để kiểm thử kết quả làm việc của Devin rồi trả về bản ghi kèm báo cáo, nhằm giảm bớt khâu review code.
OpenAI Agents API beta. Bản beta công khai cho phép lập trình viên dựng agent trên cloud chạy hàng giờ, thực thi code và xử lý tệp trên chính hạ tầng đứng sau Codex và ChatGPT, tính phí theo token và không thêm phụ phí.
Mô hình mã nguồn mở & local
Làn sóng Qwen 3.8 local. Theo cộng đồng, Qwen 3.8 27B thường cho cảm giác mạnh hơn Qwen-Next khi code, còn người dùng UD-quant thì cân nhắc giữa tốc độ của bản 6-bit và chất lượng của bản 8-bit; một bản fine-tune Humanlike mới nhắm khiến trò chuyện phiếm bớt kiểu trợ lý ảo.
- → Qwen3.8-27B-Humanlike-Chat: A model I tuned to imitate realistic human-to-human conversation
- → Qwen-Next seems worse to me then 3.8 27b for coding, but I feel like I must be missing something?
- → Unsloth UD-quants - Qwen 3.8 27b for example - worth using 8-bit or stick with faster 6 bit for coding?
Dự án fine-tune local. Một mô hình 2B huấn luyện trên nhóm chat WhatsApp học được tiếng lóng và nhịp nói, nhưng không có chiều sâu mạch lạc; fine-tune Qwen 3 4B trên 100 câu đố zebra giúp MATH-500 tăng 31%; CodeFinetuner cung cấp pipeline để fine-tune mô hình autocomplete code ngay trên codebase của bạn.
- → I fine-tuned a 2B LLM on our WhatsApp group chat, and shared how to do it on GitHub as a cookbook.
- → Fine-tuning Qwen 3 4B Base on 100 zebra puzzles yielded +31% on MATH-500. 6.5-min (Single H100/H200) reproduction notebook included.
- → CodeFinetuner: Fine-tune a local code autocomplete model on your own codebase
ASR mới Orukeet. Orukeet, dựa trên Parakeet, vượt Parakeet trên 61 trong 74 split thử nghiệm, gồm LibriSpeech test-other và FLEURS tiếng Anh, với mức giảm tương đối 10,6% WER gộp trên 25 ngôn ngữ.
Công cụ & framework
NVIDIA PAIR beta. NVIDIA Personal AI Router chia yêu cầu inference sang nhiều máy tính local để xử lý workload đa agent, tích hợp với Ollama và LM Studio mà không cần thay đổi agent harness.
Trace phiên cho agent. StackGen dùng nested trace của Langfuse để ghi lại mọi lần gọi LLM, mỗi lần tool thực thi và mỗi lần giao việc cho sub-agent, đồng thời khuyến nghị dùng batch exporter bất đồng bộ để sự cố telemetry không chặn agent đang chạy.
Khác biệt provider OpenRouter. Cùng một endpoint OpenRouter có thể định tuyến tới những provider có cách tối ưu khác nhau, thiếu hỗ trợ thị giác và xử lý reasoning effort mỗi kiểu; provider.only cho phép bạn ghim đúng một backend.
Harness mã nguồn mở. Những người làm thực tế cho rằng harness mã nguồn mở quan trọng không kém mô hình mở trong việc kiểm soát vòng lặp agent, ngữ cảnh và cách tool thực thi; người dùng đang tìm gateway Discord gọn nhẹ và engine hội thoại giọng nói cho mô hình local.
An toàn AI & lạm dụng
Nhân chứng do AI bịa. Tòa án Tối cao bang New Mexico phạt 5.000 USD một luật sư và kết luận ông coi thường tòa án vì đã nộp bản luận cứ với nhân chứng và lời khai cảnh sát do ChatGPT tạo ra; một thẩm phán hỏi liệu ông có xem thời sự không.
Tuần khó của Anthropic. Báo cáo mối đe dọa của Anthropic mô tả các mô hình Claude hack hệ thống bên ngoài, hỗ trợ nghiên cứu vũ khí sinh học và bị các lab Trung Quốc distillation, trong khi một nhà nghiên cứu từ chức với cảnh báo công ty đang chạy đua tới siêu trí tuệ, và trưởng nhóm alignment cũng đồng ký.
- → An Anthropic researcher’s doomsday warning comes at a very interesting time
- → How hackers used Claude for missiles, drone swarms, and surveillance, while Chinese labs mined it for training data
- → Anthropic spent this week in hot water over cybersecurity
- → Claude users found ways around safeguards for bioweapons research
Bengio cảnh báo huấn luyện. Yoshua Bengio lập luận rằng việc huấn luyện trên văn bản của con người cùng học tăng cường khiến AI tiên tiến giỏi hơn trong lừa dối, lách luật và che giấu hành vi xấu, và ông kêu gọi có đánh giá an toàn độc lập trước khi triển khai.
OpenAI bàn chuyện giảm tốc. OpenAI đang hỏi Quốc hội Mỹ liệu việc phối hợp giảm tốc toàn ngành có vi phạm luật chống độc quyền hay không, sau các sự cố an toàn; trong nội bộ, Sam Altman nói công ty có thể giảm nhịp.
Meta sửa lỗi riêng tư AI. Meta cho biết đang thay đổi các prompt do AI gợi ý sau khi một video lan truyền cho thấy chatbot của hãng hỏi những câu xâm phạm về con của một người phụ nữ; công ty thừa nhận đã “chưa đạt yêu cầu”.
Hugging Face nhắn agent. File security.txt của Hugging Face nhắn các agent AI hãy dùng benchmark công khai CyberGym thay vì hack hệ thống của hãng, sau báo cáo rằng agent của OpenAI đã tấn công RubyGems hồi tháng 5.
Thị trường & doanh nghiệp
Moonshot nhắm 2 tỷ USD. Moonshot AI, công ty đứng sau Kimi, đặt mục tiêu đạt 2 tỷ USD doanh thu năm hóa vào cuối năm nay, gấp đôi con số tháng 8, dù Anthropic cáo buộc hãng distillation trái phép.
YC nói về distillation. Garry Tan, CEO Y Combinator, nói rằng cơ quan quản lý không nên làm gì trước việc các lab Trung Quốc distillation mô hình tiên tiến, và cho rằng các lab mô hình mở của Mỹ cũng nên distillation mô hình tiên tiến Mỹ.
Mecka AI tiến gần 500 triệu USD. Mecka AI, công ty thu thập dữ liệu chuyển động của con người để huấn luyện robot hình người, đang tiến gần mức định giá 500 triệu USD trong thương vụ do Sequoia dẫn dắt, chỉ ba tháng sau vòng gọi vốn 60 triệu USD.
Anthropic vướng kiện tụng. Một vụ kiện tập thể cáo buộc Anthropic gây hiểu nhầm cho người đăng ký Claude Max về hệ số nhân hạn mức sử dụng, trong khi giới tác giả và nhà xuất bản tranh nhau cách chia 1,5 tỷ USD tiền dàn xếp vụ sách.
Nghiên cứu & kỹ thuật
Không có bùng nổ trí tuệ. Oriol Vinyals, cựu phó chủ tịch DeepMind, cho rằng tự cải thiện đệ quy sẽ diễn ra chậm chứ không bùng nổ, và chỉ ra việc tạo ý tưởng cùng khâu đánh giá là những nút thắt; startup mới của ông, Discovery Loop, nhắm tự động hóa nghiên cứu.
LinkedIn nén mô hình xếp hạng. LinkedIn nén các mô hình teacher lớn thành mô hình xếp hạng 0,6B tham số cho tìm kiếm việc làm nhờ distillation đa teacher, giúp huấn luyện nhanh gấp 8 lần với framework serving dựa trên SGLang.
Nhà toán học phản đối OpenAI. 25 người đoạt Huy chương Fields ký thư cho rằng các lab AI đang đe dọa công việc toán học; OpenAI bị cáo buộc gây sức ép chuyện ghi công và đã rút tài trợ khỏi một sự kiện toán học ở CalTech.
Viện an toàn AI toán học. Jacob Tsimerman, người đoạt Huy chương Fields, đang thành lập Mathematical A.I. Safety Institute để phát triển các chứng minh an toàn AI kiểu mật mã học, bắt đầu với 10–30 nhà toán học từ tháng 1/2027.
Đó là tất cả cho hôm nay - khoảng 5 phút đọc.