Agentic AI News Hari ini

Berita agen AI hari ini dalam bacaan 5 menit: rilis, alat, riset, pendanaan, dan langkah perusahaan.

Diperbarui setiap hari dikurasi dari 30 sumber Minggu, Agustus 30, 2026

Rilis Agen & Model

Pratinjau Tencent Hy4. Tencent merilis pratinjau Hy4, peningkatan ukuran yang signifikan dibanding Hy3 dengan reasoning tinggi secara default dan mode no_think. Komunitas sudah memiliki kuantisasi resmi ~2,38-bit dan GGUF ~200GB yang dilaporkan mempertahankan sekitar 98% performa BF16.

Inferensi Lokal & Hardware

Porting FlashMLA ke sm_120. Build komunitas memperluas FlashMLA ke GPU Blackwell sm_120 konsumen, menunjukkan percepatan 2–3x dibandingkan PyTorch SDPA di beberapa beban kerja MLA sparse dan latensi 8% lebih rendah untuk decode KV cache FP8.

Perbaikan Nemotron 16GB. GGUF low-bit dari Nemotron-3.5-Lightning diam-diam berada di ~4,70 bpw karena kuantisasi lebar baris; build llama.cpp yang ditambal menghasilkan file nyata 3,07 bpw / 11,77 GiB yang menjalankan konteks 262K pada 16GB.

Qwen3.8-Flash-Next di Mac. Qwen3.8-Flash-Next 2-bit sebesar 79GB berjalan di M5 Max 128GB dengan slot konteks 350K menggunakan llama.cpp, termasuk prefill dingin 333 detik untuk prompt 105K dan decoding spekulatif ngram-mod.

DeepSeek V4 Flash dual GPU. Pada konfigurasi 2x DGX Spark/GX10, DeepSeek V4 Flash 0731 mencapai 67–84 token/detik secara konsisten, dengan HumanEval Pass@1 lokal sebesar 94,5% dibandingkan 97,0% untuk GLM-5.3-Flash NVFP4. GLM menyelesaikan benchmark dalam sekitar setengah waktu.

Konteks 1M di dual 5090. Fork NInfer menambahkan paralelisme tensor dan penskalaan YaRN ×4 untuk menjalankan Qwen3.8-27B NVFP4 dengan konteks 1.048.576 token pada dua 5090, melakukan decoding pada 48–100 token/detik di 1M dan mempertahankan tingkat penerimaan MTP saat vLLM turun ke nol.

27B di 16GB. Kuantisasi hybrid plus pengaturan cache kvarn memungkinkan Qwen3.8-27B berjalan dengan konteks 100K pada 50 token/detik di RTX 4070 Ti SUPER 16GB, menggunakan decoding spekulatif MTP dan KV cache presisi-ekor.

Mesin FreeToken MoE. Peneliti UC Berkeley dan MIT memperkenalkan FreeToken, engine open-source yang menjadwalkan transfer expert MoE secara dinamis sehingga model sparse frontier dapat melakukan decoding di GPU konsumen tanpa berhenti karena miss PCIe/RAM.

Benchmark & Evaluasi

Terminal Bench 4.0. Terminal Bench 4.0 dirilis dengan leaderboard yang diperbarui dan fokus iterasi cepat untuk mengatasi saturasi; GLM-5.3 mencetak skor pada level Fable 5 dalam margin of error.

Pengungkapan benchmark finansial. Kartu benchmark untuk Ling-3.0-flash-Fin menunjukkan seberapa besar scaffolding agen, tools, dan pipeline evaluasi memengaruhi hasil yang dilaporkan; banyak run menggunakan ReAct dengan pencarian web dan Python, dan beberapa set eval bersifat internal atau belum publik.

Riset & Infrastruktur Agen

Memori WikiSkill Google. WikiSkill dari Google Research memberi agen basis pengetahuan persisten seperti wiki berisi kegagalan dan keberhasilan masa lalu, mengemas Agent Skills yang dapat digunakan kembali untuk memandu perilaku tanpa mengubah bobot model.

Standar Hardware Model Anthropic. Anthropic sedang membangun MHS, antarmuka terpadu untuk memungkinkan agen mengendalikan perangkat fisik seperti mikroskop dan lengan robot; uji awal memangkas integrasi multi-mesin dari minggu menjadi jam, tetapi pengawasan manusia tetap diperlukan.

Lapisan data untuk agen. Presentasi TOTVS berargumen bahwa sistem transaksional dan data lake tidak dioptimalkan untuk penalaran agen yang haus token dan sensitif latensi, dan menjelaskan perkembangan akses data menuju MCP dan model semantik.

Dataset BVD LAION. LAION merilis BVD, dataset khusus riset berisi 10 juta jam video dengan 55 juta klip dan 300 juta gambar diam, menghubungkan video, audio, dan teks; model yang dilatih dengannya mengungguli baseline InternVid hingga 2,1 poin pada beberapa benchmark.

Industri & Bisnis

Sony dan Warner gugat Anthropic. Sony Music Publishing, Warner Chappell, dan penerbit lainnya menggugat Anthropic, menuduh torrenting dan scraping karya berhak cipta untuk melatih Claude dan menuntut ganti rugi hingga US$150.000 per karya. Anthropic mengatakan akan membela diri.

OpenAI memutus Cursor. OpenAI mengakhiri kontraknya dengan Cursor setelah akuisisi SpaceX, dengan mengutip riwayat perusahaan-perusahaan Elon Musk yang melanggar kontrak. Anthropic merespons dengan memposisikan diri sebagai mitra yang lebih andal dan berjanji menyediakan komputasi berkelanjutan untuk penggunaan Claude di Cursor.

Nvidia melampaui GPU. Narasi pendapatan Nvidia bergeser dari pangsa GPU menuju orkestrasi pusat data dan sistem di sekitar GPU, di mana perusahaan telah membangun perangkat keras jaringan dan orkestrasi mutakhir seiring komputasi AI mencapai skala gigawatt.

Itu saja untuk hari ini - sekitar bacaan 5 menit.

Baca setiap pagi, langsung di peramban Anda

Ekstensi membuka ringkasan ini di panel samping Chrome — satu klik, tanpa akun.

Tambahkan ke Chrome — Gratis