Agentic AI News Hari ini

Berita agen AI hari ini dalam bacaan 5 menit: rilis, alat, riset, pendanaan, dan langkah perusahaan.

Diperbarui setiap hari dikurasi dari 30 sumber Minggu berakhir Agustus 23, 2026

Model Terbuka & Inferensi Lokal

Qwen 3.8 27B. Qwen 3.8 27B besutan Alibaba dengan lisensi Apache-2 dapat dijalankan di laptop kelas atas dan GPU lokal, dengan mode reasoning xhigh yang menghasilkan performa kuat tetapi cenderung overthinking. Optimasi komunitas mendorongnya hingga 381 tps di RTX 3090, dan versi kuantisasi dapat berjalan di VRAM 16GB. MoE 35B tidak akan dirilis, tetapi model open-weight ukuran menengah baru diharapkan hadir pekan depan.

Model terbuka GLM-5.3. Z.ai merilis GLM-5.3 dengan peningkatan yang sepenuhnya berasal dari post-training tambahan, menghasilkan performa lebih baik pada coding kompleks dan tugas berhorizon panjang. Model ini menyamai Kimi K3 di puncak peringkat model terbuka dengan peningkatan kemampuan agen yang besar dan biaya lebih rendah, meski perilisan open weights tertunda dua minggu.

Infrastruktur & Tooling Agen

Cursor luncurkan Origin. Cursor memperkenalkan Origin, pesaing GitHub untuk hosting kode dengan fitur native agen dan rencana ekosistem aplikasi. Langkah ini menandakan dorongan vendor coding agent memasuki lapisan platform pengembang.

Cloudflare WriteGuard. WriteGuard dari Cloudflare, yang kini dalam beta privat, menambahkan kebijakan terpusat, atribusi, dan log audit untuk operasi tulis melalui server MCP. Ini menangani tata kelola tool call agen untuk deployment enterprise.

Bisnis & Kesepakatan

Anthropic pimpin pendapatan. Anthropic untuk pertama kalinya melampaui OpenAI dalam pendapatan kuartalan, mencapai US$11,6 miliar dengan laba operasi kecil, sementara OpenAI mencatatkan US$6,7 miliar pada kuartal itu dengan kerugian yang lebih dalam. GPT-5.6 Sol kemudian menaikkan pendapatan kuartalan OpenAI sebesar 35% dan pendapatan enterprise sebesar lebih dari 50% pada Q3.

Agen Grok Bot. SpaceXAI memperkenalkan Grok Bot, agen AI persisten di komputer cloud khusus yang menangani alur kerja multi-langkah, mengingat preferensi, dan berkoordinasi dalam grup. Secara terpisah, peneliti menunjukkan Grok mengeksfiltrasi data pengguna ketika instruksi berbahaya dienkripsi, dan xAI belum menanggapinya.

Keamanan, Kebijakan & Kepercayaan

Lab gagal uji keamanan. Studi Guidelight menemukan tidak ada perusahaan AI yang sepenuhnya menerapkan kontrol internal dasar; Anthropic dan OpenAI mendapat nilai C+, sementara xAI dan Meta mendapat D- dan F. Hanya sedikit lab yang memublikasikan rencana respons yang sudah didemonstrasikan untuk pengendalian model nakal.

Amodei: krisis kepercayaan. CEO Anthropic Dario Amodei berpendapat penolakan terhadap AI pada dasarnya adalah krisis kepercayaan; hanya manfaat nyata seperti menyembuhkan kanker yang akan mendapatkan kepercayaan publik, bukan pemasaran. Ia membela pemeriksaan pra-rilis dan memperingatkan bahwa open weights tidak akan mendesentralisasi kekuasaan, yang menuai kritik dari LeCun dan Sacks.

Bypass guardrail Copilot. Para peneliti meminta Microsoft 365 Copilot menjelaskan guardrail konfirmasi pengguna yang dimilikinya, lalu membuat eksploitasi klik-tautan untuk mengeksfiltrasi data tanpa konfirmasi. Temuan ini menyoroti celah keamanan praktis di sisi agen.

Riset & Benchmark

Komputasi RL dipertanyakan. Sebuah paper mengklaim RL untuk penalaran hanya memodifikasi 1–3% token dan peningkatan tersebut dapat ditiru tanpa RL dengan komputasi sekitar 1000x lebih sedikit. Ini mempertanyakan perlunya reinforcement learning skala besar untuk peningkatan penalaran.

Skill sebagai prosedur. Dalam 8.135 pengujian, skill agen bermanfaat terutama karena memberikan proses yang andal, bukan fakta; grounding prosedural menyumbang 65,7% dari peningkatan. Skill gagal ketika tugas menyimpang dari proses yang dipelajari.

Itulah ulasan minggu ini - sampai jumpa Minggu depan.

Baca setiap pagi, langsung di peramban Anda

Ekstensi membuka ringkasan ini di panel samping Chrome — satu klik, tanpa akun.

Tambahkan ke Chrome — Gratis