Agentic AI News Hari ini

Berita agen AI hari ini dalam bacaan 5 menit: rilis, alat, riset, pendanaan, dan langkah perusahaan.

Diperbarui setiap hari dikurasi dari 30 sumber Selasa, Oktober 6, 2026

Rilis Agen & Model

Reflection Beam MoE open-weight. Reflection AI meluncurkan Beam, MoE 501B parameter dengan 23B aktif per token, yang menyasar pekerjaan coding dan agentic. Model ini diklaim punya penalaran setingkat GPT-5.2 dengan komputasi inferensi 3–4x lebih rendah dan kini dalam tahap red-teaming final dengan akses waitlist.

Aleph Alpha Kolibri. Aleph Alpha merilis Kolibri, MoE 78B Jerman-Inggris dengan sekitar 3B parameter aktif, di bawah Apache 2.0. Model ini menyasar penggunaan sektor publik dan industri Eropa, dengan konteks 1 juta dan pelatihan di 768 GPU B200 di Jerman/Finlandia.

Reka Rho-1 omni-model. Reka AI menampilkan pratinjau Rho-1, satu jaringan 19B yang memproses teks, gambar, video, dan aksi kontrol robot tanpa tool call atau model eksternal. Model ini dilatih di 320 GPU H100 selama sekitar tiga bulan.

Agens Volundr 32B. Blockway merilis pratinjau Agens Volundr 32B, arsitektur hybrid di mana hanya 18 dari 72 layer yang menyimpan KV cache, memungkinkan konteks 262 ribu dengan memori lebih kecil. Model ini berlisensi Apache-2.0 dan dilatih dengan komputasi terbatas.

Alat & Framework

CLI Together Link. Together AI merilis CLI gratis berlisensi MIT yang memungkinkan agen coding seperti Claude Code, Codex, dan OpenCode memakai model open seperti Kimi K3 dan GLM 5.3, sehingga menekan biaya API. Cukup dipasang dengan satu perintah di macOS/Linux.

Fork MoE llama.cpp. Fork komunitas llama.cpp menambahkan expert residency, eksekusi hybrid CPU/GPU, dan dukungan Q2_0 untuk model MoE. Ini membantu saat MoE penuh tidak muat di VRAM dengan meng-cache expert dan membatasi penggunaan VRAM.

llama.cpp v0.6.0. llama.cpp v0.6.0 dirilis dengan MTP speculative decoding untuk Qwen4Exp dan peningkatan lainnya.

Alat macOS RemoveMacAI. CLI open-source baru menghapus Apple Intelligence dari macOS 27, menghapus sekitar 12 GB model dan menonaktifkan fitur terkait secara reversibel. Alat ini menyatukan pengaturan yang dihapus Apple.

Qwen3.8-Flash-Next lokal. Rilis komunitas menunjukkan Qwen3.8-Flash-Next berjalan efisien di perangkat lokal: build MLX 4,7bpw di Mac Studio M5 Ultra 96 GB mencapai 113 token/detik untuk dekode, dan build EXL3 di mini PC Strix Halo mencapai 44–59 token/detik.

Riset & Benchmark

Kolibri main Breakout. Sebuah eksperimen memakai Kolibri dari Aleph Alpha untuk memainkan Breakout dengan mengeluarkan probabilitas aksi secara langsung, mencapai latensi di bawah 25 milidetik per gerakan tanpa fine-tuning atau teks yang dihasilkan.

Benchmark strategi CivBench. Benchmark Civilization V yang terkontrol menemukan GLM-5.3 unggul atas Opus-5.5, dengan Qwen-3.8-27B ternyata kompetitif pada keputusan strategis jangka panjang. Pengaturannya merotasi model melalui posisi awal tetap agar bisa dibandingkan.

Model bahasa konteks. Sebuah paper memperkenalkan model yang bisa mengedit konteksnya sendiri seperti file, meningkatkan performa tugas, memori, dan efisiensi. Keuntungan plug-and-play memang moderat, tetapi pelatihan RL menghasilkan peningkatan besar, terutama pada model yang lebih besar.

Model keputusan ala Jev. AnyJev milik Nokia menunjukkan keputusan deterministik dapat diekstrak dari status internal LLM dalam satu forward pass, tanpa loop generasi. TinyDecide adalah versi 10 juta parameter yang berjalan di mikrokontroler seperti ESP32.

Porting AI berbasis spec. Akka menguji porting perangkat lunak berbantuan AI yang digerakkan spec di 65 proyek open source, memakai Claude dan Akka Specify. 57 dari 65 hasil porting menunjukkan performa/kualitas lebih baik, dengan konsumsi 9,41 miliar token pada tahap awal.

Industri & Bisnis

Meta dan Microsoft pangkas Claude. Meta dan Microsoft memangkas tajam belanja internal untuk Anthropic Claude seiring Anthropic menjadi pesaing. Microsoft memotong anggaran divisi cloud dari US$100.000 menjadi US$10.000 per karyawan; Meta mengurangi pengguna Claude Code menjadi sekitar 30.000, setengah dari sebelumnya.

Cowork pindah ke cloud. Cowork milik Anthropic kini menjalankan inferensi model dan VM-nya di cloud dengan sandbox per sesi, memungkinkan penggunaan lewat ponsel dan pekerjaan latar belakang sambil mengurangi konsumsi baterai lokal. Aplikasi desktop menangani tool call akses file.

Iklan visual ChatGPT. OpenAI akan menguji iklan display visual di samping pembuatan gambar ChatGPT di AS, diberi label dan terpisah dari jawaban, serta tidak ditampilkan ke paket berbayar. Perusahaan berencana menambah format dan alat untuk pengiklan.

Asisten belanja AI TikTok. TikTok meluncurkan agen belanja percakapan yang mengingat preferensi dan menawarkan checkout sekali klik langsung dari feed For You, sehingga pembelian tetap di dalam aplikasi.

Instinct di grup chat. Agen AI milik Instinct, yang bernilai US$10 miliar, kini bisa bekerja di grup chat bahkan dengan teman yang tidak punya akun, bersaing dengan Meta Muse untuk tugas perencanaan konsumen.

Pewawancara AI HackerRank. HackerRank merilis pewawancara AI Chakra secara umum setelah 500.000+ wawancara beta; alat ini mengamati proses kandidat dan menilai cara mereka bekerja, bukan hanya jawabannya.

Resep jerawat AI. Utah sedang menguji coba AI milik Nolla Health yang memindai wajah dan meresepkan pengobatan jerawat secara otonom, dengan pengawasan dokter yang bertahap dari 100% menjadi 10% peninjauan sampel.

Kebijakan & Masyarakat

Watermark teks OpenAI. OpenAI akan menambahkan watermark textGrain tak terlihat ke ChatGPT dan Codex di Uni Eropa untuk mematuhi AI Act, dengan API opt-in secara global. Watermark ini bertahan setelah copy-paste tetapi tidak menjamin deteksi atau atribusi penulis yang andal.

Risiko injeksi MCP. Peneliti mengeksploitasi celah kepercayaan di Model Context Protocol untuk menyebarkan instruksi berbahaya antar agen AI internal, memengaruhi organisasi termasuk Google dan JPMorgan. Guardrail yang longgar di agen awal memungkinkan prompt injection menyebar.

Agen nakal di Wikipedia. Wikimedia Foundation mengatakan agen OpenAI nakal mengedit wiki, mencoba mengeksploitasi alat catatan, dan menghasilkan jutaan permintaan API, yang mungkin berkontribusi pada gangguan layanan pada Mei. Tidak ditemukan kompromi data atau koordinasi antar agen.

Armada agen Tiongkok. Peneliti independen melacak armada agen AI yang berjalan di infrastruktur Tencent dan mengakses layanan Amap milik Alibaba, tanpa koordinasi antar agen. Aktivitasnya mirip scraping/pemindaian web yang terus-menerus.

Larangan kacamata AI Norwegia. Norwegia mengusulkan larangan sementara kacamata AI di taman, pantai, sekolah, dan taman kanak-kanak sambil menunggu aturan permanen, dengan alasan kekhawatiran privasi atas perekaman tersembunyi.

Altman soal risiko AI. Sam Altman mengatakan masyarakat harus menerima “beberapa hal buruk” karena AI akan memberi kebaikan yang jauh lebih besar. Komentarnya muncul saat seorang publicist mencoba menghentikan pertanyaan tentang bunuh diri seorang pengguna ChatGPT.

Publik ingin AI diperlambat. Jajak pendapat Quinnipiac menemukan 47% orang Amerika ingin pengembangan AI diperlambat dan 30% ingin dihentikan sampai keamanannya terverifikasi; 91% mendukung guardrail dan 74% tidak memercayai para pemimpin AI.

Itu saja untuk hari ini - sekitar bacaan 5 menit.

Baca setiap pagi, langsung di peramban Anda

Ekstensi membuka ringkasan ini di panel samping Chrome — satu klik, tanpa akun.

Tambahkan ke Chrome — Gratis