Agentic AI News Hari ini

Berita agen AI hari ini dalam bacaan 5 menit: rilis, alat, riset, pendanaan, dan langkah perusahaan.

Diperbarui setiap hari dikurasi dari 30 sumber Sabtu, Oktober 3, 2026

Rilis Agen & Model

Gadget Muse. Meta merilis firmware dan SDK secara open source untuk merakit perangkat keras DIY yang terhubung ke agen Muse, misalnya layar E Ink dan HDMI stick, lengkap dengan Discord untuk dukungan.

OpenAI Dot. Agen Dot baru dari OpenAI berperilaku seperti software enterprise yang juga bisa memesan makan malam. Ia berjalan di mesin virtual dengan akses ke aplikasi seperti Blender dan GIMP, dan diposisikan sebagai rekan kerja, bukan asisten belanja pribadi.

Model humanoid Unitree. Unitree merilis UnifoLM-WLA-1.0, model 6B yang dilatih dengan sekitar 2.500 jam data robot nyata dan menangani 64 tugas whole-body serta tabletop di G1, memadukan optical flow dan MMDiT untuk kendali kontinu.

FrogNano untuk coding. FrogNano-4B-2609 dari Microsoft adalah model agentic turunan Qwen3.5-4B, dilatih lanjut pada 1.500 tugas SWE sintetis dengan reward yang bisa dieksekusi untuk meningkatkan rekayasa perangkat lunak tingkat repositori dalam ukuran ringkas.

Cloudflare Clef. Cloudflare merilis model keputusan Clef dan Clef-flash yang mengeluarkan probabilitas untuk jawaban yang sudah ditentukan, dengan latensi median serendah 39 milidetik, sehingga agen bisa bertindak tanpa campur tangan manusia.

Alat & Framework

Mesin MegaCapybara. Mesin inferensi yang dirancang khusus untuk RTX 5090 dan Qwen3.8 27B ini mengklaim kecepatan decode sekitar dua kali lipat NInfer, mencapai 500+ token/detik untuk satu agen dan 2.000+ token/detik di 12 agen, berkat kernel dinamis dan manajemen cache.

Pembaruan llama.cpp. llama.cpp menambahkan dukungan untuk model keputusan dan sebuah pull request CUDA yang menggabungkan shared expert untuk mempercepat arsitektur MoE seperti Qwen 35B A3B.

Subtitle mlsubgen. Alat lokal baru ini menghasilkan subtitle dalam 45 bahasa sepenuhnya di komputer sendiri, mendeteksi bahasa per segmen, menyelaraskan dua speech recognizer dengan LLM lokal, dan mengutamakan subtitle tertanam yang sudah ada.

Riset & Kemajuan Model

Arsitektur memori Spotlight. Spotlight dari Percepta menggantikan attention dengan memori yang bisa ditulis tanpa batas dan diindeks sendiri oleh model, memisahkan kecerdasan dari pengetahuan sehingga kemampuan bisa bertambah tanpa mengubah bobot.

Pembaruan GPT-6. OpenAI menerbitkan panduan keluarga GPT-6 dan mengumumkan pembaruan DevDay, termasuk GPT-6.1 Sol, computer use untuk Agents API, lingkungan Codex di cloud, dan Decisions API.

AstaBrief open source. Hugging Face merilis AstaBrief sebagai open source, model kecil yang dilatih khusus untuk menghasilkan laporan ilmiah bersitasi secara cepat, dirancang agar tetap berpijak pada bukti dan memverifikasi keluarannya.

Industri & Bisnis

Apple perketat akses disk. Apple menambahkan kontrol pada Full Disk Access di macOS karena risiko agen AI, menyusul tuduhan bahwa Meta Muse membaca pesan tanpa izin. Meta menyebut akses itu bersifat opt-in, sementara Apple menginginkan tindakan pengguna yang sangat eksplisit.

Tolakan pusat data. Amazon menjanjikan US$1 miliar untuk komunitas di sekitar pusat data dan CEO AWS Matt Garman mendesak pencabutan moratorium, sembari menyebut adanya disinformasi asing. Microsoft memperluas biomimikri di pusat data di tengah penolakan warga setempat.

AI jadi 'super intelligence'. Gedung Putih membuat para CEO perusahaan teknologi besar menandatangani komitmen keselamatan AI dan Trump meneken perintah eksekutif yang mengubah sebutan AI menjadi "super intelligence". Sementara itu, baru 2% konsumen yang membeli produk AI.

Guncangan di OpenAI. OpenAI memecat tiga peneliti dan seorang peneliti keempat keluar setelah investigasi menemukan mereka membocorkan informasi rahasia ke organisasi keselamatan AI dari luar.

Pencarian Uber Eats. Uber membangun ulang pipeline pencariannya dan memangkas latensi end-to-end sebesar 50%, memakai agentic coding untuk mengidentifikasi dan memvalidasi optimasi.

Strategi AI Airbnb. CTO Airbnb Ahmad Al-Dahle menerapkan strategi AI dari dalam ke luar: memakai AI generatif secara internal untuk mempercepat pengembangan produk, lalu mentransformasi pengalaman pelanggan.

AI Lokal & Perangkat Keras

Strata + Qwen3.8 Next. Pengguna melaporkan Strata dengan Qwen3.8 Next berjalan pada 45-70 token/detik di konfigurasi DDR4+7900XTX yang lambat dan 150-200 token/detik pada RTX 5090 berdaya terbatas dengan DDR5 96GB, jauh mengalahkan llama.cpp.

iPhone jadi GPU kedua. iPhone 17 Pro Max dapat mempercepat prefill Qwen 3.8 27B sebesar 29-44% pada MacBook 24GB asalkan tersambung lewat USB-C dan lapisan atasnya dijalankan di GPU ponsel.

Kartu Ascend 96GB. Dua kartu Huawei Atlas 300I Duo yang masing-masing berkapasitas 96GB dapat menjalankan Qwen3.8 Flash-Next pada sekitar 30 token/detik setelah software stack-nya disetel, meski keduanya bukan pengganti CUDA yang bisa langsung dipakai.

Biaya DGX Spark & 5090. Nvidia memperkenalkan DGX Spark 64GB, sementara harga model asli 128GB naik menjadi US$6.950. Kabarnya, membeli RTX 5090 di Micro Center kini butuh berkas bebas ekspor.

Itu saja untuk hari ini - sekitar bacaan 5 menit.

Baca setiap pagi, langsung di peramban Anda

Ekstensi membuka ringkasan ini di panel samping Chrome — satu klik, tanpa akun.

Tambahkan ke Chrome — Gratis