Rilis Model & Infrastruktur
Model Nvidia yang Mengutamakan Kecepatan. Nvidia merilis Nemotron 3.5 Lightning, model Mamba-Transformer 30B dengan bobot terbuka yang setara dengan GPT-OSS-120B pada tolok ukur namun dioptimalkan untuk inferensi cepat dengan hanya 3,6B parameter aktif.
DeepSeek V4 Berjalan Lokal. Kuantisasi komunitas DeepSeek V4 memperbaiki masalah konversi untuk baseline yang tepat-bit, dan DeepSeek V4 Flash mencapai 27+ t/s pada APU Strix Halo dengan decoding spekulatif, menunjukkan penerapan lokal yang layak.
Aplikasi Desktop Unsloth. Unsloth merilis aplikasi desktop sumber terbuka untuk menjalankan dan melatih model lokal di berbagai GPU, dengan eksekusi kode dalam sandbox, RAG, ekspor model, dan tanpa telemetri.
Pendanaan Awal $1.1B River AI. Didirikan oleh mantan salah satu pendiri xAI, Igor Babuschkin, River AI mengumpulkan $1.1B untuk membangun asisten AI yang dapat dilatih secara pribadi dengan merombak seluruh tumpukan dari pelatihan hingga perangkat keras.
Daybreak Cyber di AWS. Model keamanan siber Daybreak dari OpenAI kini tersedia melalui Amazon Bedrock, memberi para pembela akses ke kemampuan siber terdepan di lingkungan AWS yang ada.
Manifesto Sumber Terbuka Zuck. CEO Meta berargumen untuk lebih banyak rilis bobot terbuka dan mengundang pemerintah untuk berkolaborasi dalam pengujian keselamatan, seiring perusahaan terus merilis model seperti Muse Glimmer.
Dukungan Ling‑3.0. Sebuah pull request menambahkan Ling‑3.0 ke llama.cpp, dengan varian kecil yang sudah bekerja baik untuk tugas suara asisten rumah karena penolakan jujurnya saat tidak yakin.
Alat & AI Lokal
Broker MCP Memangkas Konteks. Kerangka agen DIY menggunakan broker MCP untuk menyembunyikan alat di balik proxy, memangkas konteks awal dari 20K token menjadi hampir nol, dan menambah kesadaran temporal untuk eksekusi lokal yang lebih baik.
GPU Penambangan untuk LLM. Kartu penambangan CMP170HX 8GB dapat diperluas hingga 64GB masing-masing, menjalankan model besar atau beberapa model kecil secara bersamaan, menawarkan performa kelas Ampere yang murah namun menua.
366 t/s di V100. Kernel CUDA khusus (v100‑skinny) memungkinkan hingga 366 t/s pada Qwen3.6 27B dalam NVFP4 di GPU Volta, memberikan kehidupan baru bagi perangkat keras lama untuk inferensi lokal.
Model TinyTitle. Model GRU 1,8M-parameter menghasilkan judul obrolan dalam kurang dari 5 MiB RAM, menunjukkan peringkasan on-device yang sangat ringan dan berjalan dalam beberapa milidetik.
AI E-Reader Pribadi. Aplikasi e-reader mengintegrasikan model Gemma 4B secara lokal untuk tanya jawab buku dalam aplikasi yang pribadi, dengan sakelar spoiler dan pencocokan bahasa otomatis.
Server AI Daya Rendah. Rakitan yang menggabungkan Intel N100 dengan RTX 5060Ti menghasilkan server llama.cpp yang senyap dan efisien, mampu menjalankan model terkini seperti Qwen 3.5 untuk penggunaan sehari-hari.
Biaya Inferensi Dipangkas. CEO Doubleword menjelaskan bagaimana merancang tumpukan inferensi untuk penggunaan non-real-time dapat memangkas biaya token lebih dari satu orde besaran dibandingkan pengaturan tujuan umum.
Perutean Model Cerdas. Pustaka Switchyard dari NVIDIA hanya merutekan 7% panggilan agen ke model frontier, mengurangi biaya hingga 74% dengan kehilangan akurasi minimal, dan menawarkan formula untuk mengevaluasi biaya-manfaat.
Kacamata AR Pribadi. Seorang pengguna tunanetra meminta kacamata AR ala Meta yang menjalankan model lokal untuk menghindari pengiriman data visual ke Meta, menyoroti permintaan privasi dalam teknologi bantu.
Penelitian Frontier
AI Menangani Riemann. Model Anthropic yang belum dirilis membuat kemajuan pada hipotesis Riemann dengan menguji 650 ide bersama 60 subagen selama 36 jam, memicu kembali perdebatan tentang peran AI dalam penemuan matematika.
Diagnosis Video AMIE. Sistem riset AMIE dari Google menunjukkan konsultasi video klinis tingkat ahli, menggunakan Gemini dan pengaturan multi-agen untuk menafsirkan isyarat visual, pendengaran, dan kontekstual.
AI Rontgen Dada CARE‑X. CARE‑X dari Microsoft adalah VLM rontgen dada terpadu yang menggabungkan generasi dan prediksi terstruktur, menggunakan pembelajaran penguatan untuk memberi penghargaan pada ketepatan klinis.
Adu Memori Agentik. ACE dan ALTK‑Evolve sama-sama mengubah lintasan agen menjadi pelajaran yang dapat digunakan kembali; ACE membangun playbook komprehensif, sementara ALTK‑Evolve mengambil pedoman individual.
Logprobs Mendeteksi Halusinasi. Menganalisis distribusi probabilitas token pada pengingatan faktual pertama dalam rantai pemikiran dapat mengungkap pengetahuan yang tidak dapat diandalkan, memberikan sinyal awal potensial untuk halusinasi.
Peringatan Penulisan AI. S. Alpert berargumen bahwa tidak ada penulisan ulang yang tanpa kehilangan, sehingga teks berbantuan AI harus diverifikasi secara pribadi untuk menghindari distorsi makna yang dimaksudkan penulis.
Bisnis & Keuangan
Tonggak 1 Miliar Pengguna. ChatGPT dan Gemini sama-sama mencapai 1 miliar pengguna aktif bulanan, dengan Gemini menjadi produk Google tercepat yang mencapai skala tersebut; ChatGPT telah mencapai 900 juta pengguna mingguan awal tahun ini.
Iklan ChatGPT Mendunia. OpenAI memperluas iklan ChatGPT ke lima negara lagi, melaporkan tidak ada dampak pada kepercayaan pengguna dan tingkat penolakan yang rendah saat mencari monetisasi berkelanjutan.
Kenaikan Harga OpenAI. Kursi Premium Bisnis ChatGPT baru berharga $125/pengguna/bulan dengan kapasitas lima kali lipat dan tanpa batas per jam, mencerminkan penggunaan token yang berat dari beban kerja agentik.
Lightcap Meninggalkan. Brad Lightcap, mantan COO dan pimpinan proyek khusus OpenAI, pergi setelah delapan tahun untuk memulai sesuatu yang baru, melanjutkan rentetan kepergian eksekutif.
Sewa $9.1B Anthropic. Anthropic menandatangani kesepakatan pusat data 20 tahun senilai $9.1B dengan penambang Bitcoin Riot Platforms untuk 191 MW di Texas, yang akan mendukung model generasi berikutnya mulai 2027.
Hambatan IPO Anthropic. Menjelang potensi IPO $965B, investor mempertanyakan pertumbuhan Anthropic di tengah model China yang murah dan hambatan politik, meskipun perusahaan memuji aplikasi kesehatan dan biologi masa depan.
Dorongan $500B Nvidia. Nvidia bermitra dengan enam perusahaan keuangan untuk memobilisasi $500B bagi infrastruktur AI dengan menjamin hingga 25% nilai sisa chipnya, melawan kekhawatiran depresiasi.
Taruhan AI India Accel. Accel menutup dana India $550M yang kelebihan permintaan, bertaruh AI akan mendukung startup konsumen, fintech, dan manufaktur daripada menjadi kategori mandiri.
Pencairan Dana Karyawan OpenAI. Pembelian kembali saham senilai $7B pada valuasi $852B memungkinkan karyawan OpenAI saat ini dan mantan untuk mencairkan saham, mengurangi tekanan sebelum potensi IPO.
Keamanan & Transparansi
UE Mewajibkan Tanda Air AI. Di bawah EU AI Act, Anthropic dan OpenAI berkomitmen menandai konten yang dihasilkan; Claude akan menyematkan tanda air tak terlihat dalam teks dan gambar, dengan dukungan untuk model lama sedang dikerjakan.
Asal-usul Foto Apple. iOS 27 mungkin memperkenalkan 'Apple Reference Image' untuk menyematkan metadata asal-usul saat pengambilan gambar, memungkinkan pengguna membuktikan foto iPhone bukan deepfake.
Spotify Menandai Artis AI. Spotify akan memberi label pada profil artis yang dihasilkan AI dan mengecualikannya dari rekomendasi, menggunakan pengungkapan diri dan deteksi sebelum meluncurkan perubahan pada pertengahan September.
Sengketa Penulisan AI. Studio game Saber membantah mengganti penulis dengan ChatGPT untuk Rideshare Stimulator, tetapi mantan penulis utama mengklaim AI digunakan untuk penulisan dan suara, tanpa pengungkapan di Steam.
Eksploitasi Zoom Bertenaga AI. Kerentanan kritis Zoom yang memungkinkan pengambilalihan perangkat melalui fitur anotasinya ditemukan menggunakan kurang dari 20 perintah ke model AI publik, menunjukkan riset keamanan yang dipercepat AI.
Pencurian Jejak Penalaran. Para peneliti memutar ulang token rantai pemikiran terenkripsi dari model frontier ke model saudara yang lebih lemah, me-jailbreak mereka, dan memulihkan penalaran tersembunyi, mengekspos kata sandi dan kunci API di sesi publik.
Mempercayai Kode yang Dihasilkan AI. IBM dan Red Hat memperluas Lightwell untuk menciptakan rantai pasokan perangkat lunak yang dapat diverifikasi untuk era AI, memastikan asal-usul dan kepatuhan kebijakan untuk kode yang dihasilkan manusia dan AI.
Itu saja untuk hari ini - sekitar bacaan 5 menit.