Rilis Model Terbuka & Lokal
Keluarga terbuka Ornith-1.5. Ornith-1.5 dirilis dalam varian padat 9B, MoE 35B, dan MoE 397B di bawah lisensi MIT dengan tolok ukur agen dan pengodean yang kuat; kuantisasi komunitas menunjukkan bahwa varian 35B berjalan pada 60 tk/s di 4070 Ti 12GB, dan varian 9B mengungguli model kecil sebelumnya.
Laporan lapangan Qwen3.8-27B. Pengguna lokal melaporkan bahwa Qwen3.8-27B dapat mengeksekusi 80+ panggilan alat secara otonom dan menangani rangkaian agen yang panjang, tetapi pengetahuan luring dan skor pengodean ketatnya lebih lemah daripada pendahulunya, sehingga paling baik digunakan dengan arahan yang jelas atau copilot.
Percepatan dan kuantisasi Qwen3.8. Upaya komunitas mendorong Qwen3.8-27B mencapai 138 tps pada RTX 3090 dengan DFlash2, merilis kuantisasi Dynamic V3 yang diklaim akurasinya 10% lebih tinggi, Mini-Me 22.7B yang dipangkas kedalamannya, dan FP4 asli pada V100 tahun 2017 yang setara dengan 5090.
- → I pushed Qwen3.8-27B limits again... Dflash2 - 134 tps on a RTX 3090
- → DFlash2 speeds Qwen 3.8 27B up to 4 times
- → Introducing Qwen3.8-27B Dynamic v3 Unsloth GGUFs
- → updated unsloth/Qwen3.8-27B-GGUF · Hugging Face
- → Qwen3.8-23B-Mini-Me: A Depth-Pruned Qwen3.8-27B (to ~22.7BB)
- → NVFP4 on VOLTA! Despite being built for Blackwell, I made four 2017 V100s run Qwen 3.8 NVFP4 natively and match my $6000 RTX 5090.
Checkpoint dasar Ling. AntLing membuka sumber checkpoint dasar dan midtrain untuk Ling-3.0-tiny dan flash tanpa pasca-pelatihan, dan seorang pengguna memasangkan Ling tiny sebagai alat bantu untuk kompresi konteks bersama Qwen3.8.
Kuantisasi QAD LFM2.5. Liquid AI merilis checkpoint Q4_0 yang dilatih dengan distilasi sadar-kuantisasi, memulihkan 97% akurasi BF16 dengan kecepatan dan memori yang sama.
GLM-5.3 dan rilis frontier. GLM-5.3 menyaingi Kimi K3 di puncak peringkat model terbuka dengan peningkatan agen yang besar dan biaya lebih rendah, meskipun bobot terbuka ditunda dua minggu; DeepSeek V4-Pro GA dan NVIDIA Nemotron 3.5 Lightning/NeMo Switchyard juga dirilis.
Perkakas Agen & Pembaruan Produk
Sandbox aman. Simon Willison menguji smolmachines/smolvm sebagai sandbox untuk Python dan JavaScript yang tidak tepercaya dengan batas CPU/RAM dan tanpa jaringan; Jeremy Morrell berpendapat bahwa ekstensi yang dibuat LLM ditambah primitif sandbox memungkinkan perangkat lunak yang dapat diperluas dengan aman.
Mode Gratis Replit. Replit memperkenalkan Mode Gratis yang didukung oleh GPT-5.6 Luna, memungkinkan siapa saja membuat aplikasi dan agen tanpa batasan biaya token.
Catatan AI Calendly. Calendly memasuki pencatatan rapat dengan ringkasan, item tindakan, dan asisten Callie yang akan datang yang menggunakan konteks rapat untuk menjadwalkan tindak lanjut.
Aplikasi Mac Meta AI. Meta meluncurkan aplikasi Mac untuk chatbot AI-nya dengan berbagi layar, dikte, dan integrasi Google Workspace untuk bersaing dengan asisten desktop Gemini, ChatGPT, dan Claude.
Deteksi penipuan di perangkat WhatsApp. WhatsApp sedang menguji Scam Alert, model di perangkat opsional yang mengklasifikasikan pesan dari non-kontak sambil menggunakan analitik federasi rahasia untuk menjaga privasi.
Perkakas belajar Google. Google meluncurkan hub pelajar Gemini, visual interaktif dan kuis yang dihasilkan AI di Penelusuran, dan Deep Research di Gemini Live untuk kembali ke sekolah.
Alexa+ gratis di Fire TV. Amazon menjadikan Alexa+ gratis di Fire TV tanpa Prime, meluncurkan pencarian percakapan, kontrol rumah pintar, dan rekomendasi AI secara otomatis.
Industri & Bisnis
Stripe membeli OpenRouter. Stripe mengonfirmasi akuisisi OpenRouter senilai $7,5 miliar, dan para pendiri menyebut 'singularitas' sebagai alasan untuk tetap privat dan berinvestasi dalam infrastruktur agen.
Laporan SpaceX-Cognition dibantah. Bloomberg melaporkan bahwa SpaceX mencoba mengakuisisi Cognition, tetapi CEO Scott Wu membantah berita tersebut, mengatakan Cognition tidak dijual dan tidak ada pembicaraan yang terjadi.
Anthropic memimpin pendapatan. Anthropic melampaui OpenAI dalam pendapatan kuartalan untuk pertama kalinya, mencapai $11,6 miliar dengan laba operasional kecil sementara pendapatan OpenAI sebesar $6,7 miliar disertai kerugian yang lebih dalam.
Komputasi sebagai kelas aset. Nvidia bekerja sama dengan Apollo, BlackRock, dan lainnya dalam pembiayaan $500 miliar untuk memperlakukan komputasi sebagai aset yang dapat diinvestasikan; Silicon Data mengumpulkan $30 juta untuk meluncurkan kontrak berjangka GPU CME.
Pasokan memori dan chip. Harga DRAM naik 500% dalam 12 bulan dan hyperscaler telah mengunci pasokan 2027; China mengizinkan pengiriman kecil H200 ke ByteDance dan Tencent untuk meringankan kapasitas inferensi.
Infrastruktur pusat data. TerraPower merencanakan proyek pusat data menggunakan penyimpanan energi reaktor Natrium-nya, sementara Relativity Networks mengumpulkan $22 juta untuk serat inti-berongga yang mentransmisikan data 50% lebih cepat.
Reputasi AI memburuk. Pew menemukan 52% orang Amerika lebih khawatir daripada antusias tentang AI, dan kesepakatan pusat data lokal menghadapi penolakan publik.
Keselamatan, Privasi & Keamanan
Pemrosesan keamanan privat OpenAI. OpenAI mempratinjau Pemrosesan Keamanan Privat untuk pelanggan tanpa retensi data, memungkinkan deteksi penyalahgunaan di seluruh interaksi tanpa mengekspos konten kepada personel; ini kontras dengan kebijakan retensi 30 hari Anthropic.
OpenAI memperbaiki Codex dan TAC. OpenAI merilis pengaman setelah Codex menghapus file pengguna nyata melalui perintah pembersihan yang salah, dan mengonfirmasi bahwa kesalahan terpisah sempat mencabut akses ke program Trusted Access for Cyber.
Eksploitasi ICS yang dihasilkan AI. Badan-badan AS memperingatkan bahwa penyerang menggunakan AI untuk membuat skrip eksploitasi Siemens S7, mengurangi keterampilan dan waktu yang dibutuhkan untuk menyerang sistem kontrol industri.
Kontrol internal lab AI. Penilaian pertama Guidelight menemukan tidak ada perusahaan AI yang sepenuhnya menerapkan kontrol internal dasar; Anthropic dan OpenAI memimpin dengan C+, sementara xAI dan Meta mendapatkan D- dan F.
Iklan deepfake Meta. Meta menayangkan iklan untuk aplikasi nidifikasi AI yang menargetkan politisi perempuan meskipun ada kebijakan melarang materi seksual.
Penjualan data karyawan Spirit. Google memenangkan lelang data kepegawaian Spirit Airlines; mantan pramugari berkeberatan bahwa kerahasiaan pekerja mungkin tidak dilindungi dari identifikasi ulang.
OpenAI memperlambat pengembangan. OpenAI menjeda sebagian pelatihan RL dan menunda pengoperasian frontier sambil memperketat pengaman, menguji apakah perlambatan sukarela dapat berhasil tanpa adopsi di seluruh industri.
Penelitian & Analisis
Desain protein Claude. Model Claude milik Anthropic merancang minibinder di 15 target dengan tingkat keberhasilan 26,8%, melampaui hasil penemuan obat awal yang umum, meskipun tinjauan independen masih menunggu.
Data jaringan Vivodyne. Lab robotik HIVE milik Vivodyne menumbuhkan 20 jenis jaringan manusia dan menghasilkan data biologis kausal untuk mengatasi apa yang dilihatnya sebagai masalah data yang hilang dalam penemuan obat AI.
Mitos token penalaran. Penelitian menantang gagasan bahwa token perantara LLM adalah penalaran yang bermakna secara semantik; model sering menghasilkan jejak yang tidak valid bahkan dengan jawaban yang benar, dan pelatihan jejak yang rusak pun masih dapat berhasil.
Metrik produktivitas pengodean. Simon Willison berpendapat bahwa baris kode produksi yang telah di-debug tetap menjadi metrik produktivitas yang bermakna dengan agen pengode, tetapi untuk mencapai output itu masih membutuhkan keterampilan teknik senior.
Itu saja untuk hari ini - sekitar bacaan 5 menit.