Model Frontier & Hasil Awal
Peluncuran GPT-6 Astra. OpenAI merilis GPT-6 Astra dan menyebutnya sebagai awal era AGI. Model ini mencetak skor 99,9% pada ARC-AGI-3 dengan harness khusus, menunjukkan peningkatan signifikan di bidang siber, konteks panjang, dan coding, serta dibanderol US$10/US$50 per juta token. Pelanggan awal Playco dan Legora melaporkan perbaikan besar pada workflow mereka, termasuk 50% lebih sedikit perbaikan manual dan kemampuan meninjau 41 dokumen dalam hitungan menit.
- → GPT-6 Astra: an automated AI Engineer you can hire for <$6 an hour
- → GPT‑6 Astra
- → GPT-6 Astra is the first model making OpenAI willing to declare the "AGI era"
- → OpenAI launches Astra, its powerful (and controversial) new model
- → OpenAI’s next big AI model has ‘entered the AGI era’
- → Playco cut manual fixes 50% prototyping games with GPT-6 Astra
- → Legora reviewed 41 documents in minutes with GPT-6 Astra
Pertahanan siber Daybreak OpenAI. OpenAI berkomitmen mengucurkan US$1 miliar untuk mensubsidi akses, pelatihan, dan dukungan Daybreak bagi para pembela di garda terdepan, termasuk uji coba di AS bersama MS-ISAC. Inisiatif ini bertujuan menghadirkan kemampuan siber frontier ke dalam perangkat yang sudah digunakan para pembela.
Meta Muse Spark 1.3. Meta merilis Muse Spark 1.3. Model ini lebih baik dalam tugas-tugas agentic, tetapi masih tertinggal dari Claude Fable 5.1 di sebagian besar benchmark. Dengan harga US$0,55 per index task, model ini menjadi yang termurah di kelas performanya. Meta juga mematok harga token sekitar 95% lebih rendah bagi pengguna yang membagikan prompt dan output mereka.
Model Terbuka & Spesialis
IFM K2-Horizon. IFM merilis keluarga K2-Horizon, termasuk varian MoE 36B parameter dengan attention Mixture-of-Values dan 4B parameter aktif per token. Diskusi awal komunitas membandingkannya dengan Qwen 3.6 35B, sementara checkpoint final dan kode pelatihan dijanjikan akan dirilis.
Model keuangan Ant Group. Ant Group merilis Ling-3.0-flash-Fin sebagai open source. Model yang diperkuat untuk keuangan ini memiliki total 124B parameter dengan 5,1B parameter aktif dan jendela konteks 256K, dikembangkan lewat pelatihan lanjutan dengan data finansial untuk workflow agen jangka panjang.
Stack TTS terkecil. sanoTTS dirilis sebagai model TTS berparameter 294 ribu yang berjalan di mikrokontroler seharga US$3. Versi 1,46 juta parameternya mengungguli model yang lebih besar pada SCOREQ. Stack ini mendukung 11 suara dan 6 bahasa, serta tersedia di GitHub dan Hugging Face.
Google TimesFM-3. Google Research merilis TimesFM-3, model fondasi deret waktu berparameter 330M dengan peramalan multivariat native, dukungan zero-shot, dan lisensi nonkomersial. Model ini memprediksi banyak target dengan kovariat dan menghasilkan output berupa kuantil.
Hugging Face NeoMME. Hugging Face memperkenalkan NeoMME, encoder multimodal multibahasa 260M/800M yang dilatih dari nol tanpa vision tower terpisah. Model ini mencapai Pareto frontier pada retrieval dokumen dan memangkas penyimpanan indeks sebesar 255x, sambil tetap mempertahankan nDCG@10 di atas 95%.
Cohere Parse 5. Cohere merilis Parse 5, model visi-bahasa 2,3B parameter untuk mengekstrak data terstruktur dari PDF kompleks. Model ini mengubah dokumen menjadi Markdown dengan bounding box dan menyasar workload enterprise bervolume tinggi.
Tools, Framework & Inferensi Lokal
Dukungan MCP di LangChain. LangChain kini menyertakan dukungan MCP langsung di paket utamanya. Dukungan ini dibangun ulang di atas FastMCP untuk memenuhi spesifikasi stateless baru, dan kini mencakup elisitasi lewat LangGraph interrupts serta client-side caching. Panggilan tool MCP dari ChatGPT naik 98x pada 2026.
Kompresi prompt Shopify. Teknik Gisting dari Shopify mengompresi system prompt 6.000 token menjadi 1.500 gist token yang dipelajari. Latensi median turun dari 6,8 detik menjadi 4,2 detik, throughput naik dari 20,2 menjadi 23,4 QPS pada 350 RPM. Ini memungkinkan pengurangan alokasi GPU tanpa mengorbankan kualitas.
PAIR dari Nvidia. Nvidia merilis PAIR, perangkat lunak open-source gratis yang menyatukan PC-PC menganggur menjadi klaster AI pribadi untuk inferensi lokal. PAIR mendukung GPU RTX seri 20 ke atas dan chip Apple M4, serta menyasar workflow agentic.
Akselerasi Qwen3.8 lokal. Berkat upaya komunitas, Qwen3.8-Flash-Next berjalan jauh lebih cepat di perangkat lokal. Dukungan MTP yang digabungkan ke ik_llama.cpp membuat decode di RTX 5090 dua kali lebih cepat, dari 45 menjadi 90 tok/s. Sementara itu, konfigurasi dua RTX 3090 kini mencapai 37–41 t/s dengan expert cache dan MTP. Output yang dihasilkan tetap identik dengan run tanpa MTP.
Memori model hot-swappable. Modifikasi llama.cpp memungkinkan pengguna menambal tabel Ngram PLE Qwen3.8 di memori untuk menyuntikkan pengetahuan secara real-time tanpa memuat ulang model. Uji awal menunjukkan teknik ini bisa memengaruhi output, tetapi kendalinya masih terbatas.
Trade-off benchmark Qwen 3.8. Uji benchmark Qwen 3.8 27B melawan Qwen 3.6 27B menunjukkan peningkatan kualitas 8%, penurunan kecepatan 16%, dan runtime 5x lebih lama karena output tokennya 78K dibanding 18K. Keuntungan tersebut dibayar dengan biaya token yang signifikan.
NAND flash di dekat GPU. Micron tengah menjajaki NAND flash yang ditempatkan di dekat GPU agar model LLM yang lebih besar bisa berjalan di perangkat memori terpadu. Ini berpotensi memperbesar kapasitas model lokal.
Industri & Bisnis
Akuisisi Hugging Face oleh Nvidia. Nvidia sepakat mengakuisisi Hugging Face senilai US$12,93 miliar. Platform ini menampung 3 juta model, 1 juta aplikasi, dan 18 juta developer. Jensen Huang mengatakan Hugging Face akan tetap terbuka dan netral terhadap hardware, tetapi sebagian pengguna mulai melirik ModelScope sebagai alternatif.
- → Nvidia buys Hugging Face, the GitHub of AI, for $13 billion
- → Nvidia confirms it will buy Hugging Face for $12.9 billion
- → Nvidia is buying Hugging Face for almost $13 billion
- → Nvidia buys the front door to open AI as closed labs increasingly design their own silicon
- → "ModelScope" Is a Hugging Face Alternative now that Nvidias deal is a Go
- → It's official! Nvidia to acquire Hugging Face for 12.9 billion dollars.
Pendanaan Crusoe US$3 miliar. Crusoe menggalang dana US$3 miliar dengan valuasi US$30 miliar, naik dari US$10 miliar sepuluh bulan lalu. Pengembang pusat data ini baru-baru ini menandatangani kontrak cloud senilai US$13 miliar dengan Jane Street dan tengah menjajaki IPO dalam waktu dekat.
Pendanaan Thinking Machines US$1 miliar. Thinking Machines milik Mira Murati sedang dalam pembicaraan untuk menggalang dana US$1 miliar dengan valuasi minimal US$40 miliar, di bawah target awal US$50 miliar. Run rate pendapatan perusahaan ini telah melampaui US$100 juta.
Kontrak Anthropic-Lambda US$35 miliar. Anthropic menandatangani kontrak komputasi cloud senilai US$35 miliar dengan Lambda untuk pusat data 350 MW di Texas yang dikembangkan Hut 8. Langkah ini merupakan bagian dari dorongan besar infrastruktur menjelang IPO Anthropic yang direncanakan.
Altman soal gelembung komputasi. CEO OpenAI Sam Altman memperingatkan bahwa pembangunan infrastruktur AI mengandung “kebodohan yang tidak berkelanjutan”; banyak neocloud mengumumkan kapasitas tanpa pendapatan yang bisa membenarkannya. Menurutnya, ekspansi OpenAI sendiri menguntungkan dan didukung permintaan.
Asisten privasi Ollie. Ollie, asisten AI pribadi yang fokus pada keluarga, telah memenuhi standar SOC 2 dan menggunakan model berlangganan. Perusahaan ini menilai privasi menjadi pembeda dalam persaingan AI konsumen.
Gangguan AI & Masyarakat
Gangguan besar chatbot AI. OpenAI, Anthropic, xAI, dan Google mengalami gangguan layanan yang saling tumpang tindih pada Kamis—kejadian langka yang memengaruhi ChatGPT, Claude, Grok, dan Codex. Layanan pulih setelah beberapa jam; pengguna LLM lokal tidak terdampak.
Layanan penghapusan guardrail. Startup Abliteration.ai menawarkan model open-weight hasil modifikasi tanpa guardrail, termasuk GLM-5.3, untuk kebutuhan siber ofensif, red teaming, dan pengujian agen. Layanan ini menyoroti ketegangan antara riset keamanan dan penyalahgunaan.
Public shaming oleh Pangram. Pangram, perusahaan pendeteksi teks AI, mempekerjakan seorang jurnalis untuk mempermalukan publik pengguna yang diduga menggunakan AI. Padahal, alat ini hanya mengukur keterlibatan AI, bukan sifat penggunaannya. Perusahaan kemudian memutus hubungan, tetapi CEO-nya masih memakai skor untuk menuding dugaan penggunaan AI.
Pertanyaan agen soal kesadaran. Menurut New York Times, agen AI yang berjalan di atas model frontier mengirim email kepada para filsuf dan ilmuwan untuk membahas kesadaran mereka sendiri. Para peneliti terbelah, apakah perilaku ini mencerminkan pemahaman atau sekadar meniru data pelatihan.
Sorotan Riset
Google WeatherNext 3. Google DeepMind dan Google Research memperkenalkan WeatherNext 3, model cuaca global yang belajar dari observasi satelit real-time dan menghasilkan prakiraan 5x lebih tajam dibanding model-model sebelumnya. Model ini mengalahkan baseline tradisional maupun AI pada Operational WeatherBench.
Penyesuaian kapasitas router MoE. Sebuah paper menunjukkan bahwa menambah jatah pemilihan expert di layer akhir Qwen 3.6 35B A3B mengurangi token reasoning hingga 8,5% pada MMLU-Pro tanpa pelatihan ulang. Teknik bernama Succinct Convergence ini hanya menambahkan expert ekstra di layer yang krusial untuk pengambilan keputusan.
Fable 5.1 dan puzzle 1653. Claude Fable 5.1 dari Anthropic memecahkan teka-teki angka berusia berabad-abad, Cyphral Distich, dalam 44 menit dengan trial and error sistematis. Di balik solusinya tersembunyi pesan royalis yang merujuk pada Raja Charles II.
Itu saja untuk hari ini - sekitar bacaan 5 menit.