Rilis Agen & Model
Skor Qwen 3.8 27B. Qwen 3.8 27B mencetak skor 52 pada Artificial Analysis Intelligence Index, menyamai GPT-5.6 Luna Max dan tertinggal satu poin dari GLM-5.2 dan DeepSeek V4 Pro yang jauh lebih besar. Model ini hadir dengan default penalaran xhigh, kemungkinan untuk memaksimalkan visibilitas benchmark.
Coding agentic Qwen. Pada VRAM 16GB, Qwen 3.8 27B terkuantisasi dengan decoding spekulatif MTP menangani konteks 73k pada 30-50 tps. Benchmark lokal menemukan mode penalaran medium hampir menyamai DeepSeek V4 Flash dengan token lebih sedikit, sementara xhigh tidak jelas meningkatkan coding agentic.
- → Optimizing Qwen3.6 / Qwen3.8-27B on 16GB VRAM: Complete Benchmark Results and Setup Guide (~30-50tps at 32k to 72k context)
- → After pushing 1M+ tokens through Qwen 3.8 27B, here is my optimal llama.cpp config for 16GB VRAM (73k Context, Agentic Coding)
- → Local agentic coding Benchmark : Qwen 3.8 27B (in many weights quants / cache quants / engine / reasoning effort) vs others.
35B-A3B masih belum jelas. Seorang pengembang Qwen mengatakan agar tidak menunggu 35B-A3B, meskipun permintaan komunitas untuk 35B-A3B dan 122B tetap tinggi tanpa sinyal rilis resmi.
Kecepatan Ling 3.0 Tiny. Ling 3.0 Tiny 8B dengan 1,3 miliar parameter aktif berjalan pada 36 token/detik di VRAM 4GB dan kinerjanya mendekati Qwen 3.5 9B dan Gemma 12.
Pasca-pelatihan GLM-5.3. Z.ai merilis GLM-5.3 dengan peningkatan yang semata-mata berasal dari lebih banyak pasca-pelatihan, menghasilkan coding kompleks dan kinerja tugas jangka panjang yang lebih baik.
Agen Grok Bot. SpaceXAI memperkenalkan Grok Bot, agen AI persisten pada komputer cloud khusus yang menangani alur kerja multi-langkah, mengingat preferensi, dan berkoordinasi dalam grup.
Alat & Kerangka Kerja
llama.cpp v0.1.0. llama.cpp merilis versi semantik pertamanya, v0.1.0, dan sebuah PR menambahkan MTP adaptif yang secara dinamis memilih kedalaman MTP, meningkatkan pembuatan kode 10-15% dan recall hingga 100% lebih cepat.
Middleware pembayaran agen. Middleware AgentCore Payments untuk agen LangChain menambahkan anggaran tingkat sesi yang deterministik dan dukungan dompet, dengan LangSmith mencatat apa yang dibeli agen dan alasannya.
Fungsi fitness agentic. Sebuah artikel baru berpendapat bahwa fungsi fitness agentic dapat memperluas arsitektur evolusioner dengan menangani risiko yang membutuhkan penilaian, sementara gerbang deterministik tetap ada untuk invarian yang dapat diukur.
Penjadwalan GPU sadar kendala. Hugging Face membangun pengalokasi GPU yang sadar kendala yang meningkatkan pemanfaatan hingga 33 poin persentase dan output berbobot prioritas hingga 105% pada perangkat keras yang identik.
Industri & Bisnis
Kesepakatan Stripe-OpenRouter. Stripe dilaporkan akan mengakuisisi startup routing model AI OpenRouter dengan nilai lebih dari $7 miliar, setelah Series B senilai $1,3 miliar; OpenRouter memiliki 8 juta pengguna dan 250 triliun token per bulan.
Lonjakan pendapatan Anthropic. Laju pendapatan tahunan Anthropic melampaui $65 miliar pada Juli, naik dari $47 miliar pada Mei dan $9 miliar pada akhir 2025, dengan IPO diperkirakan pada musim gugur ini dengan valuasi lebih dari $2 triliun.
Relay tutup. Startup otomatisasi alur kerja AI Relay sedang ditutup; pendirinya dan beberapa staf bergabung dengan tim Chrome Google untuk mengerjakan AI di Chrome.
Wispr menggalang $280 juta. Wispr menggalang Series B senilai $280 juta dengan valuasi $2 miliar untuk berekspansi dari dikte AI ke pencatatan dan rapat, meluncurkan model Canto.
Pemulihan pasar video AI. Video yang dihasilkan AI mulai menarik studio Hollywood dan miliaran dolar setelah kegagalan awal Sora, dengan startup seperti Promise menggunakan Seedance 2.5 untuk latar belakang real-time.
Agen AI Grab. Grab mengurangi pekerjaan analitik mekanis dari 44% menjadi 30% menggunakan model otonomi agen lima tingkat, dengan analis tetap memegang keputusan akhir.
Infrastruktur & Komputasi
Pusat data OpenAI Ohio. OpenAI menandatangani sewa 20 tahun untuk kapasitas IT 8 GW di PORTS-Pike, Ohio dengan SB Energy; Nvidia mendukung hingga $105 miliar dan menjadi satu-satunya pemasok chip.
Groq beralih ke neocloud. Groq menggalang $350 juta dengan valuasi $3,5 miliar saat beralih dari chip AI ke infrastruktur neocloud berbasis Nvidia setelah kesepakatan lisensi dengan Nvidia.
Lonjakan harga RTX Pro 6000. CDW menaikkan MSRP RTX Pro 6000 dari $16 ribu menjadi $19.999, dan harga pasar barang bekas juga melonjak, menekan para pengembang AI lokal.
Data Pelatihan & Kebijakan
Pemindaian buku langka Amazon. Sebuah AirTag melacak pesanan buku langka dalam jumlah besar ke fasilitas pelatihan AI Amazon di mana para pekerja menghancurkan buku untuk memindainya; Amazon mengatakan pihaknya membeli buku melalui saluran komersial.
Penandaan air Anthropic Claude. Anthropic akan menyematkan penanda air SynthID-Text pada keluaran Claude untuk mematuhi EU AI Act; para kritikus khawatir tentang kualitas pilihan kata dan masalah transparansi.
Itu saja untuk hari ini - sekitar bacaan 5 menit.