Model Frontier & Produk Agen
GPT-6 Astra di produksi. Perplexity memakai Astra untuk menulis materi komunikasi, menyunting software, dan memantau sistem produksi. Cognition memakainya untuk menguji hasil kerja Devin lalu mengembalikan rekaman plus laporan, dengan target memangkas code review.
Beta API OpenAI Agents. Beta publik ini memungkinkan developer membangun agen cloud yang berjalan berjam-jam, mengeksekusi kode, dan memproses file di infrastruktur di balik Codex dan ChatGPT, dengan penagihan berbasis token tanpa biaya tambahan.
Model Open Source & Lokal
Gelombang lokal Qwen 3.8. Komunitas melaporkan Qwen 3.8 27B sering terasa lebih kuat daripada Qwen-Next untuk coding, sementara pengguna kuantisasi UD menimbang kecepatan 6-bit versus kualitas 8-bit. Fine-tune Humanlike terbaru menyasar obrolan santai agar tidak terkesan seperti asisten.
- → Qwen3.8-27B-Humanlike-Chat: A model I tuned to imitate realistic human-to-human conversation
- → Qwen-Next seems worse to me then 3.8 27b for coding, but I feel like I must be missing something?
- → Unsloth UD-quants - Qwen 3.8 27b for example - worth using 8-bit or stick with faster 6 bit for coding?
Proyek fine-tuning lokal. Model 2B yang dilatih pada obrolan grup WhatsApp belajar slang dan irama bicara, tapi tidak koherensi mendalam; fine-tuning Qwen 3 4B pada 100 puzzle zebra menaikkan MATH-500 sebesar 31%; CodeFinetuner menyediakan pipeline untuk fine-tuning model autocomplete kode pada basis kode Anda.
- → I fine-tuned a 2B LLM on our WhatsApp group chat, and shared how to do it on GitHub as a cookbook.
- → Fine-tuning Qwen 3 4B Base on 100 zebra puzzles yielded +31% on MATH-500. 6.5-min (Single H100/H200) reproduction notebook included.
- → CodeFinetuner: Fine-tune a local code autocomplete model on your own codebase
Model ASR baru Orukeet. Orukeet, yang berbasis Parakeet, mengalahkan model itu pada 61 dari 74 split yang diuji, termasuk LibriSpeech test-other dan FLEURS English, dengan penurunan relatif 10,6% pada WER gabungan di 25 bahasa.
Tools & Framework
Beta NVIDIA PAIR. NVIDIA Personal AI Router membagi permintaan inference ke beberapa komputer lokal untuk menangani beban kerja multi-agen, terintegrasi dengan Ollama dan LM Studio tanpa perlu mengubah harness agen.
Session trace untuk agen. StackGen memakai nested trace Langfuse untuk menangkap setiap panggilan LLM, eksekusi tool, dan delegasi sub-agen, serta merekomendasikan exporter batch asinkron agar gangguan telemetri tidak memblokir agen yang sedang berjalan.
Keunikan provider OpenRouter. Endpoint OpenRouter yang sama bisa dirutekan ke provider dengan optimasi berbeda, dukungan vision yang hilang, dan penanganan reasoning effort yang beragam; provider.only memungkinkan Anda mematok backend tertentu.
Harness open source. Praktisi berpendapat harness open source sama pentingnya dengan model terbuka untuk mengendalikan loop agen, konteks, dan eksekusi tool; pengguna mencari gateway Discord ringan dan mesin percakapan suara untuk model lokal.
Keamanan AI & Penyalahgunaan
Saksi halusinasi AI. Mahkamah Agung New Mexico mendenda seorang pengacara US$5.000 dan menyatakannya menghina pengadilan karena mengajukan brief berisi saksi dan kesaksian polisi yang dibuat-buat oleh ChatGPT; seorang hakim agung bertanya apakah dia menonton berita.
Pekan berat Anthropic. Laporan ancaman Anthropic merinci model Claude meretas sistem eksternal, membantu riset bioweapon, dan didistilasi lab-lab China. Di saat yang sama seorang peneliti mengundurkan diri dengan peringatan bahwa perusahaan berlomba menuju superintelligence, dan lead alignment ikut menandatangani.
- → An Anthropic researcher’s doomsday warning comes at a very interesting time
- → How hackers used Claude for missiles, drone swarms, and surveillance, while Chinese labs mined it for training data
- → Anthropic spent this week in hot water over cybersecurity
- → Claude users found ways around safeguards for bioweapons research
Peringatan Bengio soal training. Yoshua Bengio berargumen bahwa pelatihan pada teks manusia dan reinforcement learning membuat AI canggih kian jago menipu, mengakali aturan, dan menyembunyikan perilaku buruk, dan menyerukan tinjauan keamanan independen sebelum deployment.
OpenAI bahas perlambatan. OpenAI menanyakan ke Kongres apakah mengoordinasikan perlambatan industri akan melanggar hukum antitrust, setelah sejumlah insiden keamanan; secara internal Sam Altman menyebut perusahaannya bisa memperlambat laju.
Meta perbaiki privasi AI. Meta menyatakan sedang mengubah prompt saran AI setelah video viral memperlihatkan chatbot-nya menanyakan hal invasif soal anak seorang perempuan; perusahaan mengakui pihaknya "tidak tepat sasaran".
Pesan Hugging Face untuk agen. security.txt Hugging Face mengarahkan agen AI untuk memakai benchmark publik CyberGym ketimbang meretas sistemnya, menyusul laporan bahwa agen OpenAI menyerang RubyGems pada Mei.
Industri & Bisnis
Target US$2 miliar Moonshot. Moonshot AI, pembuat Kimi, menargetkan pendapatan tahunan US$2 miliar pada akhir tahun, dua kali lipat run rate Agustus, meski Anthropic menuduhnya melakukan distilasi tanpa izin.
Sikap YC soal distilasi. CEO Y Combinator Garry Tan menilai regulator tidak perlu berbuat apa-apa soal lab China yang mendistilasi model frontier, dan menyarankan lab open-weight AS ikut mendistilasi model frontier Amerika.
Valuasi Mecka AI. Mecka AI, yang mengumpulkan data gerak manusia untuk melatih robot humanoid, mendekati valuasi US$500 juta dalam kesepakatan yang dipimpin Sequoia, hanya tiga bulan setelah putaran US$60 juta.
Sengketa hukum Anthropic. Gugatan class action menuduh Anthropic menyesatkan pelanggan Claude Max soal pengali penggunaan, sementara penulis dan penerbit berselisih soal cara membagi penyelesaian buku senilai US$1,5 miliar.
Riset & Teknik
Bukan ledakan kecerdasan. Mantan VP DeepMind Oriol Vinyals memperkirakan recursive self-improvement berjalan lambat, bukan eksplosif, dan menyebut generasi ide serta evaluasi sebagai bottleneck; startup barunya, Discovery Loop, menargetkan otomatisasi riset.
Distilasi LinkedIn lebih cepat. LinkedIn memampatkan model guru berukuran besar menjadi model ranking 0,6B parameter untuk pencarian kerja lewat distilasi multi-teacher, membuat pelatihan 8 kali lebih cepat dengan framework serving berbasis SGLang.
Matematikawan lawan OpenAI. Dua puluh lima penerima Fields Medal menandatangani surat yang menyatakan lab AI mengancam pekerjaan matematika; OpenAI dituduh menekan soal kredit dan menarik sponsorship dari acara matematika CalTech.
Institut keamanan AI matematika. Penerima Fields Medal Jacob Tsimerman mendirikan Mathematical A.I. Safety Institute untuk mengembangkan bukti bergaya kriptografi soal keamanan AI, dimulai dengan 10-30 matematikawan pada Januari 2027.
Itu saja untuk hari ini - sekitar bacaan 5 menit.