การเปิดตัวโมเดลและเอเจนต์
Grok 4.6 และ Grok Bot. SpaceXAI เปิดตัว Grok 4.6 ซึ่งเสมอ GPT-5.6 Sol ของ OpenAI และเป็นรองเพียง Claude Opus 5 บนดัชนี Artificial Analysis ในขณะที่ราคาถูกกว่าโมเดลระดับแนวหน้า และยังเปิดตัว Grok Bot ซึ่งเป็นเพื่อนร่วมทีม AI ที่ทำงานตลอดเวลา โดยทำงานจากคลาวด์คอมพิวเตอร์ของตัวเองเพื่อทำงานที่ได้รับมอบหมายให้สำเร็จ
Qwen 3.8 รุ่นใหญ่และเล็ก. Qwen3.8-2.4T-A95B พร้อมใช้งานแล้ว และหน้า Qwen3.8 ขนาด 27B ปรากฏบน ModelScope ชั่วครู่ก่อนจะถูกลบออก ซึ่งบ่งชี้ว่าจะมีการเปิดตัวในเร็ว ๆ นี้ ผู้ที่ชื่นชอบการรันบนเครื่องตัวเองกำลังวางแผนแยกฮาร์ดแวร์สำหรับโมเดล 2.4T อยู่แล้ว
อัปเดต DeepSeek V4 Pro. DeepSeek V4 Pro 0813 พร้อมใช้งานผ่าน API บน OpenRouter แล้ว โดยยังไม่มีหน้าประกาศอย่างเป็นทางการ มีแนวโน้มว่าจะเปิดเผยน้ำหนัก เนื่องจากการเปิดตัวก่อนหน้านี้ พฤติกรรมการใช้เหตุผลของมันแตกต่างอย่างเห็นได้ชัดในระดับการใช้เหตุผลต่ำ กลาง และสูง
โมเดลวิทัศน์เอดจ์. LFM2.5-VL-3B ของ Liquid AI มีความสามารถในการเข้าใจ UI ที่แข็งแกร่งขึ้นมากและสามารถรันบนโทรศัพท์ได้ ขณะที่ Apache-2.0 North Micro Vision ของ Cohere รองรับภาพความละเอียดดั้งเดิมในแพ็กเกจขนาดกะทัดรัด 2.4 พันล้านพารามิเตอร์
โมเดลล้านล้านพารามิเตอร์ของ Nvidia. มีรายงานว่า Nvidia กำลังสร้าง Nemotron 4 ด้วยพารามิเตอร์อย่างน้อยหนึ่งล้านล้านตัว และเพิ่มค่าใช้จ่ายในการฝึกอบรมบนคลาวด์เป็นสามเท่าเป็น 28 พันล้านดอลลาร์ภายในปี 2031 เพื่อแข่งขันกับโมเดลน้ำหนักแบบเปิดของจีน
การพัฒนาเอเจนต์และเครื่องมือ
เอเจนต์แบบจัดการและ BYOC. LangChain เปิดตัว Managed Deep Agents ซึ่งเป็นขั้นตอนถัดไปหลังจากเฟรมเวิร์ก และทำให้ LangSmith BYOC พร้อมใช้งานทั่วไปบน AWS ช่วยให้องค์กรเก็บข้อมูลการติดตามเอเจนต์และข้อมูลภายใน VPC ของตนเอง
แอป ChatGPT บน Linux. OpenAI เปิดตัวแอปเดสก์ท็อปสำหรับ Linux ที่รวม ChatGPT, ChatGPT Work และ Codex ไว้ด้วยกัน แต่ยังไม่มีการใช้งานคอมพิวเตอร์แบบเนทีฟในตอนเปิดตัว
การอินเฟอเรนซ์ในเครื่องและฮาร์ดแวร์
ราคา RTX PRO 6000 เพิ่มขึ้นสองเท่า. Nvidia เกือบเพิ่มราคาแนะนำ (MSRP) ของ RTX PRO 6000 Blackwell ความจุ 96GB เป็นสองเท่าเป็น 16,000 ดอลลาร์ หลังจากที่มีการสั่งซื้อล่วงหน้าในราคาต่ำกว่า 8,000 ดอลลาร์เมื่อปีที่แล้ว
DSpark สตรีมบน GPU หนึ่งตัว. RTX PRO 6000 96GB หนึ่งตัวสามารถรัน DeepSeek V4 Flash 284B ได้ประมาณ 31 โทเคนต่อวินาทีโดยใช้ drafter ของ DSpark ในแรมระบบ ซึ่งเร็วกว่าพื้นฐานที่ไม่มี drafter ประมาณ 15-17% เมื่อใช้ VRAM เท่ากัน
Muse Glimmer บน Mac. Muse Glimmer 30B ของ Meta ตอนนี้รันได้เร็วขึ้นประมาณ 3.3 เท่าบน Apple Silicon โดยใช้ mlx-dspark ให้คุณภาพระดับ 8 บิตที่ความเร็วใกล้เคียง 4 บิตบน Mac ความจุ 48GB
Gemma 4 การควอนไทซ์แคช KV. การฝึกที่คำนึงถึงควอนไทเซชันช่วยให้ Gemma 4 31B คงคุณภาพไว้ได้ภายใต้การควอนไทซ์แคช KV ที่เข้มข้น ทำให้การอินเฟอเรนซ์บริบทขนาดใหญ่ทำได้จริงมากขึ้น
อุตสาหกรรมและธุรกิจ
Cognition ระดมทุนที่มูลค่า 40 พันล้านดอลลาร์. มีรายงานว่า Cognition ผู้สร้างเอเจนต์เขียนโค้ด AI อยู่ระหว่างการเจรจาระดมทุนที่มูลค่า 40 พันล้านดอลลาร์ หลังจากมีรายได้ต่อปี (annualized revenue) ถึง 1 พันล้านดอลลาร์ เพิ่มขึ้นจาก 492 ล้านดอลลาร์เมื่อสามเดือนก่อน
Lovable แตะมูลค่า 13.3 พันล้านดอลลาร์. สตาร์ทอัพสาย Vibe-coding อย่าง Lovable ระดมทุนได้ 400 ล้านดอลลาร์ที่มูลค่า 13.3 พันล้านดอลลาร์ หลังจากรายได้ annualized ผ่าน 500 ล้านดอลลาร์ โดยมีโปรเจกต์ที่โฮสต์อยู่ 60 ล้านโปรเจกต์
Thrive Holdings AI สำหรับองค์กร. Thrive Holdings ซึ่งได้รับการสนับสนุนจาก OpenAI ระดมทุนได้ 2 พันล้านดอลลาร์ที่มูลค่า 12 พันล้านดอลลาร์ เพื่อเข้าซื้อธุรกิจแบบดั้งเดิมและนำ AI มาใช้ โดยขยายขอบเขตไปไกลกว่าบัญชีและไอที
ส่วนแบ่งของ Gemini ลดลง. ข้อมูลตลาดจาก Pangram, OpenRouter และ Similarweb แสดงให้เห็นว่าการใช้งาน Gemini ลดลง โดย Pangram บันทึกว่าลดลงเหลือ 1.9% ของงานเขียนที่ใช้ AI ในขณะที่ OpenAI ครองมากกว่า 50%
Claude มุ่งหน้าสู่สายกฎหมาย. Anthropic จ้าง Robert Mahari ผู้ก่อตั้ง AI ด้านกฎหมาย เป็น Head of Claude for Legal คนแรก ต่อยอดจากปลั๊กอินและความร่วมมือด้านกฎหมายก่อนหน้านี้
นโยบาย ความปลอดภัย และสังคม
การรั่วไหลของซัพพลายเชน LiteLLM. การโจมตีซัพพลายเชนต่อ LiteLLM ทำให้ข้อมูลประจำตัวหลายเทราไบต์จากองค์กรกว่า 2,500 แห่งรั่วไหล รวมถึง Microsoft, Amazon และ Samsung ผ่านแพ็กเกจ PyPI ที่เป็นอันตราย
ลายน้ำในผลลัพธ์ของ Claude. Anthropic ใส่ลายน้ำในผลลัพธ์ของ Claude เพื่อให้เป็นไปตาม EU AI Act สร้างความไม่พอใจให้ผู้ใช้ที่กังวลว่ามันจะเปิดเผยการใช้ AI ในงานหรือโรงเรียน
Twitch ใช้ข้อมูลเพื่อฝึกโดยค่าเริ่มต้น. Twitch จะฝึกโมเดล AI ของ Amazon บนคอนเทนต์ของสตรีมเมอร์โดยค่าเริ่มต้น โดยมีตัวเลือกให้เลือกไม่เข้าร่วม (opt-out) แล้ว นโยบายนี้ก่อให้เกิดกระแสต่อต้าน
ShieldFont แทนที่ข้อความ. นักออกแบบเปิดตัว ShieldFont ซึ่งเป็นฟอนต์ที่แสดงข้อความปกติให้ผู้ใช้เห็น แต่แทนที่คำใน HTML พื้นฐานเพื่อทำให้สแครปเปอร์ได้รับข้อมูลที่ผิดเพี้ยน
Hinton, Li, Ng เกี่ยวกับ AI แบบเปิด. ในงาน Ai4 Geoffrey Hinton, Fei-Fei Li และ Andrew Ng สนับสนุนให้คง AI แบบเปิดไว้เพื่อหลีกเลี่ยงไม่ให้บริษัทไม่กี่แห่งควบคุมการเข้าถึง แม้จะมีความกังวลด้านความปลอดภัยเกี่ยวกับน้ำหนักแบบเปิด
หนังสือหายากถูกทำลาย. ผู้ขายหนังสือกังวลว่าบริษัท AI กำลังซื้อหนังสือหายากและทำลายเพื่อใช้ฝึก แม้จะมีทางเลือกการสแกนแบบไม่ทำลายก็ตาม
งานวิจัยและเกณฑ์วัด
MindTopo การให้เหตุผลเชิงทอพอโลยี. เกณฑ์วัด MindTopo ของ Microsoft Research แสดงให้เห็นว่าโมเดลมัลติโมดัลเก่งในการจดจำเชิงทอพอโลยีแบบคงที่ แต่ประสบปัญหาในการวางแผนเชิงโต้ตอบที่ต้องรักษาความสัมพันธ์ตลอดเวลา
การสร้างพรอมพ์ใหม่จากเอาต์พุต. IIT Bombay และ Adobe Research พัฒนา Previous-Token Prediction ซึ่งสามารถสร้างพรอมพ์ของ LLM ขึ้นใหม่จากข้อความเอาต์พุตได้อย่างแม่นยำเกือบสมบูรณ์โดยไม่ต้องใช้น้ำหนักโมเดล
นี่คือทั้งหมดสำหรับวันนี้ - อ่านประมาณ 5 นาที