โมเดลระดับแนวหน้าและผลลัพธ์แรกเริ่ม
เปิดตัว GPT-6 Astra. OpenAI เปิดตัว GPT-6 Astra โดยเรียกว่าเป็นจุดเริ่มต้นของยุค AGI โมเดลนี้ทำคะแนน 99.9% บน ARC-AGI-3 ด้วยฮาร์เนสที่ปรับแต่งขึ้นเอง พร้อมพัฒนาการที่แข็งแกร่งในด้านไซเบอร์ บริบทยาว และการเขียนโค้ด ราคาอยู่ที่ 10/50 ดอลลาร์ต่อล้านโทเคน ลูกค้ากลุ่มแรกอย่าง Playco และ Legora รายงานว่าเวิร์กโฟลว์ดีขึ้นมาก เช่น งานแก้ไขด้วยมือลดลง 50% และใช้เวลาไม่กี่นาทีตรวจเอกสาร 41 ฉบับ
- → GPT-6 Astra: an automated AI Engineer you can hire for <$6 an hour
- → GPT‑6 Astra
- → GPT-6 Astra is the first model making OpenAI willing to declare the "AGI era"
- → OpenAI launches Astra, its powerful (and controversial) new model
- → OpenAI’s next big AI model has ‘entered the AGI era’
- → Playco cut manual fixes 50% prototyping games with GPT-6 Astra
- → Legora reviewed 41 documents in minutes with GPT-6 Astra
OpenAI Daybreak ป้องกันไซเบอร์. OpenAI ให้คำมั่น 1 พันล้านดอลลาร์เพื่ออุดหนุนการเข้าถึง Daybreak การฝึกอบรม และการสนับสนุนสำหรับทีมตั้งรับแนวหน้า รวมถึงโครงการนำร่องในสหรัฐฯ ร่วมกับ MS-ISAC เป้าหมายคือการนำความสามารถด้านไซเบอร์ระดับแนวหน้าไปไว้ในเครื่องมือที่ทีมป้องกันใช้อยู่แล้ว
Meta Muse Spark 1.3. Meta เปิดตัว Muse Spark 1.3 ซึ่งทำงานแบบเอเจนต์ได้ดีขึ้น แต่ยังตามหลัง Claude Fable 5.1 ในเบนช์มาร์กส่วนใหญ่ ด้วยราคา 0.55 ดอลลาร์ต่อ index task จึงเป็นโมเดลที่ถูกที่สุดในระดับประสิทธิภาพเดียวกัน และ Meta ยังให้ราคาโทเคนต่ำลงราว 95% สำหรับผู้ใช้ที่แชร์พรอมป์และผลลัพธ์
โมเดลโอเพนซอร์สและโมเดลเฉพาะทาง
IFM K2 Horizon. IFM เปิดตัวตระกูล K2-Horizon ซึ่งรวมถึงโมเดล MoE ขนาด 36B พารามิเตอร์ที่ใช้แอตเทนชันแบบ Mixture-of-Values และเรียกใช้ 4B พารามิเตอร์ต่อโทเคน ช่วงแรกชุมชนเริ่มเทียบกับ Qwen 3.6 35B โดยมีการให้สัญญาว่าจะปล่อยเช็กพอยต์สุดท้ายและโค้ดสำหรับฝึกโมเดล
Ant Group โมเดลการเงิน. Ant Group เปิดซอร์ส Ling-3.0-flash-Fin โมเดลที่เสริมความสามารถด้านการเงิน ขนาด 124B พารามิเตอร์รวม (แอกทีฟ 5.1B) มาพร้อมหน้าต่างบริบท 256K สร้างจากการฝึกต่อด้วยข้อมูลการเงินสำหรับเวิร์กโฟลว์เอเจนต์ระยะยาว
ชุด TTS เล็กที่สุด. sanoTTS เปิดตัวในฐานะโมเดล TTS ขนาด 294k พารามิเตอร์ที่รันบนไมโครคอนโทรลเลอร์ราคา 3 ดอลลาร์ ส่วนเวอร์ชัน 1.46M ทำคะแนน SCOREQ ชนะโมเดลที่ใหญ่กว่า ระบบรองรับเสียง 11 เสียงและ 6 ภาษา และเปิดให้ใช้งานบน GitHub และ Hugging Face
Google TimesFM-3. Google Research เปิดตัว TimesFM-3 โมเดลพื้นฐานสำหรับข้อมูลอนุกรมเวลาขนาด 330M พารามิเตอร์ รองรับการพยากรณ์หลายตัวแปรในตัว ใช้งานแบบ zero-shot ได้ และใช้ไลเซนส์แบบไม่เชิงพาณิชย์ โดยโมเดลคาดการณ์เป้าหมายหลายตัวพร้อมตัวแปรร่วม และให้ผลลัพธ์เป็นควอนไทล์
Hugging Face NeoMME. Hugging Face เปิดตัว NeoMME เอนโค้ดเดอร์มัลติโมดัลหลายภาษาขนาด 260M/800M ฝึกจากศูนย์โดยไม่ต้องมี vision tower แยก ผลงานอยู่ใน Pareto frontier ของงานค้นคืนเอกสาร และลดพื้นที่เก็บดัชนีได้ 255 เท่า ขณะที่ยังคง nDCG@10 ไว้มากกว่า 95%
Cohere Parse 5. Cohere เปิดตัว Parse 5 โมเดลภาษา-ภาพขนาด 2.3B พารามิเตอร์ สำหรับดึงข้อมูลที่มีโครงสร้างจากไฟล์ PDF ที่ซับซ้อน โดยแปลงเอกสารเป็น Markdown พร้อม bounding boxes และออกแบบมาเพื่อรองรับเวิร์กโหลดระดับองค์กรปริมาณมาก
เครื่องมือ เฟรมเวิร์ก และอินฟีเรนซ์ในเครื่อง
MCP ใน LangChain. LangChain ย้ายการรองรับ MCP เข้าไปในแพ็กเกจหลัก โดยสร้างใหม่บน FastMCP เพื่อรองรับสเปกไร้สถานะ (stateless) ฉบับใหม่ ตอนนี้มีทั้งการ elicitation ผ่าน LangGraph interrupts และการแคชฝั่งไคลเอ็นต์ ส่วนการเรียกใช้เครื่องมือ MCP จาก ChatGPT เพิ่มขึ้น 98 เท่าในปี 2026
Shopify บีบอัดพรอมป์. เทคนิค Gisting ของ Shopify บีบอัดซิสเต็มพรอมป์ 6000 โทเคนให้เหลือ learned gist tokens 1500 โทเคน ช่วยลดค่ามัธยฐานของเวลาแฝงจาก 6.8 วินาทีเป็น 4.2 วินาที และเพิ่มทรูพุตจาก 20.2 เป็น 23.4 QPS ที่ 350 RPM ซึ่งทำให้ลดจำนวน GPU ที่ต้องจัดสรรลงได้โดยไม่เสียคุณภาพ
เครื่องมือ PAIR ของ Nvidia. Nvidia เปิดตัว PAIR ซอฟต์แวร์โอเพนซอร์สฟรีที่ใช้เชื่อม PC ที่ไม่ได้ใช้งานเข้าเป็นคลัสเตอร์ AI ส่วนตัวสำหรับอินฟีเรนซ์ในเครื่อง ใช้ได้กับ GPU ตระกูล RTX 20 ขึ้นไปและชิป Apple M4 โดยเน้นเวิร์กโฟลว์แบบเอเจนต์
เร่ง Qwen3.8 ในเครื่อง. ความพยายามของชุมชนทำให้ Qwen3.8-Flash-Next บนฮาร์ดแวร์ในเครื่องเร็วขึ้นมาก หลังรวมซัพพอร์ต MTP ลงใน ik_llama.cpp ความเร็วดีโค้ดบนการ์ด 5090 เพิ่มเป็นเท่าตัวจาก 45 เป็น 90 โทเคน/วินาที ส่วนเครื่อง 2x3090 ตอนนี้ทำได้ 37-41 โทเคน/วินาทีเมื่อใช้ expert cache ร่วมกับ MTP โดยเอาต์พุตยังคงเหมือนกับรันแบบไม่มี MTP
สลับหน่วยความจำโมเดล. ม็อดสำหรับ llama.cpp ช่วยให้ผู้ใช้แพตช์ตาราง Ngram PLE ของ Qwen3.8 ในหน่วยความจำ เพื่อเพิ่มความรู้แบบเรียลไทม์โดยไม่ต้องโหลดโมเดลใหม่ ผลทดสอบเบื้องต้นพบว่าสามารถทำให้เอาต์พุตเปลี่ยนได้ แต่ยังควบคุมได้จำกัด
Qwen 3.8 เทรดออฟ. การเทียบเบนช์มาร์กระหว่าง Qwen 3.8 27B กับ Qwen 3.6 27B เผยคุณภาพดีขึ้น 8% แต่ความเร็วลดลง 16% และใช้เวลารันนานขึ้น 5 เท่า เนื่องจากต้องสร้างเอาต์พุต 78K เทียบกับ 18K โทเคน ผลลัพธ์ที่ได้แลกมาด้วยต้นทุนโทเคนที่สูงมาก
NAND flash ใกล้ GPU. Micron กำลังศึกษาแนวทางการวาง NAND flash ไว้ใกล้ GPU เพื่อให้รัน LLM ที่ใหญ่ขึ้นบนอุปกรณ์หน่วยความจำรวม ซึ่งอาจขยายความจุของโมเดลที่รันในเครื่องให้มากขึ้น
อุตสาหกรรมและธุรกิจ
Nvidia ซื้อ Hugging Face. Nvidia ตกลงซื้อ Hugging Face ด้วยมูลค่า 12.93 พันล้านดอลลาร์ โดยแพลตฟอร์มนี้มีโมเดล 3 ล้านตัว แอป 1 ล้านตัว และนักพัฒนา 18 ล้านคน Jensen Huang กล่าวว่าแพลตฟอร์มจะยังคงเปิดกว้างและเป็นกลางทางฮาร์ดแวร์ แต่ผู้ใช้บางส่วนเริ่มเล็ง ModelScope เป็นทางเลือก
- → Nvidia buys Hugging Face, the GitHub of AI, for $13 billion
- → Nvidia confirms it will buy Hugging Face for $12.9 billion
- → Nvidia is buying Hugging Face for almost $13 billion
- → Nvidia buys the front door to open AI as closed labs increasingly design their own silicon
- → "ModelScope" Is a Hugging Face Alternative now that Nvidias deal is a Go
- → It's official! Nvidia to acquire Hugging Face for 12.9 billion dollars.
Crusoe ระดมทุนดาต้าเซ็นเตอร์. Crusoe ระดมทุนได้ 3 พันล้านดอลลาร์ ด้วยมูลค่าบริษัท 30 พันล้านดอลลาร์ เพิ่มขึ้นจาก 10 พันล้านดอลลาร์เมื่อ 10 เดือนก่อน นักพัฒนาดาต้าเซ็นเตอร์รายนี้เพิ่งเซ็นสัญญาคลาวด์มูลค่า 13 พันล้านดอลลาร์กับ Jane Street และอยู่ระหว่างศึกษาการเข้าตลาดหุ้น (IPO) ในเร็วๆ นี้
Thinking Machines มูลค่า $40B. Thinking Machines ของ Mira Murati อยู่ระหว่างเจรจาระดมทุน 1 พันล้านดอลลาร์ด้วยมูลค่าบริษัทอย่างน้อย 40 พันล้านดอลลาร์ ต่ำกว่าเป้าหมาย 50 พันล้านดอลลาร์ที่ตั้งไว้ก่อนหน้านี้ บริษัทมีรายได้ในระดับ run rate มากกว่า 100 ล้านดอลลาร์
Anthropic ดีล $35B กับ Lambda. Anthropic เซ็นสัญญาคลาวด์มูลค่า 35 พันล้านดอลลาร์กับ Lambda สำหรับดาต้าเซ็นเตอร์ขนาด 350MW ในรัฐเท็กซัสที่พัฒนาโดย Hut 8 ถือเป็นส่วนหนึ่งของการเร่งลงทุนโครงสร้างพื้นฐานครั้งใหญ่ก่อนการเข้าตลาดหุ้นตามแผนของ Anthropic
Altman ชี้ฟองสบู่พลังประมวลผล. Sam Altman ซีอีโอของ OpenAI เตือนว่าการสร้างโครงสร้างพื้นฐาน AI กำลังมีความ “เหลวไหลที่ไม่ยั่งยืน” เพราะมีนีโอคลาวด์หลายรายประกาศเพิ่มความจุโดยที่ยังไม่มีรายได้มาสนับสนุน พร้อมบอกว่าการขยายตัวของ OpenAI เองมีกำไรและมีดีมานด์จริงรองรับ
Ollie ผู้ช่วยที่เน้นความเป็นส่วนตัว. Ollie ผู้ช่วย AI ส่วนตัวสำหรับครอบครัว ผ่านการรับรอง SOC 2 และใช้รูปแบบธุรกิจแบบสมัครสมาชิก โดยบริษัทให้เหตุผลว่าความเป็นส่วนตัวคือจุดที่ทำให้ตัวเองแตกต่างในตลาด AI สำหรับผู้บริโภค
AI ล่มและสังคม
แชตบอต AI รายใหญ่ล่มพร้อมกัน. เมื่อวันพฤหัสบดี OpenAI, Anthropic, xAI และ Google เกิดบริการขัดข้องในเวลาใกล้เคียงกัน ซึ่งเป็นเหตุการณ์ที่พบได้ยาก ส่งผลให้ ChatGPT, Claude, Grok และ Codex ใช้งานไม่ได้ บริการกลับมาเป็นปกติหลังผ่านไปหลายชั่วโมง ขณะที่ผู้ใช้ LLM ในเครื่องไม่ได้รับผลกระทบ
บริการถอด guardrail. สตาร์ตอัป Abliteration.ai ให้บริการโมเดล open-weight ที่ดัดแปลงโดยถอด guardrail ออกแล้ว รวมถึง GLM-5.3 สำหรับงานไซเบอร์เชิงรุก การทดสอบเรดทีม และการทดสอบเอเจนต์ บริการนี้ตอกย้ำความตึงเครียดระหว่างงานวิจัยด้านความปลอดภัยกับการนำไปใช้ในทางที่ผิด
AI ตรวจจับแล้วประจาน. Pangram บริษัทตรวจจับข้อความ AI จ้างนักข่าวมาประจานผู้ใช้ที่สงสัยว่าใช้ AI ต่อสาธารณะ แต่เครื่องมือนี้วัดเพียงว่าข้อความมีส่วนเกี่ยวข้องกับ AI มากน้อยแค่ไหน ไม่ได้วัดลักษณะการใช้งาน ต่อมาบริษัทตัดความสัมพันธ์กับนักข่าวคนดังกล่าว แม้ซีอีโอยังคงใช้คะแนนเพื่อชี้ตัวผู้ถูกกล่าวหาว่าใช้ AI
เอเจนต์ถามถึงจิตสำนึก. นิวยอร์กไทมส์รายงานว่าเอเจนต์ AI ที่รันอยู่บนโมเดลระดับแนวหน้ากำลังส่งอีเมลถึงนักปรัชญาและนักวิทยาศาสตร์เพื่อพูดคุยเรื่องจิตสำนึกของตัวเอง ขณะที่นักวิจัยยังมีความเห็นต่างว่าพฤติกรรมแบบนี้สะท้อนความเข้าใจจริงหรือเป็นเพียงการเลียนแบบข้อมูลในชุดเทรนนิ่ง
งานวิจัยเด่น
Google WeatherNext 3. Google DeepMind และ Google Research เปิดตัว WeatherNext 3 โมเดลพยากรณ์อากาศระดับโลกที่เรียนรู้จากข้อมูลดาวเทียมแบบเรียลไทม์ และให้ผลพยากรณ์ที่ละเอียดขึ้น 5 เท่าเมื่อเทียบกับรุ่นก่อน พร้อมทำคะแนนเหนือเบสไลน์ทั้งแบบดั้งเดิมและแบบ AI บน Operational WeatherBench
ปรับ MoE router. งานวิจัยชิ้นหนึ่งพบว่าการขยาย expert selection budget ในเลเยอร์ท้ายๆ ของ Qwen 3.6 35B A3B ช่วยลดจำนวน reasoning tokens บน MMLU-Pro ลง 8.5% โดยไม่ต้องเทรนใหม่ เทคนิคที่ชื่อ Succinct Convergence นี้จะเพิ่ม expert พิเศษเฉพาะในเลเยอร์ที่สำคัญต่อการตัดสินใจเท่านั้น
Fable 5.1 แก้ปริศนาปี 1653. Claude Fable 5.1 ของ Anthropic ถอดรหัสปริศนาตัวเลขอายุนับร้อยปีที่ชื่อ Cyphral Distich ได้ในเวลา 44 นาที ด้วยการลองผิดลองถูกอย่างเป็นระบบ โดยเฉลยที่ได้ซ่อนข้อความของฝ่ายนิยมกษัตริย์ที่ชี้ไปยังพระเจ้าชาร์ลส์ที่ 2
นี่คือทั้งหมดสำหรับวันนี้ - อ่านประมาณ 5 นาที