การเปิดตัวโมเดลและ Benchmarks
Gemini 3.8 Flash. Google ปล่อยโมเดล Flash ตัวที่สามในรอบหกสัปดาห์ โดยการให้เหตุผล การเขียนโค้ด และการใช้เครื่องมือแบบเอเจนต์ดีขึ้น ราคาต่อโทเคนเท่าเดิม แต่โมเดลอาจใช้โทเคนมากขึ้น และมีเวอร์ชัน Cyber สำหรับผู้ป้องกันที่ได้รับความไว้วางใจผ่านโปรแกรม Fairwind ใหม่
- → Google releases Gemini 3.8 Flash, its third Flash model in six weeks
- → Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
- → Proactive cyber defense for governments and enterprises
- → Proactive cyber defense for governments and enterprises
- → Gemini 3.8 Flash is Google's third budget model in six weeks while frontier models remain MIA
- → Google says its new Gemini 3.8 Flash model ‘works harder’ but might cost more
- → llm-gemini 0.34
Muse Spark 1.3. โมเดล open-weights ของ Meta ตอนนี้อยู่อันดับ 3 บน AAII ร่วมกับ GPT-5.6-Sol และเปิดทางให้ประหยัดค่าเทรนได้มากกว่า 90% หากผู้ใช้เลือกใช้ อีกทั้งยังมีคำมั่นว่าจะปล่อย open weights ขณะที่ผู้ใช้รอ variant ที่เล็กกว่าระหว่าง Glimmer กับ Spark
GLM-5.3 vs DeepSeek-V4. การเปรียบเทียบในคอมมูนิตี้บน Mac Studio และ DGX Spark พบว่า GLM 5.3 Flash ให้คำตอบได้เร็วกว่า และยังเก่งการเขียนกับงานภาพมากกว่า ในขณะที่ DeepSeek V4 Flash ให้โทเคนต่อวินาทีสูงกว่าและบริบทยาวกว่า ขณะนี้ DeepSeek-V4-Flash-Vision-Exp รองรับทั้ง Vision และไฟล์ GGUF แล้ว
Local AI และโอเพนซอร์ส
จูน Qwen3.8 Flash Next. Expert cache PR เพิ่มความเร็ว decode จาก 17 เป็น 25-29 t/s บนการ์ด 3090 สองใบ และ AP quants ใหม่กับ Q8 N-gram bolting ก็ไม่ทำให้ความเร็วลดลง ส่วนผู้ใช้รายงานว่าเกิด plan hallucination และ context corruption ซึ่งชี้ว่ายังเป็นคุณภาพระดับพรีวิว
Perplexity Lily. Perplexity เปิดซอร์ส Mac inference server ของตัวเอง ซึ่งปรับแต่งมาเพื่อ Qwen 3.6 บน Apple silicon โดยเน้นที่โมเดลเดียวเพื่อประสิทธิภาพสูงสุด
เครื่องมือ speech ในเครื่อง. VoxGen ปล่อย TTS แบบ Rust/Vulkan สำหรับ VoxCPM2 ที่รันบน AMD ได้ลื่น, Microsoft ปล่อย VibeVoice ASR แบบสตรีมมิง และผู้ใช้แชร์วิธีใช้ Mac Parakeet ร่วมกับ Whisper/Parakeet เป็นเซ็ต STT สำหรับเขียนโค้ด
ม็อด Minecraft จาก GLM. โมเดล GLM 5.3 Flash Q4 ที่รันในเครื่องบนการ์ด RTX PRO 6000 สี่ใบ ค่อย ๆ สร้างม็อดปืนหลุมดำสำหรับ Minecraft ขึ้นมาด้วย Fabric API
งานวิจัยและ World Models
World Labs Atlas. World Labs เปิดตัว Atlas โมเดลเดียวที่สร้างฉากสามมิติ สร้างใหม่จากภาพถ่ายเพียงไม่กี่ภาพ และจำลองฉากได้ โดยใช้บริบทเชิงพื้นที่ยึดอินพุตทุกตัวให้อยู่ในปริภูมิสามมิติ
H3-World ควบคุมด้วยภาษา. H3-World เปลี่ยนท่าทางตัวละครและการเคลื่อนกล้องให้กลายเป็นคำสั่งข้อความ ซึ่งถูกส่งผ่าน text pathway ของ MiniMax-H3 ทำให้สามารถควบคุมการเคลื่อนไหวในเกมได้ด้วยข้อมูลเพียง 8,000 ตัวอย่างและพารามิเตอร์ที่ฝึกได้แค่ 0.199%
ความปลอดภัย นโยบาย และกฎหมาย
ข้อกังวล safety ของ Astra. OpenAI เตรียมปล่อย Astra ซึ่งใช้ recurrence ที่ไม่โปร่งใส ทำให้การมอนิเตอร์ chain-of-thought ยากขึ้น และถูกจัดระดับ ‘critical’ ในด้านความสามารถไซเบอร์ ขณะที่ผู้เชี่ยวชาญด้านความปลอดภัยเตือนถึงการแข่งขันที่ลดมาตรฐานลงเรื่อย ๆ
DOJ หนุน fair use. รัฐบาลสหรัฐฯ เข้าข้าง OpenAI ในคดีที่ NYT ฟ้อง โดยให้เหตุผลว่าการเทรน LLM บนข้อความที่มีลิขสิทธิ์ถือเป็น fair use และเป็นคนละส่วนกับเอาต์พุตของโมเดล เพื่อรักษาความเป็นผู้นำด้าน AI ของอเมริกา
กฎ AI safety ลับ. คดีฟ้องร้องต้องการบีบให้รัฐบาลทรัมป์เปิดเผยเฟรมเวิร์กลับสำหรับการตรวจสอบความปลอดภัย frontier AI ก่อนเปิดตัว ซึ่งตอนนี้ขาดความโปร่งใสทั้งต่อสาธารณะและสภาคองเกรส
NYC แบน AI สำหรับนักเรียน. นิวยอร์กแบน AI สำหรับนักเรียนจนถึงเกรด 8 และแบนแชทบอตเพื่อนเล่นในทุกระดับชั้น โดยนักเรียนมัธยมปลายใช้ได้อย่างจำกัด พร้อมทั้งมีชั้นเรียน AI literacy
คดี Tumbler Ridge. มีคดีใหม่ 30 คดี กล่าวหา OpenAI ว่าช่วยเหลือและสนับสนุนเหตุยิงในโรงเรียน Tumbler Ridge โดยอ้างว่าบริษัทเพิกเฉยต่อสัญญาณเตือนด้านความปลอดภัยจากการแชต ChatGPT ของผู้ต้องสงสัย
ธุรกิจและองค์กร
Palo Alto ซื้อ Console. Palo Alto Networks จ่าย 500 ล้านดอลลาร์ซื้อ Console สตาร์ตอัปด้าน AI agent ซึ่งทำให้งาน IT help desk เป็นอัตโนมัติ เพื่อให้แพลตฟอร์ม Cortex มีผลลัพธ์ด้านความปลอดภัยแบบอัตโนมัติ
HiddenLayer ระดมทุน 100 ล้านดอลลาร์. HiddenLayer สตาร์ตอัปด้านความปลอดภัย AI ระดมทุนได้ 100 ล้านดอลลาร์ ท่ามกลางองค์กรที่เพิ่มงบประมาณในการปกป้องโมเดล AI, เอเจนต์ และเวิร์กโฟลว์จากการโจมตีแบบ adversarial
Wonderful มูลค่า 5 พันล้านดอลลาร์. Wonderful สตาร์ตอัปด้าน AI OS ระดมทุนได้ 550 ล้านดอลลาร์ ทำให้มูลค่าเพิ่มขึ้นสองเท่าแตะ 5 พันล้านดอลลาร์ พร้อมขยายจากเอเจนต์บริการลูกค้าไปสู่การประสานเวิร์กโฟลว์ใน 35 ประเทศ
การสเกล Agent ระดับองค์กร. Schneider Electric, Vodafone และ monday.com ต่างสร้างเลเยอร์โครงสร้างพื้นฐานสำหรับ observability การประเมินผล และการดีพลอย หลังพบว่า agent สร้างต้นแบบได้ง่ายแต่ยากต่อการดูแล
Alexa ตรวจจับสแกม. Alexa for Shopping ของ Amazon ตอนนี้เทียบข้อความกับบันทึกที่ Amazon เคยส่ง เพื่อยืนยันว่าเป็นของจริงหรือไม่ ช่วยให้ผู้ใช้สังเกตสแกมแบบแอบอ้าง
นี่คือทั้งหมดสำหรับวันนี้ - อ่านประมาณ 5 นาที