Agentic AI News วันนี้

ข่าว AI agents ประจำวันใน 5 นาที: เปิดตัว, เครื่องมือ, งานวิจัย, การเงิน และการเคลื่อนไหวขององค์กร

อัปเดตทุกวัน คัดสรรจาก 30 แหล่ง เสาร์, ตุลาคม 3, 2026

การเปิดตัวเอเจนต์และโมเดล

แกดเจ็ต Muse. Meta เปิดโอเพนซอร์สเฟิร์มแวร์และ SDK สำหรับสร้างฮาร์ดแวร์ DIY ที่เชื่อมต่อกับเอเจนต์ Muse ของบริษัท เช่น จอ E Ink และ HDMI สติก พร้อมมี Discord สำหรับช่วยเหลือ

OpenAI Dot. เอเจนต์ Dot ใหม่ของ OpenAI ทำงานเหมือนซอฟต์แวร์องค์กรที่สั่งมื้อเย็นได้ด้วย โดยรันในเครื่องเสมือนและเข้าถึงแอปอย่าง Blender และ GIMP; ถูกวางตำแหน่งเป็นเพื่อนร่วมงานมากกว่าผู้ช่วยช้อปปิ้งส่วนตัว

โมเดลฮิวแมนนอยด์ Unitree. Unitree เปิดตัว UnifoLM-WLA-1.0 โมเดล 6B ที่เทรนด้วยข้อมูลหุ่นยนต์จริงราว 2,500 ชั่วโมง รองรับงานทั้งตัวและงานบนโต๊ะ 64 งานบน G1 ผสมผสาน optical flow และ MMDiT เพื่อการควบคุมต่อเนื่อง

FrogNano สำหรับเขียนโค้ด. FrogNano-4B-2609 ของ Microsoft เป็นโมเดลเอเจนต์ที่พัฒนาต่อจาก Qwen3.5-4B ผ่านการโพสต์เทรนบนงาน SWE สังเคราะห์ 1,500 งานพร้อมรางวัลจากการรันโค้ด เพื่อยกระดับวิศวกรรมซอฟต์แวร์ระดับรีโพซิทอรีในรูปแบบกะทัดรัด

Cloudflare Clef. Cloudflare เปิดตัว Clef และ Clef-flash โมเดลตัดสินใจที่ส่งออกความน่าจะเป็นเหนือคำตอบที่กำหนดไว้ล่วงหน้า มีค่ามัธยฐานความหน่วงต่ำสุด 39 มิลลิวินาที ช่วยให้เอเจนต์ลงมือได้โดยไม่ต้องมีมนุษย์อยู่ในลูป

เครื่องมือและเฟรมเวิร์ก

เอนจิน MegaCapybara. เอนจินอินเฟอเรนซ์ที่สร้างมาเพื่อ RTX 5090 และ Qwen3.8 27B อ้างว่ามีความเร็ว decode ราวสองเท่าของ NInfer แตะมากกว่า 500 โทเคน/วินาทีแบบเดี่ยว และมากกว่า 2,000 โทเคน/วินาทีเมื่อรันเอเจนต์ 12 ตัว พร้อมเคอร์เนลไดนามิกและการจัดการแคช

อัปเดต llama.cpp. llama.cpp เพิ่มรองรับโมเดลตัดสินใจ และมี pull request CUDA ที่รวม shared experts เพื่อเร่งสถาปัตยกรรม MoE อย่าง Qwen 35B A3B

คำบรรยาย mlsubgen. เครื่องมือโลคอลตัวใหม่สร้างคำบรรยาย 45 ภาษาได้ทั้งหมดบนเครื่องของคุณ ตรวจจับภาษาตามช่วง ประสานผลจากระบบรู้จำเสียงพูดสองตัวด้วย LLM โลคอล และเลือกใช้คำบรรยายที่ฝังอยู่ในไฟล์เดิมก่อน

งานวิจัยและความก้าวหน้าของโมเดล

สถาปัตยกรรมหน่วยความจำ Spotlight. Spotlight ของ Percepta แทนที่ attention ด้วยหน่วยความจำที่เขียนได้แบบไร้ขอบเขต ซึ่งโมเดลจัดดัชนีเอง แยกความฉลาดออกจากความรู้ เพื่อให้ความสามารถเติบโตได้โดยไม่ต้องเปลี่ยนเวต

อัปเดต GPT-6. OpenAI เผยแพร่คู่มือตระกูล GPT-6 และประกาศอัปเดต DevDay รวมถึง GPT-6.1 Sol, computer use สำหรับ Agents API, สภาพแวดล้อม Codex บนคลาวด์ และ Decisions API

AstaBrief โอเพนซอร์ส. Hugging Face เปิดโอเพนซอร์ส AstaBrief โมเดลขนาดเล็กที่เทรนมาโดยเฉพาะสำหรับสร้างรายงานวิทยาศาสตร์ที่รวดเร็วและมีการอ้างอิง ออกแบบให้ยึดโยงกับหลักฐานและตรวจสอบผลลัพธ์

อุตสาหกรรมและธุรกิจ

Apple เข้มการเข้าถึงดิสก์. Apple กำลังเพิ่มมาตรการควบคุมให้ Full Disk Access ของ macOS เพราะความเสี่ยงจากเอเจนต์ AI หลังมีข้อกล่าวหาว่า Meta Muse อ่านข้อความโดยไม่ได้รับอนุญาต; Meta ระบุว่าการเข้าถึงเป็นแบบเลือกเปิดเอง และ Apple ต้องการให้ผู้ใช้ดำเนินการอย่างชัดเจนมาก

แรงต้านดาต้าเซ็นเตอร์. Amazon ประกาศมอบ 1 พันล้านดอลลาร์ให้ชุมชนรอบดาต้าเซ็นเตอร์ และ Matt Garman ซีอีโอ AWS เรียกร้องให้ยุติการระงับก่อสร้าง โดยอ้างว่ามีข้อมูลบิดเบือนจากต่างประเทศ; Microsoft กำลังขยายการใช้ biomimicry ในดาต้าเซ็นเตอร์ท่ามกลางแรงต้านในพื้นที่

AI กลายเป็น “super intelligence”. ทำเนียบขาวให้ซีอีโอเทคโนโลยีรายใหญ่ลงนามคำมั่นด้านความปลอดภัย AI และ Trump ลงนามคำสั่งฝ่ายบริหารเปลี่ยนชื่อ AI เป็น “super intelligence” ขณะที่ผู้บริโภคเพียง 2% กำลังซื้อผลิตภัณฑ์ AI

เขย่าทีมความปลอดภัย OpenAI. OpenAI ปลดนักวิจัย 3 คน และคนที่สี่ออกไป หลังการสอบสวนพบว่าพวกเขารั่วข้อมูลลับให้องค์กรความปลอดภัย AI ภายนอก

Uber Eats เร่งค้นหา. Uber สร้างไปป์ไลน์ค้นหาใหม่ ลดความหน่วงแบบ end-to-end ลง 50% โดยใช้ agentic coding ในการระบุและตรวจสอบการปรับประสิทธิภาพ

AI จากภายในของ Airbnb. Ahmad Al-Dahle CTO ของ Airbnb ใช้กลยุทธ์ AI แบบ inside-out: ใช้ generative AI ภายในเพื่อเร่งการพัฒนาผลิตภัณฑ์ แล้วจึงเปลี่ยนประสบการณ์ลูกค้า

AI โลคอลและฮาร์ดแวร์

Strata + Qwen3.8 Next. ผู้ใช้รายงานว่า Strata กับ Qwen3.8 Next ทำได้ 45-70 โทเคน/วินาทีบน DDR4+7900XTX ที่ช้า และ 150-200 โทเคน/วินาทีบน RTX 5090 ที่จำกัดพลังงานพร้อม DDR5 96GB เร็วกว่า llama.cpp อย่างมีนัยสำคัญ

iPhone เป็น GPU ตัวที่สอง. iPhone 17 Pro Max สามารถเร่ง prefill ของ Qwen 3.8 27B ได้ 29-44% บน MacBook 24GB เมื่อเชื่อมต่อผ่าน USB-C และรันเลเยอร์ชั้นบนบน GPU ของโทรศัพท์

การ์ด Ascend 96GB. การ์ด Huawei Atlas 300I Duo สองใบ ความจุใบละ 96GB รัน Qwen3.8 Flash-Next ได้ราว 30 โทเคน/วินาทีหลังปรับจูนสแตกซอฟต์แวร์ แม้จะไม่ใช่ drop-in replacement ของ CUDA

ราคา DGX Spark กับ 5090. Nvidia เปิดตัว DGX Spark 64GB ขณะที่ราคารุ่น 128GB เดิมปรับขึ้นเป็น 6,950 ดอลลาร์ และการซื้อ RTX 5090 ที่ Micro Center ตอนนี้มีรายงานว่าต้องใช้เอกสารยืนยันไม่ส่งออก

นี่คือทั้งหมดสำหรับวันนี้ - อ่านประมาณ 5 นาที

อ่านทุกเช้าตรงในเบราว์เซอร์ของคุณ

ส่วนขยายเปิดสรุปนี้ในแผงด้านข้างของ Chrome — คลิกเดียว ไม่ต้องมีบัญชี

เพิ่มไปยัง Chrome — ฟรี