Agentic AI News วันนี้

ข่าว AI agents ประจำวันใน 5 นาที: เปิดตัว, เครื่องมือ, งานวิจัย, การเงิน และการเคลื่อนไหวขององค์กร

อัปเดตทุกวัน คัดสรรจาก 30 แหล่ง จันทร์, สิงหาคม 31, 2026

การเปิดตัวโมเดลและ AI ในเครื่อง

Sori-1B โมเดลเสียง-ภาษา. โมเดลขนาด 1B พารามิเตอร์ที่เทรนจากศูนย์บนข้อความที่จับคู่กับเสียง โดยไม่มีการ pretraining ด้วยข้อความเพียงอย่างเดียว มีจุดประสงค์เพื่อให้คำตอบอ้างอิงจากเสียงจริง ใช้เอนโค้ดเดอร์ Audio Flamingo Next ของ NVIDIA ที่แช่แข็ง และโทเคนไนเซอร์แบบ auditory-ontology ที่กำหนดเอง ปล่อยเผยแพร่ภายใต้ใบอนุญาตแบบไม่ใช้เชิงพาณิชย์/เชิงวิชาการ

Qwen3.8 รันในเครื่อง. รายงานจากคอมมูนิตี้แสดงให้เห็น Qwen3.8-27B และ Flash Next ทำงานบนฮาร์ดแวร์หลากหลาย ตั้งแต่โทรศัพท์แรม 12GB (ได้ 3.5 โทเคน/วินาที) ไปจนถึง GPU R9700 สี่ตัว (ความเร็วสร้าง 80-120 โทเคน/วินาที, บริบท 700k) ในงานเอเจนต์ที่รันในเครื่อง Flash Next เร็วกว่าและเชื่อถือได้ในเชิงกลไก ขณะที่โมเดล dense 27B ยังแข็งแกร่งกว่าสำหรับการสนทนาต่อเนื่องยาว ๆ ผู้ใช้บางคนมองว่าโมเดลค่อนข้าง dense แม้คุณภาพการแปลภาษาเยอรมันจะได้รับคำชม

GGUF ไร้เซ็นเซอร์. ผู้ใช้ Reddit คนหนึ่งเผยแพร่ไฟล์ GGUF ของ LongCat-Flash-Lite-Sparse ซึ่งเป็นโมเดล sparse-attention ขนาด 69B-A3B รองรับบริบท 1M พร้อมทั้ง Qwen3.8-27B ที่มี MTP, Qwen3.5-122B-A10B, Qwen3-Coder-Next และโมเดลวิทัศน์ การรองรับ LongCat ต้องใช้ llama.cpp fork ที่ปรับแต่งเอง

ฮาร์ดแวร์ AI เดสก์ท็อป. เดสก์ท็อป DGX Station ของ NVIDIA ให้ประสิทธิภาพระดับศูนย์ข้อมูลด้วยแบนด์วิดท์หน่วยความจำ 7.1TB/s ขณะที่ Framework ดูเหมือนกำลังเตรียมเมนบอร์ดแรม 192GB ที่คาดว่าจะมีราคาราว 4.5 พันดอลลาร์

เบนช์มาร์กและการประเมินผล

เบนช์มาร์ก LLM เพนเทสต์. เบนช์มาร์กใหม่นี้ทดสอบ LLM กับระบบจริงที่ต้องโจมตี โดยมีเป้าหมายเพื่อค้นหาโมเดลที่ดีที่สุดสำหรับงานความปลอดภัยเชิงรุก แทนที่จะสร้าง CVE ที่รู้จักแล้วซ้ำ

ดัชนีเบนช์มาร์กเขียนโค้ด. ผู้ใช้ Reddit รวบรวมเบนช์มาร์กการเขียนโค้ดแบบ agentic หลัก ๆ ไว้ใน “Agentic Coding Index” และคำนวณเมตริก intelligence density เพื่อเปรียบเทียบความสามารถของโมเดลต่อจำนวนพารามิเตอร์

ประเมิน VLM โอเพนซอร์สแบบ egocentric. การทดสอบโดยใช้ HFlow กับเบนช์มาร์กวิดีโอแบบ egocentric พบว่า VLM โอเพนซอร์สอย่าง Gemma ทำผลงานเท่ากับ Gemini 2.5 Flash ในเมตริกการมองเห็นมือและการจัดการวัตถุ ขณะที่ราคาถูกกว่า 19 เท่า ทำให้การประมวลผลแบบ self-hosted ส่วนตัวเป็นไปได้

เครื่องมือและเฟรมเวิร์กเอเจนต์

AI Search จาก Cloudflare. ตอนนี้ AI Search ของ Cloudflare มีไปป์ไลน์การค้นหาแบบ end-to-end สำหรับข้อมูลที่กำหนดเอง พร้อมการผสานกับเอเจนต์ การค้นหาแบบมัลติโมดัล และโหมด discover ที่สามารถจัดทำดัชนีเว็บไซต์โดยไม่ต้องมี sitemap

Kiro Crew ของ AWS. AWS เปิดซอร์ส Kiro Crew ซึ่งเป็นเวิร์กสเปซสำหรับรันเอเจนต์เขียนโค้ดแบบอะซิงโครนัสหลายตัวพร้อมกัน โดยมีหน่วยความจำร่วม ทักษะที่ใช้ซ้ำได้ และงานที่ตั้งเวลาไว้ ภายใน AWS เองมีนักพัฒนากว่า 39,000 คนใช้งาน

รู้จัก ChatGPT Work. ChatGPT Work ของ OpenAI ซึ่งมีให้ในแผนแบบเสียเงิน มีทั้งเวอร์ชันคลาวด์ผ่าน chatgpt.com และเวอร์ชันเดสก์ท็อปในเครื่องที่เข้าถึงไฟล์และรันโปรแกรมได้ แต่เส้นแบ่งระหว่างมันกับ Chat ยังคงคลุมเครือ

Claude Code ลดขีดจำกัด. การเพิ่มขีดจำกัดพื้นฐาน 25% ที่กำลังจะมาถึงของ Anthropic สำหรับ Claude Code จริง ๆ แล้วคือการลดลงจริง 17% เมื่อเทียบกับการเพิ่มชั่วคราว 50% ที่มีอยู่ในปัจจุบัน โดยได้เพิ่มเครื่องมือรายงานบั๊กอัตโนมัติด้วย

งานวิจัยและการวิเคราะห์

เอเจนต์ไม่รู้เวลา. การศึกษาพบว่า Claude Code และ Codex ประเมินระยะเวลาที่งานต้องใช้ผิดพลาดอย่างสม่ำเสมอ โดยประเมินงานสั้นสูงเกินไป 3-10 เท่า ซึ่งเป็นปัญหาสำหรับงานเอเจนต์ที่รันยาวนาน

PILOT ปรับตัวเองแบบสด. PILOT เป็น harness แบบ supervisor-worker ที่เพิ่มการควบคุมแบบสดและการวิวัฒน์ตนเองแบบสดสำหรับเอเจนต์ระยะยาว โดยทำคะแนนได้เหนือกว่า harness ที่เทียบเคียงถึง 9.8 จุดบน Terminal-Bench 2.0

GameWAM โมเดลโลก-แอคชัน. GameWAM เป็นโมเดล world-action ตัวแรกสำหรับการเล่นเกมวิดีโอแบบเนทีฟ ที่สร้างเฟรมในอนาคตและการกดแป้นพิมพ์-คลิกเมาส์ร่วมกันผ่าน flow matching พร้อมการควบคุมแบบ block-cycle ในระยะยาว

RL next-chunk กับ SFT. การศึกษาแบบควบคุมแสดงให้เห็นว่า Mixed SFT บนข้อมูล no-CoT และ long-CoT เอาชนะ next-chunk reasoning RL ในฐานะกลยุทธ์การเทรนก่อน RLVR โดยใช้คอมพิวต์น้อยกว่า 60 เท่า

ถกเถียงเรื่องเอเจนซี AI. บทความหนึ่งอ้างถึงเหตุการณ์ “Hugging Face Incident” จากเดือนกรกฎาคม โดยโต้แย้งว่า เอเจนซีของ AI ไม่ใช่แค่ความสามารถเท่านั้น ที่จะเป็นตัวกำหนดผลลัพธ์ และวิธีที่ผู้ใช้ให้หรือจำกัดเอเจนซีนั้นมีความสำคัญ

อุตสาหกรรม นโยบาย และธุรกิจ

NVIDIA ซื้อ Hugging Face. ดีลมูลค่า 12.9 พันล้านดอลลาร์ที่รายงานว่า NVIDIA จะเข้าซื้อ Hugging Face จะเป็นการรวมโครงสร้างพื้นฐานด้านการประมวลผลเข้ากับฮับกระจายหลักของระบบนิเวศโมเดลโอเพนซอร์ส ซึ่งจะเร่งการเปลี่ยนผ่านของ AI ไปสู่เชิงอุตสาหกรรม

กำแพงการค้าหุ่นยนต์สหรัฐฯ. วอชิงตันได้เพิ่มความเข้มงวดในข้อจำกัดและภาษีต่อโดรนและหุ่นยนต์จากจีน โดยอ้างเหตุผลด้านความมั่นคงแห่งชาติ แม้ขนาดการผลิตและความได้เปรียบด้านต้นทุนของจีนอาจลดทอนผลกระทบในระดับโลก

อุตสาหกรรมหันใช้ AI. Meta กำลังทดสอบหุ่นยนต์จาก Watney, Kinova และ ABB เพื่อรีเซ็ตเซิร์ฟเวอร์ สลับสายเคเบิล และเปิดปิดเครื่องในศูนย์ข้อมูล ส่วน Caterpillar กำลังนำบทเรียนจากระบบอัตโนมัติในเหมืองมาปรับใช้กับงานก่อสร้าง และใช้ผู้ช่วย AI สำหรับช่างเทคนิค

มัสก์หล่อชิ้นส่วนเทอร์ไบน์. SpaceX กำลังสร้างโรงหล่อสำหรับใบพัดและเวนกังหันแก๊ส โดยมัสก์กล่าวว่าการหล่อเองอาจเร่งการผลิตไฟฟ้าจากแก๊สธรรมชาติสำหรับศูนย์ข้อมูล AI ได้เร็วขึ้นถึง 18 เดือน

พนักงานมอง AI แย่ลง. ข้อมูล Glassdoor เผยความรู้สึกเชิงบวกของพนักงานสหรัฐฯ ที่มีต่อ AI ลดลงจาก 81% ในปี 2019 เหลือ 43% ในช่วงกลางปี 2026 โดยผู้จัดการมองโลกในแง่ดีที่สุด ส่วนผู้หญิงเจน Z นักเขียน และพนักงานประกันภัยมองแง่ลบที่สุด

ค่ายเพลงฟ้อง Anthropic. Sony Music, Warner Music และค่ายอื่น ๆ กล่าวหา Anthropic ว่าใช้ทอร์เรนต์เนื้อเพลงลิขสิทธิ์หลายหมื่นชิ้นอย่างผิดกฎหมายเพื่อฝึก Claude โดยระบุชื่อซีอีโอ Dario Amodei และผู้ร่วมก่อตั้ง Benjamin Mann เป็นรายบุคคล

เท็กซัสระงับกล้อง Flock. ผู้ว่าการรัฐ Abbott ระงับการใช้จ่ายของรัฐสำหรับกล้องเฝ้าระวัง AI ของ Flock หลังจากมีการใช้จ่ายไปกว่า 30 ล้านดอลลาร์ ท่ามกลางความกังวลเรื่องความเป็นส่วนตัวจากทั้งสองพรรค และเหตุการณ์เจ้าหน้าที่ใช้ในทางที่ผิด

นี่คือทั้งหมดสำหรับวันนี้ - อ่านประมาณ 5 นาที

อ่านทุกเช้าตรงในเบราว์เซอร์ของคุณ

ส่วนขยายเปิดสรุปนี้ในแผงด้านข้างของ Chrome — คลิกเดียว ไม่ต้องมีบัญชี

เพิ่มไปยัง Chrome — ฟรี