Agentic AI News วันนี้

ข่าว AI agents ประจำวันใน 5 นาที: เปิดตัว, เครื่องมือ, งานวิจัย, การเงิน และการเคลื่อนไหวขององค์กร

อัปเดตทุกวัน คัดสรรจาก 30 แหล่ง พุธ, สิงหาคม 19, 2026

โมเดลท้องถิ่นและฮาร์ดแวร์

การเพิ่มความเร็วของ Qwen3.8-27B. การดีโค้ดแบบ spec ของ DFlash2 ทำให้ Qwen3.8-27B มีความเร็ว 218 tok/s บน 3090 สองตัว ประมาณ 200 บน 5090 และ 124 บน 3090 ตัวเดียวด้วยเอ็นจิ้นที่ปรับแต่งแล้ว และ DFlash2 GGUF quants มีให้ใช้งาน

Qwen รุ่นกลางถัดไป. ผู้จัดการชุมชนของ Qwen กล่าวว่าโมเดล open-weight ขนาดกลางใหม่คาดว่าจะเปิดตัวสัปดาห์หน้า น่าจะมีพารามิเตอร์เกิน 100B โดยไม่มีการเข้าถึงล่วงหน้า

การรองรับ Ling-3.0 บนเอดจ์. ตอนนี้ llama.cpp รองรับ Ling-3.0 (BailingMoE3) อย่างเป็นทางการแล้ว รุ่น tiny รันคอนเท็กซ์เต็ม 128K บน Orin Nano 8GB ราคา 249 ดอลลาร์ที่ความเร็ว 33 tok/s ในขณะที่ Arc B580 ทำได้ประมาณ 114 tok/s

ความเร็วของ DeepSeek V4 Flash. เคอร์เนลที่ปรับแต่งแล้วและการอุ่น KV-cache ลดเวลาตอบสนองของ Mac Studio M3 Ultra จาก 6-20 วินาทีเหลือ 1.6 วินาที การตั้งค่า RTX 3060 จำนวน 4 ตัวประมวลผลพรอมต์ที่ความเร็วประมาณ 100 tok/s ด้วยควอนต์ 144GiB

สรุปโมเดลบิตต่ำ. ตอนนี้ Bonsai 27B แบบ ternary ทำงานบน CUDA/Vulkan หลักแล้ว ส่วน Mach-1 Additive 35B รันได้สูงสุด 120 t/s บนแล็ปท็อปทั่วไป มีการพัฒนาเวอร์ชันใหม่จาก Qwen3.8-27B

เครื่องมือและเฟรมเวิร์กสำหรับเอเจนต์

ตัวประเมินเอเจนต์ที่ปรับแต่งแล้ว. LangChain เปิดตัว Tuned Evaluators ซึ่งแนบฟีดแบ็ก Perceived Error กับ production traces โดยอัตโนมัติ โดยใช้โมเดลเฉพาะทาง ช่วยลดต้นทุนการประเมินได้ถึง 82%

เกณฑ์มาตรฐานการค้นหาเอเจนต์. Search Index ของ Artificial Analysis จัดอันดับ Parallel, Exa, Firecrawl และอื่นๆ ตามคุณภาพ ต้นทุน และความเร็วสำหรับเอเจนต์ คุณภาพการค้นหาที่ดีขึ้นช่วยลดการใช้โทเคนลงมากกว่า 40%

WriteGuard สำหรับ MCP. WriteGuard ของ Cloudflare ซึ่งตอนนี้อยู่ในช่วงเบต้าส่วนตัว เพิ่มนโยบายแบบรวมศูนย์ การระบุแหล่งที่มา และบันทึกการตรวจสอบสำหรับการดำเนินการเขียนผ่านเซิร์ฟเวอร์ MCP

โรงงานซอฟต์แวร์ Warp. Warp Factories เป็นชั้นโครงสร้างพื้นฐานที่ช่วยให้บริษัทขนาดเล็กปรับใช้เอเจนต์เขียนโค้ด AI โดยใช้โมเดลโรงงานซอฟต์แวร์

โมคอัพของ Claude Code. คำสั่ง /design ของ Anthropic ใน Claude Code สร้างโมคอัพ UI ในเทอร์มินัล โดยให้ตรงกับสไตล์โค้ดเบสเดิมก่อนการพัฒนา

ความปลอดภัย ความมั่นคง และนโยบาย

การยกเครื่องความปลอดภัยของ OpenAI. หลังเหตุการณ์ Hugging Face และหลักฐานว่า Astra อาจมีความสามารถด้านความมั่นคงปลอดภัยทางไซเบอร์ที่สำคัญ OpenAI หยุด RL เป็นเวลาสองสัปดาห์และเสริมความแข็งแกร่งให้แซนด์บ็อกซ์ การรัน RL ระดับแนวหน้าที่ใหญ่ที่สุดของพวกเขายังคงถูกระงับ

Copilot เผยการ์ดเรล. นักวิจัยขอให้ Microsoft 365 Copilot อธิบายการ์ดเรลการยืนยันผู้ใช้ของตัวเอง จากนั้นจึงสร้างช่องโหว่การคลิกลิงก์เพื่อขโมยข้อมูลโดยไม่ต้องยืนยัน

ChatGPT สำหรับวัยรุ่น. ChatGPT สำหรับวัยรุ่นจะนำไปใช้กับผู้ใช้ที่มีอายุต่ำกว่า 18 โดยอัตโนมัติ พร้อมข้อจำกัดเนื้อหาที่เข้มงวดขึ้น โหมดการศึกษา และการควบคุมโดยผู้ปกครอง โดยมีจุดมุ่งหมายเพื่อลดการโกงและเนื้อหาที่เป็นอันตราย

การถกเถียงโมเดลเปิดของ Amodei. ซีอีโอของ Anthropic อย่าง Dario Amodei โต้แย้งว่าโมเดลเปิดทำให้อำนาจตกไปอยู่กับเจ้าของชิป และปกป้องข้อเสนอการกำกับดูแล AI นักวิจารณ์รวมถึง LeCun และ Sacks กล่าวหาว่าเขาปลูกความกลัว

อุตสาหกรรมและธุรกิจ

Cursor เปิดตัว Origin. Cursor เปิดตัว Origin คู่แข่งของ GitHub สำหรับการโฮสต์โค้ด พร้อมฟีเจอร์ที่ออกแบบสำหรับเอเจนต์โดยเฉพาะ และมีแผนสร้างระบบนิเวศแอปพลิเคชัน

มูลค่าของ Etched เพิ่มขึ้นสองเท่า. Etched ระดมทุนได้ 700 ล้านดอลลาร์ที่มูลค่า 21 พันล้านดอลลาร์ เพิ่มขึ้นสองเท่าในหนึ่งเดือน หลังจาก Jane Street ทดสอบชิปอินเฟอเรนซ์ prefill/decode ของบริษัท

ความต้องการการกำหนดเส้นทางโมเดล. การซื้อ OpenRouter ด้วยมูลค่า 7 พันล้านดอลลาร์ของ Stripe และ ARR 300 ล้านดอลลาร์ของ Glean ชี้ให้เห็นถึงความต้องการการกำหนดเส้นทางโมเดลที่เพิ่มขึ้น ในขณะที่โมเดล open-weight ได้รับความนิยมมากขึ้น

งานวิจัยและการศึกษา

การปรับเทียบหน่วยความจำเอเจนต์. การศึกษาของ Hugging Face แสดงให้เห็นว่าผลของหน่วยความจำแบบเอเจนต์แตกต่างกันไปตามระดับโมเดล: gpt-oss-120b มีความสำเร็จของงานเพิ่มขึ้น +16.1 pp เมื่อใช้คำแนะนำเต็มรูปแบบ ในขณะที่โมเดลที่อ่อนแอกว่าต้องการการเรียกค้นแบบกระชับ

ข้อมูลการใช้งาน AI อิสระ. AI Observatory ของมหาวิทยาลัยสแตนฟอร์ดรวบรวมบทสนทนาจริงและพบว่าการใช้ AI แตกต่างกันอย่างมีนัยสำคัญระหว่างโมเดล โดยกรณีการใช้งานด้านการทำงานพบได้น้อยกว่าที่บริษัทอ้าง

การบีบอัดทำให้คำสั่งหาย. นักวิจัยจาก Penn State พบว่ามีเพียง 17% ของข้อจำกัดในเซสชันที่ยังคงอยู่หลังการบีบอัดคอนเท็กซ์ LLM เสริมขนาดเล็กสามารถกู้คืนคำสั่งที่สูญหายได้ส่วนใหญ่

การพัฒนาตนเองยังอีกไกล. การศึกษาที่นำโดย Princeton พบว่าเอเจนต์ AI สามารถแก้ปัญหาทางวิศวกรรมได้ แต่ขาดการตัดสินใจสำหรับการวิจัย AI แบบปลายเปิด ซึ่งบ่งชี้ว่าการพัฒนาตนเองแบบย้อนกลับอาจใช้เวลานานขึ้น

นี่คือทั้งหมดสำหรับวันนี้ - อ่านประมาณ 5 นาที

อ่านทุกเช้าตรงในเบราว์เซอร์ของคุณ

ส่วนขยายเปิดสรุปนี้ในแผงด้านข้างของ Chrome — คลิกเดียว ไม่ต้องมีบัญชี

เพิ่มไปยัง Chrome — ฟรี