Agentic AI News วันนี้

ข่าว AI agents ประจำวันใน 5 นาที: เปิดตัว, เครื่องมือ, งานวิจัย, การเงิน และการเคลื่อนไหวขององค์กร

อัปเดตทุกวัน คัดสรรจาก 30 แหล่ง พฤหัสบดี, ตุลาคม 8, 2026

โมเดลและอินเทอร์เฟซ

Claude Haiku 5.5. โมเดลตัวใหม่ที่เร็วและราคาถูกของ Anthropic มาพร้อม context 1 ล้านโทเคน และลดราคาคิดค่าพรอมต์เหลือ $0.10 ต่อล้านโทเคนสำหรับการใช้งานไม่เกิน 100K โทเคน เท่ากับ GPT-6 Luna แต่ tokenizer ของมันนับโทเคนมากกว่าราว 25-30% และราคาจะขยับขึ้น 5 เท่าเมื่อเกิน 100K ส่วนผลเบนช์มาร์กกระโดดขึ้นจาก Haiku 4.5 อย่างชัดเจน และงานเขียนโค้ดแบบ agentic ก็อยู่ในระดับที่แข่งขันได้

Mistral Large 4 "Le Chonk". Mistral ปล่อยโมเดล open-weight ขนาด 1 ล้านล้านพารามิเตอร์ในเวอร์ชันพรีวิว ปรับมาเพื่องานเขียนโค้ด ไซเบอร์ดีเฟนส์ และอุตสาหกรรมเฉพาะทาง พร้อมอ้างว่าความสามารถใกล้เคียงโมเดลแนวหน้าของสหรัฐฯ และจีน

โมเดล decision ของ Liquid AI. Liquid AI เปิดซอร์ส d1-3B และ d1-omni-600M ซึ่งเป็นโมเดล decision แบบมัลติโมดัล ที่ตอบกลับเป็น yes/no ตัวเลือก หรือคะแนนที่คาลิเบรตแล้ว โดยไม่เปลือง output token เลย d1-3B อ้างว่าเป็นโมเดลที่ดีที่สุดในกลุ่มต่ำกว่า 10B บน Decision Index และรันได้เร็วสุด 16 มิลลิวินาทีบนฮาร์ดแวร์ NVIDIA Jetson ขณะที่พอร์ต WebGPU สำหรับเบราว์เซอร์ก็เริ่มมีให้เห็น

OpenAI Decisions API. OpenAI เปิดตัว Decisions API เวอร์ชันเบตา สำหรับการประเมินแบบ yes/no แบบหมวดหมู่ และแบบสเกลบนข้อความหรือรูปภาพ เร็วกว่า Responses ราว 10 เท่า รองรับ GPT-6 Luna ที่ราคาอินพุต $0.10 ต่อล้านโทเคน และไม่คิดค่า output token

ChatGPT Intelligent UI. เมื่อใช้ GPT-6 ChatGPT แสดงแผนภูมิแบบอินเทอร์แอกทีฟ ปุ่ม ฟอร์ม และมินิแอปได้ แทนที่จะเป็นข้อความล้วน OpenAI ระบุว่า reasoning เริ่มทำงานระหว่างการคิด เพื่อลดเวลารอ และผู้ใช้แบบเสียเงินได้ GPT-6 Sol ส่วนผู้ใช้ฟรีได้ Luna

Kandinsky 6.0 สร้างวิดีโอ. Kandinsky Lab ปล่อย Kandinsky 6.0 Pro (29B) และ Lite (3B) พร้อมรองรับ ComfyUI และ Diffusers และเพิ่มตัวอัปสเกลวิดีโอ

ผลแข่งของ Nemotron. โมเดล Nemotron ที่ผ่านการ fine-tune ทำผลงานระดับเหรียญทองแบบไม่เป็นทางการใน IOI 2026 (535.4/600) และได้เหรียญทองอย่างเป็นทางการใน IMO 2026 ด้วยคะแนน 30/42 โดยใช้ SFT, RL และ generate-verify-refine

เอเจนต์และเฟรมเวิร์ก

เอเจนต์ของ Nous Research. Nous Research ระดมทุนได้ $90 ล้าน ที่มูลค่า $1.5 พันล้าน และเปิดตัว Hermes for Businesses มุ่งเป้าไปที่เอเจนต์ AI สำหรับองค์กร ขณะที่ Hermes Agent แบบโอเพนซอร์สของบริษัทถูกโคลนไป 24 ล้านครั้ง และคิดเป็นสัดส่วนราว 2.5% ของการใช้โทเคน AI ทั่วโลก

LangChain Deep Agents. LangChain เปิดตัวอัปเดต Skills ที่ผูกเครื่องมือเข้ากับสกิลเพื่อให้ context เล็กลง พร้อม Managed Deep Agents v0.9 ที่มีตารางเวลาซึ่งเอเจนต์สร้างเอง การตั้งค่าต่อการรันแต่ละครั้ง และรีแอกชันใน Slack

Copilot ลงมือทำงาน. Hybrid Intelligence ของ Microsoft จะเปิดให้ Copilot เข้าถึงไฟล์ในเครื่องและลงมือทำงานต่างๆ ทั่ว Windows เช่น ค้นหา เปลี่ยนชื่อ บีบอัดเป็น zip และส่งอีเมลเอกสารให้ผู้ใช้

Muse ของ Meta ลง iPad. Muse ผู้ช่วยแบบเอเจนต์ของ Meta รองรับ iPad แบบเนทีฟแล้ว หลังยอดติดตั้งแตะ 6.6 ล้านครั้ง และเพิ่มตัวเชื่อมต่อสำหรับเครื่องมืออย่าง Canva, GitHub และ QuickBooks

Agent Lightning RL. Microsoft Research เปิดซอร์ส Agent Lightning v1.0 เฟรมเวิร์ก RL สำหรับเอเจนต์ที่มีโค้ด 3,500 บรรทัด ใช้ฮาร์เนส deployment ของจริงและ Kubernetes แบบเนทีฟ ตัวอย่างหนึ่งคือมันดัน Pass@1 ของ Qwen3.5-9B บน SWE-bench Verified จาก 41.8% ขึ้นเป็น 56.4% ด้วยตัวอย่างฝึกประมาณ 6,000 ตัวอย่าง

AI โลคอลและเครื่องมือนักพัฒนา

ROCm 10.1. ROCm 10.1 ของ AMD มุ่งแก้คอขวดเรื่องการเคลื่อนย้ายข้อมูลตอนรันอินเฟอเรนซ์ในเครื่อง และเป็นเวอร์ชันที่ผู้ใช้ AI โลคอลพูดถึงกันมากบน Reddit

llama.cpp เร่งความเร็ว MoE. llama.cpp ได้ GPU cache สำหรับ expert ของ MoE ที่พักไว้ในหน่วยความจำโฮสต์ ช่วยเร่งความเร็วได้มากสำหรับโมเดลที่โหลดไม่พอดี VRAM และเพิ่มการรองรับ MTP ของ GLM5Next

Unsloth Studio ตรวจ repo. Unsloth Studio จะตรวจ repo ของโมเดลที่เชื่อถือได้ซ้ำอีกครั้งก่อนรัน หลังพบ LiteLLM เวอร์ชันที่ถูกฝังโค้ดอันตรายบน PyPI ซึ่งแสดงให้เห็นว่าการโจมตีซัพพลายเชนเข้าถึงเครื่องมือ AI ได้อย่างไร

GLM-5.3-Flash บนสอง GPU. เซ็ตอัป CMP 170HX 64GB สองใบรัน GLM-5.3-Flash ที่ context 384K ได้ราว 90 โทเคนต่อวินาทีด้วย EXL3 โดยโมเดล MoE ขนาด 320B เก็บ weights ที่ใช้งานไว้ใน HBM และมีการทดสอบเทียบกับ Qwen3.8-Flash-Next

เบนช์มาร์ก Qwen โลคอล. การทดสอบล่าสุดในคอมมูนิตีนำ Qwen3.8-27B ที่ผ่านการ fine-tune และ Qwen3.8-Flash-Next มาเทียบกับโมเดลแนวหน้าในงานเฉพาะทางและงานเขียนโค้ด ผลทดสอบ 469 คำถามพบว่าโมเดลที่รันในเครื่องให้ผลลัพธ์ใกล้เคียงโมเดลแนวหน้าได้ พร้อมข้อดีด้านความเป็นส่วนตัวและต้นทุนที่ต่ำกว่า แต่การใช้ thinking token มากเกินไปยังเป็นปัญหาอยู่

ฮาร์ดแวร์และ Windows

ฮาร์ดแวร์ AI ของ Surface. Microsoft เปิดตัว Surface Laptop Ultra และ Surface RTX Spark Dev Box ซึ่งใช้ชิป RTX Spark สถาปัตยกรรม Arm ของ Nvidia ทั้งคู่ Laptop เริ่มต้นที่ $2,599 พร้อม unified memory สูงสุด 128GB เริ่มส่ง 16 ต.ค. ส่วน Dev Box เริ่มต้นที่ $5,999 มุ่งเป้าไปที่การรันโมเดลโลคอลขนาด 120B ขึ้นไป

อุตสาหกรรมและธุรกิจ

ช่องว่างความเข้าใจโค้ด. ผลสำรวจผู้บริหารฝ่ายวิศวกรรมระดับอาวุโส 300 คนพบว่าเอเจนต์เขียนโค้ด AI ทำให้คอขวดย้ายไปอยู่ที่การดีบักและการทำความเข้าใจโค้ด ทีมต่างๆ ใช้เวลาเขียนโค้ด 9.8 ชั่วโมงต่อสัปดาห์ แต่ใช้เวลาดีบักถึง 16.9 ชั่วโมงต่อสัปดาห์ รายงานชี้ว่าความเสี่ยงนี้กำลังเพิ่มขึ้นในโค้ดเบสที่สำคัญต่อการดำเนินงาน

โครงการ virtual cell. Biohub กำลังประสานงานโครงการมูลค่า $1.8 พันล้าน เพื่อสร้างโมเดล AI ที่ทำนายพฤติกรรมของเซลล์ โดย Google DeepMind, Meta และ Isomorphic Labs ลงทุน $300 ล้าน ขณะที่กระทรวงพลังงานสหรัฐฯ (DOE) ใส่เงินอีกกว่า $500 ล้านสำหรับการวัดผลในแล็บและพลังประมวลผล

โคลน Adobe แบบโอเพนซอร์ส. นักพัฒนา Brandon Thomas ใช้ Claude Opus 5.5 สร้าง Artcraft ชุดแอปโอเพนซอร์ส 7 ตัวที่เขียนด้วย Rust/WebAssembly เลียนแบบ Photoshop, Illustrator, Premiere และโปรแกรมอื่นๆ ของ Adobe แอปเหล่านี้ยังอยู่ในช่วงเริ่มต้นและยังมีข้อบกพร่องอีกมาก แต่โครงการนี้แสดงให้เห็นการทำ clean-room reimplementation ด้วยความช่วยเหลือของ AI

SynthID เปิดให้ตรวจลายน้ำ. Google เปิดให้สาธารณะใช้ตัวตรวจจับ SynthID ใครก็ตรวจสอบได้ว่ารูป วิดีโอ และเสียงมีลายน้ำของ Google หรือพันธมิตรหรือไม่ ระบบนี้ติดลายน้ำไปแล้วมากกว่า 1.8 แสนล้านรายการสื่อ และถูกฝังไว้ใน Chrome กับ Gemini ด้วย

Playground สร้างเกมของ Google. Google Labs เปิดตัว Playground แพลตฟอร์มบนเบราว์เซอร์ที่ผู้ใหญ่ในสหรัฐฯ สร้างเกมจากพรอมต์ข้อความได้ โดยขับเคลื่อนด้วย Gemini, Nano Banana และ Lyria ขณะที่ Unity ก็เปิดตัว Unity Spark สำหรับการพัฒนาเกมระดับมืออาชีพด้วยความช่วยเหลือของ AI

นี่คือทั้งหมดสำหรับวันนี้ - อ่านประมาณ 5 นาที

อ่านทุกเช้าตรงในเบราว์เซอร์ของคุณ

ส่วนขยายเปิดสรุปนี้ในแผงด้านข้างของ Chrome — คลิกเดียว ไม่ต้องมีบัญชี

เพิ่มไปยัง Chrome — ฟรี