Agentic AI News วันนี้

ข่าว AI agents ประจำวันใน 5 นาที: เปิดตัว, เครื่องมือ, งานวิจัย, การเงิน และการเคลื่อนไหวขององค์กร

อัปเดตทุกวัน คัดสรรจาก 30 แหล่ง สัปดาห์สิ้นสุด กรกฎาคม 12, 2026

โมเดลและการแข่งขัน

GPT-5.6 และ Work Agent. OpenAI เปิดตัว GPT-5.6 ในสามระดับการให้เหตุผล และเปิดตัว ChatGPT Work สำหรับงานอัตโนมัติที่ใช้เวลาหลายชั่วโมง แต่ข้อจำกัดในการใช้งานและอินเทอร์เฟซที่สับสนทำให้เกิดข้อร้องเรียน นำไปสู่สัญญาว่าจะแก้ไข

Claude Fable 5 ครองอันดับใน Benchmark. Claude Fable 5 ของ Anthropic กวาดคะแนนใน Benchmark ของ Artificial Analysis แต่ค่าใช้จ่ายสูงทำให้บริษัทแนะนำให้ใช้เป็นตัววางแผนที่มอบหมายงานให้โมเดลราคาถูกกว่า ลดค่าใช้จ่ายประมาณ 40% ในขณะที่ยังคงความสามารถส่วนใหญ่ไว้

การโจมตีของ Meta และผลกระทบด้านความเป็นส่วนตัว. Meta เปิดตัว Muse Spark 1.1 โมเดลการเขียนโค้ดที่มีบริบทสูง ซึ่งต่ำกว่าราคาคู่แข่ง ขณะที่เครื่องกำเนิดภาพ Muse ถูกถอนออกหลังจากเปิดให้ใช้ใบหน้า Instagram โดยไม่ได้รับอนุญาต จุดประเด็นถกเถียงเรื่องความยินยอมอีกครั้ง

คลื่นโอเพนซอร์สของจีน. ขณะนี้โมเดลจีนมีสัดส่วนมากกว่า 30% ของปริมาณการใช้งาน OpenRouter; HY3 และ GLM-5.2 ของ Tencent ทำงานบนฮาร์ดแวร์ภายในประเทศ, MiniMax วางแผนปล่อยโอเพนซอร์สที่มีพารามิเตอร์ 2.7T, และการออกแบบชิปของ DeepSeek ส่งสัญญาณถึงการบูรณาการแนวตั้งท่ามกลางความกังวลของสหรัฐฯ

วิศวกรรมเอเจนต์และโครงสร้างพื้นฐาน

Bun ถูกเขียนใหม่โดย 64 เอเจนต์. Claude Fable 5 จัดการ 64 อินสแตนซ์แบบขนานเพื่อเขียน Bun ใหม่จาก Zig เป็น Rust ใน 11 วัน สร้างโค้ดมากกว่าล้านบรรทัดและแก้ไข 128 บัก ด้วยต้นทุน $165K

การตรวจสอบ SWE‑Bench Pro ล้มเหลว. OpenAI พบว่างานใน SWE‑Bench Pro ประมาณ 30% ทำงานไม่ได้และถอนการรับรอง สะท้อนความกังวลก่อนหน้านี้จาก Artificial Analysis และบั่นทอนการประเมินการเขียนโค้ดแบบเอเจนต์

Modal ระดมทุน $355M. Modal ได้รับเงิน $355 ล้านเพื่อสร้างโครงสร้างพื้นฐานคลาวด์ที่ออกแบบมาเฉพาะสำหรับเอเจนต์ AI โดยเน้นสภาพแวดล้อมแบบแซนด์บ็อกซ์ที่ทำซ้ำได้เร็วสำหรับซอฟต์แวร์อัตโนมัติ

Cloudflare เอเจนต์ชั่วคราว. Cloudflare เปิดตัวบัญชีชั่วคราวที่ให้เอเจนต์ AI ปรับใช้ Workers โดยไม่มีข้อมูลรับรองถาวร โดยจะหมดอายุหากไม่มีการเรียกร้อง ทำให้เวิร์กโฟลว์ที่ขับเคลื่อนโดยเอเจนต์ราบรื่นขึ้น

เอเจนต์ทำงานบน GPU ในเครื่อง. เทคนิคการหาปริมาณใหม่และชุด GPU ที่คุ้มค่าต้นทุนสามารถรันโมเดล MoE บนฮาร์ดแวร์ผู้บริโภคได้ แต่ Benchmark แสดงว่าการหาปริมาณบิตต่ำสามารถทำให้งานแบบเอเจนต์เสื่อมสภาพอย่างรุนแรง จึงควรเลือกการหาปริมาณอย่างระมัดระวัง

ความปลอดภัย กฎหมาย และการตีความ

Jacobian Lens แผนที่ความคิดของโมเดล. Jacobian Lens ของ Anthropic เผยชุดการแสดงผลที่สามารถอธิบายเป็นคำพูดได้จำนวนน้อยที่จับการให้เหตุผลหลักของโมเดล ทำให้สามารถตรวจจับภาพหลอน ควบคุมผลลัพธ์ และดังที่การสาธิตของชุมชนแสดง การสร้างตัวแปรที่เป็นอันตรายได้ทันที

แรนซัมแวร์ที่ขับเคลื่อนโดยเอเจนต์. Sysdig บันทึกเอเจนต์ AI ที่จัดการการดำเนินการทางเทคนิคของการโจมตีแรนซัมแวร์ แม้ว่ามนุษย์จะเป็นผู้ตั้งค่าการดำเนินการ โดยเน้นความสามารถและข้อจำกัดในปัจจุบันของมัลแวร์แบบเอเจนต์

วิกฤตการใช้ AI ในทางที่ผิด. คดีความกล่าวหาว่า Grok ของ xAI สร้างภาพ CSAM ขณะที่ Boko Haram ใช้แชทบอทเพื่อวางแผนการโจมตี เหตุการณ์เหล่านี้เน้นย้ำถึงความจำเป็นเร่งด่วนสำหรับมาตรการป้องกันความปลอดภัยเมื่อความสามารถแบบเอเจนต์ขยายตัว

Apple ฟ้อง OpenAI. Apple ยื่นฟ้องในศาลรัฐบาลกลางกล่าวหาว่า OpenAI ล่อลวงพนักงานกว่า 400 คนเพื่อขโมยความลับทางการค้าด้านฮาร์ดแวร์ ซึ่งอาจเป็นการสร้างสมาร์ทโฟน AI ที่เป็นคู่แข่ง ทำให้การต่อสู้ทางกฎหมายในอุตสาหกรรม AI รุนแรงขึ้น

นี่คือสรุปประจำสัปดาห์ - แล้วพบกันใหม่วันอาทิตย์หน้า

อ่านทุกเช้าตรงในเบราว์เซอร์ของคุณ

ส่วนขยายเปิดสรุปนี้ในแผงด้านข้างของ Chrome — คลิกเดียว ไม่ต้องมีบัญชี

เพิ่มไปยัง Chrome — ฟรี