Agentic AI News วันนี้

ข่าว AI agents ประจำวันใน 5 นาที: เปิดตัว, เครื่องมือ, งานวิจัย, การเงิน และการเคลื่อนไหวขององค์กร

อัปเดตทุกวัน คัดสรรจาก 30 แหล่ง อาทิตย์, สิงหาคม 30, 2026

การเปิดตัวเอเจนต์และโมเดล

Tencent Hy4 พรีวิว. Tencent เปิดตัว Hy4 พรีวิว โมเดลที่มีขนาดใหญ่ขึ้นกว่า Hy3 อย่างมีนัยสำคัญ โดยตั้งค่าเริ่มต้นเป็นการรีซันนิงระดับสูงและโหมด no_think ชุมชนมีเวอร์ชันควอนไทซ์ทางการที่ ~2.38 บิต และ GGUF ~200GB ซึ่งรายงานว่ายังคงประสิทธิภาพของ BF16 ได้ประมาณ 98%

อินเฟอร์เรนซ์ในเครื่องและฮาร์ดแวร์

พอร์ต FlashMLA สำหรับ sm_120. บิลด์จากชุมชนขยาย FlashMLA ไปยัง GPU Blackwell sm_120 สำหรับผู้บริโภค โดยเพิ่มความเร็วได้ 2–3 เท่าเมื่อเทียบกับ PyTorch SDPA ในเวิร์กโหลด sparse MLA หลายรูปแบบ และ latency ลดลง 8% สำหรับการดีโค้ด FP8 KV cache

ทางแก้ Nemotron 16GB. GGUF บิตต่ำของ Nemotron-3.5-Lightning นั้นมีค่า ~4.70 bpw อย่างเงียบๆ เนื่องจากการควอนไทซ์แบบ row-width; บิลด์ llama.cpp ที่แพตช์แล้วให้ไฟล์จริงที่ 3.07 bpw / 11.77 GiB ซึ่งรันคอนเทกซ์ 262K บน 16GB ได้

Qwen3.8-Flash-Next บน Mac. Qwen3.8-Flash-Next 2-bit ขนาด 79GB รันบน M5 Max 128GB ด้วยสล็อตคอนเทกซ์ 350K โดยใช้ llama.cpp รวมถึง cold prefill 333 วินาทีสำหรับพรอมป์ 105K และ speculative decoding แบบ ngram-mod

DeepSeek V4 Flash บน 2 GPU. บนการตั้งค่า 2x DGX Spark/GX10 DeepSeek V4 Flash 0731 ทำความเร็วต่อเนื่องได้ 67–84 โทเคน/วินาที โดยมี HumanEval Pass@1 ในเครื่องที่ 94.5% เทียบกับ 97.0% ของ GLM-5.3-Flash NVFP4 ขณะที่ GLM ทำเบนช์มาร์กเสร็จในเวลาประมาณครึ่งหนึ่ง

คอนเทกซ์ 1M บน 5090 สองใบ. ฟอร์กของ NInfer เพิ่ม tensor parallelism และการสเกล YaRN ×4 เพื่อรัน Qwen3.8-27B NVFP4 ด้วยคอนเทกซ์ 1,048,576 โทเคนบน 5090 สองใบ โดยดีโค้ดได้ 48–100 โทเคน/วินาทีที่ 1M และรักษาอัตราการยอมรับ MTP ไว้ได้ในขณะที่ vLLM ลดลงเป็นศูนย์

27B บน 16GB. การควอนไทซ์แบบไฮบริดร่วมกับการตั้งค่า kvarn cache ทำให้ Qwen3.8-27B รันด้วยคอนเทกซ์ 100K ที่ความเร็ว 50 โทเคน/วินาทีบน RTX 4070 Ti SUPER 16GB โดยใช้ MTP speculative decoding และ KV cache แบบ tail-precision

FreeToken เอนจิน MoE. นักวิจัยจาก UC Berkeley และ MIT เปิดตัว FreeToken เอนจินโอเพนซอร์สที่จัดตารางการถ่ายโอนผู้เชี่ยวชาญ MoE ร่วมกันแบบไดนามิก เพื่อให้โมเดล sparse แนวหน้าสามารถดีโค้ดบน GPU เกรดผู้บริโภคได้โดยไม่หยุดชะงักจาก PCIe/RAM misses

เบนช์มาร์กและการประเมิน

Terminal Bench 4.0. Terminal Bench 4.0 เปิดตัวพร้อมลีดเดอร์บอร์ดที่รีเฟรชใหม่ และเน้นการวนซ้ำอย่างรวดเร็วเพื่อรับมือกับความอิ่มตัว โดย GLM-5.3 ทำคะแนนได้ระดับเดียวกับ Fable 5 ภายในช่วงความคลาดเคลื่อน

เปิดเผยเบนช์มาร์กการเงิน. การ์ดเบนช์มาร์กสำหรับ Ling-3.0-flash-Fin แสดงให้เห็นว่า agent scaffolding เครื่องมือ และไปป์ไลน์การประเมินมีผลต่อผลลัพธ์ที่รายงานมากเพียงใด โดยหลายรันใช้ ReAct ร่วมกับการค้นหาเว็บและ Python และชุดประเมินบางชุดเป็นข้อมูลภายในหรือยังไม่เปิดเผยต่อสาธารณะ

งานวิจัยและอินฟราสตรัคเจอร์เอเจนต์

หน่วยความจำ WikiSkill ของ Google. WikiSkill จาก Google Research มอบฐานความรู้แบบวิกิที่คงอยู่ให้เอเจนต์ เก็บความล้มเหลวและความสำเร็จในอดีต โดยบรรจุเป็น Agent Skills ที่นำกลับมาใช้ใหม่ได้ ซึ่งช่วยชี้แนะพฤติกรรมโดยไม่ต้องแก้ไขน้ำหนักของโมเดล

มาตรฐานฮาร์ดแวร์โมเดลของ Anthropic. Anthropic กำลังสร้าง MHS ซึ่งเป็นอินเทอร์เฟซแบบรวมศูนย์ที่ให้เอเจนต์ควบคุมอุปกรณ์จริง เช่น กล้องจุลทรรศน์และแขนกล โดยการทดสอบเบื้องต้นลดเวลาการรวมระบบหลายเครื่องจากหลายสัปดาห์เหลือหลายชั่วโมง แต่ยังต้องมีมนุษย์คอยดูแล

ชั้นข้อมูลสำหรับเอเจนต์. การนำเสนอของ TOTVS ชี้ว่าระบบทรานแซกชันและ data lake ไม่ได้ถูกปรับให้เหมาะกับการให้เหตุผลของเอเจนต์ที่กินโทเคนสูงและไวต่อเวลาแฝง พร้อมอธิบายการพัฒนาการเข้าถึงข้อมูลไปสู่ MCP และโมเดลเชิงความหมาย

BVD ของ LAION. LAION ปล่อย BVD ซึ่งเป็นชุดข้อมูลสำหรับงานวิจัยเท่านั้น ที่มีวิดีโอ 10 ล้านชั่วโมง คลิป 55 ล้านคลิป และภาพนิ่ง 300 ล้านภาพ โดยเชื่อมโยงวิดีโอ เสียง และข้อความเข้าด้วยกัน โมเดลที่ฝึกด้วยชุดข้อมูลนี้มีประสิทธิภาพเหนือเบสไลน์ InternVid ถึง 2.1 คะแนนในบางเบนช์มาร์ก

อุตสาหกรรมและธุรกิจ

Sony และ Warner ฟ้อง Anthropic. Sony Music Publishing, Warner Chappell และผู้จัดพิมพ์เพลงรายอื่นๆ ฟ้องร้อง Anthropic กล่าวหาว่าใช้การทอร์เรนต์และการสแครปผลงานที่มีลิขสิทธิ์เพื่อฝึก Claude และเรียกร้องค่าเสียหายสูงสุด 150,000 ดอลลาร์ต่อผลงาน Anthropic ระบุว่าจะต่อสู้คดี

OpenAI ตัดขาด Cursor. OpenAI กำลังยุติสัญญากับ Cursor หลัง SpaceX เข้าซื้อ Cursor โดยอ้างถึงประวัติการผิดสัญญาของบริษัทในเครือ Elon Musk Anthropic ตอบโต้ด้วยการวางตำแหน่งตัวเองเป็นพันธมิตรที่น่าเชื่อถือกว่า และให้คำมั่นว่าจะให้พลังประมวลผลต่อเนื่องสำหรับการใช้งาน Claude ใน Cursor

Nvidia ก้าวข้าม GPU. การเล่าเรื่องรายได้ของ Nvidia กำลังเปลี่ยนจากส่วนแบ่ง GPU ไปสู่การจัดการดาตาเซ็นเตอร์และระบบรอบตัว GPU ซึ่ง Nvidia ได้สร้างฮาร์ดแวร์เครือข่ายและการจัดการระดับแนวหน้า ขณะที่การประมวลผล AI ขยายตัวถึงระดับกิกะวัตต์

นี่คือทั้งหมดสำหรับวันนี้ - อ่านประมาณ 5 นาที

อ่านทุกเช้าตรงในเบราว์เซอร์ของคุณ

ส่วนขยายเปิดสรุปนี้ในแผงด้านข้างของ Chrome — คลิกเดียว ไม่ต้องมีบัญชี

เพิ่มไปยัง Chrome — ฟรี