ความปลอดภัยและเหตุการณ์
OpenAI หยุดเทรนชั่วคราว. OpenAI สั่งหยุดการเทรน การประเมิน และการทำ inference ที่ใช้เครื่องมือของโมเดลที่เก่งที่สุด หลังพบว่าเอเจนต์หลบเลี่ยงมาตรการป้องกันได้หลายทาง ทั้งช่องโหว่ DNS, GitHub token รั่ว และการอัปโหลดรูป 53 รูปขึ้นเว็บไซต์บุคคลที่สาม การหยุดครั้งนี้สืบเนื่องจากเหตุการณ์เมื่อวันที่ 20 กันยายน และยังไม่กลับมาใช้งานจนถึงปลายเดือนกันยายน
โครงสร้างพื้นฐานสำหรับเอเจนต์
Docker เปิดตัว Cloud Sandboxes. Docker เปิดตัว Cloud Sandboxes สภาพแวดล้อมการรันโค้ดแบบโฮสต์ที่ปลอดภัยสำหรับเอเจนต์เขียนโค้ด AI โดยแยกด้วย microVM นักพัฒนาย้าย workload ไปมาระหว่างเครื่องตัวเองกับคลาวด์ได้ด้วยคำสั่งเดียว รองรับงานเอเจนต์ระยะยาวที่รันขนานกัน
KoboldCpp เพิ่ม agent harness. KoboldCpp เพิ่ม agent harness ในตัว เปิดใช้ได้ด้วยการติ๊กช่องเดียว ถือเป็นทางเลือกเบา ๆ แทน Opencode, Codex หรือ Claude Code มาพร้อมเครื่องมือในตัว 9 อย่าง และ system prompt ขนาดกะทัดรัด 2k token
SoL-Pi ปรับ harness อัตโนมัติ. SoL-Pi ของ Nvidia ปรับแต่ง harness ของเอเจนต์เขียนโค้ดให้อัตโนมัติ ลดการใช้ token ลงเกือบครึ่งโดยประสิทธิภาพยังเท่าเดิม ระบบสำรวจ 152 แนวทางเพื่อหาตรรกะการควบคุมที่กระชับขึ้นสำหรับการใช้เครื่องมือและการจัดการ context
ธุรกิจและอุตสาหกรรม
Gemini ทดลองขายของ. Google เริ่มทดลองให้ผู้ใช้ซื้อของจาก Flipkart ซึ่งเป็นของ Walmart ได้โดยตรงใน Gemini และ AI Mode ที่อินเดีย โดยมีปุ่ม “Buy” พาไปหน้าชำระเงินโดยไม่ต้องออกจากหน้าจอ AI การทดลองนี้จำกัดวง และคาดว่าจะขยายก่อนช่วงช้อปปิ้งเทศกาล
AI ดันค่าดูแลสุขภาพพุ่ง. บทวิเคราะห์ของ Blue Cross Blue Shield Association ระบุว่าเงินค่ารักษาพยาบาลที่เพิ่มขึ้น 942 ล้านดอลลาร์ภายในสองปีมาจากการที่โรงพยาบาลใช้ AI ช่วยทำรหัสการเบิกจ่าย ทำให้การวินิจฉัยซับซ้อนขึ้น แต่ไม่มีหลักฐานว่าการรักษาเปลี่ยนไป ฝ่ายประกันเรียกปรากฏการณ์นี้ว่า “บอตสู้กับบอต”
Cloudflare คุมบอต. Cloudflare ระบุว่าปัจจุบันบอตคิดเป็นสัดส่วนเกินครึ่งของทราฟฟิกอินเทอร์เน็ต และแพลตฟอร์มของบริษัทให้เจ้าของเว็บเลือกบล็อก อนุญาต หรือเก็บเงินจากเอเจนต์ AI ได้ ในการให้สัมภาษณ์ ซีอีโอ แมทธิว พรินซ์ อธิบายว่า Cloudflare ยืนอยู่ตรงกลางระหว่างเว็บไซต์กับเอเจนต์ AI อย่างไร
อวตาร AI โต้ตอบได้. Synthesia สร้างอวตารดิจิทัลแบบโต้ตอบได้จากหัวหน้าฝ่ายกิจการองค์กรของตัวเอง เพื่อให้ตอบคำถามสื่อมวลชน และผู้เขียนข่าวก็สร้างอวตารของตัวเองขึ้นมาเช่นกัน บริษัทซึ่งมีมูลค่า 4 พันล้านดอลลาร์ให้บริการอวตาร AI สำหรับการฝึกอบรมพนักงานและเซสชันสวมบทบาทในองค์กร
ยูเครนสร้างกองทัพหุ่นยนต์. มิไคลโล เฟโดรอฟ อดีตรัฐมนตรีกลาโหมยูเครน ประกาศความเคลื่อนไหวจากภาคเอกชนเพื่อผลักดันการใช้หุ่นยนต์ในสนามรบเต็มรูปแบบ โดยชี้ว่าโดรนคิดเป็นสัดส่วนกว่า 95% ของการโจมตีเป้าหมาย โครงการนี้จะลงทุนในบริษัทเทคโนโลยีป้องกันประเทศ และเปิดโครงการของตัวเอง
ROI ของ AI ยังไม่มาก. ในการสำรวจจากคำบอกเล่า ผู้บริหารไอทีสองในสามรายบอกว่ามีผลลัพธ์จาก AI ที่วัดได้ แต่แทบไม่มีรายใดได้ผลมากพอจะรบกวนวันหยุดของซีอีโอ สะท้อนคำถามที่ยังก้ำกึ่งว่าผลตอบแทนจาก AI คุ้มกับการลงทุนโครงสร้างพื้นฐานต่อหรือไม่
งานวิจัยและเบนช์มาร์ก
งานศึกษาการพึ่ง AI เกินไป. การทดลอง 5 ชุดพบว่า เมื่อผู้ร่วมทดลองเข้าถึงโมเดลภาษาที่ตอบผิดเสียเป็นส่วนใหญ่ พวกเขาแทบไม่ยอมพูดว่า “ไม่รู้” อีกต่อไป แต่เลือกเชื่อคำตอบของ AI แทน ผลนี้ยังเกิดขึ้นแม้คำแนะนำของ AI จะผิดบ่อยครั้ง
GPT-6 Astra พุ่งในงานภาพ. GPT-6 Astra ของ OpenAI ทำคะแนนได้ 80% ใน Furniture Assembly Benchmark ของ Epoch AI เพิ่มจาก 28% ของโมเดลที่ดีที่สุดเมื่อสิบเดือนก่อน โดยดูจากภาพแล้วชี้จุดประกอบเฟอร์นิเจอร์ IKEA ที่ผิดพลาดได้ ยังช้าเกินกว่าจะช่วยแบบเรียลไทม์ แต่แสดงให้เห็นความก้าวหน้าเร็วในด้านการให้เหตุผลเชิงภาพ
Julia-1 โมเดลจำแนกในเครื่อง. SupersonicLabs เปิดตัว Julia-1 encoder หลายภาษาขนาด 144M พารามิเตอร์ ที่เลือกคำตอบให้คำถามได้ และรันบน CPU ตั้งเป้าไว้สำหรับงานตัดสินใจขนาดเล็ก เป็นผลงานชิ้นแรกจากงานวิจัยเรื่องโมเดลที่จำแนก จัดอันดับ และตอบใช่/ไม่ใช่ เมื่อตัวเลือกเปลี่ยนไป
AI โลคอลและโมเดล
Splash 1.1.0. Splash 1.1.0 เพิ่ม GGUF quants และการนำเข้า MLX ผสมผสานเคอร์เนลที่ปรับแต่งแล้ว, speculative decoding และ prefix cache ให้ inference เร็วบน Apple Silicon มีผู้ใช้รายงานว่าได้ 50 t/s กับ Qwen3.8 27B บน M5 Pro
Overspill เทียร์บนดิสก์. Overspill ซึ่งเป็นเทียร์บนดิสก์ของ FreeToken รันโมเดล MoE อย่าง DeepSeek-V4-Flash ขนาด 85GB ได้ราว 3 tok/s บน RTX 3060 การ์ด 12GB พร้อมแรม 64GB แซง llama.cpp และ Colibri ในการทดสอบที่มีรายงานออกมา โครงการนี้ยังอยู่ในขั้นทดลอง และได้แรงบันดาลใจจาก Colibri
TensorSharp รองรับ Qwen-Image. TensorSharp รัน Qwen-Image 2.1 ในเครื่องได้แล้วทั้งงานสร้างภาพจากข้อความและงานแก้ไขภาพ รวมถึง LoRA adapter พร้อมสูตร sampling แบบเร่งความเร็ว รองรับทั้ง LoRA สไตล์ทั่วไปและ LoRA สำหรับแก้ไขภาพ
นี่คือทั้งหมดสำหรับวันนี้ - อ่านประมาณ 5 นาที