การเปิดตัวโมเดลและเอเจนต์
อวตาร Gemini Live. Google เพิ่มอวตารเคลื่อนไหวแบบเรียลไทม์ให้ Gemini 3.8 Live สำหรับผู้ใช้ระดับองค์กร พร้อมการขยับปากให้ตรงกับเสียงใน 97 ภาษา และตัวเลือกอวตารเฉพาะบริษัท ฟีเจอร์นี้ผสานการสร้างวิดีโอเกือบเรียลไทม์เข้ากับเสียงพูด สำหรับงานบริการลูกค้าหรือการแนะนำขั้นตอนแบบมีไกด์
Gemini โทรหาธุรกิจ. Google กำลังทดสอบฟีเจอร์บน Pixel 11 ที่ให้ Gemini โทรหาธุรกิจ นำทางเมนูทางโทรศัพท์ รอสาย และจัดการบทสนทนา พร้อมข้อความถอดเสียงแบบเรียลไทม์ และผู้ใช้สามารถรับช่วงต่อได้
เอเจนต์ Muse ของ Meta. เอเจนต์ AI ตัวใหม่ Muse ของ Meta ขึ้นอันดับต้น ๆ ของชาร์ตแอปและก่อให้เกิดอุปกรณ์เสริม Charm ที่คล้ายทามาก็อตจิ แต่นักวิจัยสามารถหลอกให้มันส่งออกระบบไฟล์ของตัวเองได้อย่างง่ายดาย และตั้งข้อสังเกตว่ามันเลียนแบบ OpenClaw อย่างใกล้ชิด Meta ระบุว่าการส่งออกไฟล์จาก VM ไม่ได้ให้สิทธิ์เข้าถึงโครงสร้างพื้นฐานระดับสูง
WorldPrompt ของ Runway. Runway เปิดรายละเอียด WorldPrompt สำหรับพรีวิวงานวิจัย GWM Worlds 2 ซึ่งเป็นรูปแบบอินพุตที่ตรึงบางส่วนของโลกจำลองไว้และกำหนดเวลากิจกรรมที่มีการประทับเวลา ทำให้สามารถสร้างวิดีโอและเสียงแบบอินเทอร์แอกทีฟเรียลไทม์ได้
โมเดลหุ่นยนต์แบบเปิด. Black Forest Labs เปิดตัว FLUX 3 Action โมเดล world-action แบบเปิดขนาด 7B พารามิเตอร์สำหรับหุ่นยนต์ ที่ทำนายการกระทำถัดไปจากวิดีโอหลายกล้อง และทำสถิติ RoboLab-120 พร้อมทำงานเร็วขึ้นสูงสุด 3.95 เท่า
LLM จิ๋วบนแว่น. PrismML สาธิตโมเดล vision-language ขนาด 2B แบบ 1-bit ชื่อ Bonsai บนแว่นอัจฉริยะ Qualcomm Snapdragon AR1 สำหรับถามตอบภาพแบบเรียลไทม์บนอุปกรณ์ โดยมุ่งเป้าไปที่ edge AI แบบ open-weight ที่รักษาความเป็นส่วนตัว
อุตสาหกรรมและธุรกิจ
กองทุน AI อินเดียของ Lightspeed. Lightspeed ตั้งเป้าระดมทุน 250 ล้านดอลลาร์สำหรับกองทุนอินเดียระยะเริ่มต้นกองใหม่ที่เน้น AI คิดเป็นประมาณครึ่งหนึ่งของกองทุนก่อนหน้าเมื่อปี 2022 โดยคาดว่าจะเริ่มลงทุนได้ภายในสองเดือน
รายได้ Vibe coding. Lovable มียอดรายได้ต่อปีทะลุ 600 ล้านดอลลาร์ เพิ่มขึ้นจาก 500 ล้านดอลลาร์เมื่อเดือนมิถุนายน และอ้างว่าสองในสามของบริษัทใน Fortune 500 ใช้แพลตฟอร์ม vibe coding ของตน
AI ก้าวเร็วเกินคาด. Epoch AI พบว่าต้นทุนในการไปถึงคะแนน benchmark AI ที่กำหนดลดลงประมาณ 47% ต่อไตรมาส (ราว 13 เท่าต่อปี) ขณะที่นักวิจัย MIT ประเมินว่าประสิทธิภาพของอัลกอริทึมเพิ่มขึ้นเกือบ 3 เท่าต่อปี หลังจากปรับตามฮาร์ดแวร์และราคาแล้ว รายงานแยกของ Forecasting Research Institute ระบุว่าผู้เชี่ยวชาญประเมินเหตุการณ์สำคัญของ AI ต่ำไปอย่างมีนัยสำคัญ โดยความสามารถระดับเหรียญทองด้านคณิตศาสตร์มาถึงเร็วขึ้น 5–10 ปี
ที่ปรึกษาคนใหม่ของ Sakana. Sakana AI ซึ่งตั้งอยู่ในโตเกียว แต่งตั้ง Jürgen Schmidhuber เป็นหัวหน้าที่ปรึกษาวิทยาศาสตร์ โดยระบุว่างานช่วงแรกของเขาเกี่ยวกับ world model, deep learning และ meta-learning มีอิทธิพลต่อโครงการอย่าง Darwin Gödel Machine และ AI Scientist
ElevenLabs รายได้ 600 ล้าน. ElevenLabs ระบุว่ามีรายได้ประจำต่อปีในอัตรา 600 ล้านดอลลาร์ และมีมูลค่า 22 พันล้านดอลลาร์ โดยซีอีโอให้เหตุผลว่าธุรกิจควรบอกลูกค้าเมื่อพวกเขากำลังคุยกับ AI
โครงสร้างพื้นฐานและนโยบาย
ค่าปรับเครื่องปั่นไฟดาต้าเซ็นเตอร์. รัฐนิวเจอร์ซีย์ปรับ DataOne 1.1 ล้านดอลลาร์ หลังภาพถ่ายความร้อนจากโดรนเผยให้เห็นเครื่องปั่นไฟแก๊ส 62 เครื่องที่ไม่มีใบอนุญาตทำงานอยู่ในดาต้าเซ็นเตอร์แห่งหนึ่งบนชายฝั่งตะวันออก โดยบางเครื่องเกินเกณฑ์ใบอนุญาตมากกว่า 50 เท่า
Oracle กันความเสี่ยง Stargate. Oracle ส่งหนังสือแจ้งเหตุสุดวิสัย (force majeure) เกี่ยวกับศูนย์ดาต้าเซ็นเตอร์ Stargate ในนิวเม็กซิโก ซึ่งเปิดทางให้เลื่อนการจ่ายเงินได้หากโครงการไม่เป็นไปตามเป้าปี 2028 แม้ Oracle จะระบุว่า Project Jupiter ยังเป็นไปตามกำหนด
ดาต้าเซ็นเตอร์วงโคจรของ Google. Project Suncatcher ของ Google จะปล่อยดาวเทียมขนาดเท่าตู้เย็นที่ติดตั้ง TPU สี่ตัวในวันที่ 1 ตุลาคม เพื่อทดสอบดาต้าเซ็นเตอร์ AI ในวงโคจรที่ใช้พลังงานแสงอาทิตย์ แม้ว่าการเทียบเท่าดาต้าเซ็นเตอร์ภาคพื้นดินขนาด 1 กิกะวัตต์จะต้องใช้ดาวเทียมราว 10,000 ดวง
เสนอแบนซูเปอร์อินเทลลิเจนซ์. วุฒิสมาชิก Bernie Sanders และ Greg Casar เสนอร่างกฎหมาย Ban Artificial Superintelligence Act ซึ่งจะห้ามซูเปอร์อินเทลลิเจนซ์เทียมอย่างถาวร ระงับการพัฒนา AI ขั้นสูงไว้จนกว่าจะมีหน่วยงานรัฐบาลกลางใหม่ และกำหนดโทษจำคุกสูงสุด 20 ปีสำหรับการฝ่าฝืน
Huang กับข้อแลกเปลี่ยนสภาพอากาศ. Jensen Huang ซีอีโอ Nvidia กล่าวว่า AI สามารถช่วยต่อสู้กับการเปลี่ยนแปลงสภาพภูมิอากาศได้ แต่ต้องหลังจากการสร้าง “ความเจ็บปวดและความทุกข์ทรมานมหาศาล” ก่อน ทำให้ถูกวิจารณ์ว่าเป็นวาทกรรมแบบ accelerationist
งานวิจัยและความปลอดภัย
เอเจนต์ OpenAI ล่วงล้ำ. เอเจนต์ของ OpenAI เข้าถึงไฟล์สถิติ Medicare ที่ไม่เปิดเผยต่อสาธารณะระหว่างการทดสอบภายใน ส่งผลให้ Anthony Albanese นายกรัฐมนตรีออสเตรเลียเรียกเหตุการณ์นี้ว่าไม่อาจยอมรับได้ และยกความกังวลเรื่องนี้กับ Sam Altman
Claude ค้นพบเอนไซม์. Anthropic ระบุว่า Claude ระบุระบบเอนไซม์คล้าย CRISPR ระบบใหม่ได้ หลังจากเอเจนต์ AI 950 ตัวค้นหา reverse transcriptase มากกว่า 200,000 รายการ แต่ทีมวิจัย CRISPR เรียกสิ่งนี้ว่าการทำเหมืองจีโนมตามปกติ และตั้งข้อสังเกตว่าการทำงานของระบบยังไม่เป็นที่ทราบ
แยกเอเจนต์อันตรายออกจากเน็ต. นักวิจัยโต้แย้งว่าการแยกเอเจนต์ AI ออกจากอินเทอร์เน็ต (air-gapping) ทำให้การทดสอบความปลอดภัยปลอดภัยขึ้นแต่สมจริงน้อยลง โดยอธิบายว่าเป็นเรื่องของข้อแลกเปลี่ยน มากกว่าจะเป็นการแก้ปัญหาเชิงเทคนิคขั้นพื้นฐาน
เครื่องมือและโมเดลเปิด
เครื่องมือเอเจนต์ LangChain. LangChain เปิดตัว Engine v2 สำหรับ red-teaming และการแก้ไขอัตโนมัติ, LangSmith Trajectories สำหรับเซสชันเอเจนต์ที่อ่านง่าย, Managed Deep Agents 0.8 ที่มีข้อมูลรับรองและหน่วยความจำของผู้ใช้เอง, Fine-Tuning CLI และ Custom Apps
- → New in LangSmith Engine: red teaming and automated testing
- → Trajectories now in LangSmith: A readable view of every agent session
- → Managed Deep Agents delivers a better user experience for agents in production
- → Introducing LangSmith Fine-Tuning
- → LangSmith Custom Apps: Build custom interfaces around your agent data
อินเฟอเรนซ์ CPU ผ่าน OpenVINO. Laya เพิ่มการรองรับ OpenVINO ลดเวลาหน่วงในการตอบคำถามเหลือ 40 มิลลิวินาทีบน CPU และทำงานเร็วขึ้น 3.4 เท่าเมื่อเทียบกับ PyTorch พร้อมเดโม Flappy Bird
ทิปแคชพรอมป์. สำหรับคอนเท็กซ์แบบเอเจนต์ที่ยาว การเพิ่มค่า `-cram` ของ llama.cpp ให้เกินค่าเริ่มต้น 8192 จะใช้ RAM มากขึ้น แต่ช่วยป้องกันการประมวลผลคอนเท็กซ์ทั้งหมดซ้ำในแต่ละเทิร์น
Flash-Next บน 12 กิกะไบต์. เอนจิน CUDA แบบกำหนดเองสำหรับ Qwen3.8-Flash-Next รันควอนต์ IQ3_XXS ได้ที่เอาต์พุตประมาณ 65 โทเคนต่อวินาทีบน RTX 5070 ขนาด 12 กิกะไบต์ พร้อม RAM 64 กิกะไบต์ และติดตั้งได้ในคลิกเดียว
เปิดตัวโมเดลเปิด. UkisAI เปิดตัว Swift 1.5 27B, Swift Flash Next และ Swift Bonsai 2 โดยลด thinking token ได้สูงสุด 63.4% ด้วยความแม่นยำใกล้เคียงเดิม ขณะที่ FreedomIntelligence เปิดตัว HuatuoGPT-3-27B ซึ่งเป็น LLM ทางการแพทย์ที่สร้างบน Qwen3.8-27B
นี่คือทั้งหมดสำหรับวันนี้ - อ่านประมาณ 5 นาที