การเปิดตัวโมเดลและโครงสร้างพื้นฐาน
โมเดลที่เน้นความเร็วของ Nvidia. Nvidia เปิดตัว Nemotron 3.5 Lightning โมเดล Mamba-Transformer ขนาด 30B แบบ open-weight ที่เทียบเท่า GPT-OSS-120B ใน benchmark ขณะที่ถูกปรับให้เหมาะสำหรับการ inference ที่รวดเร็วด้วย active parameters เพียง 3.6B
DeepSeek V4 ทำงานในเครื่องได้. ควอนท์ในชุมชนของ DeepSeek V4 แก้ไขปัญหาการแปลงสำหรับ baseline แบบ bit-exact และ DeepSeek V4 Flash ทำความเร็ว 27+ t/s บน Strix Halo APU ด้วย speculative decoding แสดงให้เห็นถึงการนำไปใช้งานในเครื่องที่เป็นไปได้
แอปเดสก์ท็อป Unsloth. Unsloth เปิดตัวแอปเดสก์ท็อปโอเพนซอร์สสำหรับรันและฝึกโมเดลในเครื่องบน GPU หลากหลายรุ่น โดยมีฟีเจอร์การรันโค้ดแบบ sandboxed, RAG, การส่งออกโมเดล และไม่มี telemetry
เงินทุน Seed มูลค่า $1.1B ของ River AI. River AI ก่อตั้งโดย Igor Babuschkin อดีตผู้ร่วมก่อตั้ง xAI ระดมทุนได้ $1.1B เพื่อสร้างผู้ช่วย AI ที่ฝึกได้เฉพาะบุคคล โดยคิดใหม่ทั้งสแตกตั้งแต่การฝึกจนถึงฮาร์ดแวร์
Daybreak Cyber บน AWS. โมเดลความมั่นคงทางไซเบอร์ Daybreak ของ OpenAI พร้อมใช้งานผ่าน Amazon Bedrock แล้ว ช่วยให้ผู้ป้องกันสามารถเข้าถึงความสามารถไซเบอร์ระดับแนวหน้าในสภาพแวดล้อม AWS ที่มีอยู่
แถลงการณ์โอเพนซอร์สของ Zuck. ซีอีโอของ Meta โต้แย้งให้มีการปล่อย open-weight มากขึ้น และเชิญรัฐบาลมาร่วมมือในการทดสอบความปลอดภัย ขณะที่บริษัทยังคงเผยแพร่โมเดลอย่าง Muse Glimmer
การสนับสนุน Ling-3.0. คำขอ pull ขอเพิ่ม Ling-3.0 เข้าไปใน llama.cpp โดยมี variant เล็ก ๆ ที่ทำงานได้ดีสำหรับงานเสียงของผู้ช่วยในบ้านแล้ว เนื่องจากมันปฏิเสธอย่างตรงไปตรงมาเมื่อไม่แน่ใจ
เครื่องมือและ AI ในเครื่อง
MCP Broker ลดบริบท. ชุดประกอบ agent แบบ DIY ใช้ MCP broker เพื่อซ่อนเครื่องมือไว้หลัง proxy ช่วยลดบริบทเริ่มต้นจาก 20K โทเคนเหลือเกือบศูนย์ และเพิ่มการรับรู้เชิงเวลาเพื่อการทำงานในเครื่องที่ดีขึ้น
GPU สำหรับขุดคริปโตมาใช้กับ LLM. การ์ดขุด CMP170HX ขนาด 8GB สามารถขยายได้ถึง 64GB ต่อใบ ใช้รันโมเดลใหญ่หรือโมเดลเล็กหลายตัวพร้อมกัน มอบประสิทธิภาพระดับ Ampere ที่ถูกแต่เก่า
366 t/s บน V100. เคอร์เนล CUDA แบบกำหนดเอง (v100-skinny) รองรับความเร็วสูงสุด 366 t/s สำหรับ Qwen3.6 27B ในรูปแบบ NVFP4 บน GPU Volta ช่วยให้ฮาร์ดแวร์เก่ากลับมามีชีวิตอีกครั้งสำหรับการ inference ในเครื่อง
โมเดล TinyTitle. โมเดล GRU ขนาด 1.8M พารามิเตอร์สร้างชื่อแชทในหน่วยความจำไม่ถึง 5 MiB แสดงให้เห็นการสรุปความบนอุปกรณ์ที่เบามากซึ่งทำงานในไม่กี่มิลลิวินาที
AI ในเครื่องสำหรับอีรีดเดอร์ส่วนตัว. แอปอีรีดเดอร์ผสานรวมโมเดล Gemma 4B ในเครื่องเพื่อถาม-ตอบเกี่ยวกับหนังสือแบบส่วนตัวภายในแอป พร้อมสลับการเปิดเผยเนื้อเรื่องและการจับคู่ภาษาอัตโนมัติ
เซิร์ฟเวอร์ AI ที่ใช้พลังงานต่ำ. การประกอบที่ผสาน Intel N100 กับ RTX 5060Ti ให้เซิร์ฟเวอร์ llama.cpp ที่เงียบและมีประสิทธิภาพ สามารถรันโมเดลล่าสุดอย่าง Qwen 3.5 สำหรับการใช้งานประจำวัน
ลดต้นทุน Inference ลงมาก. ซีอีโอของ Doubleword อธิบายว่าการออกแบบสแตก inference สำหรับการใช้งานแบบไม่เรียลไทม์สามารถลดต้นทุนโทเคนได้มากกว่าหนึ่งลำดับความสำคัญเมื่อเทียบกับการตั้งค่าทั่วไป
การจัดเส้นทางโมเดลอัจฉริยะ. ไลบรารี Switchyard ของ NVIDIA จัดเส้นทางเพียง 7% ของการเรียก agent ไปยังโมเดลระดับแนวหน้า ลดต้นทุนได้ 74% โดยสูญเสียความแม่นยำเล็กน้อย และมีสูตรสำหรับประเมินความคุ้มค่า
แว่นตา AR ส่วนตัว. ผู้ใช้ตาบอดขอแว่นตา AR แบบ Meta ที่รันโมเดลในเครื่องเพื่อหลีกเลี่ยงการส่งข้อมูลภาพไปยัง Meta ชี้ให้เห็นถึงความต้องการความเป็นส่วนตัวในเทคโนโลยีช่วยเหลือ
งานวิจัยแนวหน้า
AI รับมือปัญหา Riemann. โมเดล Anthropic ที่ยังไม่ได้เผยแพร่มีความคืบหน้าในสมมติฐานรีมันน์โดยทดสอบ 650 ไอเดียกับ subagent 60 ตัวในระยะเวลา 36 ชั่วโมง ปลุกการถกเถียงเรื่องบทบาทของ AI ในการค้นพบทางคณิตศาสตร์อีกครั้ง
การวินิจฉัยผ่านวิดีโอของ AMIE. ระบบวิจัย AMIE ของ Google สาธิตการปรึกษาทางคลินิกผ่านวิดีโอระดับผู้เชี่ยวชาญ โดยใช้ Gemini และการตั้งค่าแบบ multi-agent เพื่อตีความสัญญาณภาพ เสียง และบริบท
CARE-X AI สำหรับเอกซเรย์ทรวงอก. CARE-X ของ Microsoft เป็น VLM สำหรับเอกซเรย์ทรวงอกแบบรวมศูนย์ที่ผสานการสร้างและการทำนายเชิงโครงสร้าง โดยใช้การเรียนรู้แบบเสริมกำลังเพื่อให้รางวัลกับความถูกต้องทางคลินิก
การประลองความทรงจำแบบ Agentic. ทั้ง ACE และ ALTK-Evolve เปลี่ยนเส้นทางของ agent ให้เป็นบทเรียนที่นำกลับมาใช้ใหม่ได้ โดย ACE สร้างคู่มือที่ครอบคลุม ขณะที่ ALTK-Evolve ดึงแนวทางเฉพาะรายบุคคล
Logprobs ตรวจจับภาพหลอน. การวิเคราะห์การกระจายความน่าจะเป็นของโทเคน ณ จุดที่เรียกคืนข้อเท็จจริงครั้งแรกใน chain-of-thought อาจเผยให้เห็นความรู้ที่ไม่น่าเชื่อถือ ซึ่งเป็นสัญญาณเตือนเบื้องต้นของภาพหลอน
คำเตือนเกี่ยวกับการเขียนด้วย AI. S. Alpert โต้แย้งว่าไม่มีการเขียนใหม่ใดที่ไร้การสูญเสีย ดังนั้นข้อความที่ใช้ AI ช่วยจึงต้องได้รับการตรวจสอบด้วยตนเองเพื่อหลีกเลี่ยงการบิดเบือนความหมายที่ผู้เขียนตั้งใจ
ธุรกิจและการเงิน
ผู้ใช้ถึง 1 พันล้านคน. ChatGPT และ Gemini ต่างมีผู้ใช้รายเดือนถึง 1 พันล้านคน โดย Gemini เป็นผลิตภัณฑ์ที่เติบโตเร็วที่สุดของ Google ถึงขนาดนั้น ส่วน ChatGPT เคยมีผู้ใช้รายสัปดาห์ 900 ล้านคนในช่วงต้นปีนี้
โฆษณา ChatGPT ขยายสู่ทั่วโลก. OpenAI ขยายโฆษณา ChatGPT ไปอีกห้าประเทศ รายงานว่าไม่มีผลกระทบต่อความเชื่อมั่นของผู้ใช้และอัตราการปิดโฆษณาต่ำ ขณะที่แสวงหาการสร้างรายได้อย่างยั่งยืน
OpenAI ขึ้นราคา. ที่นั่ง ChatGPT Business Premium ใหม่มีค่าใช้จ่าย $125/ผู้ใช้/เดือน พร้อมความจุห้าเท่าและไม่มีขีดจำกัดรายชั่วโมง สะท้อนถึงการใช้โทเคนจำนวนมากของปริมาณงานแบบ agentic
Lightcap ลาออก. Brad Lightcap อดีต COO และหัวหน้าโครงการพิเศษของ OpenAI กำลังลาออกหลังจากแปดปีเพื่อเริ่มต้นสิ่งใหม่ ต่อเนื่องกับซีรีส์การออกของผู้บริหาร
สัญญาเช่ามูลค่า $9.1B ของ Anthropic. Anthropic เซ็นสัญญาเช่าดาต้าเซ็นเตอร์มูลค่า $9.1B เป็นเวลา 20 ปี กับ Riot Platforms นักขุด Bitcoin สำหรับกำลังไฟฟ้า 191 MW ในเท็กซัส เพื่อรองรับโมเดลรุ่นถัดไปเริ่มในปี 2027
อุปสรรคก่อน IPO ของ Anthropic. ก่อนการเสนอขายหุ้น IPO ที่อาจมีมูลค่า $965B นักลงทุนตั้งคำถามเกี่ยวกับการเติบโตของ Anthropic ท่ามกลางโมเดลจีนราคาถูกและแรงเสียดทานทางการเมือง แม้บริษัทจะโปรโมทแอปสุขภาพและชีววิทยาในอนาคต
การผลักดัน $500B ของ Nvidia. Nvidia ร่วมมือกับบริษัทการเงินหกแห่งเพื่อระดมทุน $500B สำหรับโครงสร้างพื้นฐาน AI โดยรับประกันมูลค่าคงเหลือของชิปได้ถึง 25% เพื่อตอบโต้ความกังวลเรื่องค่าเสื่อมราคา
การเดิมพัน AI ในอินเดียของ Accel. Accel ปิดกองทุนอินเดียมูลค่า $550M ที่มีผู้จองเกินจำนวน โดยเดิมพันว่า AI จะเป็นรากฐานของสตาร์ทอัพด้านผู้บริโภค ฟินเทค และการผลิต มากกว่าจะเป็นหมวดหมู่เดี่ยว ๆ
การแลกหุ้นเป็นเงินของพนักงาน OpenAI. การซื้อหุ้นคืนมูลค่า $7B ที่มูลค่าบริษัท $852B ช่วยให้พนักงานปัจจุบันและอดีตของ OpenAI เปลี่ยนหุ้นเป็นเงินสด ลดแรงกดดันก่อนการ IPO ที่อาจเกิดขึ้น
ความมั่นคงและความโปร่งใส
EU บังคับลายน้ำ AI. ภายใต้กฎหมาย AI ของ EU Anthropic และ OpenAI ให้คำมั่นในการทำเครื่องหมายเนื้อหาที่สร้างขึ้น โดย Claude จะฝังลายน้ำที่มองไม่เห็นในข้อความและรูปภาพ พร้อมการสนับสนุนโมเดลรุ่นเก่าที่กำลังดำเนินการ
ที่มาของรูปภาพ Apple. iOS 27 อาจเปิดตัว 'Apple Reference Image' เพื่อฝังเมตาดาต้าที่มาของภาพ ณ เวลาที่ถ่าย ทำให้ผู้ใช้พิสูจน์ได้ว่ารูปจาก iPhone ไม่ใช่ดีพเฟก
Spotify ระบุศิลปิน AI. Spotify จะติดป้ายโปรไฟล์ศิลปินที่สร้างโดย AI และแยกพวกเขาออกจากคำแนะนำ โดยใช้ทั้งการเปิดเผยตนเองและการตรวจจับ ก่อนจะเริ่มการเปลี่ยนแปลงในกลางเดือนกันยายน
ข้อพิพาทการเขียนด้วย AI. สตูดิโอเกม Saber ปฏิเสธว่าไม่ได้แทนที่นักเขียนด้วย ChatGPT สำหรับ Rideshare Stimulator แต่อดีตหัวหน้านักเขียนอ้างว่า AI ถูกใช้สำหรับการเขียนและเสียง โดยไม่มีการเปิดเผยบน Steam
การโจมตี Zoom ด้วย AI. พบช่องโหว่ร้ายแรงใน Zoom ที่ทำให้ยึดอุปกรณ์ผ่านฟีเจอร์คำอธิบายประกอบ โดยใช้พรอมต์น้อยกว่า 20 ครั้งกับโมเดล AI สาธารณะ แสดงให้เห็นงานวิจัยด้านความปลอดภัยที่เร่งด้วย AI
การขโมยร่องรอยการใช้เหตุผล. นักวิจัยเล่นซ้ำโทเคน chain-of-thought ที่เข้ารหัสจากโมเดลแนวหน้าไปยังโมเดลย่อยที่อ่อนแอกว่า ปลดล็อก และกู้ร่องรอยการใช้เหตุผลที่ซ่อนอยู่ เผยรหัสผ่านและคีย์ API ในเซสชันสาธารณะ
การเชื่อถือโค้ดที่สร้างโดย AI. IBM และ Red Hat ขยาย Lightwell เพื่อสร้างห่วงโซ่อุปทานซอฟต์แวร์ที่ตรวจสอบได้สำหรับยุค AI เพื่อให้แน่ใจว่ามีที่มาและการปฏิบัติตามนโยบายสำหรับโค้ดที่สร้างโดยมนุษย์และ AI
นี่คือทั้งหมดสำหรับวันนี้ - อ่านประมาณ 5 นาที