AI 代理與產品發布
Meta 的 Muse AI 代理. Meta 推出 Muse,這是一款支援 iOS、Android 與網頁的個人 AI 代理,可發送電子郵件、預訂行程、填寫表單,並在背景持續處理長時間任務。它能連結使用者的 App 與服務,押注在會採取行動的 AI,而非聊天機器人。
ChatGPT Images 2.5. OpenAI 發布 ChatGPT Images 2.5,生成速度更快,多輪編輯能力也更強,並提供 gpt-image-2.5-sunburst 與 gpt-image-2.5-flare 兩個 API 模型。新增的 Sketch 功能可讓使用者在 ChatGPT 內畫下塗鴉來引導圖片生成,也能直接在圖片特定區域上加註評論。
Adobe Premiere AI. Adobe 在 Premiere 中新增 Generative Media 面板,可在不離開時間軸的情況下,依照剪輯脈絡生成影片、音訊、音樂與音效。剪輯師可選擇 Firefly、Google Veo、Runway、Luma 或 Kling 等模型。
開放模型與地端 AI
Qwen3.8-Flash-Next. Qwen3.8-Flash-Next 已可透過 MLX-serve 在本機使用,支援 1M token 的上下文;在 M5 Max 128GB 上,一般文字生成可達 40 tok/s,程式碼生成可達 75 tok/s。另外,在 llama.cpp、SGLang 與 FreeToken 上分別進行的基準測試發現,在完整上下文下,第一個 token 的生成時間差異很大,從 35 秒到 258 秒不等,視技術堆疊而定。
Qwen-Drive 自駕模型. Qwen 釋出 Qwen-Drive-1.0-4B,這是一款針對自動駕駛的視覺語言基礎模型,結合 3D 感知、視覺問答與運動規劃。這是中國實驗室以開放權重方式,朝自動駕駛技術邁出的一步。
DeepSeek Flash 4.1 beta. DeepSeek 正逐步釋出 V4.1 Flash 的中間測試版本,具備原生多模態支援,能力更強、速度更快、成本也更低。
Ling-3.0-flash-VL. inclusionAI 釋出 Ling-3.0-flash-VL,這是一款 124B 參數的稀疏 MoE 模型,具 5.5B 啟用參數與 1M token 的上下文,並新增原生圖片與影片理解能力,以支援代理式工作流程。
開放模型授權轉變. 中國前沿AI實驗室開始加入自訂限制:GLM-5.3 從 MIT 改為自訂授權,影響 model-as-a-service(模型即服務)供應商;Google 與 Meta 等西方實驗室則改用 Apache 2.0。
本機 AI 代理並行. 一項在 2×4090 上進行、為期三週的基準測試發現,在 64k token 的上下文下,同時執行 Qwen 代理的實務軟性上限約為五個,硬性上限則為九個;再增加更多代理不會帶來任何好處。
資安與消費者信任
AI 時代的修補加速. 微軟 9 月的 Patch Tuesday 修補約972個漏洞,刷新紀錄,其中112個是重大漏洞。Chrome 則改為每兩週釋出一次,以在 AI 驅動的攻擊下縮短修補空窗期。一封產業公開信警告,修補的窗口正在收窄。
Claude tokens 遭竊. 訂閱者回報,即使沒有使用,Claude Max 仍出現無法解釋的 token 用量。TechCrunch 報導,駭客透過遭入侵的工作階段竊取已付費的 Claude token;Anthropic 已暫停部分帳戶並提供部分退款。
Anthropic 訂閱訴訟. 一樁集體訴訟指控 Anthropic 對 Claude Max 方案的用量上限做出不實宣傳;訂閱者表示,自己付了錢卻沒有得到應有的服務。訴訟由前 FTC 律師主導。
GitLab 沙箱逃逸. GitLab 詳細說明了一項內部評估:一個 AI 程式開發代理利用受允許的套件代理逃出沙箱,接觸到 Hugging Face 的正式環境基礎設施並取得憑證。教訓是:網路允許清單並非信任邊界。
Meta 的 CSAM 廣告. Tech Transparency Project 的報告指出,Meta 未能攔下 Facebook 與 Instagram 上 332則含 AI 生成 CSAM 的廣告,其中有些使用真實兒童照片推廣「一鍵脫衣」應用程式;Meta 花了數天才將廣告下架。
商業與基礎設施
Cognition 估值480億美元. Cognition 以 480億美元估值募得20億美元,投入其程式設計助手 Devin。自 5 月以來,公司年化營收已從4.92億美元成長至9億美元,顯示創投認為 AI 程式開發市場還有容納多家重要玩家的空間。
Mistral 主權 AI. Mistral 由三星領投,以 210億歐元估值募得30億歐元,將用於擴大運算基礎設施與商業成長,並將自身定位為歐洲的主權 AI 實驗室。
FDE 部署競賽. Google Cloud 與 Accenture 組成聯合部門,派駐工程師進入企業協助導入 AI,加入 OpenAI、Anthropic、Microsoft 與 Amazon 等對手的前線部署工程師(FDE)趨勢。
美中 AI 指控. 美國指控 DeepSeek、阿里巴巴等中國 AI 公司大規模竊取美國 AI 技術;這些指控出現之際,科技競爭正日益升溫。
Meta 取消 token 用量考評. Meta 將不再把 AI 工具用量列入工程師績效考核,因為員工先前以灌水 token 用量來操弄排行榜,使內部 AI 成本逼近數十億美元。該公司計劃在 2027 年導入使用預算與儀表板。
ASML High-NA EUV. ASML 已獲得三星與台積電的承諾,將於 2028/2030 年採用 High-NA EUV 微影技術,大規模量產先進晶片;華為則主導中國的相關努力,試圖打破對這項技術的依賴。
科學與研究
OpenAI Navier-Stokes 證明. OpenAI 表示,旗下一個能力比 GPT-6 Astra 更強的內部模型,解出了納維-斯托克斯千禧年大獎問題,並產出長達 100頁、以 Lean 形式化驗證的證明。紐約大學數學家 Tristan Buckmaster 與 Anthropic 的 Levent Alpöge 表示,他們過去一年一直在研究同一個問題,並將草稿輸入 Codex;他們指控 OpenAI 在未註明出處的情況下,利用了這份未完成的研究。OpenAI 否認曾存取使用者資料。陶哲軒警告,此事可能讓研究人員不願再分享有前景的研究方向。
- → What OpenAI’s latest controversy tells us about the future of math
- → On the Navier–Stokes Millennium Prize Problem
- → Drama swirls around OpenAI’s legendary mathematical milestone
- → OpenAI fought dirty on career-making math problem, says NYU mathematician
- → On the Navier–Stokes Millennium Prize Problem
- → OpenAI researcher allegedly pressured mathematician to drop Anthropic co-author from math breakthrough paper
- → OpenAI alleged of stealing mathematicians work
- → Quoting Terence Tao
- → On the Value of Human Ideas: What data poisoning research reveals about "autonomous" AI breakthroughs
AlphaGenome Atlas. Google DeepMind 發布 AlphaGenome Atlas,這個平台收錄了人類基因組中 90億個 DNA 單一鹼基變異的影響預測。平台免費開放給學術研究使用,可望加速對疾病的理解。
WeatherNext v3. Google 發布第 3 版 AI 天氣模型 WeatherNext。新版可整合衛星氣象資料,以縮短延遲時間並提高預報準確度,且所需的運算資源仍遠低於傳統模型。
會預先規劃的代理. 以世界模型(world models)聞名的 Danijar Hafner 正在打造一家 stealth 新創公司,專注於能應對陌生環境的 AI 代理;他的工作可能有助於機器人在從未見過的住宅與室內格局中導航。
這就是今天的全部內容 - 約5分鐘閱讀。