模型與代理發布
Grok 4.6 與 Grok Bot. SpaceXAI 發布了 Grok 4.6,它在 Artificial Analysis 指數上與 OpenAI 的 GPT-5.6 Sol 持平,僅次於 Claude Opus 5,同時價格低於前沿模型,並推出了 Grok Bot,一個永遠在線的 AI 夥伴,從自己的雲端電腦執行指派任務。
Qwen 3.8 大與小. Qwen3.8-2.4T-A95B 現已推出,而 27B 的 Qwen3.8 頁面在 ModelScope 上短暫出現後被撤下,顯示近期可能會發布。本地運行愛好者已經在為 2.4T 模型規劃硬體分割方案。
DeepSeek V4 Pro 更新. DeepSeek 的 V4 Pro 0813 現已透過 OpenRouter 上的 API 提供,尚未有官方公告頁面;考量到先前的發布,開放權重的可能性很高。其推理行為在低、中、高三種推理層級間有顯著差異。
邊緣視覺模型. Liquid AI 的 LFM2.5-VL-3B 帶來了更強的 UI 基礎能力,且可在手機上運行,而 Cohere 的 Apache-2.0 North Micro Vision 則在緊湊的 2.4B 參數套件中提供原生解析度影像支援。
Nvidia 的兆參數模型. 據報導,Nvidia 正在打造至少一兆參數的 Nemotron 4,並將雲端訓練支出增至三倍,到 2031 年達到 280 億美元,旨在與中國的開放權重模型競爭。
代理開發與工具
受管代理與 BYOC. LangChain 推出了 Managed Deep Agents,作為框架之後的下一步,並將 LangSmith BYOC 在 AWS 上全面推出,讓企業能將代理軌跡和資料保留在自己的 VPC 內。
ChatGPT 應用程式登陸 Linux. OpenAI 發布了 Linux 桌面應用程式,整合 ChatGPT、ChatGPT Work 和 Codex,但發布時尚未提供原生電腦使用功能。
本地推論與硬體
RTX PRO 6000 價格翻倍. Nvidia 將 96GB RTX PRO 6000 Blackwell 的建議零售價近乎翻倍至 16,000 美元,而去年預購價格低於 8,000 美元。
DSpark 在單一 GPU 上串流. 單張 RTX PRO 6000 96GB 搭配 DSpark 的草稿模型,在系統 RAM 中能以每秒約 31 個 token 的速度執行 DeepSeek V4 Flash 284B,在相同 VRAM 使用量下,比沒有草稿模型的基準快約 15-17%。
Muse Glimmer 在 Mac 上. Meta 的 Muse Glimmer 30B 現在透過 mlx-dspark 在 Apple Silicon 上執行速度最高可提升約 3.3 倍,在 48GB Mac 上以接近 4-bit 的速度提供 8-bit 品質。
Gemma 4 KV 快取量化. 量化感知訓練有助於 Gemma 4 31B 在激進的 KV 快取量化下保持品質,使大型上下文推論更加實用。
產業與商業
Cognition 以 400 億美元估值融資. 據報導,AI 編碼代理公司 Cognition 正洽談以 400 億美元估值進行融資,此前其年化營收運行率已達 10 億美元,高於三個月前的 4.92 億美元。
Lovable 達到 133 億美元. Vibe-coding 新創公司 Lovable 在年化營收超過 5 億美元後,以 133 億美元估值籌集了 4 億美元,託管專案達 6,000 萬個。
Thrive Holdings 企業 AI. OpenAI 支持的 Thrive Holdings 以 120 億美元估值籌集了 20 億美元,用於收購傳統企業並導入 AI,擴展至會計和 IT 以外的領域。
Gemini 市占率下滑. 來自 Pangram、OpenRouter 和 Similarweb 的市場數據顯示 Gemini 的使用量在下降,其中 Pangram 記錄到 AI 寫作占比降至 1.9%,而 OpenAI 仍佔據超過 50%。
Claude 進軍法律領域. Anthropic 聘請法律 AI 創辦人 Robert Mahari 擔任首位 Claude 法律領域負責人,此舉奠基於先前的法律外掛與合作關係。
政策、安全與社會
LiteLLM 供應鏈洩漏. 針對 LiteLLM 的供應鏈攻擊,透過惡意的 PyPI 套件,暴露了來自超過 2,500 個組織(包括 Microsoft、Amazon 和 Samsung)的數 TB 憑證。
Claude 輸出浮水印. Anthropic 現在為 Claude 的輸出加上浮水印,以符合歐盟 AI 法案,這讓擔心在職場或學校會暴露 AI 使用情況的使用者感到不滿。
Twitch 預設使用內容進行訓練. Twitch 將預設使用串流內容來訓練 Amazon AI 模型,現在提供退出選項;這項政策引發了反彈。
ShieldFont 替換文字. 設計師發布了 ShieldFont,這是一款對使用者顯示正常文字、但在底層 HTML 中替換詞語以干擾抓取器的字型。
Hinton、Li、Ng 談開放 AI. 在 Ai4 上,Geoffrey Hinton、Fei-Fei Li 和 Andrew Ng 主張保持 AI 開放,以避免少數公司控制存取,儘管對開放權重存在安全疑慮。
珍稀書籍遭毀. 書商擔心 AI 公司購買珍稀書籍並將其銷毀用於訓練,儘管存在非破壞性的掃描替代方案。
研究與基準
MindTopo 拓撲推理. 微軟研究院的 MindTopo 基準顯示,多模態模型擅長靜態拓撲識別,但在需要隨時間維持關係的互動規劃方面表現不佳。
從輸出重建提示. IIT Bombay 和 Adobe Research 開發了 Previous-Token Prediction,可以在沒有模型權重的情況下,以近乎完美的準確度從輸出文字重建 LLM 提示。
這就是今天的全部內容 - 約5分鐘閱讀。