模型与智能体发布
Grok 4.6 与 Grok Bot. SpaceXAI 发布了 Grok 4.6,它在 Artificial Analysis 指数上与 OpenAI 的 GPT-5.6 Sol 持平,仅次于 Claude Opus 5,同时低于前沿模型价格;还推出了 Grok Bot,一个常驻 AI 队友,可从自己的云计算机上工作以完成分配的任务。
Qwen 3.8 大模型与小模型. Qwen3.8-2.4T-A95B 现已可用,一个 27B 的 Qwen3.8 页面在 ModelScope 上短暂出现后被撤下,表明即将发布。本地运行爱好者已经在为 2.4T 模型规划硬件拆分。
DeepSeek V4 Pro 更新. DeepSeek 的 V4 Pro 0813 已通过 API 在 OpenRouter 上提供,目前还没有官方公告页面;鉴于之前的发布,开放权重很有可能。其推理行为在低、中、高推理级别上存在显著差异。
边缘视觉模型. Liquid AI 的 LFM2.5-VL-3B 带来了更强的 UI 接地能力,可在手机上运行;而 Cohere 的 Apache-2.0 North Micro Vision 以紧凑的 2.4B 参数包提供原生分辨率图像支持。
Nvidia 的万亿参数模型. 据报道,Nvidia 正在构建至少一万亿参数的 Nemotron 4,并将到 2031 年的云训练支出提高两倍至 280 亿美元,旨在与中国开放权重模型竞争。
智能体开发与工具
托管智能体与 BYOC. LangChain 推出了托管深度智能体,作为框架之后的下一步,并让 LangSmith BYOC 在 AWS 上全面可用,使企业能够将智能体追踪和数据保留在自己的 VPC 内部。
Linux 上的 ChatGPT 应用. OpenAI 发布了 Linux 桌面应用,捆绑了 ChatGPT、ChatGPT Work 和 Codex,但发布时原生计算机使用功能尚不可用。
本地推理与硬件
RTX PRO 6000 价格翻倍. Nvidia 将 96GB RTX PRO 6000 Blackwell 的建议零售价几乎翻倍至 16,000 美元,而去年的预购价格低于 8,000 美元。
单 GPU 上的 DSpark 流式推理. 单个 RTX PRO 6000 96GB 在系统 RAM 中使用 DSpark 的草稿模型,可以以约每秒 31 个 token 的速度运行 DeepSeek V4 Flash 284B,在匹配的 VRAM 使用情况下,比无草稿模型基线快约 15-17%。
Mac 上的 Muse Glimmer. Meta 的 Muse Glimmer 30B 现在在 Apple Silicon 上使用 mlx-dspark 运行速度最高可提升约 3.3 倍,在 48GB Mac 上以接近 4 位速度提供 8 位质量。
Gemma 4 KV 缓存量化. 量化感知训练帮助 Gemma 4 31B 在激进的 KV 缓存量化下保持质量,使大上下文推理更加实用。
行业与商业
Cognition 以 400 亿美元估值融资. 据报道,AI 编程智能体制造商 Cognition 正在洽谈以 400 亿美元估值融资,此前其年化收入运行率已达到 10 亿美元,高于三个月前的 4.92 亿美元。
Lovable 达到 133 亿美元估值. Vibe 编码初创公司 Lovable 在年化收入超过 5 亿美元后,以 133 亿美元估值筹集了 4 亿美元,托管项目达 6000 万个。
Thrive Holdings 企业 AI. OpenAI 支持的 Thrive Holdings 以 120 亿美元估值筹集了 20 亿美元,用于收购传统企业并实施 AI,扩展到会计和 IT 之外。
Gemini 份额下降. 来自 Pangram、OpenRouter 和 Similarweb 的市场数据显示 Gemini 使用量下降,Pangram 记录其占 AI 写作的比例降至 1.9%,而 OpenAI 持有超过 50%。
Claude 进军法律领域. Anthropic 聘请了法律 AI 创始人 Robert Mahari 担任其首位 Claude 法律负责人,以早期法律插件和合作伙伴关系为基础。
政策、安全与社会
LiteLLM 供应链泄露. 针对 LiteLLM 的供应链攻击通过恶意 PyPI 包暴露了来自超过 2,500 个组织的 TB 级凭据,包括 Microsoft、Amazon 和 Samsung。
Claude 输出水印. Anthropic 现在对 Claude 输出添加水印以符合欧盟 AI 法案,这令担心在工作或学校中暴露 AI 使用的用户感到不满。
Twitch 默认用于训练. Twitch 将默认使用主播内容训练 Amazon AI 模型,现在提供了退出选项;该政策引发了强烈反对。
ShieldFont 替换文本. 设计师发布了 ShieldFont,这种字体向用户显示正常文本,但在底层 HTML 中替换单词以毒化爬虫。
Hinton、Li、Ng 谈开放 AI. 在 Ai4 上,Geoffrey Hinton、Fei-Fei Li 和 Andrew Ng 主张保持 AI 开放,以避免少数公司控制访问,尽管存在对开放权重的安全担忧。
稀有书籍被毁. 书商担心 AI 公司购买稀有书籍并将其销毁用于训练,尽管存在非破坏性扫描替代方案。
研究与基准
MindTopo 拓扑推理. 微软研究院的 MindTopo 基准表明,多模态模型擅长静态拓扑识别,但在需要随时间维护关系的交互式规划方面表现不佳。
从输出重构提示词. IIT Bombay 和 Adobe Research 开发了 Previous-Token Prediction,它可以在没有模型权重的情况下,以近乎完美的准确率从输出文本重构 LLM 提示词。
今天的内容就这些 - 大约5分钟阅读。