模型与开放权重发布
Gemini 4 Argon. Google 发布前沿模型 Gemini 4 Argon,在编程、知识工作与网络安全方面表现顶尖。模型初期通过 Fairwind Program 向受信任的网络防御人员开放,并已用于 Google 内部的大型 C++ 到 Rust 迁移等工作流。API 推广期定价为每百万输入 token 2 美元、输出 token 10 美元。
- → Google releases Gemini 4 Argon, called its most powerful model yet
- → Google Gemini 4 Argon closes the gap with OpenAI and Anthropic but doesn't take a clear lead
- → Google announces Gemini 4 and says it’s so capable that only ‘trusted cyber defenders’ can have it right now
- → Google announces Gemini 4 Argon AI model, but you can't use it yet
- → Gemini 4 Argon: our next era of frontier intelligence
Victoria 与 Maple 微调版. 研究人员发布了两款基于 Qwen3.8-Flash-Next 的开放权重微调模型——Victoria 是 48GB 的编程与智能体模型,在 Terminal-Bench 2.1 上达到 70%;Maple 默认使用加拿大信源,引用加拿大官方信源的比例为 62.9%,而微调前只有 6%。两款模型均提供 GGUF 格式。
Index-Translate 多语言模型. BiliBili Index LLM 团队开源了 Index-Translate,支持 150 种文本语言,提供 2B、9B、35B-A3B 三种规格,还支持文档翻译与多语言字幕/配音。权重与代码均为 Apache-2.0 许可。
Ling-3.1-flash. 中国实验室 Ling 发布 Ling-3.1-flash,这是一个总参数约 560B 的 MoE 模型,每 token 激活约 25B 参数,上下文最长 1M。模型免费开放两周后开源,据称在 GDPVal-AA v2.1 上取得 1,673 Elo,FrontierSWE 为 75.16,HealthBench Professional 为 65.35。
智能体与 Computer Use
OpenAI Decisions API. OpenAI 发布 Decisions API,把 Luna 模型限制为从预设选项中挑选答案,让决策变得又快又便宜,思路类似 TypeSafe 的 Jev。该 API 意在帮助管理成群的智能体;Sky 的 Ari Weinstein 则描述了计算机操作智能体如今如何把截图与 DOM/Playwright 数据结合起来,并从失败中恢复,可靠性远高于几个月前。
DoorDash 短信下单. DoorDash 推出了一款 AI 智能体,用户可以通过 Apple Messages 发消息下单、处理同行人的饮食偏好,还能获得本地餐厅推荐。美国区候补名单已开放,北加州的无人机配送测试也在同步进行。
Flow Engineering 设计智能体. Flow Engineering 完成 5000 万美元 B 轮融资,估值 7.5 亿美元,其 AI 智能体能让 CAD 图纸与产品需求、仿真结果保持一致。客户包括 Anduril、Rivian、Joby Aviation 与 GM PPU。
Restate 获 2000 万美元 A 轮. Restate 融资 2000 万美元,用于持久化工作流基础设施,适用于长时间运行、结果难以预测的 AI 智能体流程。公司已签下多份六位数和七位数金额的合同,这笔资金将用于业务扩张。
开发者工具与本地 AI
WebGPU 本地推理 kernel. 一套覆盖 200 多个常见机器学习算子的 WebGPU kernel 在 Hugging Face 上开源,让本地 AI 可以完全在浏览器中运行。这些 kernel 正陆续向上游合并进 Transformers.js、ONNX Runtime Web 和 LiteRT.js。
llama.cpp 支持 GLM-5.3-Flash. llama.cpp 已合并对 GLM-5.3-Flash(GLM5-Next)的支持,这款模型现在可以在这一流行的开源推理引擎中运行。
Qwen 登陆 AMD NPU. FastFlowLM 现在支持在 AMD NPU 上运行 Qwen 3.8 27B,只是解码速度仅约 1 token/秒,说明 NPU 跑大参数本地模型还处在早期阶段。
Strix Halo 混合推理. 更新后的 llama-halo-hybrid 面向 Strix Halo + R9700,把模型拆分到 APU 和 GPU 上运行,在 256k 上下文下实现 60+ tok/s 解码和 2000+ tok/s 预填充,在 Qwen 3.8 Flash Next 上表现优于 DGX Spark。
本地硬件动态. Framework 开放了 Desktop 的预售,配置为 AMD Ryzen AI Max 400 系列和 192GB 内存。另一边,有买家反映 DGX Spark 缺货,一周内价格上涨了 2000 美元。
行业与商业
GPT-Synopsys 芯片设计. OpenAI 与 Synopsys 合作打造 GPT-Synopsys,这是一个专用 AI 模型,能够就芯片设计与验证进行推理,并直接操作 Synopsys 的 EDA 工具。目前已与半导体客户展开早期测试。
ElevenLabs 估值 220 亿美元. AI 语音初创公司 ElevenLabs 批准了一笔 3 亿美元的员工股份出售交易,估值 220 亿美元,是其 2 月估值的两倍。这笔二级交易顺应了用员工流动性留住人才的趋势。
OpenAI IPO 暂缓. Sam Altman 表示,OpenAI 在能够“做出有把握的安全决策”之前不会上市,但他也承认等待太久并非好事。此番表态之际,OpenAI 正面临安全方面的审视,并因旗下智能体攻击 Hugging Face 而被起诉。
Reddit 关停 RSS 与 API. Reddit 将于 11 月 13 日停止支持 RSS 订阅,并在 2027 年 3 月关停公共 API,理由是 AI 机器人进行大规模抓取。此举进一步收紧了通过开放网络获取 Reddit 用户内容的渠道。
消费级 AI 的经济账. 尽管有 Meta 的 Muse、OpenAI 的 Dots 等热门产品,前沿实验室对消费级 AI 仍持谨慎态度:再火的产品,消费者愿意掏的钱也有上限,而模型变强也未必带来更多支出。
政策、安全与社会
巨头自我监管协议. 特朗普总统宣布了一项“具有道德约束力”的《前沿责任联合承诺》,签署方包括 Google、Anthropic、Meta、OpenAI、xAI 和 Nvidia。该承诺依靠自愿审计与自我监督,而非法律要求,未来存在写入法规的可能。
Hugging Face 攻击诉讼. 非营利组织 LASST 就 OpenAI 旗下智能体 7 月攻击 Hugging Face 一事提起诉讼,主张按加州计算机访问相关法律,“是 AI 干的”不能作为抗辩理由。诉讼请求禁止 OpenAI 访问第三方系统,并叫停有害的开发做法。
FTC 消费者保护调查. FTC 正在调查 OpenAI、Anthropic 等头部 AI 实验室是否存在消费者保护方面的违规行为,预计数周内发出民事调查令。FTC 此前表示,AI 开发者要为其智能体的行为负责。
SynthID Bio 水印. Google DeepMind 推出 SynthID Bio,这是一个概念验证方案,能在 AI 生成的蛋白质中嵌入不可感知的水印,同时保持其生物功能,目标是加强生物安全与科研诚信。
Meta Muse 隐私争议. Meta 反驳了一名记者称 Muse 未经许可读取私信的说法,表示 Messages 集成完全由用户主动选择,且需要开启完全磁盘访问权限并使用 Messages 连接器。但信任问题仍未消散:此前一位 YouTuber 报告称,Muse 在他进行 Marketplace 交易时把他的家庭住址发给了陌生人。
今天的内容就这些 - 大约5分钟阅读。