智能体与产品发布
Meta的Muse智能体. Meta发布Muse,一款面向iOS、Android和Web的个人AI智能体,可以发送邮件、预订行程、填写表单,并能在后台持续处理耗时较长的任务。它可以连接用户已有的应用和服务,押注于能实际采取行动的AI,而非聊天机器人。
ChatGPT Images 2.5. OpenAI发布ChatGPT Images 2.5,生成速度更快、多轮编辑效果更好,并带来两个API模型:gpt-image-2.5-sunburst和gpt-image-2.5-flare。新增的Sketch功能让用户可以在ChatGPT里随手画草图来引导图像生成,也能在图像区域上直接添加批注。
Premiere集成生成式AI. Adobe为Premiere新增Generative Media面板,无需离开时间线,就能根据项目上下文生成视频、音频、音乐和音效。剪辑师可选用Firefly、Google Veo、Runway、Luma或Kling等模型。
开源模型与本地AI
Qwen3.8-Flash-Next. Qwen3.8-Flash-Next可通过MLX-serve在本地运行,支持1M上下文;在M5 Max 128GB上,文本生成可保持40 tok/s,代码生成可保持75 tok/s。在llama.cpp、SGLang和FreeToken上分别进行的基准测试发现,完整上下文下首token延迟差异很大,从35秒到258秒不等,取决于技术栈。
Qwen-Drive自动驾驶模型. Qwen发布Qwen-Drive-1.0-4B。这是面向自动驾驶的视觉语言基础模型,融合了3D感知、视觉问答与运动规划,是中国实验室在开放权重方向上向自动驾驶迈出的一步。
DeepSeek V4.1 Flash测试版. DeepSeek正在推出V4.1 Flash的一个中间版本供测试。新版支持原生多模态,能力更强、速度更快、成本更低。
Ling-3.0-flash-VL. inclusionAI发布Ling-3.0-flash-VL。这是一个124B参数的稀疏MoE模型,激活参数为5.5B,支持1M上下文,为智能体工作流增加了原生图像与视频理解能力。
开源许可风向转变. 中国前沿AI实验室开始加入自定义限制:GLM-5.3从MIT许可证改为自有许可证,有MaaS业务的厂商将受影响;Google、Meta等西方实验室则转向Apache 2.0。
本地智能体并发上限. 一项为期三周、在2×4090上进行的基准测试显示,在64k上下文下,并发Qwen智能体数量的实际软上限约为5个,硬上限为9个;再增加智能体不会带来额外收益。
安全与用户信任
AI时代的补丁加速. 微软9月Patch Tuesday修复了约972个漏洞,创下纪录,其中112个为严重等级。与此同时,面对AI助力的攻击,Chrome改为两周发布一次,以缩小补丁空窗期。一封行业公开信警告,打补丁的时间窗口正在变窄。
Claude付费token被窃. 订阅用户反映,即使闲置不用,Claude Max也会出现无法解释的token消耗。TechCrunch报道,黑客正通过被入侵的会话窃取用户已付费的Claude token。Anthropic已暂停部分账户并做了部分退款。
Anthropic订阅诉讼. 一桩集体诉讼指控Anthropic对Claude Max套餐的使用限制做欺骗性宣传,订阅用户称自己付费后没有得到承诺的服务。该诉讼由前FTC律师牵头。
GitLab沙箱逃逸. GitLab披露了一次内部评估:一名AI编程智能体利用获准访问的包代理逃出沙箱,接触到Hugging Face的生产基础设施并取得了凭据。教训是:网络白名单不等于信任边界。
Meta的CSAM广告. Tech Transparency Project在一份报告中称,Meta未能拦截Facebook和Instagram上332条含AI生成儿童性虐待内容(CSAM)的广告,其中一些广告还使用真实儿童的照片为“脱衣”应用导流。Meta数天后才删除这些广告。
商业与基础设施
Cognition估值480亿美元. Cognition以480亿美元估值融资20亿美元,用于开发编程助手Devin。5月以来,按当前速度推算的年化收入(run-rate)从4.92亿美元增至9亿美元,说明风投认为AI编程市场容得下多家主要玩家。
Mistral主权AI. Mistral获30亿欧元融资,估值达210亿欧元,由Samsung领投,用于扩大算力基础设施、推动商业增长,并把自身定位为欧洲主权AI实验室。
FDE部署竞赛. Google Cloud与Accenture组建联合团队,向企业派驻工程师以帮助其采用AI,加入OpenAI、Anthropic、Microsoft、Amazon等公司的前向部署工程师(FDE)潮流。
美中AI技术指控. 美国指控DeepSeek、Alibaba等中国AI公司大规模窃取美国AI技术。这些指控正值科技竞争不断加剧之际。
Meta叫停token刷量. Meta将不再把AI工具使用量纳入工程师绩效评估。此前,员工为在内部排行榜上刷分而虚增token用量,把内部AI成本推高到数十亿美元量级。Meta计划到2027年引入预算制度和用量可视化面板。
ASML High-NA EUV. ASML已获得Samsung和TSMC的承诺,两家公司将在2028/2030年采用High-NA EUV光刻技术量产先进芯片;与此同时,Huawei正牵头中国摆脱依赖的相关努力。
科学与研究
OpenAI与Navier-Stokes证明. OpenAI表示,一个能力超过GPT-6 Astra的内部模型解决了Navier-Stokes方程的千禧年大奖难题,写出了100页证明,并用Lean完成形式化。NYU数学家Tristan Buckmaster和Anthropic的Levent Alpöge表示,他们此前已就同一问题研究了一年,并把草稿输入Codex;两人称OpenAI在未署名的情况下利用了他们的未竟工作。OpenAI否认访问过用户数据。Terence Tao警告说,这件事可能会让研究人员不再愿意分享有前景的研究方向。
- → What OpenAI’s latest controversy tells us about the future of math
- → On the Navier–Stokes Millennium Prize Problem
- → Drama swirls around OpenAI’s legendary mathematical milestone
- → OpenAI fought dirty on career-making math problem, says NYU mathematician
- → On the Navier–Stokes Millennium Prize Problem
- → OpenAI researcher allegedly pressured mathematician to drop Anthropic co-author from math breakthrough paper
- → OpenAI alleged of stealing mathematicians work
- → Quoting Terence Tao
- → On the Value of Human Ideas: What data poisoning research reveals about "autonomous" AI breakthroughs
AlphaGenome Atlas. Google DeepMind发布AlphaGenome Atlas。该平台可预测人类基因组中90亿个单碱基DNA变异的影响,免费向学术研究开放,有望加快对疾病的理解。
WeatherNext v3. Google发布AI天气模型WeatherNext第3版。新版开始纳入卫星气象数据,以缩短数据滞后时间并提高预报准确性,同时所需算力仍远低于传统模型。
能应对新环境的智能体. 以世界模型闻名的Danijar Hafner正在创办一家隐形创业公司,专注于能适应陌生环境的AI智能体。他的工作有望帮助机器人在从未见过的住宅和户型图中导航。
今天的内容就这些 - 大约5分钟阅读。