智能体与模型发布
Muse 开源硬件. Meta 开源了固件和一套 SDK,供开发者打造能接入其 Muse 智能体的 DIY 硬件,比如 E Ink 显示屏和 HDMI 电视棒,并开设 Discord 提供支持。
OpenAI Dot. OpenAI 新推出的 Dot 智能体像企业软件,却还能帮你订晚餐:它运行在虚拟机里,可调用 Blender、GIMP 等应用。官方把它定位成同事,而不是私人导购。
宇树人形模型. 宇树发布 UnifoLM-WLA-1.0,这是一个 6B 模型,用约 2500 小时真实机器人数据训练,可在 G1 上完成 64 项全身与桌面任务,并把光流与 MMDiT 结合实现连续控制。
FrogNano 编程模型. 微软的 FrogNano-4B-2609 由 Qwen3.5-4B 衍生而来,基于 1500 个合成 SWE 任务、以可执行奖励做后训练,在紧凑体量下提升仓库级软件工程能力。
Cloudflare Clef. Cloudflare 发布决策模型 Clef 和 Clef-flash,它们在预设答案上输出概率,中位延迟低至 39ms,让智能体无需人工介入即可行动。
工具与框架
MegaCapybara 引擎. 一款专为 RTX 5090 和 Qwen3.8 27B 打造的推理引擎,宣称解码速度约为 NInfer 的两倍:单路 500+ t/s,12 个智能体并发可达 2000+ t/s,并配有动态 kernel 与缓存管理。
llama.cpp 更新. llama.cpp 新增对决策模型的支持,并合入一个 CUDA PR,通过融合共享专家来加速 Qwen 35B A3B 这类 MoE 架构。
mlsubgen 字幕工具. 一款新的本地工具可以完全在自己机器上生成 45 种语言的字幕:逐段检测语种,用本地 LLM 调和两个语音识别器的结果,并优先采用已有的内嵌字幕。
研究与模型进展
Spotlight 记忆架构. Percepta 的 Spotlight 用可无限写入、由模型自行索引的记忆取代注意力机制,把智能与知识分离,从而在不改动权重的情况下扩展能力。
GPT-6 更新. OpenAI 发布了 GPT-6 系列指南,并公布 DevDay 更新,包括 GPT-6.1 Sol、Agents API 的电脑操作能力、云端 Codex 环境以及 Decisions API。
AstaBrief 开源. Hugging Face 开源了 AstaBrief,这是一个专门为快速生成带引用的科学报告而训练的小模型,设计上要求始终基于证据并核查输出。
行业与商业
苹果收紧磁盘权限. 出于对 AI 智能体风险的担忧,苹果正在为 macOS 的完全磁盘访问权限增加管控。此前有消息称 Meta Muse 未经许可读取消息;Meta 称该访问需用户主动授权,苹果则希望用户操作足够明确。
数据中心的阻力. 亚马逊承诺向数据中心所在社区投入 10 亿美元,AWS CEO Matt Garman 呼吁终止相关禁令,并称反对声来自境外虚假信息;微软则在地方反对声中,扩大数据中心的仿生设计。
AI 改称“超级智能”. 白宫促成多家大型科技公司 CEO 签署 AI 安全承诺,特朗普签署行政令,把 AI 重新定名为“超级智能”;与此同时,只有 2% 的消费者在购买 AI 产品。
OpenAI 安全团队震荡. 一项调查发现三名研究人员向一家外部 AI 安全组织泄露了机密信息,OpenAI 随后解雇了他们,另有第四人离职。
Uber Eats 提速搜索. Uber 重建了搜索链路,端到端延迟降低 50%,并用智能体编程来发现和验证优化点。
Airbnb 的由内而外. Airbnb CTO Ahmad Al-Dahle 正在推行“由内而外”的 AI 策略:先在内部用生成式 AI 加速产品开发,再改造客户体验。
本地部署与硬件
Strata + Qwen3.8 Next. 用户反馈,Strata 搭配 Qwen3.8 Next,在慢速 DDR4 加 7900XTX 上可达 45–70 t/s,在功耗受限、配 96GB DDR5 的 RTX 5090 上可达 150–200 t/s,明显优于 llama.cpp。
iPhone 当第二块 GPU. 用 USB-C 连上 iPhone 17 Pro Max,并在手机 GPU 上运行上层网络,可以让 24GB MacBook 上 Qwen 3.8 27B 的 prefill 提速 29%–44%。
昇腾 96GB 卡. 两张各 96GB 的华为 Atlas 300I Duo,在调优软件栈后可以约 30 t/s 运行 Qwen3.8 Flash-Next,尽管它们并不能即插即用地替代 CUDA。
DGX Spark 与 5090 价格. 英伟达推出 64GB 版 DGX Spark,原有 128GB 型号涨到 6950 美元;如今在 Micro Center 买一块 RTX 5090,据说还要填报非出口用途的文件。
今天的内容就这些 - 大约5分钟阅读。