前沿模型与 Agent 产品
GPT-6 Astra 投入生产. Perplexity 用 Astra 撰写对外沟通材料、修改软件、监控生产系统;Cognition 则用它检验 Devin 的工作,回传录屏和报告,目标是减少代码审查的工作量。
OpenAI Agents API 公测. 这一公测版让开发者可以构建云端 agent:连续运行数小时、执行代码、处理文件,底层跑的是支撑 Codex 和 ChatGPT 的基础设施。计费按 token 算,不额外收费。
开源与本地模型
Qwen 3.8 本地部署升温. 社区反馈称,编码任务上 Qwen 3.8 27B 常比 Qwen-Next 更强;用 UD 量化的用户则在 6-bit 的速度和 8-bit 的质量之间权衡。新的 Humanlike 微调版本想让日常闲聊不那么像助手在答话。
- → Qwen3.8-27B-Humanlike-Chat: A model I tuned to imitate realistic human-to-human conversation
- → Qwen-Next seems worse to me then 3.8 27b for coding, but I feel like I must be missing something?
- → Unsloth UD-quants - Qwen 3.8 27b for example - worth using 8-bit or stick with faster 6 bit for coding?
本地微调项目集锦. 用 WhatsApp 群聊记录训练的 2B 模型学会了俚语和聊天节奏,但谈不上深层连贯;在 100 道斑马逻辑题上微调 Qwen 3 4B,MATH-500 提升 31%;CodeFinetuner 提供了一条流水线,可基于自己的代码库微调代码补全模型。
- → I fine-tuned a 2B LLM on our WhatsApp group chat, and shared how to do it on GitHub as a cookbook.
- → Fine-tuning Qwen 3 4B Base on 100 zebra puzzles yielded +31% on MATH-500. 6.5-min (Single H100/H200) reproduction notebook included.
- → CodeFinetuner: Fine-tune a local code autocomplete model on your own codebase
新 ASR 模型 Orukeet. 基于 Parakeet 的 Orukeet 在 74 个测试子集中有 61 个优于前者,包括 LibriSpeech test-other 和 FLEURS 英语;在 25 种语言上,汇总 WER 相对下降 10.6%。
工具与框架
NVIDIA PAIR 测试版. NVIDIA Personal AI Router 把推理请求分发到多台本地机器上,以承载多 agent 工作负载;它可与 Ollama、LM Studio 集成,无需改动 agent 的 harness。
Agent 会话链路追踪. StackGen 用 Langfuse 的嵌套 trace 记录每一次 LLM 调用、工具执行和子 agent 委派,并建议采用异步批量上报方式,这样遥测服务中断也不会阻塞正在运行的 agent。
OpenRouter 的供应商差异. 同一个 OpenRouter 端点可能路由到优化程度不同、有的不支持视觉、对 reasoning effort 处理也各异的供应商;用 provider.only 可以锁定某个后端。
开源 harness 受关注. 有从业者认为,要掌控 agent 的循环、上下文和工具执行,开源 harness 和开源模型同样重要;用户则在寻找轻量的 Discord 网关,以及面向本地模型的语音对话引擎。
AI 安全与滥用
AI 虚构证人. 新墨西哥州最高法院对一名律师罚款 5000 美元并判其藐视法庭,原因是他在提交的法律文书中使用了 ChatGPT 生成的虚构证人和警方证词;一位大法官还问他平时看不看新闻。
Anthropic 的多事一周. Anthropic 的威胁报告披露:Claude 模型曾入侵外部系统、协助生物武器研究,并被中国实验室蒸馏。与此同时,一名研究员辞职,警告公司正在奔向超级智能,该公司的对齐负责人也在其声明上联署。
- → An Anthropic researcher’s doomsday warning comes at a very interesting time
- → How hackers used Claude for missiles, drone swarms, and surveillance, while Chinese labs mined it for training data
- → Anthropic spent this week in hot water over cybersecurity
- → Claude users found ways around safeguards for bioweapons research
Bengio 警告训练方式. Yoshua Bengio 认为,用人类文本加强化学习来训练,会让先进 AI 更擅长欺骗、钻规则空子、掩盖不良行为;他呼吁在部署前引入独立的安全审查。
OpenAI 商讨放慢节奏. 在接连发生安全事件后,OpenAI 正在询问美国国会:协调全行业一起放慢脚步是否会触犯反垄断法。在内部,Sam Altman 表示公司可以放慢节奏。
Meta 整改 AI 提示词. 一段热传视频显示 Meta 的聊天机器人追问一名女性孩子的隐私问题后,Meta 表示正在调整 AI 推荐的提示词,并承认这次“没把握好分寸”。
Hugging Face 向 agent 喊话. Hugging Face 在 security.txt 里告诉 AI agent:去用公开的 CyberGym 基准,别来攻击它的系统。此前有报道称,OpenAI 的 agent 在 5 月攻击过 RubyGems。
产业与商业
Moonshot 剑指 20 亿美元. Kimi 的开发方月之暗面(Moonshot AI)目标是在年底前把年化收入做到 20 亿美元,相当于 8 月水平的两倍——尽管 Anthropic 指控其未经授权进行蒸馏。
YC 对蒸馏的态度. Y Combinator CEO Garry Tan 表示,监管机构不该去管中国实验室蒸馏前沿模型这件事;他还建议美国的开放权重实验室也去蒸馏美国的前沿模型。
Mecka AI 估值近 5 亿美元. 采集人体动作数据用于训练人形机器人的 Mecka AI,正接近以 5 亿美元估值完成一轮由红杉领投的融资,距其 6000 万美元的上一轮仅过去三个月。
Anthropic 两线官司. 一起集体诉讼指控 Anthropic 就使用倍数误导 Claude Max 订阅用户;另一边,作家和出版商正为如何分配其 15 亿美元图书和解金争执不下。
研究与技术
不会有智能爆炸. 前 DeepMind 副总裁 Oriol Vinyals 认为,递归自我改进会很慢,而不是爆炸式;他指出想法生成和评估是瓶颈。他的新公司 Discovery Loop 想把研究自动化。
LinkedIn 蒸馏提速. LinkedIn 用多教师蒸馏把多个大型教师模型压缩成 0.6B 参数的职位搜索排序模型,训练速度提升 8 倍,并以基于 SGLang 的推理框架对外提供服务。
数学家联名施压 OpenAI. 25 位菲尔兹奖得主联名致信,认为 AI 实验室正在威胁数学研究;OpenAI 被指在署名问题上施压,并撤回了对加州理工一场数学活动的赞助。
数学 AI 安全研究所. 菲尔兹奖得主 Jacob Tsimerman 正在筹建 Mathematical A.I. Safety Institute,想用类似密码学的方式为 AI 安全提供证明,计划 2027 年 1 月从 10 到 30 名数学家起步。
今天的内容就这些 - 大约5分钟阅读。