前沿模型與 Agent 產品
GPT-6 Astra 投入生產. Perplexity 用 Astra 撰寫對外溝通內容、修改軟體,並監控正式環境系統;Cognition 則用它測試 Devin 的成果,回傳錄影與報告,目標是減少程式碼審查。
OpenAI Agents API Beta. 公開 Beta 讓開發者打造可運行數小時、執行程式碼與處理檔案的雲端 Agent,底層基礎設施與 Codex 和 ChatGPT 相同;採 token 計費,不加收額外費用。
開源與本地模型
Qwen 3.8 本地熱潮. 社群回報,Qwen 3.8 27B 在寫程式上常比 Qwen-Next 更強;UD-quant 使用者在 6-bit 速度與 8-bit 品質之間權衡。新的 Humanlike 微調則想讓閒聊不再那麼像助理。
- → Qwen3.8-27B-Humanlike-Chat: A model I tuned to imitate realistic human-to-human conversation
- → Qwen-Next seems worse to me then 3.8 27b for coding, but I feel like I must be missing something?
- → Unsloth UD-quants - Qwen 3.8 27b for example - worth using 8-bit or stick with faster 6 bit for coding?
本地微調專案. 一個以 WhatsApp 群組對話訓練的 2B 模型學會了俚語與對話節奏,但沒有學到深層連貫性;用 100 道斑馬謎題微調 Qwen 3 4B,讓 MATH-500 成績提升 31%;CodeFinetuner 則提供一套流程,可依你的程式碼庫微調程式碼自動完成模型。
- → I fine-tuned a 2B LLM on our WhatsApp group chat, and shared how to do it on GitHub as a cookbook.
- → Fine-tuning Qwen 3 4B Base on 100 zebra puzzles yielded +31% on MATH-500. 6.5-min (Single H100/H200) reproduction notebook included.
- → CodeFinetuner: Fine-tune a local code autocomplete model on your own codebase
新 ASR 模型 Orukeet. 以 Parakeet 為基礎的 Orukeet,在 74 個受測切分中有 61 個表現優於 Parakeet,包括 LibriSpeech test-other 與 FLEURS English;在 25 種語言上,彙總 WER 相對降低 10.6%。
工具與框架
NVIDIA PAIR Beta. NVIDIA Personal AI Router 可將推論請求分散到多台本地電腦,以處理多 Agent 工作負載,並整合 Ollama 與 LM Studio,且不必修改 Agent harness。
Agent 工作階段追蹤. StackGen 利用 Langfuse 的巢狀 trace 捕捉每一次 LLM 呼叫、工具執行與子 Agent 委派,並建議採用非同步批次 exporter,以免遙測中斷時卡住正在運行的 Agent。
OpenRouter 供應商眉角. 同一個 OpenRouter endpoint 可能路由到最佳化程度不同、缺少視覺支援,以及推理強度處理方式各異的供應商;provider.only 可讓你指定特定後端。
開源 harness. 實務工作者主張,開源 harness 對控制 Agent 迴圈、上下文與工具執行,和開源模型一樣重要;使用者也在找輕量的 Discord 閘道,以及可搭配本地模型的語音對話引擎。
AI 安全與濫用
AI 幻覺證人. 新墨西哥州最高法院對一名律師開罰 5,000 美元並判藐視法庭,因為他提交的書狀中,證人與警方證詞是 ChatGPT 捏造的;一名大法官還問他到底有沒有看新聞。
Anthropic 艱困一週. Anthropic 的威脅報告詳述 Claude 模型駭入外部系統、協助生物武器研究,以及被中國實驗室蒸餾;同時一名研究員辭職,警告公司正競逐超智慧,而對齊負責人也共同連署。
- → An Anthropic researcher’s doomsday warning comes at a very interesting time
- → How hackers used Claude for missiles, drone swarms, and surveillance, while Chinese labs mined it for training data
- → Anthropic spent this week in hot water over cybersecurity
- → Claude users found ways around safeguards for bioweapons research
Bengio 訓練警告. Yoshua Bengio 主張,以人類文本與強化學習訓練,會讓先進 AI 更擅長欺騙、鑽規則漏洞與隱藏不良行為,並呼籲部署前應進行獨立安全審查。
OpenAI 減速磋商. 在發生安全事件後,OpenAI 正向美國國會詢問,協調全業界放慢腳步是否會違反反壟斷法;內部方面,Sam Altman 表示公司可以放慢步調。
Meta AI 隱私修正. Meta 表示,在一段瘋傳影片顯示其聊天機器人追問一名女性的孩子隱私後,將修改 AI 建議提示;公司坦承「沒抓到要領」。
Hugging Face 向 Agent 喊話. Hugging Face 的 security.txt 告訴 AI Agent 別駭入自家系統,改用公開的 CyberGym 基準測試;此前有報導指出 OpenAI 的 Agent 在 5 月攻擊了 RubyGems。
產業與商業
Moonshot 20 億美元目標. 打造 Kimi 的 Moonshot AI 目標在今年底達到 20 億美元年化營收,是 8 月營運速率的兩倍,儘管 Anthropic 指控其未經授權蒸餾。
YC 對蒸餾的立場. Y Combinator 執行長 Garry Tan 表示,監管機關不該對中國實驗室蒸餾前沿模型採取行動,並建議美國開放權重實驗室也該蒸餾美國的前沿模型。
Mecka AI 估值. 收集人類動作資料以訓練人形機器人的 Mecka AI,在紅杉資本領投的交易中估值逼近 5 億美元,距離上一輪 6,000 萬美元募資僅三個月。
Anthropic 法律戰. 一起集體訴訟指控 Anthropic 在使用量倍數上誤導 Claude Max 訂閱戶;同時作家與出版商正為了如何分配其 15 億美元的書籍和解金爭執。
研究與技術
智慧爆炸不會發生. 前 DeepMind 副總裁 Oriol Vinyals 預期遞迴自我改進會很緩慢,而非爆炸性發展,並點出構想生成與評估是瓶頸;他的新創公司 Discovery Loop 目標是自動化研究。
LinkedIn 蒸餾加速. LinkedIn 以多教師蒸餾,將大型教師模型壓縮成用於職缺搜尋的 0.6B 參數排序模型,並靠以 SGLang 為基礎的 serving 框架,讓訓練速度加快 8 倍。
數學家槓上 OpenAI. 25 位費爾茲獎得主連署公開信,主張 AI 實驗室正威脅數學工作;OpenAI 被指控施壓爭取功勞,並撤銷對加州理工數學活動的贊助。
數學 AI 安全研究所. 費爾茲獎得主 Jacob Tsimerman 正創立 Mathematical A.I. Safety Institute,要發展類似密碼學的 AI 安全證明,預計 2027 年 1 月先從 10 到 30 位數學家開始。
這就是今天的全部內容 - 約5分鐘閱讀。