Agentic AI News 今天

一天AI代理新聞,5分鐘讀完:發佈、工具、研究、募資和企業動態。

每日更新 精選自 30 個來源 星期四, 八月 20, 2026

開放與本地模型發布

Ornith-1.5 開放系列. Ornith-1.5 以 MIT 授權發布,提供 9B dense、35B MoE 和 397B MoE 版本,在智能體與程式碼基準測試中表現強勁;社群量化版本顯示,35B 在 12GB 4070 Ti 上可達 60 tk/s,而 9B 則優於先前的小型模型。

Qwen3.8-27B 實地報告. 本地用戶回報 Qwen3.8-27B 可自主執行 80+ 次工具呼叫,並處理長鏈智能體任務,但其離線知識與嚴格的程式碼評分不如前代,因此最適合在明確指導或副駕駛模式下使用。

Qwen3.8 加速與量化. 社群努力將 Qwen3.8-27B 在 RTX 3090 上提升至 138 tps(搭配 DFlash2),發布 Dynamic V3 量化版本宣稱準確度提升 10%,同時推出深度剪枝的 22.7B Mini-Me,以及在 2017 年 V100 上原生 FP4 表現可匹敵 5090。

Ling 基礎檢查點. AntLing 開源了 Ling-3.0-tiny 和 flash 的基礎與中期訓練檢查點(不含後期訓練),有用戶將 Ling tiny 作為輔助,搭配 Qwen3.8 進行上下文壓縮。

LFM2.5 QAD 量化. Liquid AI 發布了使用量化感知蒸餾訓練的 Q4_0 檢查點,在相同速度與記憶體下恢復了 BF16 97% 的準確度。

GLM-5.3 與前沿發布. GLM-5.3 與 Kimi K3 並列開放模型排行榜榜首,帶來大幅智能體能力提升與更低成本,不過開放權重延遲兩週;DeepSeek V4-Pro GA 與 NVIDIA Nemotron 3.5 Lightning/NeMo Switchyard 也已發布。

智能體工具與產品更新

安全沙盒. Simon Willison 測試了 smolmachines/smolvm 作為不受信任的 Python 和 JavaScript 沙盒,具備 CPU/RAM 限制且無網路連線;Jeremy Morrell 主張 LLM 撰寫的擴充套件加上沙盒原語,能實現安全且可擴充的軟體。

Replit 免費模式. Replit 推出了由 GPT-5.6 Luna 驅動的免費模式,讓任何人都能不受 token 成本限制地建立應用程式與智能體。

Calendly AI 會議筆記. Calendly 進軍會議筆記領域,提供摘要、行動項目,以及即將推出的 Callie 助理,能利用會議上下文安排後續會議。

Meta AI Mac 應用程式. Meta 為其 AI 聊天機器人推出了 Mac 應用程式,具備螢幕共享、語音聽寫和 Google Workspace 整合,與 Gemini、ChatGPT 和 Claude 桌面助理競爭。

WhatsApp 裝置端詐騙偵測. WhatsApp 正在測試 Scam Alert,這是一個可選的裝置端模型,能對非聯絡人的訊息進行分類,同時使用機密聯邦分析來保護隱私。

Google 學習工具. Google 推出了 Gemini 學生中心、Search 中 AI 生成的互動視覺與測驗,以及 Gemini Live 中的 Deep Research,迎接開學季。

Alexa+ 在 Fire TV 上免費. Amazon 讓 Alexa+ 在 Fire TV 上無需 Prime 即可免費使用,並自動推出對話式搜尋、智慧家庭控制和 AI 推薦功能。

產業與商業

Stripe 收購 OpenRouter. Stripe 確認以 75 億美元收購 OpenRouter,創辦人引述「奇點」作為保持私有並投資智能體基礎設施的理由。

SpaceX 收購 Cognition 報導遭否認. 彭博社報導 SpaceX 試圖收購 Cognition,但執行長 Scott Wu 否認此消息,表示 Cognition 不出售,且未發生任何洽談。

Anthropic 營收領先. Anthropic 首次在季度營收上超越 OpenAI,達到 116 億美元並有小幅營業利潤,而 OpenAI 的 67 億美元則伴隨更深的虧損。

運算作為資產類別. Nvidia 正與 Apollo、BlackRock 等合作,提供 5000 億美元融資,將運算視為可投資資產;Silicon Data 籌集 3000 萬美元,推出 CME GPU 期貨。

記憶體與晶片供應. DRAM 價格在 12 個月內上漲 500%,超大規模雲端業者已鎖定 2027 年供應;中國正允許向 ByteDance 和 Tencent 提供小批量 H200,以緩解推論能力。

資料中心基礎設施. TerraPower 計劃利用其 Natrium 反應爐的儲能系統進行資料中心專案,而 Relativity Networks 為空心光纖籌集 2200 萬美元,該光纖傳輸數據速度快 50%。

AI 聲譽惡化. 皮尤研究發現,52% 的美國人對 AI 的擔憂多於期待,而當地的資料中心交易正面臨公眾反彈。

安全、隱私與保安

OpenAI 私有安全處理. OpenAI 預覽了適用於零資料保留客戶的私有安全處理,能在不讓人員接觸內容的情況下,對互動進行濫用偵測;這與 Anthropic 的 30 天保留政策形成對比。

OpenAI 修復 Codex 與 TAC. OpenAI 在 Codex 因錯誤的清理指令刪除真實用戶檔案後,推出了防護措施,並確認另一個錯誤曾短暫撤銷其 Trusted Access for Cyber 計畫的存取權。

AI 生成的 ICS 漏洞利用. 美國機構警告,攻擊者正利用 AI 建構 Siemens S7 漏洞利用腳本,降低了攻擊工業控制系統所需的技能與時間。

AI 實驗室內部控制. Guidelight 的首次評估發現,沒有 AI 公司完全落實基本內部控制;Anthropic 和 OpenAI 以 C+ 領先,而 xAI 和 Meta 分別獲得 D- 和 F。

Meta 深假廣告. Meta 為一個針對女性政治人物的 AI 去衣應用程式投放廣告,儘管其政策禁止性內容。

Spirit 員工資料出售. Google 贏得了 Spirit Airlines 員工資料的拍賣;前空服員反對,認為員工保密可能無法防止重新識別。

OpenAI 放緩開發. OpenAI 暫停部分強化學習訓練並延遲前沿運行,同時加強防護措施,測試在沒有業界全面跟進的情況下,自願放緩是否可行。

研究與分析

Claude 蛋白質設計. Anthropic 的 Claude 模型針對 15 個目標設計了微型結合子(minibinders),命中率達 26.8%,優於典型的早期藥物發現結果,不過獨立審查仍在進行中。

Vivodyne 組織資料. Vivodyne 的機器人 HIVE 實驗室培育 20 種人類組織類型,並生成因果生物資料,以解決其所認為的 AI 藥物發現數據缺失問題。

推理 token 迷思. 研究挑戰了 LLM 中間 token 具有語意意義的推理想法;模型即使在答案正確時也常產生無效軌跡,而且使用損壞軌跡訓練仍然有效。

程式設計生產力指標. Simon Willison 認為,經過除錯的生產程式碼行數仍是使用程式設計智能體時有意義的生產力指標,但要達到那樣的產出仍需資深工程能力。

這就是今天的全部內容 - 約5分鐘閱讀。

每天早上在瀏覽器中閱讀

此擴充功能在Chrome側邊欄中開啟摘要 — 一鍵點擊,無需帳戶。

新增至 Chrome — 免費