Agentic AI News 今天

一天AI代理新聞,5分鐘讀完:發佈、工具、研究、募資和企業動態。

每日更新 精選自 30 個來源 星期三, 八月 12, 2026

模型發布與基礎設施

Nvidia 的速度優先模型. Nvidia 發布了 Nemotron 3.5 Lightning,這是一個開放權重的 30B Mamba-Transformer 模型,在基準測試上與 GPT-OSS-120B 匹敵,同時針對快速推論進行最佳化,僅有 3.6B 個活躍參數。

DeepSeek V4 本機運行. DeepSeek V4 的社群量化修復了位元精確基線的轉換問題,而 DeepSeek V4 Flash 在 Strix Halo APU 上透過推測解碼達到 27+ t/s,展示了可行的本機部署。

Unsloth 桌面應用程式. Unsloth 發布了一款開源桌面應用程式,可在各種 GPU 上執行和訓練本機模型,具備沙盒程式碼執行、RAG、模型匯出,且無遙測功能。

River AI 的 11 億美元種子輪. River AI 由前 xAI 共同創辦人 Igor Babuschkin 創立,籌集了 11 億美元,旨在透過重新思考從訓練到硬體的整個技術堆疊,打造可個人訓練的 AI 助手。

Daybreak Cyber 登上 AWS. OpenAI 的 Daybreak 網路安全模型現已可透過 Amazon Bedrock 使用,讓防禦者能在其現有的 AWS 環境中存取前沿的網路安全能力。

祖克柏的開源宣言. Meta 執行長主張更多開放權重的發布,並邀請政府合作進行安全測試,同時該公司持續發布 Muse Glimmer 等模型。

Ling‑3.0 支援. 一個 pull request 將 Ling‑3.0 加入 llama.cpp,其中一個小型變體已能在家庭助理語音任務中良好運作,因為它在不確定時會誠實拒絕。

工具與本機 AI

MCP Broker 減少上下文. 一個 DIY 代理程式框架使用 MCP broker 將工具隱藏在代理之後,將啟動上下文從 20K tokens 減少到幾乎為零,並加入了時間感知以改善本機執行。

礦卡執行 LLM. 8GB CMP170HX 礦卡可擴充至每張 64GB,可同時執行大型模型或多個小型模型,提供便宜但老舊的 Ampere 級效能。

V100 上 366 t/s. 自訂 CUDA 核心(v100‑skinny)在 Volta GPU 上以 NVFP4 格式對 Qwen3.6 27B 實現高達 366 t/s 的效能,為老舊硬體注入新生命,用於本機推論。

TinyTitle 模型. 一個 1.8M 參數的 GRU 模型可在不到 5 MiB RAM 的環境下生成聊天標題,展示了在裝置上執行的超輕量摘要能力,僅需幾毫秒。

私密電子書閱讀器 AI. 一款電子書閱讀器應用程式在本機整合了 Gemma 4B 模型,提供私密的應用程式內書籍問答,並具備劇透開關和自動語言配對功能。

低功耗 AI 伺服器. 一個結合 Intel N100 與 RTX 5060Ti 的組合,打造出安靜、高效的 llama.cpp 伺服器,能夠執行 Qwen 3.5 等最新模型,適合日常使用。

推論成本大幅削減. Doubleword 的執行長解釋了如何針對非即時使用設計推論堆疊,與通用設定相比,可將 token 成本降低一個數量級以上。

智慧模型路由. NVIDIA 的 Switchyard 函式庫僅將 7% 的代理程式呼叫路由到前沿模型,在最小準確度損失下將成本降低 74%,並提供一個公式來評估成本效益。

私密 AR 眼鏡. 一位視障使用者要求 Meta 風格的 AR 眼鏡能執行本機模型,以避免將視覺資料傳送給 Meta,凸顯了輔助技術中的隱私需求。

前沿研究

AI 挑戰黎曼猜想. 一個未發布的 Anthropic 模型在 36 小時內透過 60 個子代理測試了 650 個想法,在黎曼猜想上取得了進展,重新引發了關於 AI 在數學發現中角色的辯論。

AMIE 的影片診斷. Google 的 AMIE 研究系統展示了專家級的臨床影片諮詢,使用 Gemini 和多代理設定來解讀視覺、聽覺和情境線索。

CARE‑X 胸部 X 光 AI. Microsoft 的 CARE‑X 是一個統一的胸部 X 光 VLM,結合了生成與結構化預測,使用強化學習來獎勵臨床正確性。

代理記憶對決. ACE 和 ALTK‑Evolve 都將代理軌跡轉化為可重複使用的經驗;ACE 建立全面的策略手冊,而 ALTK‑Evolve 則檢索個別指導方針。

Logprobs 偵測幻覺. 在鏈式思考中首次事實回憶時分析 token 機率分佈,可能揭示不可靠的知識,提供潛在的早期幻覺訊號。

AI 寫作警告. S. Alpert 認為沒有重寫是無損的,因此 AI 輔助的文字必須由個人驗證,以避免扭曲作者的原意。

商業與金融

10 億使用者里程碑. ChatGPT 和 Gemini 的每月活躍使用者皆達到 10 億,其中 Gemini 是 Google 最快達到此規模的產品;ChatGPT 在今年稍早已達到 9 億的每週使用者。

ChatGPT 廣告全球上線. OpenAI 將 ChatGPT 廣告擴展到另外五個國家,並表示對使用者信任沒有影響且關閉率低,因為它尋求可持續的變現方式。

OpenAI 漲價. 新的 ChatGPT Business Premium 席位每個使用者每月 125 美元,容量為五倍且沒有每小時限制,反映了代理工作負載的大量 token 使用。

Lightcap 離職. OpenAI 的前營運長兼特別專案負責人 Brad Lightcap 在八年後離開,去開創新的計畫,延續了一系列高階主管離職的趨勢。

Anthropic 的 91 億美元租約. Anthropic 與比特幣礦商 Riot Platforms 簽署了一項為期 20 年、價值 91 億美元的資料中心協議,位於德州的 191 MW 設施,預計從 2027 年開始為其下一代模型提供電力。

Anthropic 的 IPO 障礙. 在可能高達 9650 億美元的 IPO 之前,投資者質疑 Anthropic 在廉價中國模型和政治逆風下的成長,儘管該公司宣稱未來將有健康和生物學應用。

Nvidia 的 5000 億美元推動. Nvidia 與六家金融公司合作,透過保證其晶片殘值最高 25%,為 AI 基礎設施籌集 5000 億美元,以對抗折舊擔憂。

Accel 對印度 AI 的押注. Accel 完成了一個超額認購的 5.5 億美元印度基金,押注 AI 將支撐消費、金融科技和製造業新創公司,而不是一個獨立類別。

OpenAI 員工現金兌現. 在 8520 億美元估值下的 70 億美元股票回購,讓現任和前任 OpenAI 員工能將股票變現,在可能的 IPO 前緩解壓力。

安全與透明

歐盟強制要求 AI 浮水印. 根據歐盟 AI 法案,Anthropic 和 OpenAI 承諾標記生成的內容;Claude 將在文字和圖像中嵌入隱形浮水印,並正在開發對舊版模型的支援。

Apple 照片出處. iOS 27 可能推出『Apple Reference Image』,在拍攝時嵌入來源後設資料,讓使用者證明 iPhone 照片不是深偽內容。

Spotify 標記 AI 藝術家. Spotify 將標記 AI 生成的藝術家個人檔案,並將其排除在推薦之外,在 9 月中旬推出此變更前會同時使用自我揭露和偵測機制。

AI 寫作爭議. 遊戲工作室 Saber 否認在《Rideshare Stimulator》中以 ChatGPT 取代編劇,但前任首席編劇聲稱 AI 被用於寫作和配音,且未在 Steam 上揭露。

AI 驅動的 Zoom 漏洞. 一個允許透過註釋功能接管裝置的嚴重 Zoom 漏洞,被發現僅需對公共 AI 模型使用不到 20 個提示詞即可利用,展示了 AI 加速的安全研究。

推理軌跡竊取. 研究人員將來自前沿模型的加密鏈式思考 token 重播到較弱的同系列模型中,對其進行越獄,並恢復了隱藏的推理,在公開會話中暴露了密碼和 API 金鑰。

信任 AI 生成的程式碼. IBM 和 Red Hat 擴展 Lightwell,為 AI 時代建立可驗證的軟體供應鏈,確保人工和 AI 生成的程式碼都具有來源和政策合規性。

這就是今天的全部內容 - 約5分鐘閱讀。

每天早上在瀏覽器中閱讀

此擴充功能在Chrome側邊欄中開啟摘要 — 一鍵點擊,無需帳戶。

新增至 Chrome — 免費