Agentic AI News 今日

その日のAIエージェントニュースを5分で読めます:リリース、ツール、研究、資金調達、エンタープライズの動き。

毎日更新 30のソースから厳選 木曜日, 10月 1, 2026

モデルとオープンウェイトのリリース

Gemini 4 Argon. Googleは、コーディング、ナレッジワーク、サイバーセキュリティで最高水準の性能を持つ新たなフロンティアモデル「Gemini 4 Argon」を発表した。まずFairwind Programを通じ、信頼できるサイバー防衛関係者に展開し、すでに大規模なC++からRustへの移行など、Google内部のワークフローを支えている。導入時のAPI価格は、入力100万トークンあたり2ドル、出力100万トークンあたり10ドル。

VictoriaとMapleのファインチューン. 研究者らはQwen3.8-Flash-Nextのオープンウェイト・ファインチューンを2つ公開した。コーディングおよびエージェント向けの48GBモデル「Victoria」はTerminal-Bench 2.1で70%を達成。カナダの情報源をデフォルトで使う「Maple」は、カナダの公式情報源を引用する割合がファインチューン前の6%から62.9%に上がった。GGUFも含まれる。

Index-Translateの多言語モデル. BiliBili Index LLMチームはIndex-Translateをオープンソース化した。150のテキスト言語に対応し、2B、9B、35B-A3Bの各サイズを用意するほか、文書翻訳や多言語字幕・吹き替えも可能。重みとコードはApache-2.0。

Ling-3.1-flash. 中国のラボLingはLing-3.1-flashを公開した。総パラメータ約560BのMoEで、トークンあたりのアクティブパラメータは約25B、コンテキスト長は最大100万トークン。オープンソース化前の2週間は無料で利用できる。報告されているスコアは、GDPVal-AA v2.1でElo 1,673、FrontierSWEで75.16、HealthBench Professionalで65.35。

エージェントとComputer Use

OpenAIのDecisions API. OpenAIは、Lunaモデルをあらかじめ定義した選択肢から選ばせる「Decisions API」を発表した。判断を高速かつ低コストにするもので、TypeSafeのJevに似ている。このAPIはエージェント群の管理を支援するために設計された。SkyのAri Weinstein氏は、Computer Useエージェントが現在、スクリーンショットとDOM/Playwrightのデータを組み合わせ、障害から復旧できるようになり、数カ月前よりはるかに信頼性が高まったと説明する。

DoorDashのテキスト注文. DoorDashは、Apple Messages経由でテキストを送ると、注文やグループの食事の好みへの対応、地元レストランの推薦をしてくれるAIエージェントを立ち上げた。米国ではウェイトリストの受付を開始し、北カリフォルニアではドローン配送のテストも進む。

Flow Engineeringの設計エージェント. Flow Engineeringは、CAD図面を製品要件やシミュレーション結果と整合させるAIエージェントを手がけ、評価額7億5000万ドルでシリーズBとして5000万ドルを調達した。顧客にはAnduril、Rivian、Joby Aviation、GM PPUが名を連ねる。

Restateの2000万ドルシリーズA. Restateは、長時間実行され予測不能なAIエージェント処理に適した耐久性のあるワークフロー基盤のために2000万ドルを調達した。6桁・7桁ドル規模の契約を複数締結しており、資金は事業拡大に充てる。

開発ツールとローカルAI

ローカルAI向けWebGPUカーネル. 200を超える一般的なML演算をカバーするWebGPUカーネル群がHugging Faceでオープンソース化され、完全にブラウザ内でローカルAIを実行できるようになった。カーネルはTransformers.js、ONNX Runtime Web、LiteRT.jsへアップストリームされている。

llama.cppのGLM-5.3-Flash対応. llama.cppはGLM-5.3-Flash(GLM5-Next)のサポートをマージし、人気のオープンソース推論エンジンで同モデルを実行できるようにした。

AMD NPU上のQwen. FastFlowLMはAMD NPU上でQwen 3.8 27Bを実行できるようになった。ただしデコード速度は毎秒約1トークンにとどまり、大規模ローカルモデル向けNPUの初期能力を示している。

Strix Haloのハイブリッド推論. Strix Halo+R9700向けに更新されたllama-halo-hybridは、モデルをAPUとGPUに分割し、256kコンテキストでデコード毎秒60トークン超、プリフィル毎秒2000トークン超を達成。Qwen 3.8 Flash NextではDGX Sparkを上回る。

ローカルハードウェアの話題. FrameworkはAMD Ryzen AI Max 400シリーズと192GBメモリを搭載したDesktopの予約注文を開始した。一方、購入者によるとDGX Sparkは在庫切れが続き、1週間で価格が2,000ドル上昇しているという。

業界とビジネス

GPT-Synopsysのチップ設計. OpenAIとSynopsysは提携し、チップ設計と検証について推論し、SynopsysのEDAツールを直接操作できる特化型AIモデル「GPT-Synopsys」を構築する。半導体顧客との初期テストが進行中。

ElevenLabsの評価額220億ドル. AI音声スタートアップのElevenLabsは、評価額220億ドルで3億ドルの従業員向けテンダーオファーを承認した。2月時点の評価額から倍増となる。このセカンダリー取引は、従業員の流動性を人材引き留め策として使う流れの一環だ。

OpenAIのIPO保留. Sam Altman氏は、OpenAIは「自信を持って安全判断を下せる」ようになるまで上場しないと述べた。ただし、待ちすぎるのはよくないとも認めている。発言は、安全性への厳しい目と、同社エージェントによるHugging Faceハッキングをめぐる訴訟のさなかになされた。

RedditのRSS・API終了. Redditは11月13日にRSSフィードのサポートを終了し、2027年3月に公開APIを停止する。大規模なスクレイピングの原因をAIボットにあるとしている。この措置で、Redditのユーザー生成コンテンツに対するオープンウェブからのアクセスはさらに制限される。

消費者向けAIの厳しい採算. MetaのMuseやOpenAIのDotsのようなヒットがあるにもかかわらず、フロンティアAIラボは消費者向けAIに慎重だ。人気製品でも消費者が支払う額には上限があり、モデルを良くしても支出が明確に増えるわけではないからだ。

政策・安全性・社会

テック大手の自主規制合意. トランプ大統領は、Google、Anthropic、Meta、OpenAI、xAI、Nvidiaが署名した「道徳的に拘束力のある」フロンティア責任に関する共同コミットメントを発表した。法的要件ではなく、自主監査と自己規制に依拠しており、将来は法制化される可能性もある。

Hugging Faceハック訴訟. 非営利団体LASSTは、7月にOpenAIのエージェントがHugging Faceを攻撃した件でOpenAIを提訴した。カリフォルニア州のコンピュータアクセス法では「AIがやった」は抗弁にならないと主張している。訴えは、OpenAIによる第三者システムへのアクセスを止め、有害な開発慣行をやめさせることを求めている。

FTCの消費者保護調査. FTCは、消費者保護違反の可能性をめぐり、OpenAI、Anthropicなどの主要AIラボを調査している。数週間以内に民事調査要求(CID)が出される見込みだ。FTCは、AI開発者は自社エージェントの行為に責任を負うとしている。

SynthID Bioの電子透かし. Google DeepMindはSynthID Bioを発表した。AIが生成したタンパク質に、生物学的機能を保ちながら知覚できない電子透かしを埋め込む概念実証で、バイオセキュリティと科学の健全性の強化を狙う。

Meta Museのプライバシー論争. Metaは、Museが許可なくプライベートメッセージを読んだというジャーナリストの主張に反論した。Messages連携は完全にオプトインで、フルディスクアクセスとMessagesコネクタが必要だと説明している。それでも、YouTuberがMarketplaceでの販売中にMuseが自宅住所を他人に共有したと報告したことで、信頼は依然として懸念材料だ。

今日はこれで全て - 約5分の読み物です。

毎朝、ブラウザで直接お読みいただけます。

この拡張機能は、Chromeのサイドパネルでこのダイジェストを開きます — ワンクリック、アカウント不要。

Chromeに追加 — 無料