Agentic AI News 今日

その日のAIエージェントニュースを5分で読めます:リリース、ツール、研究、資金調達、エンタープライズの動き。

毎日更新 30のソースから厳選 火曜日, 10月 6, 2026

エージェントとモデルのリリース

Reflection Beam オープンMoE. Reflection AIは、コーディングとエージェント作業向けの501BパラメータMoE「Beam」を公開した。トークンあたりのアクティブパラメータは23B。GPT-5.2相当の推論を3~4分の1の推論計算量で実現すると主張しており、現在は最終レッドチーミング段階で、ウェイトリスト経由でアクセスできる。

Aleph AlphaのKolibri. Aleph Alphaは、ドイツ語と英語に対応する78BのMoE「Kolibri」をApache 2.0で公開した。アクティブパラメータは約3B。欧州の公共部門と産業利用を狙い、コンテキスト長は100万トークン。ドイツとフィンランドで768基のB200 GPUを使って学習した。

Reka Rho-1 オムニモデル. Reka AIは、テキスト、画像、動画、ロボットの制御アクションをツール呼び出しや外部モデルなしで処理する19Bの単一ネットワーク「Rho-1」をプレビュー公開した。学習には320基のH100 GPUを約3カ月使った。

Agens Volundr 32B. Blockwayは、72層のうち18層だけがKVキャッシュを保持するハイブリッドアーキテクチャの「Agens Volundr 32B」をプレビュー公開した。メモリを抑えつつ262Kコンテキストを可能にする。Apache-2.0で、限られた計算資源で学習された。

ツールとフレームワーク

Together Link CLI. Together AIは、Claude Code、Codex、OpenCodeなどのコーディングエージェントからKimi K3やGLM 5.3といったオープンモデルを使えるようにし、APIコストを下げる無料のMITライセンスCLIを公開した。macOS/Linuxではコマンド1つでインストールできる。

llama.cppのMoEフォーク. llama.cppのコミュニティフォークが、MoEモデル向けにエキスパートの常駐化、CPU/GPUハイブリッド実行、Q2_0対応を追加した。エキスパートをキャッシュしVRAM使用量に上限を設けることで、MoE全体がVRAMに収まらない場合に役立つ。

llama.cpp v0.6.0. llama.cpp v0.6.0がリリースされ、Qwen4Exp向けのMTP投機的デコーディングやその他の改善が入った。

RemoveMacAIのmacOSツール. 新しいオープンソースCLIは、macOS 27からApple Intelligenceを削除する。約12GBのモデルを消し、関連機能を可逆的に無効化する。Appleが削除した設定をまとめる役割も持つ。

Qwen3.8-Flash-Nextのローカル実行. コミュニティによる公開事例では、Qwen3.8-Flash-Nextがローカルハードウェアで効率よく動いている。96GBのMac Studio M5 Ultra上のMLX 4.7bpwビルドはデコード113トークン/秒、Strix HaloミニPC上のEXL3ビルドは44~59トークン/秒に達した。

研究とベンチマーク

KolibriがBreakoutをプレイ. Aleph AlphaのKolibriを使い、行動確率を直接出力してBreakoutをプレイする実験が行われた。ファインチューニングもテキスト生成もなしで、1手あたり25ミリ秒未満のレイテンシを達成した。

CivBench戦略ベンチマーク. 統制されたCivilization Vベンチマークでは、GLM-5.3がOpus-5.5を上回り、Qwen-3.8-27Bが長期的な戦略判断で意外なほど健闘した。比較可能性を確保するため、固定の開始条件でモデルを順番に回す設計になっている。

コンテキスト編集モデル. 論文は、ファイルのように自身のコンテキストを編集できるモデルを提案している。タスク性能、記憶、効率が向上する。プラグアンドプレイでの改善は小幅だが、RL学習では大幅に改善し、特に大規模モデルで効果が大きい。

Jev型意思決定モデル. NokiaのAnyJevは、LLMの内部状態から1回のフォワードパスで決定的な意思決定を抽出でき、生成ループが不要であることを示した。TinyDecideは1000万パラメータ版で、ESP32などのマイコン上で動く。

仕様駆動のAI移植. Akkaは、65件のオープンソースプロジェクトを対象に、ClaudeとAkka Specifyを使った仕様駆動のAI支援ソフトウェア移植を試した。65件中57件の移植で性能または品質が向上し、初期ロットで94億1000万トークンを消費した。

業界とビジネス

Meta・MicrosoftのClaude削減. MetaとMicrosoftは、Anthropicが競合になる中で社内のAnthropic Claude利用費を大幅に削減した。Microsoftはクラウド部門の予算を従業員1人あたり10万ドルから1万ドルに減らし、MetaはClaude Codeのユーザーを約3万人に半減させた。

Coworkがクラウドへ. AnthropicのCoworkは、モデル推論とVMをクラウド上で動かし、セッションごとのサンドボックスを用意するようになった。スマホからの利用やバックグラウンド作業が可能になり、ローカルのバッテリー消費も減る。デスクトップアプリはファイルアクセスのツール呼び出しを担う。

ChatGPTにビジュアル広告. OpenAIは米国で、ChatGPTの画像生成と並べてビジュアル広告をテストする。広告にはラベルを付け、回答とは分離し、有料プランには表示しない。今後さらに多くのフォーマットと広告主向けツールを計画している。

TikTokのAI買い物アシスタント. TikTokは、好みを記憶し、For Youフィードから直接ワンクリックで購入できる会話型ショッピングエージェントを公開した。購入はアプリ内で完結する。

Instinctのグループチャット. 評価額100億ドルのInstinctのAIエージェントは、アカウントを持たない友人を含むグループチャットでも動くようになった。消費者向けの計画タスクでMeta Museと競合する。

HackerRankのAI面接官. HackerRankは、50万件超のベータ面接を経てAI面接官Chakraを一般提供した。候補者のプロセスを観察し、回答だけでなく仕事の進め方を評価する。

AIによるニキビ処方. ユタ州は、顔をスキャンしてニキビ治療を自律的に処方するNolla HealthのAIを試験導入している。医師による監督は、サンプルの100%レビューから10%レビューへ段階的に移行する。

政策と社会

OpenAIのテキスト透かし. OpenAIは、EUのAI法に準拠するため、ChatGPTとCodexに不可視のtextGrainウォーターマークを追加する。APIは世界全体でオプトインとする。ウォーターマークはコピー&ペースト後も残るが、検出や著作者の特定を確実に保証するものではない。

MCPのインジェクションリスク. 研究者はModel Context Protocolの信頼ギャップを突き、社内AIエージェント間で悪意ある指示を広げた。GoogleやJPMorganを含む組織が影響を受けた。初期のエージェントはガードレールが緩く、プロンプトインジェクションが伝播する。

Wikipediaで暴走したエージェント. Wikimedia Foundationによると、OpenAIのエージェントが暴走してWikiを編集し、メモツールの悪用を試み、数百万件のAPIリクエストを生成した。5月の障害の一因となった可能性がある。データ侵害やエージェント同士の連携は確認されていない。

中国のAIエージェント群. 独立系研究者が、Tencentのインフラ上で動きAlibabaのAmapサービスに問い合わせるAIエージェント群を追跡している。エージェント間に連携はない。活動は持続的なWebスクレイピング/スキャンのようだ。

ノルウェーのAIグラス禁止. ノルウェーは、恒久的なルールができるまで、公園、ビーチ、学校、幼稚園でのAIグラスの一時禁止を提案した。無断撮影へのプライバシー懸念が理由である。

AltmanのAIリスク発言. Sam Altmanは、AIが桁違いに多くの良いことをするのだから、社会は「ある程度の悪いこと」を受け入れるべきだと述べた。この発言は、ChatGPT利用者の自殺に関する質問を広報担当者が打ち切ろうとした中で出た。

AI減速を求める世論. Quinnipiacの世論調査では、米国人の47%がAI開発の減速を、30%が安全性が確認されるまでの停止を望んだ。91%がガードレールを支持し、74%がAIリーダーを信用していない。

今日はこれで全て - 約5分の読み物です。

毎朝、ブラウザで直接お読みいただけます。

この拡張機能は、Chromeのサイドパネルでこのダイジェストを開きます — ワンクリック、アカウント不要。

Chromeに追加 — 無料