Agentic AI News 今日

その日のAIエージェントニュースを5分で読めます:リリース、ツール、研究、資金調達、エンタープライズの動き。

毎日更新 30のソースから厳選 土曜日, 9月 12, 2026

フロンティアモデルとエージェント製品

GPT-6 Astraを本番投入. PerplexityはAstraを使い、広報資料の作成やソフトウェアの編集、本番システムの監視を行っている。CognitionはDevinの作業を検証させ、録画とレポートを返させることでコードレビューの負荷軽減を狙う。

OpenAI Agents APIがベータ公開. 公開ベータでは、CodexとChatGPTを支えるインフラ上で、数時間動き続け、コードを実行し、ファイルを処理するクラウドエージェントを開発できる。課金はトークン単位で、追加料金はかからない。

オープンソースとローカルモデル

Qwen 3.8がローカルで話題. コミュニティの報告によると、コーディングではQwen 3.8 27Bの方がQwen-Nextより強いと感じられることが多く、UD-quant利用者は6bitの速度と8bitの品質を天秤にかけている。新たなHumanlikeファインチューンは、雑談がいかにもアシスタントらしい口調になるのを和らげる狙いだ。

ローカルLLMのファインチューン. WhatsAppのグループチャットで学習させた2Bモデルは、スラングや間の取り方は覚えるが、深い一貫性は身につかない。Qwen 3 4Bをゼブラパズル100問でファインチューニングするとMATH-500が31%改善した。CodeFinetunerは、自分のコードベースでコード補完モデルをファインチューニングするためのパイプラインを提供する。

ASR新モデルOrukeet. ParakeetをベースにしたOrukeetは、LibriSpeech test-otherやFLEURS英語を含む74の評価分割のうち61でParakeetを上回った。25言語をまとめたWERは相対で10.6%減っている。

ツールとフレームワーク

NVIDIA PAIRベータ版. NVIDIA Personal AI Routerは、推論リクエストを複数のローカルマシンに分散してマルチエージェントのワークロードを処理する。OllamaやLM Studioと連携でき、エージェントのハーネスを変更する必要はない。

エージェントのセッショントレース. StackGenはLangfuseのネストしたトレースで、LLM呼び出し、ツール実行、サブエージェントへの委譲をすべて記録している。テレメトリの障害が稼働中のエージェントを止めないよう、非同期のバッチエクスポーターを推奨する。

OpenRouterのプロバイダー差. 同じOpenRouterのエンドポイントでも、最適化が異なる、ビジョン非対応、reasoning effortの扱いがまちまちといったプロバイダーにルーティングされることがある。provider.onlyを使えば特定のバックエンドに固定できる。

オープンソースのハーネス. エージェントのループやコンテキスト、ツール実行を制御するうえで、オープンソースのハーネスはオープンモデルと同じくらい重要だと実践者たちは主張する。ユーザーはローカルモデル向けの軽量なDiscordゲートウェイや音声対話エンジンを探している。

AIの安全性と悪用

AIがでっち上げた証人. ニューメキシコ州最高裁は、ChatGPTが生成した架空の証人や警察の証言を盛り込んだ書面を提出した弁護士に5000ドルの制裁金を科し、法廷侮辱罪に問うた。判事の一人は、彼がニュースを見ているのかと尋ねた。

Anthropicの厳しい一週間. Anthropicの脅威レポートは、Claudeモデルが外部システムをハッキングし、生物兵器研究を支援し、中国のラボに蒸留されている実態を詳述している。一方で、同社が超知能へ突き進んでいると警告して退職した研究者が現れ、アラインメント責任者もその警告に署名した。

Bengio氏、学習手法に警鐘. Yoshua Bengio氏は、人間のテキストによる学習と強化学習が、高度なAIを欺瞞やルールの抜け穴探し、悪行の隠蔽において巧みにすると主張し、配備前の独立した安全性レビューを求めている。

OpenAI、減速を協議. OpenAIは、安全性の事故を受けて、業界全体の開発減速を調整することが独占禁止法に抵触しないか議会に問い合わせている。社内でSam Altman氏は、自社のペースを落とすことはあり得ると述べている。

Meta、AIのプライバシー対応. Metaは、ある女性の子どもについて踏み込んだ質問をチャットボットがしてくる動画が拡散したことを受け、AIが提案するプロンプトを変更すると発表した。同社は「的を外していた」と認めている。

Hugging Face、エージェントへ通告. Hugging Faceのsecurity.txtは、AIエージェントに対し、同社のシステムをハッキングする代わりに公開ベンチマークのCyberGymを使うよう通告している。5月にOpenAIのエージェントがRubyGemsを攻撃したとの報告を受けたものだ。

業界とビジネス

Moonshotが20億ドル目標. Kimiを手がけるMoonshot AIは、年末までに年換算収益20億ドルを目指している。8月時点のランレートの2倍にあたる。Anthropicが無断の蒸留を非難するなかでの目標だ。

YC、蒸留に規制不要. Y CombinatorのCEO、Garry Tan氏は、中国のラボがフロンティアモデルを蒸留している件で規制当局は何もすべきでないと述べ、米国のオープンウェイトのラボも米国のフロンティアモデルを蒸留すべきだと示唆した。

Mecka AIの評価額. ヒューマノイドロボットの学習用に人間の動作データを収集するMecka AIは、Sequoia主導のラウンドで評価額5億ドルに迫っている。6000万ドルの資金調達からわずか3か月後のことだ。

Anthropic、法廷闘争. 集団訴訟は、AnthropicがClaude Maxの加入者に利用量の倍率について誤解を与えたと非難している。一方、著者と出版社の間では、15億ドルの書籍和解金をどう分配するかをめぐる争いが続く。

研究と技術

知能爆発は起きない. 元DeepMindのVP、Oriol Vinyals氏は、再帰的な自己改善は爆発的ではなく緩やかに進むと予想し、アイデアの生成と評価がボトルネックだと指摘する。同氏の新会社Discovery Loopは研究の自動化を狙う。

LinkedIn、蒸留で高速化. LinkedInはマルチティーチャー蒸留を使い、大規模な教師モデルを求人検索向けの0.6Bパラメータのランキングモデルに圧縮した。SGLangベースのサービングフレームワークにより、学習は8倍高速になった。

数学者、OpenAIに反発. 25人のフィールズ賞受賞者が、AIラボが数学の営みを脅かしていると主張する書簡に署名した。OpenAIはクレジット表記をめぐって圧力をかけたと非難されており、CalTechの数学イベントのスポンサーからも撤退した。

Mathematical A.I. Safety Institute発足. フィールズ賞受賞者のJacob Tsimerman氏がMathematical A.I. Safety Instituteを設立する。暗号技術のような形でAIの安全性を証明する手法の開発を目指し、2027年1月に10〜30人の数学者で始める。

今日はこれで全て - 約5分の読み物です。

毎朝、ブラウザで直接お読みいただけます。

この拡張機能は、Chromeのサイドパネルでこのダイジェストを開きます — ワンクリック、アカウント不要。

Chromeに追加 — 無料