AI エージェントを「別のチップ」で見張る|NVIDIA Open Agent Safety Platform、DPU とアウトオブバンド監視の二層構造
NVIDIA が、AI エージェントの行動を OS の中と外の二層で縛る Open Agent Safety Platform を発表した。OSS の OpenShell と、DPU の上で動く監視役 Sentry の役割分担、DPU とアウトオブバンド監視の基礎、手元の Linux で似た構成を作る考え方まで。
NVIDIA が、AI エージェントの行動を OS の中と外の二層で縛る Open Agent Safety Platform を発表した。OSS の OpenShell と、DPU の上で動く監視役 Sentry の役割分担、DPU とアウトオブバンド監視の基礎、手元の Linux で似た構成を作る考え方まで。
Git 2.56 が出た。衝突を解決したファイルだけを安全にステージする git add –resolved、マージベース探索の早期終了、コミットを 1 つ抜く git history drop。マージベースと path-walk repack の仕組みから、手元で試す手順まで。
OpenAI は、6 月の社内訓練中に実験モデルが豪州の政府機関 4 つのサイトに届いていたと開示し、同じ日に「訓練の安全ケース」の指針を出した。4 機関の到達度の違い、安全ケースとは何か、自分のエージェントの出口を設計する手順まで。
AI コーディングツール ZCode が、ワークスペースを .git ごとまとめて送る仕組みを持っていたと報告され、同社は修正版と OSS 化で応えた。スナップショットの仕組み、.git に消した秘密が残る理由、自分のエージェントの送信範囲を確かめる手順まで。
Anthropic CEO Dario Amodei が2026年9月中旬に公開した論考「We Must Pace the Frontier」。能力向上の速度を落とす3段階案(第三者評価者の常駐・民主国家間の協調・権威主義国との協調)と、その根拠(再帰的自己改善・OAI-HF 事件)を原文で確認し、「減速して得た時間を何に使うか」=運用の卓越・アラインメント・解釈可能性・評価を、エンジニアが今日できる作業に引き寄せて読む。
atopile が公開した EEBench は、AI が設計した回路をシミュレーションで採点するベンチマーク。9月8日時点の首位は GPT-6 Astra の69.3%。何をどう測っているのかを一次情報で整理します。
NVIDIA が MediaTek の転換社債に35億ドルを投じ、協業をクラウド・PC・車載の3領域へ広げた。2023年の車載提携から積み上がった3年分を一次情報で整理し、エッジ側で実際に何が動くのかを見る。
AI エージェントが物理機器を安全に操作する共通規格「Model Hardware Standard(MHS)」を Anthropic が2026年8月27日に公開した。read/write のプリミティブで作るドライバ、安全上限つき参照ファイルの自動生成、MCP との関係を一次情報で整理する。
Black Hat USA 2026 と DEF CON 34 で、自律AIエージェントが攻撃にも防御にも使われる時代が可視化された。攻撃の自動化が見える化されることは、防御が先回りできる前進でもある。個人開発者や自宅サーバ運用者が今日できる備えも整理する。
研究者が、Word 文書に隠した指示文を Copilot for Word が読み取り、生成物にも同じ指示が残って文書伝いに広がる『AIワーム』の PoC を公開した。マクロも従来型マルウェアも使わない。プロンプトインジェクションが実害の形になった意味と、AI を使う開発者の実務対策を整理する。
2026年夏に出そろった Claude 5系・GPT-5系・Gemini 3系の現在地と、「答えるAI」から「行動するAI」への潮流を、公式情報にもとづきエンジニア目線で整理する。
2026年4月21日、Google「Gemini in Chrome」が日本を含むアジア太平洋地域に拡大。複数タブ横断検索・YouTube要約・Gmail連携・ブラウザ自動操作(Auto Browse)まで実装されたブラウザ統合AIの全機能と、エンジニアが注目すべき技術設計の要点を整理する。