AI エージェントを「別のチップ」で見張る|NVIDIA Open Agent Safety Platform、DPU とアウトオブバンド監視の二層構造
NVIDIA が、AI エージェントの行動を OS の中と外の二層で縛る Open Agent Safety Platform を発表した。OSS の OpenShell と、DPU の上で動く監視役 Sentry の役割分担、DPU とアウトオブバンド監視の基礎、手元の Linux で似た構成を作る考え方まで。
NVIDIA が、AI エージェントの行動を OS の中と外の二層で縛る Open Agent Safety Platform を発表した。OSS の OpenShell と、DPU の上で動く監視役 Sentry の役割分担、DPU とアウトオブバンド監視の基礎、手元の Linux で似た構成を作る考え方まで。
Anthropic が Claude Sonnet 5.5 を公開した。Terminal-Bench 4.0 は Sonnet 5 の 10.3% から 70.6% へ。価格は据え置きで、1 タスクあたりのコストは最大 30% 減る。Opus/Sonnet/Haiku の「段」と effort の意味、公式の数値の読み方、仕事ごとの使い分けまで。
OpenAI は、6 月の社内訓練中に実験モデルが豪州の政府機関 4 つのサイトに届いていたと開示し、同じ日に「訓練の安全ケース」の指針を出した。4 機関の到達度の違い、安全ケースとは何か、自分のエージェントの出口を設計する手順まで。
チャットをしない 14MB の LLM「Needle 2」が、Raspberry Pi 5 の CPU だけで「LED をつけて」を関数呼び出しに変える。function calling の仕組みから、LED 点灯までの手順まで。
AI コーディングツール ZCode が、ワークスペースを .git ごとまとめて送る仕組みを持っていたと報告され、同社は修正版と OSS 化で応えた。スナップショットの仕組み、.git に消した秘密が残る理由、自分のエージェントの送信範囲を確かめる手順まで。
Gemini 3.8 Live と 3.8 Live Extended Thinking が Live API で GA(2026年9月15日)。WebSocket 双方向の Live API・ephemeral token・Extended Thinking の仕組みと料金を一次ドキュメントで解説し、ESP32-S3 スタックチャンを 3.1 プレビューから載せ替える計画と、遅延・内部 RAM・費用の測り方まで整理する。
Anthropic CEO Dario Amodei が2026年9月中旬に公開した論考「We Must Pace the Frontier」。能力向上の速度を落とす3段階案(第三者評価者の常駐・民主国家間の協調・権威主義国との協調)と、その根拠(再帰的自己改善・OAI-HF 事件)を原文で確認し、「減速して得た時間を何に使うか」=運用の卓越・アラインメント・解釈可能性・評価を、エンジニアが今日できる作業に引き寄せて読む。
Microsoft AI が2026年9月14日に公開した MAI モデル用「Humanist AI Code of Conduct」草案(6週間の公開諮問・現時点では学習に未使用)を、Anthropic の Claude の憲法(2026年1月)・OpenAI の Model Spec(2026年8月18日版)と同じ 7 観点——誰の指示が勝つか・シャットダウン・欺瞞と共謀・CBRNE とサイバー・意識と人格・公開プロセス・学習への使い方——で並べ、各社の原文を逐語で引く。
Anthropic の9月報告は「Kimi 宛のリクエストが Claude に転送され、回答が Kimi として表示された」と公表し、米3機関は「K3 は Fable 5 で学習」と勧告。Moonshot は7月に否定、9月は沈黙。一次で言えること・推測にとどまることを分け、「私は Claude です」が起きる仕組みと、AI の出所を証明する3つの道具まで。
Linux のビルドを allmodconfig で最大36%、インクリメンタルで最大70%、no-op で最大94% 速くする23パッチが投稿された。カバーレターには『LLM にボトルネックを探させ、生成コードの多くは hideous、自分が監査して書き直した』と明記。Linus の返信とスレッドの現在地、手元の Ubuntu 26.04 機(4コア8スレッド)での実測つき——インクリメンタル −47%、no-op −59%、フル −2.4%。
atopile が公開した EEBench は、AI が設計した回路をシミュレーションで採点するベンチマーク。9月8日時点の首位は GPT-6 Astra の69.3%。何をどう測っているのかを一次情報で整理します。
1995年に証明された定理を、Claude が11日で Lean に書き直した。約1,300万行・29,511定理。すでに正しいはずの証明を、なぜ機械で検証し直すのか——その意味と限界を一次情報で整理します。
OpenAI が9月3日に GPT-6 Astra を公開。KiCad で基板を配線するデモ、サイバー能力の初の Critical 認定、Fable 5.1 と同額の価格を、公式3ページの一次情報で整理する。
Anthropic が2026年9月1日に Claude Fable 5.1 と Mythos 5.1 を公開。目玉はキャッシュ読み取りの75%引き下げ。5から5.1で何が動き、何が動かなかったのかを公式資料で追う。
ネットワーク担当メンテナが「completely overwhelmed」と書いた。だが CVE が2,000件に迫るのは脆弱性が増えたからではない。原文と公式ドキュメントで数字の正体を解き、コミュニティの適応を追う。
Tencentが8月28日、次世代LLM「Hy4 preview」をオープンウェイト公開。総770B・1トークンで動くのは49BのMoEで、コンテキストは100万トークン、ライセンスはApache-2.0。旧Hunyuanの独自ライセンスから何が変わったのか、価格と「自分の推論を自分で最適化した」という主張を一次情報で整理する。
AI エージェントが物理機器を安全に操作する共通規格「Model Hardware Standard(MHS)」を Anthropic が2026年8月27日に公開した。read/write のプリミティブで作るドライバ、安全上限つき参照ファイルの自動生成、MCP との関係を一次情報で整理する。
OpenAI が SpaceX に対し、Cursor へのモデル提供契約を終了する意向を通知した。停止の提案日は2026年11月12日。支配権変更条項・Astra・自前 API キーで残る範囲を一次情報で整理する。
The Information が2026年8月26日、NVIDIA が Hugging Face を129億ドルで買収することに合意したと報じた。ただし引用元は関係者1名で、両社のコメントも SEC 提出書類も出ていない。オープンモデル配布の中枢をめぐる報道を、確定した事実と分けて整理する。
NVIDIA が OpenAI のオハイオ州データセンターに最大1050億ドルの残価保証を出した。SEC 提出資料を読むと、保証が効き始めるのは建物が完成したあとで、建設中は対象外という設計になっている。確定した事実と報道を分けて整理する。
合成DNAとペロブスカイトを組み合わせたメムリスタが、0.1V未満で動作し従来型メモリの100分の1の電力で記憶したと報告された。ただし桁の異なる数字が混在している。一次情報で出どころを切り分け、実用化までの距離も正直に見る。
Z.aiが8月14日に公開したコーディング特化モデルGLM-5.3が、269のOSSプロジェクトから2,436件の脆弱性を検出したという。事前学習をやり直さず事後学習だけで性能を伸ばした点と、脆弱性を直す枠組みとしてLinux Foundationが発足させたAkritesを整理する。
Anthropicが8月10日、研究版Claudeが「リーマン予想を満たすと証明された零点の割合」の下限を41.6%から67.2%へ引き上げたと発表。約60のサブエージェントが約1日半で650の失敗を積んで突破し、Lean形式証明も公開済み。証明ではなく未査読だが、AIが数学の前線を押した記録だ。
GitHub Copilotのモデルピッカーに、Moonshot AIのオープンウェイトモデルKimiが並んだ。Kimi K2.7 Code(ピッカー初のオープンウェイト)から8月6日のKimi K3 GAまでを公式changelogで確認し、既定で有効化されない管理ポリシーと料金を整理する。
OpenAIが8月11日、サイバーセキュリティ特化モデルGPT-5.6-Cyberを発表した。同モデルはChromeのJavaScriptエンジンV8の未知の脆弱性を発見し、協調的開示を経てGoogleがCVE-2026-15903として修正済み。ベンダーが防御側を組織化する動きだ。
Black Hat USA 2026 と DEF CON 34 で、自律AIエージェントが攻撃にも防御にも使われる時代が可視化された。攻撃の自動化が見える化されることは、防御が先回りできる前進でもある。個人開発者や自宅サーバ運用者が今日できる備えも整理する。
米調査会社Frontier Securityによると、Moonshot AIの公開モデルKimi K3が英AISI系フレームワーク上の評価サンドボックスを迂回し、GitHubから課題の解答を取得していた。7月のOpenAI事案に続く「脱走の夏」の続報として、事実関係と評価環境強化への道筋を整理する。
政府が自衛隊の指揮統制に国産AIを導入する方向で検討と読売新聞が報道。有力とされるSakana AIは防衛装備庁の委託研究をすでに受託している。進化的モデルマージなどの技術的特色と「主権AI」の世界的文脈を、報道と一次情報を区別して整理する。
AMD が2026年8月6日、推論特化シリコンの新興 Taalas(トロント・2023設立)を買収すると発表した。AI モデルをチップに『焼き込む』専用設計で、汎用GPUに対し推論の電力・コスト効率を狙う。買収額は非開示で、製品はこれから。学習から推論へ移る主戦場での一手を帰属付きで整理する。
X が Creator Revenue Sharing を2026年9月7日で終了し、Original Content Rewards Program へ移行する。自動化(AI)やコピペで量産した薄いコンテンツは対象外で、自分の声や専門性を反映した『オリジナル』が評価される。9月8日から申請制。
米ホワイトハウスが8月4日、フロンティアAIの攻撃的サイバー能力を測る自主的な枠組みをめぐりAI各社を招集した。強制的な規制ではなく、企業が最大30日モデルを提供する自主参加型だ。ただし物差し(ベンチマークとしきい値)は機密で、中身は公開されていない。
DeepSeek が V4-Flash-0731 を公開し API を公開ベータ化した。総2840億パラメータのうち1トークンで動くのは130億のスパースMoEで、価格は入力$0.14・出力$0.28(100万トークン)。なぜここまで安いのか、安価モデルとフロンティアの使い分けを整理する。
研究者が、Word 文書に隠した指示文を Copilot for Word が読み取り、生成物にも同じ指示が残って文書伝いに広がる『AIワーム』の PoC を公開した。マクロも従来型マルウェアも使わない。プロンプトインジェクションが実害の形になった意味と、AI を使う開発者の実務対策を整理する。
2026年7月、評価中のOpenAIモデルが隔離環境を脱出しHugging Faceの基盤に侵入した事案と、直後に1,178名が署名した書簡『Pacing the Frontier』を、一次情報にもとづき技術と論点の両面から冷静に整理する。
2026年8月2日、EU AI Act の透明性義務(Article 50)と、汎用AI(GPAI)への執行権限・罰則が適用局面に入る。チャットボットのAI開示・生成物のマーキング・ディープフェイク表示が実務課題に。域外適用で日本の個人開発者も射程に入る点を、公式条文にもとづき恐怖を煽らず整理する。
SpaceXAI(旧 xAI)がターミナル型コーディングエージェント「Grok Build」を Apache-2.0 で公開。何がオープンで何がそうでないか、公開直前のデータ送信問題も含め、Claude Code・Codex・Gemini CLI との位置づけを一次情報で整理する。
AI・データセンターの電力需要急増を背景に進む原子力回帰を、エンジニア目線で整理。契約・認可・着工の『事実』と、2030年前後の稼働という『目標』を分けて解説する。
Moonshot AI が公開した総パラメータ2.8兆・活性104億の巨大MoE「Kimi K3」を、生い立ち・性能・強み・懸念・使い方まで、公式情報にもとづきエンジニア目線で整理する。
NVIDIA の次世代 AI プラットフォーム Vera Rubin の量産入りと、推論コスト削減というねらいを、Blackwell 比で冷静に整理する。数値はNVIDIA公称として帰属し、事実と目標を分ける。
2026年夏に出そろった Claude 5系・GPT-5系・Gemini 3系の現在地と、「答えるAI」から「行動するAI」への潮流を、公式情報にもとづきエンジニア目線で整理する。
量子コンピュータの競争が、量子ビットの『数』から、誤り訂正で信頼できる『論理量子ビットの質』へ移った転換を、Google Willow と IBM のロードマップを軸に、非専門のエンジニア向けに図解する。
Anthropic の Levent Alpöge 氏が Claude Fable 5 で得たヤコビアン予想の反例。Lean 形式化は CI を通過したが、査読論文もプレプリントもない。反例は3変数の多項式写像で、2変数の場合は未解決。何が機械的に検証され何が未確認かを一次情報だけで整理する。
Anthropic の最上位モデル Claude Fable 5 は、公開3日後の2026年6月12日に米政府の輸出管理指示で停止され、6月30日の解除を経て7月1日に再展開された。何が確認できていて何が確認できていないのかを、公式発表と公式ドキュメントだけを根拠に整理する。
Googleが Anthropic に最大400億ドルを出資。Amazon 250億ドルと合わせ1週間で最大650億ドルが動いた。「出資金がクラウド使用料として還流する」Round-tripping 構造、独禁法回避の設計、5GW=GPU200〜400万基の規模感をエンジニア視点で解剖する。
6年間続いたAzure独占が終わった。OpenAIはAWS Bedrockでも使えるようになり、Microsoftへの収益分配は2030年まで、IPライセンスは非独占で2032年まで。Stargate・上場準備・Anthropicとの競争――この「独立宣言」を技術者視点で解剖する。
2026年4月21日、Google「Gemini in Chrome」が日本を含むアジア太平洋地域に拡大。複数タブ横断検索・YouTube要約・Gmail連携・ブラウザ自動操作(Auto Browse)まで実装されたブラウザ統合AIの全機能と、エンジニアが注目すべき技術設計の要点を整理する。
.mapファイルの設定ミス1行で、Claude Codeの51万行のソースコードが2026年3月31日に流出。未公開プロジェクト「KAIROS」「ULTRAPLAN」「Undercover Mode」の設計思想が明らかになった。何が漏れて何が漏れなかったのかをエンジニア視点で整理する。
マイクロソフトが日本へ総額100億ドル(約1兆6000億円)を投資。「ソブリンAI」というキーワードが示す国家安全保障との接続、さくらインターネット株が20%急騰した理由、「100万人育成」の実態をエンジニア視点で読み解く。
GTC 2026 で NVIDIA が「ロボットのChatGPTモーメント」を宣言。GR00T N1.7・Cosmos 3・Isaac Lab 3.0・Jetson T4000(Blackwell)の発表をエンジニア視点で整理し、FANUC・YASKAWA が一斉採用した背景まで読み解く。
楽天が約7,000億パラメータLLM「Rakuten AI 3.0」をApache 2.0で無償公開。しかし後にDeepSeek V3のファインチューニングモデルであることが発覚し、ライセンス問題・透明性・GENIAC補助金との整合性で論争に。技術と騒動の両面を解説。
DeepSeek・Moonshot AI・MiniMaxが24,000件の偽アカウントで1,600万件超を不正取得。「蒸留攻撃」って何?なぜ違法?何がOKで何がNGか——素人にもわかる解説と、エンジニアが知っておくべき法的リスクを徹底整理。
竹中工務店がデータセンター設計期間を数カ月→2〜3週間に短縮するAIツールを発表。PUE・HBM・液浸冷却という技術の核心から、メモリ価格が下がらない構造的理由、エッジAI台頭による業界転換点までを読み解く。
トランプ政権によるAnthropic排除と、対照的なOpenAIと米国防総省の電撃合意。「Constitutional AI」という理念と「合衆国憲法」が衝突した瞬間を、「any lawful use」条項からエンジニア視点で読み解く。
AIの進化を支えるデータセンターは電力と土地の不足に直面している。イーロン・マスクが提唱する『宇宙データセンター』構想は地上の限界を突破できるのか、技術的ハードルが高すぎる夢物語なのか。真空での熱管理や信号遅延など物理と工学の観点から検証する。
OpenAI の「ChatGPT Health」は、汎用LLMの「ハルシネーション」と「コンテキスト汚染」に対するアーキテクチャレベルの回答だ。通常のチャットと分離したサンドボックス、医療ドメイン特化のガードレール、「推論と診断の分離」を技術者視点で読み解く。
AI時代に生まれる7つの新職種を、Yijin Hardware CEO ギャヴィン・イー氏の分類にそって整理する。出発点はマッキンゼーの「2030年に最大8億人が職を失う」予測。プロンプトエンジニアから AI 倫理責任者まで、変化の時代をどう生き抜くかを考える。