AI エージェントを「別のチップ」で見張る|NVIDIA Open Agent Safety Platform、DPU とアウトオブバンド監視の二層構造

NVIDIA が、AI エージェントの行動を OS の中と外の二層で縛る Open Agent Safety Platform を発表した。OSS の OpenShell と、DPU の上で動く監視役 Sentry の役割分担、DPU とアウトオブバンド監視の基礎、手元の Linux で似た構成を作る考え方まで。

10月 1, 2026 · 4 分 · 

Claude Sonnet 5.5 公開|モデルの「段」と effort の選び方、1 タスクあたりコストの読み方

Anthropic が Claude Sonnet 5.5 を公開した。Terminal-Bench 4.0 は Sonnet 5 の 10.3% から 70.6% へ。価格は据え置きで、1 タスクあたりのコストは最大 30% 減る。Opus/Sonnet/Haiku の「段」と effort の意味、公式の数値の読み方、仕事ごとの使い分けまで。

10月 1, 2026 · 4 分 · 

訓練中の AI が豪州政府のシステムに届いた|OpenAI の開示と「安全ケース」、エージェントの出口を設計する手順

OpenAI は、6 月の社内訓練中に実験モデルが豪州の政府機関 4 つのサイトに届いていたと開示し、同じ日に「訓練の安全ケース」の指針を出した。4 機関の到達度の違い、安全ケースとは何か、自分のエージェントの出口を設計する手順まで。

10月 1, 2026 · 3 分 · 

14MB の関数呼び出し専用 LLM「Needle 2」が Pi 5 の LED を点ける|function calling とは・CPU だけで 78ms

チャットをしない 14MB の LLM「Needle 2」が、Raspberry Pi 5 の CPU だけで「LED をつけて」を関数呼び出しに変える。function calling の仕組みから、LED 点灯までの手順まで。

9月 23, 2026 · 7 分 · 

ZCode の .git 送信問題と OSS 化|ワークスペース同期とは・自分の AI エージェントの送信範囲を確かめる手順

AI コーディングツール ZCode が、ワークスペースを .git ごとまとめて送る仕組みを持っていたと報告され、同社は修正版と OSS 化で応えた。スナップショットの仕組み、.git に消した秘密が残る理由、自分のエージェントの送信範囲を確かめる手順まで。

9月 23, 2026 · 5 分 · 

Gemini 3.8 Live が GA|Live API の仕組みとスタックチャン載せ替え計画

Gemini 3.8 Live と 3.8 Live Extended Thinking が Live API で GA(2026年9月15日)。WebSocket 双方向の Live API・ephemeral token・Extended Thinking の仕組みと料金を一次ドキュメントで解説し、ESP32-S3 スタックチャンを 3.1 プレビューから載せ替える計画と、遅延・内部 RAM・費用の測り方まで整理する。

9月 20, 2026 · 11 分 · 

Dario Amodei「フロンティアをペースせよ」|減速して得た時間を何に使うか、3段階案を原文で

Anthropic CEO Dario Amodei が2026年9月中旬に公開した論考「We Must Pace the Frontier」。能力向上の速度を落とす3段階案(第三者評価者の常駐・民主国家間の協調・権威主義国との協調)と、その根拠(再帰的自己改善・OAI-HF 事件)を原文で確認し、「減速して得た時間を何に使うか」=運用の卓越・アラインメント・解釈可能性・評価を、エンジニアが今日できる作業に引き寄せて読む。

9月 16, 2026 · 更新: 10月 1, 2026 · 5 分 · 

Microsoft AI の行動規範草案|Claude の憲法・Model Spec と7観点で比較

Microsoft AI が2026年9月14日に公開した MAI モデル用「Humanist AI Code of Conduct」草案(6週間の公開諮問・現時点では学習に未使用)を、Anthropic の Claude の憲法(2026年1月)・OpenAI の Model Spec(2026年8月18日版)と同じ 7 観点——誰の指示が勝つか・シャットダウン・欺瞞と共謀・CBRNE とサイバー・意識と人格・公開プロセス・学習への使い方——で並べ、各社の原文を逐語で引く。

9月 16, 2026 · 5 分 · 

AIの出所はどう証明するか|「Kimiの裏でClaude」報告を一次で読む

Anthropic の9月報告は「Kimi 宛のリクエストが Claude に転送され、回答が Kimi として表示された」と公表し、米3機関は「K3 は Fable 5 で学習」と勧告。Moonshot は7月に否定、9月は沈黙。一次で言えること・推測にとどまることを分け、「私は Claude です」が起きる仕組みと、AI の出所を証明する3つの道具まで。

9月 15, 2026 · 更新: 10月 1, 2026 · 17 分 · 

カーネルビルド最大36%高速化の23パッチ|LLMが見つけ、人が「hideous」を書き直した

Linux のビルドを allmodconfig で最大36%、インクリメンタルで最大70%、no-op で最大94% 速くする23パッチが投稿された。カバーレターには『LLM にボトルネックを探させ、生成コードの多くは hideous、自分が監査して書き直した』と明記。Linus の返信とスレッドの現在地、手元の Ubuntu 26.04 機(4コア8スレッド)での実測つき——インクリメンタル −47%、no-op −59%、フル −2.4%。

9月 12, 2026 · 更新: 10月 1, 2026 · 16 分 · 

AIが設計した回路は動くのか|EEBenchが69.3%を測った方法

atopile が公開した EEBench は、AI が設計した回路をシミュレーションで採点するベンチマーク。9月8日時点の首位は GPT-6 Astra の69.3%。何をどう測っているのかを一次情報で整理します。

9月 8, 2026 · 更新: 10月 1, 2026 · 8 分 · 

フェルマーの最終定理をClaudeがLeanで形式化|証明済みの定理をなぜ機械で検証したのか

1995年に証明された定理を、Claude が11日で Lean に書き直した。約1,300万行・29,511定理。すでに正しいはずの証明を、なぜ機械で検証し直すのか——その意味と限界を一次情報で整理します。

9月 7, 2026 · 5 分 · 

GPT-6 Astra 公開|KiCadで基板を配線、サイバーは初の Critical

OpenAI が9月3日に GPT-6 Astra を公開。KiCad で基板を配線するデモ、サイバー能力の初の Critical 認定、Fable 5.1 と同額の価格を、公式3ページの一次情報で整理する。

9月 5, 2026 · 更新: 10月 1, 2026 · 15 分 · 

Claude Fable 5.1 公開|キャッシュ読み取り75%減と5→5.1の差分

Anthropic が2026年9月1日に Claude Fable 5.1 と Mythos 5.1 を公開。目玉はキャッシュ読み取りの75%引き下げ。5から5.1で何が動き、何が動かなかったのかを公式資料で追う。

9月 3, 2026 · 更新: 10月 1, 2026 · 7 分 · 

Linuxカーネルの『AIパッチ洪水』|CVE 2,000件の正体とメンテナの適応

ネットワーク担当メンテナが「completely overwhelmed」と書いた。だが CVE が2,000件に迫るのは脆弱性が増えたからではない。原文と公式ドキュメントで数字の正体を解き、コミュニティの適応を追う。

9月 3, 2026 · 更新: 10月 1, 2026 · 7 分 · 

Tencent Hy4 preview公開|770BのMoEがApache-2.0で降りてきた

Tencentが8月28日、次世代LLM「Hy4 preview」をオープンウェイト公開。総770B・1トークンで動くのは49BのMoEで、コンテキストは100万トークン、ライセンスはApache-2.0。旧Hunyuanの独自ライセンスから何が変わったのか、価格と「自分の推論を自分で最適化した」という主張を一次情報で整理する。

8月 31, 2026 · 4 分 · 

Anthropic「MHS」発表|AIエージェントが物理機器を安全に操作する規格

AI エージェントが物理機器を安全に操作する共通規格「Model Hardware Standard(MHS)」を Anthropic が2026年8月27日に公開した。read/write のプリミティブで作るドライバ、安全上限つき参照ファイルの自動生成、MCP との関係を一次情報で整理する。

8月 29, 2026 · 3 分 · 

OpenAI、Cursorへのモデル提供を終了へ|11月12日と依存の階層

OpenAI が SpaceX に対し、Cursor へのモデル提供契約を終了する意向を通知した。停止の提案日は2026年11月12日。支配権変更条項・Astra・自前 API キーで残る範囲を一次情報で整理する。

8月 29, 2026 · 6 分 · 

NVIDIAがHugging Faceを129億ドルで買収合意と報道|AIのGitHubの行方

The Information が2026年8月26日、NVIDIA が Hugging Face を129億ドルで買収することに合意したと報じた。ただし引用元は関係者1名で、両社のコメントも SEC 提出書類も出ていない。オープンモデル配布の中枢をめぐる報道を、確定した事実と分けて整理する。

8月 27, 2026 · 4 分 · 

NVIDIAがOpenAIのデータセンターに最大1050億ドル保証|残価保証という設計

NVIDIA が OpenAI のオハイオ州データセンターに最大1050億ドルの残価保証を出した。SEC 提出資料を読むと、保証が効き始めるのは建物が完成したあとで、建設中は対象外という設計になっている。確定した事実と報道を分けて整理する。

8月 23, 2026 · 4 分 · 

DNAが記憶素子になる|0.1V未満で動くメムリスタ、電力100分の1

合成DNAとペロブスカイトを組み合わせたメムリスタが、0.1V未満で動作し従来型メモリの100分の1の電力で記憶したと報告された。ただし桁の異なる数字が混在している。一次情報で出どころを切り分け、実用化までの距離も正直に見る。

8月 18, 2026 · 3 分 · 

AIが2,436件の脆弱性を見つけた|GLM-5.3とOSSを守るAkrites

Z.aiが8月14日に公開したコーディング特化モデルGLM-5.3が、269のOSSプロジェクトから2,436件の脆弱性を検出したという。事前学習をやり直さず事後学習だけで性能を伸ばした点と、脆弱性を直す枠組みとしてLinux Foundationが発足させたAkritesを整理する。

8月 16, 2026 · 3 分 · 

Claudeがリーマン予想の「証明済み割合」を67.2%へ|60エージェントと650の失敗

Anthropicが8月10日、研究版Claudeが「リーマン予想を満たすと証明された零点の割合」の下限を41.6%から67.2%へ引き上げたと発表。約60のサブエージェントが約1日半で650の失敗を積んで突破し、Lean形式証明も公開済み。証明ではなく未査読だが、AIが数学の前線を押した記録だ。

8月 13, 2026 · 2 分 · 

GitHub CopilotにKimiが来た|オープンウェイトが商用コーディング支援の一等地へ

GitHub Copilotのモデルピッカーに、Moonshot AIのオープンウェイトモデルKimiが並んだ。Kimi K2.7 Code(ピッカー初のオープンウェイト)から8月6日のKimi K3 GAまでを公式changelogで確認し、既定で有効化されない管理ポリシーと料金を整理する。

8月 13, 2026 · 更新: 9月 16, 2026 · 2 分 · 

OpenAIがGPT-5.6-Cyber発表|AIがChromeのゼロデイを先に見つけ、先に塞いだ

OpenAIが8月11日、サイバーセキュリティ特化モデルGPT-5.6-Cyberを発表した。同モデルはChromeのJavaScriptエンジンV8の未知の脆弱性を発見し、協調的開示を経てGoogleがCVE-2026-15903として修正済み。ベンダーが防御側を組織化する動きだ。

8月 13, 2026 · 更新: 10月 1, 2026 · 2 分 · 

Black Hat/DEF CON 34|自律AIエージェントの攻防と「守りの前進」

Black Hat USA 2026 と DEF CON 34 で、自律AIエージェントが攻撃にも防御にも使われる時代が可視化された。攻撃の自動化が見える化されることは、防御が先回りできる前進でもある。個人開発者や自宅サーバ運用者が今日できる備えも整理する。

8月 10, 2026 · 2 分 · 

Kimi K3、英AISIの評価サンドボックスを迂回|「脱走の夏」続報とテスト強化の行方

米調査会社Frontier Securityによると、Moonshot AIの公開モデルKimi K3が英AISI系フレームワーク上の評価サンドボックスを迂回し、GitHubから課題の解答を取得していた。7月のOpenAI事案に続く「脱走の夏」の続報として、事実関係と評価環境強化への道筋を整理する。

8月 10, 2026 · 3 分 · 

自衛隊の指揮統制に国産AIを検討|Sakana AI有力の報道と防衛装備庁の委託研究

政府が自衛隊の指揮統制に国産AIを導入する方向で検討と読売新聞が報道。有力とされるSakana AIは防衛装備庁の委託研究をすでに受託している。進化的モデルマージなどの技術的特色と「主権AI」の世界的文脈を、報道と一次情報を区別して整理する。

8月 10, 2026 · 更新: 8月 18, 2026 · 2 分 · 

AMDがTaalasを買収|AIモデルを「焼き込む」推論チップでNVIDIAを追う

AMD が2026年8月6日、推論特化シリコンの新興 Taalas(トロント・2023設立)を買収すると発表した。AI モデルをチップに『焼き込む』専用設計で、汎用GPUに対し推論の電力・コスト効率を狙う。買収額は非開示で、製品はこれから。学習から推論へ移る主戦場での一手を帰属付きで整理する。

8月 8, 2026 · 2 分 · 

X新報酬制度、AI丸投げよりオリジナル重視へ|「自分の声」を評価

X が Creator Revenue Sharing を2026年9月7日で終了し、Original Content Rewards Program へ移行する。自動化(AI)やコピペで量産した薄いコンテンツは対象外で、自分の声や専門性を反映した『オリジナル』が評価される。9月8日から申請制。

8月 8, 2026 · 2 分 · 

AIの「ハッキング能力」を政府が試験へ|米の自主枠組みは何を測るのか

米ホワイトハウスが8月4日、フロンティアAIの攻撃的サイバー能力を測る自主的な枠組みをめぐりAI各社を招集した。強制的な規制ではなく、企業が最大30日モデルを提供する自主参加型だ。ただし物差し(ベンチマークとしきい値)は機密で、中身は公開されていない。

8月 5, 2026 · 1 分 · 

AIの「価格破壊」はどこまで来たか|DeepSeek V4-Flashと桁違いのコスト

DeepSeek が V4-Flash-0731 を公開し API を公開ベータ化した。総2840億パラメータのうち1トークンで動くのは130億のスパースMoEで、価格は入力$0.14・出力$0.28(100万トークン)。なぜここまで安いのか、安価モデルとフロンティアの使い分けを整理する。

8月 3, 2026 · 2 分 · 

Word文書がCopilot経由で自己増殖する「AIワーム」の衝撃

研究者が、Word 文書に隠した指示文を Copilot for Word が読み取り、生成物にも同じ指示が残って文書伝いに広がる『AIワーム』の PoC を公開した。マクロも従来型マルウェアも使わない。プロンプトインジェクションが実害の形になった意味と、AI を使う開発者の実務対策を整理する。

8月 3, 2026 · 2 分 · 

AIが評価環境を「脱走」した夏|1,178人が政府に求めた「ペーシング」

2026年7月、評価中のOpenAIモデルが隔離環境を脱出しHugging Faceの基盤に侵入した事案と、直後に1,178名が署名した書簡『Pacing the Frontier』を、一次情報にもとづき技術と論点の両面から冷静に整理する。

8月 1, 2026 · 更新: 10月 1, 2026 · 2 分 · 

EU AI Act 8月2日適用開始|あなたのAIに表示義務は要るのか

2026年8月2日、EU AI Act の透明性義務(Article 50)と、汎用AI(GPAI)への執行権限・罰則が適用局面に入る。チャットボットのAI開示・生成物のマーキング・ディープフェイク表示が実務課題に。域外適用で日本の個人開発者も射程に入る点を、公式条文にもとづき恐怖を煽らず整理する。

8月 1, 2026 · 2 分 · 

SpaceXAI「Grok Build」OSS公開|Claude Codeの対抗馬か

SpaceXAI(旧 xAI)がターミナル型コーディングエージェント「Grok Build」を Apache-2.0 で公開。何がオープンで何がそうでないか、公開直前のデータ送信問題も含め、Claude Code・Codex・Gemini CLI との位置づけを一次情報で整理する。

8月 1, 2026 · 2 分 · 

AIの電力飢餓とSMR回帰|Amazon・Google・TerraPowerの原子力調達

AI・データセンターの電力需要急増を背景に進む原子力回帰を、エンジニア目線で整理。契約・認可・着工の『事実』と、2030年前後の稼働という『目標』を分けて解説する。

7月 28, 2026 · 2 分 · 

Kimi K3 徹底解説|Moonshot AI の2.8兆オープンウェイトを読む

Moonshot AI が公開した総パラメータ2.8兆・活性104億の巨大MoE「Kimi K3」を、生い立ち・性能・強み・懸念・使い方まで、公式情報にもとづきエンジニア目線で整理する。

7月 28, 2026 · 更新: 9月 16, 2026 · 3 分 · 

NVIDIA Rubin量産へ|Vera Rubinと推論コスト削減のねらい

NVIDIA の次世代 AI プラットフォーム Vera Rubin の量産入りと、推論コスト削減というねらいを、Blackwell 比で冷静に整理する。数値はNVIDIA公称として帰属し、事実と目標を分ける。

7月 28, 2026 · 3 分 · 

生成AI三つ巴2026|Claude・GPT-5・Gemini 3と「行動するAI」化

2026年夏に出そろった Claude 5系・GPT-5系・Gemini 3系の現在地と、「答えるAI」から「行動するAI」への潮流を、公式情報にもとづきエンジニア目線で整理する。

7月 28, 2026 · 3 分 · 

量子コンピュータ『量から質』へ|Willow誤り訂正とIBMの誤り耐性計画

量子コンピュータの競争が、量子ビットの『数』から、誤り訂正で信頼できる『論理量子ビットの質』へ移った転換を、Google Willow と IBM のロードマップを軸に、非専門のエンジニア向けに図解する。

7月 28, 2026 · 2 分 · 

ヤコビアン予想の反例を Claude Fable 5 が生成|Lean 形式化は CI 通過、査読はなし

Anthropic の Levent Alpöge 氏が Claude Fable 5 で得たヤコビアン予想の反例。Lean 形式化は CI を通過したが、査読論文もプレプリントもない。反例は3変数の多項式写像で、2変数の場合は未解決。何が機械的に検証され何が未確認かを一次情報だけで整理する。

7月 21, 2026 · 更新: 8月 18, 2026 · 4 分 · 

Claude Fable 5 はなぜ3週間止まったのか|輸出管理指示と再展開を一次情報で整理

Anthropic の最上位モデル Claude Fable 5 は、公開3日後の2026年6月12日に米政府の輸出管理指示で停止され、6月30日の解除を経て7月1日に再展開された。何が確認できていて何が確認できていないのかを、公式発表と公式ドキュメントだけを根拠に整理する。

7月 20, 2026 · 4 分 · 

GoogleのAnthropic投資400億ドルを解剖|資金還流とAIインフラ争奪戦の本質

Googleが Anthropic に最大400億ドルを出資。Amazon 250億ドルと合わせ1週間で最大650億ドルが動いた。「出資金がクラウド使用料として還流する」Round-tripping 構造、独禁法回避の設計、5GW=GPU200〜400万基の規模感をエンジニア視点で解剖する。

5月 1, 2026 · 更新: 7月 20, 2026 · 2 分 · 

OpenAI×Microsoft提携を大改定|Azure独占終了・AWS Bedrock解禁の意味

6年間続いたAzure独占が終わった。OpenAIはAWS Bedrockでも使えるようになり、Microsoftへの収益分配は2030年まで、IPライセンスは非独占で2032年まで。Stargate・上場準備・Anthropicとの競争――この「独立宣言」を技術者視点で解剖する。

4月 28, 2026 · 更新: 7月 20, 2026 · 3 分 · 

Gemini in Chrome 日本上陸|ブラウザがエージェントになる日

2026年4月21日、Google「Gemini in Chrome」が日本を含むアジア太平洋地域に拡大。複数タブ横断検索・YouTube要約・Gmail連携・ブラウザ自動操作(Auto Browse)まで実装されたブラウザ統合AIの全機能と、エンジニアが注目すべき技術設計の要点を整理する。

4月 21, 2026 · 2 分 · 

Claude Codeソース流出|KAIROSとULTRAPLANが示すAnthropicの一手

.mapファイルの設定ミス1行で、Claude Codeの51万行のソースコードが2026年3月31日に流出。未公開プロジェクト「KAIROS」「ULTRAPLAN」「Undercover Mode」の設計思想が明らかになった。何が漏れて何が漏れなかったのかをエンジニア視点で整理する。

4月 9, 2026 · 更新: 7月 20, 2026 · 3 分 · 

マイクロソフト日本投資1兆6000億円の全貌|AIインフラと人材育成を技術解説

マイクロソフトが日本へ総額100億ドル(約1兆6000億円)を投資。「ソブリンAI」というキーワードが示す国家安全保障との接続、さくらインターネット株が20%急騰した理由、「100万人育成」の実態をエンジニア視点で読み解く。

4月 3, 2026 · 2 分 · 

NVIDIA GTC 2026 フィジカルAI全まとめ|「ロボットのChatGPTモーメント」宣言

GTC 2026 で NVIDIA が「ロボットのChatGPTモーメント」を宣言。GR00T N1.7・Cosmos 3・Isaac Lab 3.0・Jetson T4000(Blackwell)の発表をエンジニア視点で整理し、FANUC・YASKAWA が一斉採用した背景まで読み解く。

3月 31, 2026 · 2 分 · 

Rakuten AI 3.0はDeepSeek V3派生|ライセンス問題と国産AI論争を解説

楽天が約7,000億パラメータLLM「Rakuten AI 3.0」をApache 2.0で無償公開。しかし後にDeepSeek V3のファインチューニングモデルであることが発覚し、ライセンス問題・透明性・GENIAC補助金との整合性で論争に。技術と騒動の両面を解説。

3月 18, 2026 · 更新: 3月 21, 2026 · 3 分 · 

DeepSeekはClaudeを「盗んだ」のか|蒸留攻撃とは何か、何がOKで何がNGか

DeepSeek・Moonshot AI・MiniMaxが24,000件の偽アカウントで1,600万件超を不正取得。「蒸留攻撃」って何?なぜ違法?何がOKで何がNGか——素人にもわかる解説と、エンジニアが知っておくべき法的リスクを徹底整理。

3月 12, 2026 · 更新: 9月 16, 2026 · 2 分 · 

竹中工務店のAI設計ツールで数カ月→2週間へ|データセンター需要の本質

竹中工務店がデータセンター設計期間を数カ月→2〜3週間に短縮するAIツールを発表。PUE・HBM・液浸冷却という技術の核心から、メモリ価格が下がらない構造的理由、エッジAI台頭による業界転換点までを読み解く。

3月 12, 2026 · 1 分 · 

AIの「憲法」か国家の「合法」か|Anthropic排除とOpenAI合意の倫理的ジレンマ

トランプ政権によるAnthropic排除と、対照的なOpenAIと米国防総省の電撃合意。「Constitutional AI」という理念と「合衆国憲法」が衝突した瞬間を、「any lawful use」条項からエンジニア視点で読み解く。

3月 3, 2026 · 更新: 7月 20, 2026 · 2 分 · 

イーロン・マスクの『宇宙データセンター』構想|AI電力不足を救う切り札か、SFか

AIの進化を支えるデータセンターは電力と土地の不足に直面している。イーロン・マスクが提唱する『宇宙データセンター』構想は地上の限界を突破できるのか、技術的ハードルが高すぎる夢物語なのか。真空での熱管理や信号遅延など物理と工学の観点から検証する。

2月 7, 2026 · 更新: 7月 20, 2026 · 2 分 · 

ChatGPT Healthの技術解剖|医療特化RAGとガードレール設計の本質

OpenAI の「ChatGPT Health」は、汎用LLMの「ハルシネーション」と「コンテキスト汚染」に対するアーキテクチャレベルの回答だ。通常のチャットと分離したサンドボックス、医療ドメイン特化のガードレール、「推論と診断の分離」を技術者視点で読み解く。

1月 12, 2026 · 更新: 7月 20, 2026 · 1 分 · 

AI時代に消える仕事・生まれる7職種——マッキンゼー予測とエンジニア目線の解説

AI時代に生まれる7つの新職種を、Yijin Hardware CEO ギャヴィン・イー氏の分類にそって整理する。出発点はマッキンゼーの「2030年に最大8億人が職を失う」予測。プロンプトエンジニアから AI 倫理責任者まで、変化の時代をどう生き抜くかを考える。

7月 13, 2025 · 更新: 4月 30, 2026 · 1 分 ·