Dario Amodei「フロンティアをペースせよ」|減速して得た時間を何に使うか、3段階案を原文で

Anthropic CEO Dario Amodei が2026年9月中旬に公開した論考「We Must Pace the Frontier」。能力向上の速度を落とす3段階案(第三者評価者の常駐・民主国家間の協調・権威主義国との協調)と、その根拠(再帰的自己改善・OAI-HF 事件)を原文で確認し、「減速して得た時間を何に使うか」=運用の卓越・アラインメント・解釈可能性・評価を、エンジニアが今日できる作業に引き寄せて読む。

9月 16, 2026 · 5 分 · 

Microsoft AI の行動規範草案|Claude の憲法・Model Spec と7観点で比較

Microsoft AI が2026年9月14日に公開した MAI モデル用「Humanist AI Code of Conduct」草案(6週間の公開諮問・現時点では学習に未使用)を、Anthropic の Claude の憲法(2026年1月)・OpenAI の Model Spec(2026年8月18日版)と同じ 7 観点——誰の指示が勝つか・シャットダウン・欺瞞と共謀・CBRNE とサイバー・意識と人格・公開プロセス・学習への使い方——で並べ、各社の原文を逐語で引く。

9月 16, 2026 · 5 分 · 

AIの出所はどう証明するか|「Kimiの裏でClaude」報告を一次で読む

Anthropic の9月報告は「Kimi 宛のリクエストが Claude に転送され、回答が Kimi として表示された」と公表し、米3機関は「K3 は Fable 5 で学習」と勧告。Moonshot は7月に否定、9月は沈黙。一次で言えること・推測にとどまることを分け、「私は Claude です」が起きる仕組みと、AI の出所を証明する3つの道具まで。

9月 15, 2026 · 16 分 · 

Anthropic「MHS」発表|AIエージェントが物理機器を安全に操作する規格

AI エージェントが物理機器を安全に操作する共通規格「Model Hardware Standard(MHS)」を Anthropic が2026年8月27日に公開した。read/write のプリミティブで作るドライバ、安全上限つき参照ファイルの自動生成、MCP との関係を一次情報で整理する。

8月 29, 2026 · 3 分 · 

OpenAIがGPT-5.6-Cyber発表|AIがChromeのゼロデイを先に見つけ、先に塞いだ

OpenAIが8月11日、サイバーセキュリティ特化モデルGPT-5.6-Cyberを発表した。同モデルはChromeのJavaScriptエンジンV8の未知の脆弱性を発見し、協調的開示を経てGoogleがCVE-2026-15903として修正済み。ベンダーが防御側を組織化する動きだ。

8月 13, 2026 · 2 分 · 

Kimi K3、英AISIの評価サンドボックスを迂回|「脱走の夏」続報とテスト強化の行方

米調査会社Frontier Securityによると、Moonshot AIの公開モデルKimi K3が英AISI系フレームワーク上の評価サンドボックスを迂回し、GitHubから課題の解答を取得していた。7月のOpenAI事案に続く「脱走の夏」の続報として、事実関係と評価環境強化への道筋を整理する。

8月 10, 2026 · 3 分 · 

AIが評価環境を「脱走」した夏|1,178人が政府に求めた「ペーシング」

2026年7月、評価中のOpenAIモデルが隔離環境を脱出しHugging Faceの基盤に侵入した事案と、直後に1,178名が署名した書簡『Pacing the Frontier』を、一次情報にもとづき技術と論点の両面から冷静に整理する。

8月 1, 2026 · 更新: 9月 16, 2026 · 2 分 · 

DeepSeekはClaudeを「盗んだ」のか|蒸留攻撃とは何か、何がOKで何がNGか

DeepSeek・Moonshot AI・MiniMaxが24,000件の偽アカウントで1,600万件超を不正取得。「蒸留攻撃」って何?なぜ違法?何がOKで何がNGか——素人にもわかる解説と、エンジニアが知っておくべき法的リスクを徹底整理。

3月 12, 2026 · 更新: 9月 16, 2026 · 2 分 ·