AIの出所はどう証明するか|「Kimiの裏でClaude」報告を一次で読む

Anthropic の9月報告は「Kimi 宛のリクエストが Claude に転送され、回答が Kimi として表示された」と公表し、米3機関は「K3 は Fable 5 で学習」と勧告。Moonshot は7月に否定、9月は沈黙。一次で言えること・推測にとどまることを分け、「私は Claude です」が起きる仕組みと、AI の出所を証明する3つの道具まで。

9月 15, 2026 · 16 分 · 

AIが設計した回路は動くのか|EEBenchが69.3%を測った方法

atopile が公開した EEBench は、AI が設計した回路をシミュレーションで採点するベンチマーク。9月8日時点の首位は GPT-6 Astra の69.3%。何をどう測っているのかを一次情報で整理します。

9月 8, 2026 · 7 分 · 

フェルマーの最終定理をClaudeがLeanで形式化|証明済みの定理をなぜ機械で検証したのか

1995年に証明された定理を、Claude が11日で Lean に書き直した。約1,300万行・29,511定理。すでに正しいはずの証明を、なぜ機械で検証し直すのか——その意味と限界を一次情報で整理します。

9月 7, 2026 · 5 分 · 

GPT-6 Astra 公開|KiCadで基板を配線、サイバーは初の Critical

OpenAI が9月3日に GPT-6 Astra を公開。KiCad で基板を配線するデモ、サイバー能力の初の Critical 認定、Fable 5.1 と同額の価格を、公式3ページの一次情報で整理する。

9月 5, 2026 · 更新: 9月 12, 2026 · 14 分 · 

Claude Fable 5.1 公開|キャッシュ読み取り75%減と5→5.1の差分

Anthropic が2026年9月1日に Claude Fable 5.1 と Mythos 5.1 を公開。目玉はキャッシュ読み取りの75%引き下げ。5から5.1で何が動き、何が動かなかったのかを公式資料で追う。

9月 3, 2026 · 7 分 · 

Tencent Hy4 preview公開|770BのMoEがApache-2.0で降りてきた

Tencentが8月28日、次世代LLM「Hy4 preview」をオープンウェイト公開。総770B・1トークンで動くのは49BのMoEで、コンテキストは100万トークン、ライセンスはApache-2.0。旧Hunyuanの独自ライセンスから何が変わったのか、価格と「自分の推論を自分で最適化した」という主張を一次情報で整理する。

8月 31, 2026 · 4 分 · 

NVIDIAがHugging Faceを129億ドルで買収合意と報道|AIのGitHubの行方

The Information が2026年8月26日、NVIDIA が Hugging Face を129億ドルで買収することに合意したと報じた。ただし引用元は関係者1名で、両社のコメントも SEC 提出書類も出ていない。オープンモデル配布の中枢をめぐる報道を、確定した事実と分けて整理する。

8月 27, 2026 · 4 分 · 

AIが2,436件の脆弱性を見つけた|GLM-5.3とOSSを守るAkrites

Z.aiが8月14日に公開したコーディング特化モデルGLM-5.3が、269のOSSプロジェクトから2,436件の脆弱性を検出したという。事前学習をやり直さず事後学習だけで性能を伸ばした点と、脆弱性を直す枠組みとしてLinux Foundationが発足させたAkritesを整理する。

8月 16, 2026 · 3 分 · 

Claudeがリーマン予想の「証明済み割合」を67.2%へ|60エージェントと650の失敗

Anthropicが8月10日、研究版Claudeが「リーマン予想を満たすと証明された零点の割合」の下限を41.6%から67.2%へ引き上げたと発表。約60のサブエージェントが約1日半で650の失敗を積んで突破し、Lean形式証明も公開済み。証明ではなく未査読だが、AIが数学の前線を押した記録だ。

8月 13, 2026 · 2 分 · 

GitHub CopilotにKimiが来た|オープンウェイトが商用コーディング支援の一等地へ

GitHub Copilotのモデルピッカーに、Moonshot AIのオープンウェイトモデルKimiが並んだ。Kimi K2.7 Code(ピッカー初のオープンウェイト)から8月6日のKimi K3 GAまでを公式changelogで確認し、既定で有効化されない管理ポリシーと料金を整理する。

8月 13, 2026 · 更新: 9月 16, 2026 · 2 分 · 

AIの「ハッキング能力」を政府が試験へ|米の自主枠組みは何を測るのか

米ホワイトハウスが8月4日、フロンティアAIの攻撃的サイバー能力を測る自主的な枠組みをめぐりAI各社を招集した。強制的な規制ではなく、企業が最大30日モデルを提供する自主参加型だ。ただし物差し(ベンチマークとしきい値)は機密で、中身は公開されていない。

8月 5, 2026 · 1 分 · 

AIの「価格破壊」はどこまで来たか|DeepSeek V4-Flashと桁違いのコスト

DeepSeek が V4-Flash-0731 を公開し API を公開ベータ化した。総2840億パラメータのうち1トークンで動くのは130億のスパースMoEで、価格は入力$0.14・出力$0.28(100万トークン)。なぜここまで安いのか、安価モデルとフロンティアの使い分けを整理する。

8月 3, 2026 · 2 分 · 

Kimi K3 徹底解説|Moonshot AI の2.8兆オープンウェイトを読む

Moonshot AI が公開した総パラメータ2.8兆・活性104億の巨大MoE「Kimi K3」を、生い立ち・性能・強み・懸念・使い方まで、公式情報にもとづきエンジニア目線で整理する。

7月 28, 2026 · 更新: 9月 16, 2026 · 3 分 · 

生成AI三つ巴2026|Claude・GPT-5・Gemini 3と「行動するAI」化

2026年夏に出そろった Claude 5系・GPT-5系・Gemini 3系の現在地と、「答えるAI」から「行動するAI」への潮流を、公式情報にもとづきエンジニア目線で整理する。

7月 28, 2026 · 3 分 · 

ヤコビアン予想の反例を Claude Fable 5 が生成|Lean 形式化は CI 通過、査読はなし

Anthropic の Levent Alpöge 氏が Claude Fable 5 で得たヤコビアン予想の反例。Lean 形式化は CI を通過したが、査読論文もプレプリントもない。反例は3変数の多項式写像で、2変数の場合は未解決。何が機械的に検証され何が未確認かを一次情報だけで整理する。

7月 21, 2026 · 更新: 8月 18, 2026 · 4 分 · 

OpenAI×Microsoft提携を大改定|Azure独占終了・AWS Bedrock解禁の意味

6年間続いたAzure独占が終わった。OpenAIはAWS Bedrockでも使えるようになり、Microsoftへの収益分配は2030年まで、IPライセンスは非独占で2032年まで。Stargate・上場準備・Anthropicとの競争――この「独立宣言」を技術者視点で解剖する。

4月 28, 2026 · 更新: 7月 20, 2026 · 3 分 · 

Rakuten AI 3.0はDeepSeek V3派生|ライセンス問題と国産AI論争を解説

楽天が約7,000億パラメータLLM「Rakuten AI 3.0」をApache 2.0で無償公開。しかし後にDeepSeek V3のファインチューニングモデルであることが発覚し、ライセンス問題・透明性・GENIAC補助金との整合性で論争に。技術と騒動の両面を解説。

3月 18, 2026 · 更新: 3月 21, 2026 · 3 分 · 

ChatGPT Healthの技術解剖|医療特化RAGとガードレール設計の本質

OpenAI の「ChatGPT Health」は、汎用LLMの「ハルシネーション」と「コンテキスト汚染」に対するアーキテクチャレベルの回答だ。通常のチャットと分離したサンドボックス、医療ドメイン特化のガードレール、「推論と診断の分離」を技術者視点で読み解く。

1月 12, 2026 · 更新: 7月 20, 2026 · 1 分 · 

AI時代に消える仕事・生まれる7職種——マッキンゼー予測とエンジニア目線の解説

AI時代に生まれる7つの新職種を、Yijin Hardware CEO ギャヴィン・イー氏の分類にそって整理する。出発点はマッキンゼーの「2030年に最大8億人が職を失う」予測。プロンプトエンジニアから AI 倫理責任者まで、変化の時代をどう生き抜くかを考える。

7月 13, 2025 · 更新: 4月 30, 2026 · 1 分 ·