AIの出所はどう証明するか|「Kimiの裏でClaude」報告を一次で読む
Anthropic の9月報告は「Kimi 宛のリクエストが Claude に転送され、回答が Kimi として表示された」と公表し、米3機関は「K3 は Fable 5 で学習」と勧告。Moonshot は7月に否定、9月は沈黙。一次で言えること・推測にとどまることを分け、「私は Claude です」が起きる仕組みと、AI の出所を証明する3つの道具まで。
Anthropic の9月報告は「Kimi 宛のリクエストが Claude に転送され、回答が Kimi として表示された」と公表し、米3機関は「K3 は Fable 5 で学習」と勧告。Moonshot は7月に否定、9月は沈黙。一次で言えること・推測にとどまることを分け、「私は Claude です」が起きる仕組みと、AI の出所を証明する3つの道具まで。
atopile が公開した EEBench は、AI が設計した回路をシミュレーションで採点するベンチマーク。9月8日時点の首位は GPT-6 Astra の69.3%。何をどう測っているのかを一次情報で整理します。
1995年に証明された定理を、Claude が11日で Lean に書き直した。約1,300万行・29,511定理。すでに正しいはずの証明を、なぜ機械で検証し直すのか——その意味と限界を一次情報で整理します。
OpenAI が9月3日に GPT-6 Astra を公開。KiCad で基板を配線するデモ、サイバー能力の初の Critical 認定、Fable 5.1 と同額の価格を、公式3ページの一次情報で整理する。
Anthropic が2026年9月1日に Claude Fable 5.1 と Mythos 5.1 を公開。目玉はキャッシュ読み取りの75%引き下げ。5から5.1で何が動き、何が動かなかったのかを公式資料で追う。
Tencentが8月28日、次世代LLM「Hy4 preview」をオープンウェイト公開。総770B・1トークンで動くのは49BのMoEで、コンテキストは100万トークン、ライセンスはApache-2.0。旧Hunyuanの独自ライセンスから何が変わったのか、価格と「自分の推論を自分で最適化した」という主張を一次情報で整理する。
The Information が2026年8月26日、NVIDIA が Hugging Face を129億ドルで買収することに合意したと報じた。ただし引用元は関係者1名で、両社のコメントも SEC 提出書類も出ていない。オープンモデル配布の中枢をめぐる報道を、確定した事実と分けて整理する。
Z.aiが8月14日に公開したコーディング特化モデルGLM-5.3が、269のOSSプロジェクトから2,436件の脆弱性を検出したという。事前学習をやり直さず事後学習だけで性能を伸ばした点と、脆弱性を直す枠組みとしてLinux Foundationが発足させたAkritesを整理する。
Anthropicが8月10日、研究版Claudeが「リーマン予想を満たすと証明された零点の割合」の下限を41.6%から67.2%へ引き上げたと発表。約60のサブエージェントが約1日半で650の失敗を積んで突破し、Lean形式証明も公開済み。証明ではなく未査読だが、AIが数学の前線を押した記録だ。
GitHub Copilotのモデルピッカーに、Moonshot AIのオープンウェイトモデルKimiが並んだ。Kimi K2.7 Code(ピッカー初のオープンウェイト)から8月6日のKimi K3 GAまでを公式changelogで確認し、既定で有効化されない管理ポリシーと料金を整理する。
米ホワイトハウスが8月4日、フロンティアAIの攻撃的サイバー能力を測る自主的な枠組みをめぐりAI各社を招集した。強制的な規制ではなく、企業が最大30日モデルを提供する自主参加型だ。ただし物差し(ベンチマークとしきい値)は機密で、中身は公開されていない。
DeepSeek が V4-Flash-0731 を公開し API を公開ベータ化した。総2840億パラメータのうち1トークンで動くのは130億のスパースMoEで、価格は入力$0.14・出力$0.28(100万トークン)。なぜここまで安いのか、安価モデルとフロンティアの使い分けを整理する。
Moonshot AI が公開した総パラメータ2.8兆・活性104億の巨大MoE「Kimi K3」を、生い立ち・性能・強み・懸念・使い方まで、公式情報にもとづきエンジニア目線で整理する。
2026年夏に出そろった Claude 5系・GPT-5系・Gemini 3系の現在地と、「答えるAI」から「行動するAI」への潮流を、公式情報にもとづきエンジニア目線で整理する。
Anthropic の Levent Alpöge 氏が Claude Fable 5 で得たヤコビアン予想の反例。Lean 形式化は CI を通過したが、査読論文もプレプリントもない。反例は3変数の多項式写像で、2変数の場合は未解決。何が機械的に検証され何が未確認かを一次情報だけで整理する。
6年間続いたAzure独占が終わった。OpenAIはAWS Bedrockでも使えるようになり、Microsoftへの収益分配は2030年まで、IPライセンスは非独占で2032年まで。Stargate・上場準備・Anthropicとの競争――この「独立宣言」を技術者視点で解剖する。
楽天が約7,000億パラメータLLM「Rakuten AI 3.0」をApache 2.0で無償公開。しかし後にDeepSeek V3のファインチューニングモデルであることが発覚し、ライセンス問題・透明性・GENIAC補助金との整合性で論争に。技術と騒動の両面を解説。
OpenAI の「ChatGPT Health」は、汎用LLMの「ハルシネーション」と「コンテキスト汚染」に対するアーキテクチャレベルの回答だ。通常のチャットと分離したサンドボックス、医療ドメイン特化のガードレール、「推論と診断の分離」を技術者視点で読み解く。
AI時代に生まれる7つの新職種を、Yijin Hardware CEO ギャヴィン・イー氏の分類にそって整理する。出発点はマッキンゼーの「2030年に最大8億人が職を失う」予測。プロンプトエンジニアから AI 倫理責任者まで、変化の時代をどう生き抜くかを考える。