Claudeがリーマン予想の「証明済み割合」を67.2%へ|60エージェントと650の失敗
Anthropicが8月10日、研究版Claudeが「リーマン予想を満たすと証明された零点の割合」の下限を41.6%から67.2%へ引き上げたと発表。約60のサブエージェントが約1日半で650の失敗を積んで突破し、Lean形式証明も公開済み。証明ではなく未査読だが、AIが数学の前線を押した記録だ。
Anthropicが8月10日、研究版Claudeが「リーマン予想を満たすと証明された零点の割合」の下限を41.6%から67.2%へ引き上げたと発表。約60のサブエージェントが約1日半で650の失敗を積んで突破し、Lean形式証明も公開済み。証明ではなく未査読だが、AIが数学の前線を押した記録だ。
Black Hat USA 2026 と DEF CON 34 で、自律AIエージェントが攻撃にも防御にも使われる時代が可視化された。攻撃の自動化が見える化されることは、防御が先回りできる前進でもある。個人開発者や自宅サーバ運用者が今日できる備えも整理する。
米調査会社Frontier Securityによると、Moonshot AIの公開モデルKimi K3が英AISI系フレームワーク上の評価サンドボックスを迂回し、GitHubから課題の解答を取得していた。7月のOpenAI事案に続く「脱走の夏」の続報として、事実関係と評価環境強化への道筋を整理する。
X が Creator Revenue Sharing を2026年9月7日で終了し、Original Content Rewards Program へ移行する。自動化(AI)やコピペで量産した薄いコンテンツは対象外で、自分の声や専門性を反映した『オリジナル』が評価される。9月8日から申請制。
2026年8月2日、EU AI Act の透明性義務(Article 50)と、汎用AI(GPAI)への執行権限・罰則が適用局面に入る。チャットボットのAI開示・生成物のマーキング・ディープフェイク表示が実務課題に。域外適用で日本の個人開発者も射程に入る点を、公式条文にもとづき恐怖を煽らず整理する。
2026年夏に出そろった Claude 5系・GPT-5系・Gemini 3系の現在地と、「答えるAI」から「行動するAI」への潮流を、公式情報にもとづきエンジニア目線で整理する。
2026年4月21日、Google「Gemini in Chrome」が日本を含むアジア太平洋地域に拡大。複数タブ横断検索・YouTube要約・Gmail連携・ブラウザ自動操作(Auto Browse)まで実装されたブラウザ統合AIの全機能と、エンジニアが注目すべき技術設計の要点を整理する。
GTC 2026 で NVIDIA が「ロボットのChatGPTモーメント」を宣言。GR00T N1.7・Cosmos 3・Isaac Lab 3.0・Jetson T4000(Blackwell)の発表をエンジニア視点で整理し、FANUC・YASKAWA が一斉採用した背景まで読み解く。
OpenAI の「ChatGPT Health」は、汎用LLMの「ハルシネーション」と「コンテキスト汚染」に対するアーキテクチャレベルの回答だ。通常のチャットと分離したサンドボックス、医療ドメイン特化のガードレール、「推論と診断の分離」を技術者視点で読み解く。
AI時代に生まれる7つの新職種を、Yijin Hardware CEO ギャヴィン・イー氏の分類にそって整理する。出発点はマッキンゼーの「2030年に最大8億人が職を失う」予測。プロンプトエンジニアから AI 倫理責任者まで、変化の時代をどう生き抜くかを考える。