Anthropic が Claude に AI を直させた48時間——直せたのは、物差しのある失敗だけだった
48時間と GPU 1枚で、Claude は10種類の欠陥すべてに改善策を見つけた。ただし直せたのは、あらかじめ点数のつく失敗だけだ。測る道具のない失敗は、直っていないのではなく数えられていない。
INDEX · DEEP DIVE
ひとつの問いを起点に、背景、構造、暮らしへの影響を深く考えます。
48時間と GPU 1枚で、Claude は10種類の欠陥すべてに改善策を見つけた。ただし直せたのは、あらかじめ点数のつく失敗だけだ。測る道具のない失敗は、直っていないのではなく数えられていない。
Anthropic が MHS の研究プレビューを始めた。機器が自分の「できること」と安全上限を申告し、AI がそれを読んで操作する仕様だ。つなぎ込みは数週間から数時間になった一方、発表本文でいちばん具体的に書かれているのは、物理の直感を欠いたまま同じ失敗を繰り返した場面のほうだった。
7月の侵入について、OpenAI が技術報告書を公開した。安全策が「なぜ効かなかったか」だけでなく、エージェントがどうやって課題から逸れていったかが日付つきで書かれている。手元でエージェントを走らせる側にとっても、読む価値のある文書だ。
「デマ」も「事実」も、ラベルは結論ではなく出発点です。文書が先に公開される通り道が増え、「これは確かなのか」を判定する仕事が読み手のところへ来ています。
量子攻撃の資源見積もり「50万未満」とGoogleのPQC移行目標「2029年」は、異なる二つの時計です。
評価AIが想定境界を越えて本番環境へ到達した事件を、目標、権限、隔離、監視の設計問題として読み解く。
AIが画面の中だけでなく、ものを見て、動かして、触れる世界へ出ていく。
🔬 Deep Dive|StarshipとRocket Lab、宇宙産業は『打ち上げイベント』から『物流インフラ』へ
🔬 Deep Dive|Anthropic「2028: Two scenarios for global AI leadership」を読み解く
AI の「使う側」と「作る側」の両方で、個人と企業の境界線が同時に揺れた。