6月18日、Dataconomyが「From agents to world models: What San Francisco revealed about AI's next phase」と題した記事を公開した。この記事では、サンフランシスコで開催されたAIカンファレンス「HumanX」で示されたAIの次フェーズ――エージェントからワールドモデルへの移行――について詳しく紹介されている。
※HumanXは2026年6月にサンフランシスコで開催されたエンタープライズAI特化型カンファレンス。NVIDIA・OpenAIをはじめとする主要企業のリーダーが登壇し、AIの実用化・産業応用をテーマに議論が交わされた。
「AIは質問に答えるものから、物事を実行するものへ」
NVIDIAのJensen Huangはこの移行を端的に表現した。
"What's happening now is that AI went from being able to answer questions to now being able to do things."
— Jensen Huang(HumanXにて)
Huangが描くAIの進化には3つの波がある。第1波は生成(Generative)、第2波は推論(Reasoning)、そして現在は第3波――エージェント(Agentic)の時代だというものだ。
彼が残したもう一つのフレーズも鋭い。「AIはソフトウェアを使うソフトウェアだ」。
この視点は、ソフトウェア産業の構造を根底から変える可能性を示唆する。これまでのWord、Excel、CRM、ERPといったツールは「人間がスクリーンの前に座って使う」ことを前提に設計されてきた。しかしAIエージェントがツールを自律的に操作するようになれば、ソフトウェアの「ユーザー数」そのものが爆発的に増える。それは単なる自動化ではなく、ソフトウェアの消費形態そのものの再定義だ。
コーディングはエージェント管理の仕事になった
OpenAIのSrinivas Narayananは、ソフトウェアエンジニアリングの文脈で同じ変化を描いた。
AIコーディングツールは「補助」から「代理実行」へ移行した。エンジニアはもはやコード補完や説明を求めるだけでなく、ソフトウェアを生成し、レビューし、バグを修正するシステムを管理する立場になりつつある。Narayananの言葉を借りれば、仕事の中心は「ソフトウェアを書くことではなく、エージェントを管理することになった」。
コーディング領域でこのパターンがいち早く可視化されたのは理由がある。ソフトウェアは他の知的労働に比べて検証しやすい――テストが書ける、リポジトリに境界がある、バグは再現できる、出力が確認できる。
ただし、エージェントが実用になるかどうかは「モデルの性能」だけでは決まらない。エージェントは会社のシステムを理解しているか、適切な権限を持っているか、監視できるか、そしてエージェント同士が連携し始めたとき信頼できるか――これらはインフラ・ガバナンス・インターフェースの問題だ。
言語から空間へ――「暗闇の中の知性」という比喩
李飛飛(Fei-Fei Li)は議論をさらに前に進めた。テーマは空間知性(Spatial Intelligence)だ。
李のロジックはこうだ。人間の知性は言語だけで成立していない。空間、運動、物体、幾何学、インタラクション、時間――こうした要素を通じて世界を理解している。AIがこの空間理解を欠いたまま動作するのは「暗闇の中の知性」だ、と李は表現した。
李飛飛が定義するワールドモデルは具体的だ:「空間を理解し、幾何学・物理・ダイナミクスを推論し、今日のコンピュータが文字を生成するように3Dおよび4D空間を生成できるシステム」。
李飛飛が率いるスタートアップWorld LabsのプロダクトMarbleは、その方向性の初期実装として紹介された。Marbleは幾何学的に一貫した3D世界を生成するモデルで、ロボットの学習環境構築、ヘルスケアイメージング、バーチャルワールドへの応用が想定される。生成された世界は、他のシステムが学習・テスト・シミュレーションを行うための環境そのものになりうる。
次フェーズの全体像
HumanXの各セッションを通じて浮かび上がるのは、AIの次フェーズが単一のインターフェースで定義されないということだ。
- エージェントはツールを必要とする
- エンタープライズはガードレールを必要とする
- ロボティクスは空間データを必要とする
- ワールドモデルはまだ存在しないスケールの学習環境を必要とする
これらの要件はそれぞれ独立しているように見えて、互いに連動している。エージェントが現実世界で動作するにはロボティクスの空間データが必要になり、その学習環境を提供するのがワールドモデルだ。エンタープライズがエージェントを安心して導入できるかどうかは、ガバナンスとガードレールの成熟度にかかっている。Jensen Huangが「AIはソフトウェアを使うソフトウェア」と表現した世界は、この4つの層が揃って初めて機能する。
記事はこう整理する。第1のマスマーケットAI体験は「会話」だった。次は「委任(Delegation)」。その次は「シミュレーション」――エージェントが自ら理解・モデル化・変更できる環境の中で仕事をする段階だ。
言語モデルの重要性が下がるわけではない。それは、より大きなシステムの一部になる。
詳細はFrom agents to world models: What San Francisco revealed about AI's next phaseを参照していただきたい。




