📺 Advancing Infrastructure for the Era of Agentic AI | Ian Buck at AI Infra Summit 2026
本動画では、NVIDIAのエキスパートが、エージェントAI時代における推論インフラの進化と、その中核を担うVera Rubinプラットフォームについて解説します。従来の人間参加型のワークロードから、エージェントが自律的に動作する高度なワークロードへの移行に伴い、コンピューティング基盤に何が求められるのかを、具体的なベンチマーク結果や顧客事例を交えて紹介します。
■ エージェントAI時代のワークロード変化
- 従来の推論と比較して、エージェントワークロードは入力トークン数、KVキャッシュサイズ、ターン数が大幅に増加
- 動的なコンテキスト管理、ツール呼び出し、セキュリティ監視など、複雑な処理が必要
■ Vera Rubinプラットフォームの概要
- エージェントワークロード全体を実行するために設計されたAIファクトリー
- GPU(Vera Rubin)、CPU(Vera)、ネットワーク(Spectrum-X)、ストレージ(BlueField)を統合
- 従来比で最大30倍、場合によっては60倍のAIファクトリースループットを実現
■ データセンタースケールの最適化
- 電力制約下でのGPU収容数を最大化する「MaxLPS」ソフトウェア
- 動的な電力管理により、同じ電力で最大40%多くのコンピューティングを提供
■ エコシステムとパートナーシップ
- NVLink Fusionによる他社チップとの相互接続
- Perplexity、ClickHouse、Lambdaなど、早期導入企業の事例
エージェントAIの本格的な普及に備え、データセンターの設計やAIインフラ戦略に関心のあるエンジニアや意思決定者にとって、今後のインフラ構築の方向性を理解する上で有益な内容です。
📄 このページの紹介文は AI が独自に生成したものであり、著作権をはじめとする他者の権利(商標権・名誉権・プライバシー等)を侵害しないよう配慮しています。動画の著作権は各作成者に帰属します。