エージェンティック AI

AI エージェントの本番運用を支える高信頼インフラ

Nutanix Agentic AI は、AI ファクトリーの構築・運用を支えるクラウド運用モデルを提供する、フルスタックのソフトウェアプラットフォームです。Nutanix Enterprise AI を中核とし、 Agent Gateway と推論管理を備えた AI の統合コントロールプレーンにより、インフラ、Kubernetes、データを一元化します。オンプレミス、ネオクラウド、OEM パートナーのプラットフォームにわたって、データ主権要件に対応した強固なセキュリティと優れたトークンコスト効率を実現し、エージェンティック AI の構築・運用・ガバナンスを支援します。

AI ファクトリーを支える統合 AI コントロールプレーン

ベアメタルの Kubernetes や DIY スタック、サイロ化したツールでは、エージェンティック AI のワークロード要件に対応できません。エージェンティック AI の運用には、一元化された AI ガバナンス、マルチテナントの分離、トークンレベルのコストの可視性、複数のモデルに対するセキュアでレート制限されたアクセスが必要です。Nutanix Agentic AIは、あらゆる AI ファクトリーに不可欠なクラウド運用モデルと統合 AI コントロールプレーンを提供します。ハードウェアを抽象化し、運用を標準化することで、クラスタ単位ではなく「サービス」として、ガバナンスが確保されたインテリジェンスへのアクセスを提供します。

トークンあたりのコストを最小化 グラフィック

トークンあたりのコストを最小化

フルスタックソリューションにより、スマートルーティング、推論のスケール、トポロジー認識型のリソース配置、最適化されたGPU消費を実現し、トークンあたりのコストを大幅に削減します。

エンタープライズセキュリティグラフィック

エンタープライズレベルのセキュリティと制御

Nutanix Enterprise AI は、LLM(大規模言語モデル)エンドポイントのセキュアな展開とエンタープライズレベルの制御機能を提供します。同時に、Nutanix AHV(仮想化)と Nutanix Flow(ネットワークおよびセキュリティ)の強化により、優れた隔離性とセキュリティを実現します。

開発者のスピードグラフィック

開発を加速

インフラの遅延なしにコンセプトを迅速に本番環境へと移行できます。Nutanix Enterprise AI は、スマートなモデルルーティング、1 - クリックで利用できるセキュアな推論エンドポイント、Model Context Protocol サーバーへのセキュアで容易なアクセスを提供し、AI ツールをシームレスにします。また、Nutanix Kubernetes Platform は、充実した AI サービスカタログとプライベートデータへの組み込みアクセスを備えたクイックスタート環境を提供し、エージェンティック AI アプリケーションの開発を支援します。

エージェンティック AI の運用化グラフィック

エージェンティック AI の完全な運用化

Nutanix Agentic AI ソリューションは、NVIDIA 認定の AI ファクトリーとシームレスに統合・補完できるよう専用設計されています。また、Cisco、Dell、Supermicro などの主要な OEM ハードウェアメーカーとの強力なパートナーシップを活かし、包括的なソリューションを提供します。

NVIDIA ソリューション図

主要な統合コンポーネント

AI サービスと Kubernetes プラットフォーム

開発者中心のクラウドネイティブな環境により、インフラのセットアップに時間をかけることなく、予測可能なトークンエコノミクスのもとで生産グレードのエージェンティック AI アプリケーションを迅速に拡張できます。

インフラの最適化とセキュリティ

仮想マシン(VM)のフォームファクターを通じてアクセラレーテッド・コンピューティングのパワーをオーケストレートし、最大限のパフォーマンスとセキュリティを提供して、トークンあたりのコストを低減します。

AI 向けデータサービス基盤

ストレージクラスタ内で直接、GPU 加速変換を継続的に実行し、トレーニングと推論をシームレスにつなぐ高性能データファブリックを提供します。

AI サービスと Kubernetes プラットフォーム

コンソールを使用している人

高度な AI Gateway と推論サービス

統合されたセキュアな推論エンドポイントにより、クラウドホスト型モデル(およびトークンクレジット)をプライベート LLM と併用し、一貫した認証、可観測性、トークンベースのレート制限を維持できます。

Model Context Protocol(MCP)のサポートとファインチューニング

Nutanix Enterprise AI は、既存の堅牢な Model-as-a-Service(MaaS)機能を拡張し、エージェントがエンタープライズツールやデータソースにセキュアに接続できるようにします。

充実した AI カタログを備えたオープンな Kubernetes プラットフォーム

Notebooks、ベクトルデータベース、MLOps エンジンを含む、事前検証済みのオープンソース AI サービスカタログを使用し、インフラによる遅延なしにエージェント型アプリケーションをコンセプトから本番環境へと移行できます。本ソリューションは NVIDIA AI Enterprise とネイティブに統合されており、Nemotron を含む NVIDIA NIM を即座に展開して、本番環境での高性能なAIアプリケーション開発を加速できます。

インフラの最適化とセキュリティ

夜の街の明かり

トポロジー認識型の最適化

Nutanix AHV ハイパーバイザーは、GPU 高密度サーバー間でのワークロード配置を自動的に最適化することで、手動による複雑なインフラチューニングを不要にし、最大限のパフォーマンス、セキュリティ、およびリソース利用率を確保します。

DPU 加速によるゼロトラストネットワーキング

最新の DPU オフロード機能を備えた Nutanix Flow を活用することで、仮想化環境の高度な隔離性を維持しつつベアメタルのスピードを実現。スループットを最大化し、AI ファクトリー全体でセキュアかつ信頼性の高いデータフローを確保する、高性能なゼロトラストネットワーク基盤を提供します。

エアギャップ環境のライフサイクル管理

本ソリューションは、NKP プラットフォーム全体、および NVIDIA GPU/ネットワークオペレーターの完全なオフラインインストールをサポートしており、高度に規制された環境や防衛セクターにおいて、クラスターをインターネットにさらすことなくドライバーのアップデートやネットワークの最適化を自動化できます。

AI 向けデータサービス基盤

Generic lightsグラフィック

リニアな拡張性

NVIDIA エンタープライズ認定の AI データプラットフォームであるNutanix Unified Storage(NUS)は、数千の GPU クライアントにわたって高速な読み取り/書き込みパフォーマンスを提供し、コンピュートの拡張スピードに合わせたデータの可用性を保証します。

高度なスループット

NFS over RDMA、および近日対応予定の S3 over RDMA を活用することで、低レイテンシのデータパスを提供し、GPU がデータ不足に陥らないようにします。

コスト最適化

KV キャッシュのオフロード用に大容量層を提供することで、トークンあたりの総コストを削減し、重要な GPU メモリを解放します。これにより、パフォーマンスを低下させることなく、大幅に大規模なコンテキストウィンドウと、より多くの同時実行ユーザーの処理が可能になります。

Nutanix のお客さまの声


関連製品

テストドライブ

Nutanix Enterprise AI で AI 推論を大規模に実行

デモをお試しください

Nutanix は、ハイブリッド・マルチクラウド環境全体への AI のシームレスな導入を支援します。エキスパートへのご相談・お問い合わせを承っております。

よくある質問

Nutanix Agentic AIソリューションは、複雑さを排除し、エージェント型AIビルダーとAIファクトリーのオペレーターの間にシームレスな架け橋を築きます。このフルスタック・ソリューションは、運用のシンプル化、パフォーマンスとセキュリティの最大化、そしてトークンコストの最適化を通じて、AI ファクトリーのオペレーターに「クラウド運用モデル」を提供します。同時に、エージェント型AIビルダーがインフラ管理から解放され、イノベーション、モデル管理、そして迅速な推論のスケーリングに専念できる環境を実現します。

エージェント型AIビルダーは、インテリジェンスの構築に集中する代わりに、断片化したモデルやツール、データのサイロ化という複雑な環境に翻弄され、大きな「イノベーションの摩擦」に直面しています。開発者は、多様なLLMやオープンソースツールを統合し、単純なチャットUIから、実際のビジネス成果を導き出す高度なAIへと迅速に進化させるための、統一されたセキュアな経路を必要としています。

一方、AIファクトリーのオペレーターにとっての最大の課題は、以下のような運用の複雑さにより、「価値創出までの時間」や「トークンあたりのコスト」で測定されるビジネス価値を提供することです。 

  • 多様化・高速化するハードウェア管理: 急速に進化するGPU、ネットワーキング、ストレージの管理 
  • 共有とセキュリティの両立: 重要なAIインフラへの共有アクセスを提供しつつ、モデルやデータへのセキュアなアクセスを確保し、データ主権(デジタルソブリン)要件を遵守する困難さ
  • リソースの最適化: AIファクトリー全体でリソース利用率を最適化しながら、常に最大のパフォーマンスを維持する複雑性
  • ライフサイクル管理: AIファクトリーの運用を支える、断片的で特注の個別ソリューションのライフサイクル管理の複雑さ

Nutanixの「クラウド運用モデル」は、AI開発者とインフラチームのギャップを埋めるためのアプローチです。断片化したポイントソリューションや複雑なベアメタル・クラスターを管理する代わりに、統一されたフルスタック環境を提供します。これにより、オペレーターはAIインフラ(GPU、DPU、ストレージ)をクラウドサービスのような手軽さで統制でき、開発者は数千ものインテリジェント・エージェントを拡張するために必要なツールやモデルへ、即座にセキュアにアクセスできるようになります。

Nutanixは、以下の統合された効率化メカニズムを通じてトークンエコノミクスを最適化します。

  • トポロジー認識型の最適化: Nutanix AHVハイパーバイザーが、GPU高密度サーバー間でのワークロード配置を自動的に行い、ハードウェアの整合性を最大化します。
  • リソースのオフロード: DPU(データ・プロセッシング・ユニット)を使用してネットワークやセキュリティタスクを処理することで、GPUのリソースを推論専用に解放します。
  • スマートなストレージ活用: Nutanix Unified Storage(NUS)がKVキャッシュのオフロード用に大容量層を提供。高価なGPUメモリを節約し、パフォーマンスを損なうことなく大規模なコンテキストウィンドウの処理を可能にします。

初期のモデルトレーニングにはベアメタルが標準的でしたが、企業がエージェントを大規模に展開するには、セキュリティや隔離性が不十分な場合があります。Nutanixは、仮想マシン(VM)ベースのKubernetesインフラを採用することで、以下を提供します。

  • 優れた隔離性: 異なるAIワークロード間での強固なマルチテナント環境とセキュリティ境界を確立します。
  • 大規模な管理性: ライフサイクル管理やリソース割り当てを容易にします。
  • ベアメタル級のパフォーマンス: DPUによる加速とトポロジー認識機能を活用することで、仮想化環境のガバナンスを維持しつつ、ベアメタルに匹敵するスピードを実現します。

Nutanix Agent Gatewayは、大規模言語モデル(LLM)、MCPサーバー、およびエンタープライズアプリケーションへのエージェントからのアクセスを標準化し、ガバナンスを効かせる集中型コントロールレイヤーです。主な特長は以下のとおりです。

  • 統合ガバナンス:エージェント、モデル、エンタープライズツール間のやり取りに対するアクセスを標準化し、一貫したポリシーを適用します。
  • 予測可能なトークンコスト管理:パブリッククラウドおよびセルフホスト環境全体で、リアルタイムのトークンコストの把握、使用状況の可視化、プロアクティブなコスト管理を提供します。
  • 展開の柔軟性:パブリッククラウドまたは任意のKubernetes環境への展開を可能にし、単一のベンダーにロックインされることなく、即座に拡張できます。

インフラのセットアップをバイパスできる開発者中心の環境を提供することで、イノベーションを加速させます。Nutanix Kubernetes Platform(NKP)を通じて、ビルダーは以下を含む豊富なAIカタログにアクセスできます。

  • 構築済みのオープンソースツール: Notebooks、ベクトルデータベース、MLOpsエンジンなど。
  • 即時の展開: NVIDIA NIMNVIDIA Nemotronファミリーのモデルを迅速に利用可能。
  • 1クリックの利便性: セキュアな推論エンドポイントの1クリック提供や、ファインチューニング・サービスへのターンキーアクセス。

Nutanix Unified Storage(NUS)は、AIや次世代アプリケーションなどのモダンなワークロード向けに専用設計された、スケーラブルで高性能なデータプラットフォームです。以下の主な機能が含まれます:

  • 圧倒的なスループット: 超高速な読み取りスループットと高密度なオールNVMe構成により、推論や検索拡張生成(RAG)を含むAIパイプラインの膨大なデータセットに対応します。
  • NKPとの統合: Nutanix Kubernetes Platformと連携し、コンテナ化されたAI/MLパイプラインやクラウドネイティブアプリのシームレスな展開を実現します。
  • マルチプロトコル対応: 多様なワークロードのストレージをシンプル化し、イノベーションを加速させます。