IA agentique

Votre usine d’IA a besoin d’une infrastructure qui fonctionne vraiment

La plupart des plateformes d’IA promettent une IA à grande échelle, mais apportent surtout de la complexité. Nutanix Agentic AI est une solution logicielle full-stack qui fournit un modèle d’exploitation cloud pour aider les entreprises à créer, exploiter et gouverner leurs usines d’IA. Grâce à ses intégrations avec l’écosystème de calcul accéléré de NVIDIA, la solution simplifie les opérations, maximise les performances et la sécurité, et optimise l’utilisation des GPU ainsi que les coûts liés aux jetons.

Un modèle d'exploitation cloud pour les usines d'IA

Nutanix propose un modèle d’exploitation cloud spécialement conçu pour l’ère des collaborateurs IA fonctionnant dans des usines d’IA. En masquant la complexité et en aidant les décisionnaires IT à équilibrer performances, sécurité et coûts, la solution Nutanix Agentic AI ne se contente pas de simplifier les opérations : elle optimise en profondeur l’économie de l’IA.

Graphique de la minimisation du coût par jeton

Réduisez le coût par jeton

Cette solution full-stack offre un routage intelligent, une mise à l’échelle de l’inférence, un placement des ressources tenant compte de la topologie et une consommation optimisée des GPU afin de réduire les coûts par jeton.

Graphique de sécurité d'entreprise

Assurez une sécurité et un contrôle de niveau entreprise

Nutanix Enterprise AI assure le déploiement sécurisé et le contrôle de niveau entreprise de vos points de terminaison LLM, tandis que les améliorations apportées à Nutanix AHV (virtualisation) et à Nutanix Flow (réseau et sécurité) renforcent l’isolation et la sécurité.

Visuel sur la productivité des développeurs

Accélérez la productivité des développeurs

Passez du concept à la production sans être freiné par l’infrastructure. Nutanix Enterprise AI fluidifie l’utilisation des outils d’IA grâce au routage intelligent des modèles, à des points de terminaison d’inférence sécurisés en 1 clic et à un accès clé en main sécurisé aux serveurs Model Context Protocol. La plateforme Nutanix Kubernetes fournit un environnement de démarrage rapide avec un vaste catalogue de services d’IA et un accès intégré aux données privées pour les développeurs d’applications d’IA agentique.

Visuel sur l’opérationnalisation de l’IA agentique

Déployez pleinement l’IA agentique en production

La solution Nutanix Agentic AI est conçue pour s’intégrer naturellement aux usines d’IA certifiées NVIDIA et les compléter, en s’appuyant sur des relations partenaires solides afin de proposer des solutions complètes issues de grands fabricants OEM, notamment Cisco, Dell et Supermicro.

Schéma de la solution NVIDIA

Principaux composants intégrés

Services d’IA et plateforme Kubernetes

Cet environnement cloud native centré sur les développeurs permet aux équipes d’éviter la configuration de l’infrastructure et de faire évoluer immédiatement des applications d’IA agentique prêtes pour la production, avec une économie des jetons prévisible.

Optimisation et sécurité de l’infrastructure

Orchestre la puissance du calcul accéléré dans un format VM, avec des performances et une sécurité maximales pour atteindre un coût inférieur par jeton.

Services de données fondamentaux pour l’IA

Fournit le data fabric haute performance nécessaire pour relier l’entraînement et l’inférence grâce à une transformation continue accélérée par GPU, directement au sein du cluster de stockage.

Services d’IA et plateforme Kubernetes

Personne utilisant la console

Passerelle d’IA avancée et services d’inférence

Un point de terminaison d’inférence unifié et sécurisé permet aux entreprises d’utiliser des modèles hébergés dans le cloud, ainsi que des crédits de jetons, aux côtés de LLM privés, avec une authentification, une observabilité et une limitation de débit cohérentes basée sur les jetons.

Prise en charge du Model Context Protocol et du fine-tuning

Nutanix Enterprise AI étend ses robustes capacités existantes de Model-as-a-Service (MaaS) afin de permettre aux agents de se connecter en toute sécurité aux outils et sources de données d’entreprise.

Plateforme Kubernetes ouverte avec un catalogue riche en IA

Faites passer les applications agentiques du concept à la production sans délais liés à l’infrastructure grâce à un catalogue prévalidé de services d’IA open source, notamment des notebooks, des bases de données vectorielles et des moteurs MLOps. La solution est intégrée nativement à NVIDIA AI Enterprise afin de permettre aux développeurs de déployer instantanément des NVIDIA NIMs, dont Nemotron, et d’accélérer le développement d’applications d’IA haute performance en production.

Optimisation et sécurité de l’infrastructure

Lumières de la ville la nuit

Optimisation tenant compte de la topologie

L’hyperviseur Nutanix AHV garantit un alignement matériel strict sans la complexité d’un réglage manuel de l’infrastructure, afin d’optimiser les performances, la sécurité et l’utilisation des ressources grâce au placement automatique des charges de travail sur des serveurs à forte densité de GPU.

Réseau Zero Trust accéléré par DPU

L’utilisation de Nutanix Flow avec de nouvelles capacités de délestage DPU offre la vitesse brute du bare metal et l’isolation avancée d’un environnement virtualisé, avec une base réseau Zero Trust haute performance qui maximise le débit tout en assurant le flow sécurisé et fiable des données dans l’usine d’IA.

Gestion du cycle de vie en environnement air-gap

La solution prend en charge les installations entièrement déconnectées de toute la plateforme NKP, ainsi que des opérateurs NVIDIA GPU Operator et NVIDIA Network Operator. Les environnements hautement réglementés ou du secteur de la défense peuvent ainsi automatiser les mises à jour des pilotes et l’optimisation du réseau sans exposer le cluster à Internet.

Services de données fondamentaux pour l’IA

Visuel générique avec lumières

Évolutivité linéaire

En tant que plateforme de données IA certifiée NVIDIA Enterprise, Nutanix Unified Storage offre des performances de lecture/écriture élevées sur des milliers de clients GPU, afin que la disponibilité des données évolue au même rythme que votre capacité de calcul.

Débit avancé

La solution garantit que les GPU ne manquent jamais de données en s’appuyant sur NFS over RDMA et, bientôt, sur S3 over RDMA pour fournir un chemin de données à faible latence.

Optimisation des coûts

Elle réduit le coût global par jeton et libère de la mémoire GPU critique grâce à une couche haute capacité dédiée au délestage du cache KV. Vous pouvez ainsi traiter des fenêtres de contexte beaucoup plus vastes et un plus grand nombre d’utilisateurs simultanés, sans pénalité de performances.

Ils font confiance à Nutanix


Faire un test

Exécutez l’inférence IA à grande échelle avec Nutanix Enterprise AI

Prêt pour une démo ?

Parlez à un expert de la façon dont Nutanix vous permet d'étendre l'IA à travers des environnements multicloud hybrides.

Foire aux questions

La solution Nutanix Agentic AI masque la complexité et crée un lien fluide entre les concepteurs d’IA agentique et les opérateurs d’usines d’IA. Cette solution full-stack offre aux opérateurs d’usines d’IA un modèle d’exploitation cloud qui simplifie les opérations, maximise les performances et la sécurité, et optimise les coûts liés aux jetons. Dans le même temps, elle permet aux concepteurs d’IA agentique de se concentrer sur l’innovation, la gestion des modèles et la mise à l’échelle rapide de l’inférence.

Les concepteurs d’IA agentique se heurtent à une forte « friction d’innovation » lorsqu’ils doivent composer avec un environnement fragmenté de modèles, d’outils et de silos de données, au lieu de se concentrer sur la création d’intelligence. Les développeurs ne disposent pas d’un parcours unifié et sécurisé pour exploiter différents LLM et outils open source, afin de faire évoluer rapidement leurs applications, de simples interfaces de chat vers une IA agentique sophistiquée capable de générer de véritables résultats métier.

Pour les opérateurs d’usines d’IA, le principal défi consiste à générer de la valeur métier, mesurée en temps d’accès aux jetons et en coût par jeton, malgré la complexité opérationnelle des usines d’IA, notamment : 

  • La complexité liée à la gestion de matériels d’IA variés et en constante évolution (GPU, réseau, stockage), 
  • Complexité de fournir un accès partagé aux infrastructures d’IA critiques tout en garantissant un accès sécurisé aux modèles et aux données, et en respectant les exigences de souveraineté
  • La complexité liée à la fourniture constante de performances maximales, tout en optimisant l’utilisation des ressources dans l’ensemble de l’usine d’IA.
  • La complexité liée à la gestion du cycle de vie de solutions ponctuelles fragmentées et personnalisées qui prennent en charge les opérations de l’usine d’IA

Le modèle d’exploitation cloud est l’approche de Nutanix pour combler l’écart entre les développeurs d’IA et les équipes d’infrastructure. Au lieu de gérer des solutions ponctuelles fragmentées ou des clusters bare metal complexes, ce modèle fournit un environnement unifié et full-stack. Il permet aux opérateurs de gouverner l’infrastructure d’IA (GPU, DPU et stockage) avec la même simplicité qu’un service cloud, tout en donnant aux développeurs un accès instantané et sécurisé aux outils et modèles dont ils ont besoin pour faire évoluer des milliers d’agents intelligents.

Nutanix optimise l'économie des jetons grâce à plusieurs efficacités intégrées :

  • Optimisation tenant compte de la topologie : l’hyperviseur AHV place automatiquement les charges de travail sur des serveurs à forte densité de GPU afin de maximiser l’alignement matériel.
  • Délestage des ressources : l’utilisation de DPU (Data Processing Units) pour gérer les tâches de réseau et de sécurité libère des cycles GPU spécifiquement pour l’inférence.
  • Stockage intelligent : Nutanix Unified Storage fournit une couche haute capacité pour le délestage du cache KV, ce qui permet d’économiser de la mémoire GPU coûteuse et de prendre en charge des fenêtres de contexte plus vastes sans pénalité de performances.

Bien que le bare metal constituait la norme pour l’entraînement initial des modèles, il lui manque souvent la sécurité et l’isolation nécessaires à la mise à l’échelle des agents en entreprise. Nutanix utilise une infrastructure Kubernetes basée sur des VM pour fournir :

  • Une isolation supérieure : des frontières de sécurité et de multi-tenant plus robustes entre les différentes charges de travail d’IA.
  • Une gestion à grande échelle : une gestion du cycle de vie et une allocation des ressources simplifiées.
  • Des performances bare metal : en s’appuyant sur l’accélération DPU et la prise en compte de la topologie, Nutanix offre la vitesse du bare metal avec la gouvernance d’un environnement virtualisé.

La NAI Gateway agit comme une « porte d’entrée » sécurisée pour tous les modèles d’IA. Elle fournit un point de terminaison d’inférence unifié qui permet aux entreprises de gérer au même endroit les modèles hébergés dans le cloud et les LLM privés. Ses principales fonctionnalités incluent :

  • Gouvernance : limitation de débit basée sur les jetons pour éviter les mauvaises surprises en matière de facturation.
  • Observabilité : visibilité complète sur les personnes qui consomment les ressources et sur la manière dont elles les utilisent.
  • Connectivité : prise en charge du Model Context Protocol (MCP), qui permet aux agents de se connecter en toute sécurité aux données et outils privés de l’entreprise.

La solution réduit la « friction d’innovation » en fournissant un environnement centré sur les développeurs, dans lequel ils peuvent éviter la configuration de l’infrastructure. Grâce à la plateforme Nutanix Kubernetes (NKP), les concepteurs accèdent à un riche catalogue d’IA qui comprend :

  • Des outils open source préintégrés (notebooks, bases de données vectorielles, moteurs MLOps).
  • Le déploiement instantané des NVIDIA NIMs et de la famille de modèles NVIDIA Nemotron.
  • Des points de terminaison d’inférence sécurisés en 1 clic et un accès clé en main aux services de fine-tuning.

Nutanix Unified Storage fournit une plateforme de données évolutive et haute performance, spécialement conçue pour les charges de travail modernes comme l’IA et les applications nouvelle génération. Ses principales capacités incluent :

  • Un débit de lecture ultra-rapide et une capacité all-NVMe dense pour gérer d’immenses jeux de données destinés aux pipelines d’IA, notamment l’inférence et la génération augmentée par récupération (RAG).
  • L’intégration avec la plateforme Nutanix Kubernetes, qui permet le déploiement fluide de pipelines IA/ML conteneurisés et d’applications cloud native.
  • Un accès aux données multiprotocole, qui simplifie le stockage pour diverses charges de travail et accélère l’innovation.