VMware Cloud Foundation intègre des modèles d’IA de référence au cloud privé

Broadcom Inc. annonce que plusieurs modèles d’IA proposés notamment par Google, NVIDIA, NEC, Alibaba Cloud et Z.ai ont été validés pour fonctionner sur VMware Cloud Foundation (VCF). Les clients peuvent ainsi déployer ces modèles au sein de leurs propres infrastructures et les mettre à la disposition de leurs utilisateurs sous la forme d’un service (« model as a service »).

Alors que les entreprises transfèrent de plus en plus leurs charges de travail d’inférence vers le cloud privé pour répondre à des enjeux de confidentialité, de sécurité, de gouvernance et de maîtrise des coûts liés à l’utilisation des jetons d’IA, VCF leur fournit une plateforme conçue nativement pour l’IA et Kubernetes. Les organisations de tous secteurs disposent ainsi d’un environnement prêt pour la production, capable d’accueillir une large gamme de modèles d’IA.

Selon l’étude Private Cloud Outlook 2026 de Broadcom, 56 % des entreprises exécutent déjà leurs charges d’inférence d’IA en production dans un cloud privé ou prévoient de le faire. VCF est une plateforme de cloud privé unifiée qui permet d’exécuter simultanément des charges d’inférence, des applications agentiques, des services conteneurisés et des machines virtuelles traditionnelles. Elle évite ainsi la fragmentation opérationnelle liée à la gestion d’environnements distincts. Des tests comparatifs indépendants, réalisés selon les standards MLPerf Inference v5.1, confirment par ailleurs que VCF offre des performances comparables à celles d’une infrastructure bare metal. La plateforme répond ainsi aux besoins des entreprises qui souhaitent déployer l’IA à grande échelle dans leurs propres infrastructures.

« Broadcom s’engage à proposer aux entreprises un large choix de modèles d’IA pour leurs infrastructures sur site, tous validés sur VCF », déclare Chris Wolf, responsable mondial de l’IA et des services avancés au sein de la division VMware Cloud Foundation de Broadcom. « En collaborant avec les principaux fournisseurs de modèles d’IA, nous offrons aux organisations une voie claire vers la souveraineté des données et le déploiement d’une IA à grande échelle à un coût maîtrisé. Elles peuvent ainsi accéder de manière sécurisée à des modèles de référence et les proposer sous forme de services à leurs utilisateurs grâce aux fonctionnalités intégrées de VMware Cloud Foundation. »

Des modèles d’IA de référence validés pour VMware Cloud Foundation

VCF permet aux entreprises d’accélérer le déploiement de leurs charges de travail d’IA tout en réduisant leurs coûts, grâce à un écosystème ouvert et extensible. La prise en charge d’environnements de calcul mixtes reposant sur des technologies AMD, Intel et NVIDIA leur permet de choisir librement les processeurs graphiques et centraux adaptés à leurs charges de travail d’IA.

Grâce à l’utilisation de vLLM comme environnement d’exécution par défaut, les clients peuvent faire fonctionner plus de 150 modèles open source sur VCF. Broadcom annonce aujourd’hui que les modèles suivants ont été testés et validés pour fonctionner sur la plateforme :

  • Nemotron 3 : la famille de modèles ouverts et multimodaux NVIDIA Nemotron 3 associe précision et efficacité afin d’aider les agents à accomplir leurs tâches plus rapidement. Grâce à une architecture hybride Mamba-Transformer MoE, une fenêtre de contexte d’un million de jetons et un apprentissage par renforcement dans plusieurs environnements, Nemotron 3 prend en charge des workflows agentiques évolutifs et de longue durée dans les applications d’entreprise.

  • Gemma 4 : dernière génération de modèles multimodaux open source à poids ouverts de Google DeepMind, Gemma 4 a été conçue pour les développeurs et la communauté scientifique. Elle permet une exécution locale et aide les entreprises à concevoir et à déployer des agents d’IA autonomes.

  • cotomi : le modèle d’IA propriétaire de NEC est optimisé pour la langue japonaise et entraîné à partir de jeux de données sélectionnés pour leur fiabilité. Il combine une vitesse de traitement élevée à une amélioration de 40 % de l’efficacité dans l’utilisation des jetons.

  • Qwen 3.7-Max : le modèle multimodal propriétaire Qwen 3.7-Max d’Alibaba propose une fenêtre de contexte d’un million de jetons, des capacités avancées de raisonnement multimodal et une architecture adaptée à l’ère des agents. Il permet aux entreprises du monde entier d’accéder, au sein de leurs propres infrastructures et dans un cadre souverain, à l’une des familles de modèles d’IA les plus performantes.

  • GLM 5.2 : le modèle de langage général open source de Z.ai, anciennement Zhipu AI, permet aux entreprises de déployer localement des agents spécialisés dans la programmation et le raisonnement. Ceux-ci peuvent exécuter des workflows autonomes en plusieurs étapes, tout en garantissant la souveraineté des données et une utilisation optimale des ressources matérielles.

Dans la même catégorie

Derniers articles

Deux tiers des entreprises ont ramené des workloads IA du cloud public vers le on-premise ou le cloud privé

 Cloudera  publie les résultats de sa nouvelle enquête mondiale, The Great AI Re-Architecture. Menée par Wakefield Research auprès de 1500 architectes d’entreprise, responsables d’infrastructure cloud...

Cloud français : un enjeu de souveraineté pour les données de santé

Yoann Jousse Directeur Division Cloud, Cyber et Services ManagésPendant longtemps, l'hébergement des données de santé a été considéré comme un sujet essentiellement technique. Il...

Numspot obtient la qualification SecNumCloud pour son offre IaaS

Numspot annonce l’obtention de la qualification SecNumCloud pour sa « plateforme de services cloud ». Cette qualification place désormais Numspot parmi le nombre...

HarfangLab sécurise les environnements Nutanix jusque dans les sites isolés

La plateforme peut fonctionner dans le cloud, sur site ou au sein d’une infrastructure coupée du réseau. Les clients conservent ainsi le choix du...