Broadcom Inc. annonce que plusieurs modèles d’IA proposés notamment par Google, NVIDIA, NEC, Alibaba Cloud et Z.ai ont été validés pour fonctionner sur VMware Cloud Foundation (VCF). Les clients peuvent ainsi déployer ces modèles au sein de leurs propres infrastructures et les mettre à la disposition de leurs utilisateurs sous la forme d’un service (« model as a service »).
Alors que les entreprises transfèrent de plus en plus leurs charges de travail d’inférence vers le cloud privé pour répondre à des enjeux de confidentialité, de sécurité, de gouvernance et de maîtrise des coûts liés à l’utilisation des jetons d’IA, VCF leur fournit une plateforme conçue nativement pour l’IA et Kubernetes. Les organisations de tous secteurs disposent ainsi d’un environnement prêt pour la production, capable d’accueillir une large gamme de modèles d’IA.
Selon l’étude Private Cloud Outlook 2026 de Broadcom, 56 % des entreprises exécutent déjà leurs charges d’inférence d’IA en production dans un cloud privé ou prévoient de le faire. VCF est une plateforme de cloud privé unifiée qui permet d’exécuter simultanément des charges d’inférence, des applications agentiques, des services conteneurisés et des machines virtuelles traditionnelles. Elle évite ainsi la fragmentation opérationnelle liée à la gestion d’environnements distincts. Des tests comparatifs indépendants, réalisés selon les standards MLPerf Inference v5.1, confirment par ailleurs que VCF offre des performances comparables à celles d’une infrastructure bare metal. La plateforme répond ainsi aux besoins des entreprises qui souhaitent déployer l’IA à grande échelle dans leurs propres infrastructures.
« Broadcom s’engage à proposer aux entreprises un large choix de modèles d’IA pour leurs infrastructures sur site, tous validés sur VCF », déclare Chris Wolf, responsable mondial de l’IA et des services avancés au sein de la division VMware Cloud Foundation de Broadcom. « En collaborant avec les principaux fournisseurs de modèles d’IA, nous offrons aux organisations une voie claire vers la souveraineté des données et le déploiement d’une IA à grande échelle à un coût maîtrisé. Elles peuvent ainsi accéder de manière sécurisée à des modèles de référence et les proposer sous forme de services à leurs utilisateurs grâce aux fonctionnalités intégrées de VMware Cloud Foundation. »
Des modèles d’IA de référence validés pour VMware Cloud Foundation
VCF permet aux entreprises d’accélérer le déploiement de leurs charges de travail d’IA tout en réduisant leurs coûts, grâce à un écosystème ouvert et extensible. La prise en charge d’environnements de calcul mixtes reposant sur des technologies AMD, Intel et NVIDIA leur permet de choisir librement les processeurs graphiques et centraux adaptés à leurs charges de travail d’IA.
Grâce à l’utilisation de vLLM comme environnement d’exécution par défaut, les clients peuvent faire fonctionner plus de 150 modèles open source sur VCF. Broadcom annonce aujourd’hui que les modèles suivants ont été testés et validés pour fonctionner sur la plateforme :
-
Nemotron 3 : la famille de modèles ouverts et multimodaux NVIDIA Nemotron 3 associe précision et efficacité afin d’aider les agents à accomplir leurs tâches plus rapidement. Grâce à une architecture hybride Mamba-Transformer MoE, une fenêtre de contexte d’un million de jetons et un apprentissage par renforcement dans plusieurs environnements, Nemotron 3 prend en charge des workflows agentiques évolutifs et de longue durée dans les applications d’entreprise.
-
Gemma 4 : dernière génération de modèles multimodaux open source à poids ouverts de Google DeepMind, Gemma 4 a été conçue pour les développeurs et la communauté scientifique. Elle permet une exécution locale et aide les entreprises à concevoir et à déployer des agents d’IA autonomes.
-
cotomi : le modèle d’IA propriétaire de NEC est optimisé pour la langue japonaise et entraîné à partir de jeux de données sélectionnés pour leur fiabilité. Il combine une vitesse de traitement élevée à une amélioration de 40 % de l’efficacité dans l’utilisation des jetons.
-
Qwen 3.7-Max : le modèle multimodal propriétaire Qwen 3.7-Max d’Alibaba propose une fenêtre de contexte d’un million de jetons, des capacités avancées de raisonnement multimodal et une architecture adaptée à l’ère des agents. Il permet aux entreprises du monde entier d’accéder, au sein de leurs propres infrastructures et dans un cadre souverain, à l’une des familles de modèles d’IA les plus performantes.
-
GLM 5.2 : le modèle de langage général open source de Z.ai, anciennement Zhipu AI, permet aux entreprises de déployer localement des agents spécialisés dans la programmation et le raisonnement. Ceux-ci peuvent exécuter des workflows autonomes en plusieurs étapes, tout en garantissant la souveraineté des données et une utilisation optimale des ressources matérielles.

