Partenariats

Vultr et SUSE s’associent pour apporter une plateforme d’IA NVIDIA complète à des charges de travail de production

mm
Ajouter Unite.AI à vos sources préférées sur Google

Vultr et SUSE ont annoncé un nouveau partenariat visant à l’un des principaux goulets d’étranglement de l’IA d’entreprise : passer de l’expérimentation à la production. Les sociétés ont lancé SUSE AI Factory avec NVIDIA (NVDA ) sur l’infrastructure Vultr, une plateforme complète validée qui combine le logiciel d’IA d’entreprise de SUSE, les technologies d’IA d’entreprise NVIDIA et l’infrastructure cloud mondiale de Vultr.

Annoncé au sommet RAISE à Paris, la plateforme est conçue pour les organisations qui souhaitent déployer des applications d’IA de manière sécurisée et à grande échelle sans avoir à assembler la pile complète elles-mêmes. Cela inclut la couche d’infrastructure, l’accélération GPU, l’orchestration Kubernetes, le logiciel d’IA, les contrôles de sécurité et le modèle de support requis pour exécuter des charges de travail d’IA d’entreprise en production.

Pourquoi cela est important

De nombreuses sociétés ont déjà dépassé la phase initiale de preuve de concept de l’IA. Le défi plus difficile est maintenant opérationnel. Les entreprises doivent décider où les modèles doivent s’exécuter, comment les GPU sont gérés, comment les données sensibles sont protégées, comment les applications d’IA sont gérées et comment les équipes peuvent éviter des mois de travail d’intégration avant que la première charge de travail ne soit lancée.

Le partenariat Vultr-SUSE est positionné autour de ce problème précis. Plutôt que de proposer uniquement une capacité de calcul ou uniquement des outils logiciels, la nouvelle plateforme rassemble les couches d’infrastructure et d’application dans une architecture validée. L’objectif est de réduire la « taxe d’intégration » qui ralentit souvent les projets d’IA une fois qu’ils quittent le laboratoire.

Cette distinction est importante. L’IA de production ne consiste pas seulement à avoir accès à des GPU puissants. Cela nécessite des modèles de déploiement répétables, de la sécurité, de l’observabilité, de l’orchestration, de la gestion des modèles et une structure de support que les équipes d’IT d’entreprise peuvent compter.

Une plateforme d’IA complète basée sur une infrastructure ouverte

SUSE AI Factory avec NVIDIA est basée sur une architecture ouverte, basée sur Kubernetes. Cela donne aux entreprises la flexibilité de déployer des charges de travail d’IA à travers le cloud, les environnements sur site, les environnements de bord et les environnements souverains, selon les performances, la conformité, la résidence des données ou les exigences commerciales.

SUSE décrit son usine d’IA comme une plateforme d’infrastructure ouverte pour l’IA d’entreprise privée, conçue pour s’intégrer dans les environnements Linux et Kubernetes existants tout en aidant les organisations à déplacer les charges de travail des environnements de bac à sable vers la production. SUSE positionne également la plateforme autour de plans prévalidés, de flux de travail GitOps et d’exigences d’IA souveraines, plutôt que de forcer les entreprises à adopter un modèle de cloud propriétaire.

La version activée par NVIDIA ajoute directement NVIDIA AI Enterprise à la couche de gouvernance de SUSE. NVIDIA AI Enterprise est la suite logicielle commerciale de NVIDIA pour l’IA de production, qui rassemble des microservices, des frameworks, des bibliothèques, une orchestration GPU et des outils de gestion d’infrastructure pour le déploiement d’entreprise.

Ce que NVIDIA apporte à la pile

La plateforme comprend des composants NVIDIA AI Enterprise tels que NVIDIA NIM, NVIDIA NeMo et NVIDIA Run : ai. Chacun aborde une partie différente du cycle de vie de l’IA d’entreprise.

NVIDIA NIM aide les organisations à déployer une inférence de modèle d’IA optimisée via des microservices, réduisant ainsi la quantité d’ingénierie personnalisée nécessaire pour mettre les modèles en production. NVIDIA NeMo se concentre sur la construction, la personnalisation, l’optimisation et la gouvernance des agents et des systèmes d’IA génératifs à travers les environnements cloud, sur site et hybrides.

NVIDIA Run : ai, quant à lui, aide à gérer l’orchestration GPU et la planification des charges de travail, une exigence critique alors que les entreprises tentent de maximiser l’utilisation de l’infrastructure accélérée coûteuse. NVIDIA AI Enterprise comprend également des opérateurs Kubernetes et des outils de gestion d’infrastructure qui aident à normaliser les déploiements d’IA avec GPU à travers les environnements d’entreprise.

Pour les entreprises, cela est important car l’infrastructure d’IA peut rapidement devenir fragmentée. Les équipes peuvent utiliser différents frameworks, des outils de service de modèles, des couches d’orchestration et des pratiques de sécurité à travers les départements. Une couche logicielle validée par NVIDIA aide à créer une fondation plus cohérente.

Vultr fournit la couche d’infrastructure d’IA mondiale

Le rôle de Vultr est de fournir la fondation d’infrastructure sous-jacente à la pile logicielle. La société propose des GPU cloud, du métal nu, du calcul cloud, des services Kubernetes, du stockage et des services de réseau, donnant ainsi aux entreprises un environnement de déploiement pour les charges de travail d’IA qui nécessitent à la fois des performances et une flexibilité géographique.

Vultr a élargi sa position autour de l’infrastructure d’IA, avec un accès aux GPU AMD et NVIDIA, Kubernetes géré, du métal nu, du stockage et du calcul cloud. Sa plateforme est utilisée pour des charges de travail qui nécessitent une accélération GPU, notamment l’IA/ML, le calcul haute performance, le rendu et d’autres applications à forte intensité de calcul.

C’est là que réside l’importance de ce partenariat. Les charges de travail d’IA doivent de plus en plus souvent s’exécuter à proximité des sources de données, des utilisateurs ou des juridictions réglementées. Une banque, un fournisseur de soins de santé, un opérateur de télécommunications, un fabricant ou un organisme du secteur public peut ne pas souhaiter que toutes les charges de travail d’IA soient acheminées via une seule région cloud centralisée. L’infrastructure distribuée de Vultr donne à SUSE AI Factory avec NVIDIA une empreinte de déploiement plus large pour les clients qui ont besoin d’un contrôle régional ou souverain.

Conçu pour la production, et non seulement pour les pilotes

La partie la plus importante de l’annonce n’est pas que trois grands fournisseurs d’infrastructure et de logiciels travaillent ensemble. C’est que le partenariat reflète où se dirige l’IA d’entreprise.

La première vague d’adoption de l’IA générative a été dominée par l’expérimentation : copilotes internes, prototypes de chatbots, pilotes de génération améliorée et outils de productivité départementaux. La prochaine phase est plus exigeante. Les entreprises souhaitent déployer l’IA dans des systèmes orientés client, des flux de travail réglementés, des opérations industrielles et des processus commerciaux de base.

Cela élève la barre. Les systèmes d’IA doivent être sécurisés, évolutifs, auditable et maintenables. Ils doivent s’exécuter sur des environnements hybrides complexes. Ils doivent prendre en charge les exigences de gouvernance. Et ils doivent éviter de créer de nouvelles formes de verrouillage par les fournisseurs.

L’approche d’infrastructure ouverte de SUSE, la pile d’IA de production de NVIDIA et l’infrastructure cloud mondiale de Vultr sont combinées pour répondre à ces exigences de manière plus intégrée.

Réduction de la complexité du déploiement de l’IA

L’un des thèmes les plus clairs de l’annonce est la simplification. Les entreprises sous-estiment souvent la quantité de travail d’ingénierie nécessaire avant que l’IA puisse s’exécuter de manière fiable en production. Les équipes doivent configurer les pilotes GPU, les clusters Kubernetes, les outils de service de modèles, les pipelines de données, les contrôles d’accès, les systèmes de surveillance et les stratégies de sécurité. Ils doivent également s’assurer que les environnements de développement, de test et de production restent alignés.

SUSE AI Factory avec NVIDIA est conçu pour réduire cette complexité grâce à des plans prévalidés et à un plan de gestion livré via les extensions Rancher et les opérateurs Kubernetes. La documentation SUSE décrit AI Factory comme un moyen de découvrir des applications d’IA et de les combiner en des plans immuables et contrôlés par version.

Ce modèle basé sur des plans est important car il aide les équipes à passer de déploiements ponctuels à des modèles d’infrastructure répétables. Au lieu de reconstruire la pile d’IA pour chaque nouveau projet, les entreprises peuvent normaliser la manière dont les charges de travail d’IA sont empaquetées, déployées, gérées et mises à l’échelle.

Sécurité, souveraineté et contrôle

L’annonce se concentre également sur l’IA sécurisée et souveraine. Cela reflète une préoccupation croissante des entreprises : où les charges de travail d’IA s’exécutent, qui contrôle les données et comment la propriété intellectuelle est protégée.

La stratégie d’IA plus large de SUSE met l’accent sur l’IA d’entreprise privée, le contrôle des données, la sécurité de confiance zéro et la flexibilité de déploiement à travers les environnements cloud, de centre de données et de bord. Les documents produits de l’entreprise mettent en évidence la parité entre le bac à sable et la production, les modèles prévalidés, les flux de travail GitOps et le soutien aux exigences d’IA souveraines.

C’est particulièrement pertinent pour des secteurs tels que les services financiers, les soins de santé, le gouvernement, les télécommunications, la fabrication et les secteurs adjacents à la défense, où l’adoption de l’IA est contrainte non seulement par la capacité technique mais également par la réglementation, la conformité et le risque opérationnel.

Un signe de la maturation du marché de l’IA d’entreprise

Le partenariat Vultr-SUSE fait partie d’un changement plus large dans l’infrastructure d’IA d’entreprise. Le marché s’éloigne des outils isolés et se dirige vers des usines d’IA : des environnements intégrés où les données, les modèles, le calcul, l’orchestration, la gouvernance et les pipelines de déploiement fonctionnent ensemble.

Pour les entreprises, la valeur ne réside pas simplement dans un accès plus rapide aux GPU ou à un autre tableau de bord de plateforme d’IA. La valeur réside dans la réduction de la distance entre l’ambition de l’IA et la réalité opérationnelle. Si la plateforme fonctionne comme prévu, les organisations peuvent passer moins de temps à assembler l’infrastructure et plus de temps à construire des applications d’IA qui produisent des résultats mesurables.

Les clients existants de SUSE pourront travailler avec les équipes de compte de SUSE pour évaluer la plateforme, SUSE et Vultr collaborant sur des déploiements de preuve de concept adaptés aux charges de travail des clients. Une option de déploiement en libre-service via le marché de Vultr est également prévue.

En résumé

Le lancement de SUSE AI Factory avec NVIDIA sur l’infrastructure de Vultr montre à quel point l’infrastructure d’IA d’entreprise évolue rapidement. Les sociétés ne veulent plus d’expériences d’IA qui vivent dans des environnements de bac à sable isolés. Ils veulent des systèmes gérés, sécurisés, évolutifs et maintenables qui peuvent s’exécuter partout où l’entreprise le nécessite.

En combinant la fondation logicielle d’entreprise ouverte de SUSE, la pile d’IA de production de NVIDIA et l’infrastructure cloud mondiale de Vultr, le partenariat donne aux organisations un chemin plus direct des projets pilotes à l’IA de production.

Cela n’élimine pas le travail difficile de l’adoption de l’IA. Les entreprises ont toujours besoin des bonnes données, de la gouvernance, du talent et des cas d’utilisation commerciaux. Mais cela répond à l’un des obstacles les plus persistants : la complexité de l’assemblage et de l’exploitation de la pile d’infrastructure d’IA elle-même.

Antoine est un leader visionnaire et associé fondateur d'Unite.AI, animé par une passion inébranlable pour façonner et promouvoir l'avenir de l'IA et de la robotique. Un entrepreneur en série, il croit que l'IA sera aussi perturbatrice pour la société que l'électricité, et se fait souvent prendre en train de vanter le potentiel des technologies perturbatrices et de l'AGI.

En tant que futuriste, il se consacre à explorer comment ces innovations vont façonner notre monde. En outre, il est le fondateur de Securities.io, une plateforme axée sur l'investissement dans les technologies de pointe qui redéfinissent l'avenir et remodelent des secteurs entiers.