Lenovo y NVIDIA préparent des usines d’IA prêtes à déployer en quelques semaines

Lenovo lance des solutions « prêtes pour l'IA » qui simplifient l'informatique des PME : packs validés, consommation flexible et déploiements 30 % plus rapides

Lenovo a présenté AI Express, une solution développée en partenariat avec NVIDIA afin d’accélérer la mise en production des infrastructures d’intelligence artificielle (IA) en entreprise. Ce service combine des configurations de serveurs éprouvées, un calcul accéléré et une assistance technique pour réduire les délais de déploiement. Selon Lenovo, certaines configurations peuvent passer de la commande à l’expédition en seulement 15 jours ouvrés, tandis que les options de plus grande capacité nécessitent généralement 20 à 25 jours.

Les points clés de Lenovo AI Express en 20 secondes

  • Trois configurations sont proposées pour des charges de travail IA de petite, moyenne et grande envergure.
  • L’option petite commence à 15 jours ouvrés ; la moyenne, à 20 ; et la grande, à 25.
  • Les équipements combinent des serveurs Lenovo avec des GPU NVIDIA, dont la plateforme HGX B300 dans la configuration la plus avancée.
  • Les entreprises peuvent ajouter des logiciels d’IA, des solutions de protection des données et des services pour faire évoluer les projets de la phase de test à la production.

Trois configurations adaptées à différentes charges de travail

Lenovo AI Express repose sur trois configurations de déploiement rapide, dimensionnées selon la taille des modèles, le nombre d’utilisateurs et les performances requises. Les délais indiqués représentent des estimations commerciales du traitement de la commande à l’expédition pour des configurations éligibles, sans garantir une mise en service complète dans ces délais.

Small : à partir de 15 jours ouvrés

Pour l’inférence destinée à une dizaine d’utilisateurs

Cette configuration utilise un serveur Lenovo ThinkSystem SR650a V4 équipé de deux GPU NVIDIA RTX PRO 6000 Blackwell Server Edition. Elle cible des modèles comptant entre 7 milliards et 70 milliards de paramètres, avec un rendement annoncé de 30 tokens par seconde (TPS) ou plus.

Medium : à partir de 20 jours ouvrés

Pour l’inférence et les agents prenant en charge des centaines d’utilisateurs

Le système ThinkSystem SR675 V3 intègre huit GPU NVIDIA RTX PRO 6000 Blackwell Server Edition. Il vise des modèles allant de 70 milliards à 400 milliards de paramètres, avec un rendement déclaré d’au moins 30 TPS.

Large : à partir de 25 jours ouvrés

Pour des déploiements à grande échelle, impliquant des milliers d’utilisateurs

La configuration ThinkSystem SR680a V4 s’appuie sur la plateforme NVIDIA HGX B300 et est conçue pour des modèles génératifs pouvant atteindre un billion de paramètres, ainsi que pour des charges professionnelles importantes. Lenovo ne fournit pas de chiffre unique de performance pour tous les scénarios dans cette catégorie.

Ces trois profils permettent de commencer avec une capacité adaptée aux besoins prévus, évitant ainsi de dimensionner dès l’origine une infrastructure plus grande que nécessaire. L’objectif est que les entreprises puissent augmenter leurs ressources à mesure que le nombre d’agents, de modèles, d’utilisateurs et de demandes d’inférence progresse.

Il est important de noter que la métrique TPS doit être abordée avec prudence : la performance réelle dépend de nombreux facteurs, tels que la modèle utilisé, la longueur des entrées et des réponses, la charge simultanée et la configuration du service. Le chiffre de 30 TPS mentionné pour les deux premières options n’offre aucune garantie universelle pour tous les types de modèles ou charges de travail.

Logiciels, protection des données et services de support

L’offre ne se limite pas au matériel. Lenovo propose des configurations enrichies avec des logiciels d’entreprise, notamment Red Hat AI Factory with NVIDIA et NVIDIA AI Enterprise. Elle inclut également Veeam Kasten pour la protection des applications, des données, des modèles et des pipelines d’IA.

Ces composants visent à répondre à plusieurs besoins dans une usine d’IA : exécuter des modèles, les intégrer dans les processus métiers et sécuriser les données utilisées. Le choix précis dépendra de l’architecture retenue et des exigences spécifiques à chaque entreprise.

Lenovo propose aussi des services de conseil et de déploiement pour aider à identifier les cas d’usage, évaluer le retour sur investissement via des tests de faisabilité, et ajuster les environnements GPU pour optimiser leur utilisation et maîtriser les coûts. De plus, la société annonce de nouvelles capacités de support proactif et prédictif pour les serveurs via Premier Support Plus for Servers, destinées à anticiper les problèmes et à garantir la continuité des opérations critiques.

Cette démarche s’inscrit dans le cadre de leur concept d’Hybrid AI Factory avec NVIDIA, visant à combiner infrastructure, logiciels et services pour la réalisation de projets IA en environnement professionnel. Le déploiement pourra répondre à diverses exigences telles que l’inférence, les applications génératives ou les systèmes agissants, avec une architecture adaptée aux charges de travail, aux performances et aux enjeux de sécurité.

Lenovo souhaite également étendre la diffusion d’AI Express via son réseau international de partenaires commerciaux et le programme Lenovo 360. La disponibilité, les critères d’éligibilité et les modalités de commande peuvent varier selon les régions, nécessitant une confirmation spécifique dans chaque marché.

Ce lancement fait référence au CIO Playbook 2026 de Lenovo : selon eux, les entreprises passant de l’expérimentation à une utilisation à grande échelle de l’IA anticipent un retour moyen de 2,79 dollars par dollar investi, et 93 % des grandes entreprises sondées s’attendent à voir des retours positifs. Ces chiffres proviennent d’études citées par le constructeur, mais ne garantissent pas de résultats pour chaque utilisateur de AI Express.

Questions fréquentes

Qu’est-ce que Lenovo AI Express ?

Il s’agit d’une offre de Lenovo et NVIDIA regroupant des configurations d’infrastructure IA éprouvées, des logiciels optionnels et des services pour accélérer la mise en production des projets IA.

Combien de temps faut-il pour recevoir un système Lenovo AI Express ?

Lenovo annonce des délais de traitement de commande à expédition à partir de 15 jours ouvrés pour la configuration Small, 20 jours pour la configuration Medium et 25 jours pour la configuration Large. Ces délais s’appliquent aux configurations éligibles et peuvent varier selon les régions.

Quelles GPU sont utilisées dans ces configurations ?

Les options Small et Medium emploient respectivement deux et huit GPU NVIDIA RTX PRO 6000 Blackwell Server Edition. La configuration Large s’appuie sur la plateforme NVIDIA HGX B300.

Peut-on faire évoluer l’infrastructure ultérieurement ?

Absolument. Lenovo recommande de commencer avec une configuration adaptée aux besoins initiaux, puis d’élargir la capacité à mesure que le nombre de modèles, d’utilisateurs et de demandes d’inférence augmente.

le dernier