L’IA, c’est formidable. Tout le monde en parle, tout le monde veut en faire quelque chose, et tout le monde découvre généralement au même moment qu’entre un joli prototype qui répond à trois questions et une véritable infrastructure capable de faire tourner l’affaire, il y a un petit gouffre. Lenovo aimerait justement poser un pont au-dessus.
Le constructeur vient de présenter Lenovo AI Express, une offre développée avec NVIDIA qui promet de faire passer les entreprises de “on devrait peut-être essayer l’IA” à “voilà les machines, branchez-les” en quelques semaines. Et, pour une fois, le concept est plutôt simple : Lenovo propose trois configurations matérielles déjà validées, avec les logiciels et services qui vont autour, plutôt que de demander au service informatique de passer trois mois à assembler un puzzle de GPU, de serveurs et de logiciels.
Lenovo AI Express repose sur trois niveaux : Small, Medium et Large. Rien de très subtil dans les noms, mais au moins personne ne devra organiser une réunion de deux heures pour comprendre lequel correspond à ses besoins.
La configuration Small est destinée aux entreprises qui veulent commencer avec des usages d’inférence IA ciblés. Elle peut faire fonctionner des modèles de 7 à 70 milliards de paramètres et vise des dizaines d’utilisateurs. Lenovo annonce une cadence d’au moins 30 tokens par seconde et une expédition pouvant intervenir sous 15 jours ouvrables pour les configurations éligibles.
Derrière tout cela se trouve un ThinkSystem SR650a V4 équipé de deux GPU NVIDIA RTX 6000 PRO Blackwell Server Edition. Autrement dit, on reste dans une infrastructure sérieuse, mais sans immédiatement sortir l’artillerie lourde.
Le niveau Medium passe à un ThinkSystem SR675 V3 équipé de huit GPU NVIDIA RTX 6000 PRO Blackwell Server Edition. Lenovo le destine notamment à l’inférence plus intensive et aux usages d’IA agentique, avec des modèles de 70 à 400 milliards de paramètres et potentiellement des centaines d’utilisateurs. Le délai annoncé passe alors à 20 jours ouvrables.
Et puis arrive le niveau Large, qui ne joue plus vraiment dans la même cour. Lenovo annonce la prise en charge de modèles pouvant atteindre 1 000 milliards de paramètres et de milliers d’utilisateurs. La configuration repose cette fois sur un ThinkSystem SR680a V4 avec NVIDIA HGX B300, avec une livraison annoncée sous 25 jours ouvrables pour les configurations concernées.
À ce stade, on n’est plus vraiment dans le “je vais faire répondre mon chatbot aux questions des employés”. On commence à parler d’une infrastructure capable d’alimenter de véritables charges de travail d’IA à grande échelle.
L’intérêt de Lenovo AI Express n’est finalement pas uniquement de proposer des serveurs avec beaucoup de GPU. Des serveurs avec beaucoup de GPU, l’industrie informatique sait déjà en fabriquer depuis un moment.
Le véritable sujet est plutôt la possibilité de commencer petit et d’augmenter progressivement la puissance. Une entreprise peut donc démarrer avec une infrastructure adaptée à ses premiers usages, puis évoluer lorsque les modèles deviennent plus gros, que les utilisateurs se multiplient ou que les fameux « agents IA » commencent à pousser dans tous les coins.
C’est assez logique. Parce qu’acheter immédiatement une énorme infrastructure en prévision d’un futur glorieux où chaque employé aura 14 agents IA personnels est peut-être légèrement prématuré. Surtout si, six mois plus tard, le projet se résume finalement à demander à une IA de résumer les comptes rendus de réunion.
Lenovo explique d’ailleurs que son approche vise précisément à éviter le surdimensionnement et à réduire les délais liés à l’évaluation, à l’intégration et au déploiement.
Comme souvent dans ce genre d’annonce, le serveur n’est que le début de l’histoire. Lenovo propose également des briques logicielles et des services autour de l’infrastructure.
Les configurations peuvent notamment être associées à Red Hat AI Factory avec NVIDIA ou à NVIDIA AI Enterprise. Veeam Kasten peut également être utilisé pour protéger les applications d’IA, les données, les modèles et les pipelines.
Lenovo propose aussi différents niveaux de services pour accompagner le déploiement, depuis l’installation jusqu’au passage en production et au support. L’objectif est assez évident : éviter que le service informatique reçoive une énorme palette de serveurs et un post-it disant “bonne chance”.
Le constructeur veut également intervenir en amont, avec l’identification des cas d’usage, les preuves de concept et l’optimisation des infrastructures GPU afin de travailler sur les performances, l’utilisation et les coûts.
Parce que oui, faire tourner une IA est une chose. Faire tourner une IA sans transformer la facture électrique et informatique en objet de collection en est une autre.
AI Express s’inscrit par ailleurs dans une stratégie plus large de Lenovo autour de la modernisation des infrastructures informatiques.
Le constructeur propose déjà des configurations prévalidées associant ses propres infrastructures à des technologies provenant notamment de Microsoft, Red Hat, Nutanix et SUSE. L’objectif est toujours le même : réduire le travail d’intégration et éviter que chaque entreprise doive reconstruire elle-même son architecture à partir de zéro.
Lenovo a également présenté le ThinkAgile VX850 V4, destiné notamment aux environnements fortement virtualisés et aux charges de travail importantes. L’idée est de moderniser les infrastructures existantes tout en libérant progressivement des ressources pour les futures applications d’IA.
Ce qui est plutôt intéressant dans le discours : Lenovo ne part pas du principe que toutes les entreprises vont jeter leurs serveurs actuels par la fenêtre pour acheter immédiatement une montagne de GPU Blackwell.
Et c’est probablement une bonne nouvelle pour les directeurs financiers qui viennent de reprendre connaissance après avoir entendu le prix d’une infrastructure IA moderne.
Avec Lenovo AI Express, le constructeur tente surtout de transformer l’infrastructure IA en quelque chose d’un peu plus prévisible. Trois configurations, des composants validés, des services associés et des délais annoncés de 15, 20 ou 25 jours ouvrables selon le niveau.
Cela ne signifie évidemment pas qu’une PME va commander son serveur le lundi matin et disposer d’une intelligence artificielle omnisciente le mardi après-midi. Il reste le logiciel, les données, la sécurité, les applications, les modèles, la gouvernance et surtout cette petite chose particulièrement pénible appelée « savoir ce qu’on veut réellement faire avec l’IA ».
Mais sur le papier, Lenovo essaie au moins de résoudre une partie du problème : passer du PowerPoint intitulé “Notre stratégie IA 2027” à une infrastructure qui existe réellement quelque part dans une salle serveur.
Et finalement, c’est peut-être là que commence la vraie révolution IA. Pas quand ChatGPT écrit encore un magnifique résumé de 17 pages que personne ne lira, mais quand quelqu’un réussit enfin à faire fonctionner tout le brol derrière sans organiser quatre comités, trois appels Teams et une réunion de crise avec le service IT.
On pensait qu’Elon Musk avait déjà suffisamment de casquettes pour remplir un vestiaire entier :…
Segway Navimow, numéro 1 mondial des tondeuses robots sans fil*, ouvre aujourd’hui à Houtvenne (province…
Tesla peut faire rouler son Full Self-Driving en Belgique, mais cela ne signifie pas pour…
La France vient de découvrir qu’elle avait peut-être un léger problème de plomberie numérique. Entre…
Amazon vient de renouveler une bonne partie de sa famille Kindle et, pour une fois,…
Sudo donne immédiatement cette étrange impression de déjà-vu, comme si quelqu’un avait ressorti un objet…