NVIDIA domine MLPerf Inference v6.0 : Blackwell Ultra repousse les limites

NVIDIA continue de transformer les benchmarks MLPerf en démonstration de puissance. Lors de l’édition MLPerf Inference v6.0, l’entreprise affirme avoir obtenu les meilleurs résultats sur le plus grand nombre de tests, en s’appuyant sur Blackwell Ultra et le système GB300 NVL72. Les chiffres sont vertigineux : 2,49 millions de tokens par seconde avec DeepSeek-R1 en […]
NVIDIA Vera Rubin : la chaîne d’approvisionnement mise à l’épreuve

NVIDIA confirme que Vera Rubin NVL72 est en production et que ses systèmes seront déployés au second semestre 2026. Mais derrière cette feuille de route, un rapport DIGITIMES révèle que la conception de la compute tray n’est pas totalement finalisée : NVIDIA révise certains composants pour diversifier ses fournisseurs et réduire les dépendances critiques. Quand […]
SUSE renforce Rancher Prime et Virtualization avec IA et GPU partagés

SUSE a annoncé une nouvelle série de capacités pour SUSE Rancher Prime et SUSE Virtualization, visant à impulser deux idées clés : l’utilisation d’une IA autonome pour simplifier la gestion des infrastructures et un rapprochement accru dans la gestion conjointe des machines virtuelles et des conteneurs. Présentées le 24 mars, ces innovations s’inscrivent dans une […]
NVIDIA arrive à GTC 2026 avec l’inférence au centre et des doutes sur le GPU unique

NVIDIA lance aujourd’hui la GTC 2026 à San José dans un contexte marqué par une approche différente de celle des années précédentes. La conférence se déroule du 16 au 19 mars, et la keynote de Jensen Huang est prévue pour ce lundi, lors d’un événement où la société elle-même annonce des nouveautés concernant l’Intelligence Artificielle, […]
NVIDIA Vera Rubin n’est plus seulement une GPU : ainsi évolue l’IA agentique

NVIDIA a profité du GTC 2026 pour clarifier que son prochain grand projet ne tourne plus autour d’une seule GPU ultra-puissante, mais d’une plateforme complète conçue pour couvrir toutes les phases de l’intelligence artificielle moderne. Baptisée Vera Rubin, la société a présenté un ensemble de sept puces et cinq types de racks qui, selon leur […]
Akamai signe un contrat de 200 millions de dollars pour renforcer les infrastructures d’IA avec des milliers de GPU NVIDIA Blackwell

Akamai Technologies a dévoilé de nouveaux détails concernant un contrat de services d’une valeur de 200 millions de dollars pour une durée de quatre ans, signé avec une grande entreprise technologique américaine spécialisée dans le calcul haute performance pour l’intelligence artificielle. Selon les termes du contrat, le client déploiera un cluster composé de milliers de […]
Akamai mise sur l’ère de l’inférence et déploiera des milliers de GPU NVIDIA Blackwell sur une plateforme d’IA distribuée

Historiquement associée au monde du CDN et à la distribution de contenus, Akamai cherche à se repositionner d’ici 2026 sous une nouvelle identité : GPU, inférence et intelligence artificielle distribuée. La société a annoncé l’acquisition de des milliers de GPUs NVIDIA Blackwell dans le but de créer l’une des plateformes d’IA les plus déployées au […]
NVIDIA a frôlé 94 % du marché des GPU et AMD a chuté à son pire chiffre historique

Le marché des cartes graphiques dédiées pour ordinateurs de bureau a clôturé 2025 dans une situation particulièrement défavorable pour AMD et très favorable pour NVIDIA. Les dernières données de Jon Peddie Research, le cabinet d’analyse spécialisé dans le suivi des activités des fabricants de cartes graphiques (AIB), positionnent NVIDIA à environ 94 % de parts […]
Micron augmente la mise avec GDDR7 de 24 Gbit et 36 Gb/s : plus de VRAM et plus de bande passante pour la prochaine vague de GPU

La prochaine génération de cartes graphiques ne se décide pas uniquement par la puissance de calcul du GPU. De plus en plus, le réel goulet d’étranglement se situe ailleurs : la mémoire. Ce n’est pas un débat nouveau, mais il devient plus visible : lorsque la VRAM ou la bande passante font défaut, des ralentissements, […]
HetCCL : la pièce manquante pour entraîner des modèles avec des GPU NVIDIA et AMD dans le même cluster

La course à la formation de modèles de langage de plus en plus grands rencontre un problème moins visible que la taille des paramètres ou la qualité des données : la logistique du matériel informatique. En pratique, déployer une infrastructure de machine learning à grande échelle ne consiste plus seulement à “acheter plus de GPU”, […]