NVIDIA Rubin CPX : le GPU qui redéfinit l’inférence de contexte longue à l’ère de l’IA

NVIDIA Rubin CPX : le GPU qui redéfinit l'inférence de contexte longue à l'ère de l'IA

L’inférence est devient le nouveau champ de bataille de l’intelligence artificielle. Les modèles actuels ne se contentent plus d’être de simples générateurs de texte ou d’images : ils évoluent vers des systèmes agéntiques capables de raisonner sur plusieurs étapes, de maintenir une mémoire persistante et de gérer des contextes de plusieurs millions de tokens. Pour […]

NVIDIA Rubin CPX : la nouvelle GPU qui inaugure l’ère de l’inférence avec des contextes massifs

NVIDIA Rubin CPX : la nouvelle GPU qui inaugure l'ère de l'inférence avec des contextes massifs

L’intelligence artificielle ne connaît pas de pause, et le développement du matériel capable de supporter des modèles de plus en plus complexes et exigeants continue d’évoluer. NVIDIA a présenté Rubin CPX, une GPU qui représente non seulement une évolution par rapport aux générations précédentes, mais ouvre également une nouvelle catégorie au sein de l’écosystème CUDA […]

NVIDIA vise 5 milliards de dollars en Chine avec ses GPU H20 et anticipe une demande « en gigawatts » pour sa puce Vera Rubin

NVIDIA vise 5 milliards de dollars en Chine avec ses GPU H20 et anticipe une demande « en gigawatts » pour sa puce Vera Rubin

La directrice financière de NVIDIA, Colette Kress, a suscité plusieurs déclarations marquantes lors de sa présentation à la Goldman Sachs Communacopia + Technology Conference. Elle a évoqué la possibilité que l’entreprise réalise jusqu’à 5 milliards de dollars de revenus provenant de la vente de sa GPU H20 en Chine, sous réserve du apaisement des tensions […]

NVIDIA signe un accord de 1,5 milliard de dollars avec Lambda pour louer ses propres GPU en pleine course à l’IA

NVIDIA signe un accord de 1,5 milliard de dollars avec Lambda pour louer ses propres GPU en pleine course à l'IA

NVIDIA, la société qui a impulsé comme aucune autre la fièvre actuelle autour de l’intelligence artificielle, se trouve désormais dans une situation inédite : devoir louer ses propres GPU. Selon les informations rapportées par The Information, la société dirigée par Jensen Huang aurait conclu un contrat important avec la startup cloud Lambda, spécialisée dans la […]

Together AI active ses GPU en Suède et accélère son « atterrissage » européen avec des ateliers d’IA pour ingénieurs

Together AI active ses GPU en Suède et accélère son « atterrissage » européen avec des ateliers d'IA pour ingénieurs

La compagnie d’infrastructure cloud accélérée pour l’IA renforce sa présence en Europe avec une infrastructure opérationnelle en Suède et entame une tournée de formations techniques débutant à Amsterdam. Elle promet une latence réduite pour le Nord et le Centre de l’Europe, la résidence des données dans l’UE, et une sélection pratique de techniques pour ajuster […]

Carbon Robotics et son LaserWeeder G2 : l’arme laser contre les mauvaises herbes intégrant 24 GPU NVIDIA

Carbon Robotics et son LaserWeeder G2 : l'arme laser contre les mauvaises herbes intégrant 24 GPU NVIDIA

La start-up agricole américaine a mis au point une machine capable d’éliminer jusqu’à 600 000 mauvaises herbes par heure avec une précision submillimétrique, sans utiliser de herbicides. Le secteur agricole connaît une véritable révolution technologique. Face à la résistance croissante des mauvaises herbes aux herbicides et à la pénurie mondiale de main-d’œuvre agricole, la robotique […]

CoreWeave montre une augmentation de 6,5x des performances GPU avec NVIDIA GB300 NVL72 par rapport à H100 dans le modèle de raisonnement DeepSeek R1

CoreWeave montre une augmentation de 6,5x des performances GPU avec NVIDIA GB300 NVL72 par rapport à H100 dans le modèle de raisonnement DeepSeek R1

Une nouvelle étape dans la course à l’intelligence artificielle de nouvelle génération s’appuie désormais non seulement sur les modèles, mais aussi sur l’infrastructure qui les soutient. Avec l’émergence de modèles de raisonnement capables d’accomplir des tâches complexes en plusieurs étapes, d’analyser des données et d’agir en tant qu’agents autonomes, le défi principal ne se limite […]

Intel réussit à rapprocher ses CPU des performances des GPU de NVIDIA en intelligence artificielle grâce à des micro-noyaux de 1 et 2 bits

Intel se positionne comme la seule alternative réelle à TSMC et leader émergent dans l'emballage avancé, selon un analyste de Wall Street

Une nouvelle percée dans le domaine de l’intelligence artificielle remet en cause la domination historique des GPU face aux CPU. Intel a récemment démontré que ses processeurs traditionnels, grâce à un redimensionnement logiciel utilisant des microkernels optimisés, peuvent désormais exécuter des modèles de langage de grande taille (LLM) à des vitesses proches de celles des […]