AMD lance ROCm 10 et utilise des agents d’IA pour exploiter ses GPU Instinct

AMD a lancé ROCm 10, une nouvelle génération de sa plateforme logicielle pour le calcul accéléré, accompagnée de ROCm.AI, un environnement conçu pour que les agents d’intelligence artificielle themselves aident à configurer, diagnostiquer et optimiser la charge sur le matériel AMD. La société affirme que ses optimisations ont permis, selon ses propres tests, une amélioration […]
NVIDIA n’est plus un vendeur de GPU : le Data Center pèse 92,5 % de ses revenus

NVIDIA a bouclé son deuxième trimestre fiscal 2027, clôturé le 26 juillet, avec un chiffre d’affaires de 96,221 milliards de dollars, en hausse de 106 % sur un an. La division Data Center représente à elle seule 89 milliards de dollars, en progression de 117 %, soit 92,5 % du chiffre d’affaires total. Derrière ces […]
Samsung prépare la zHBM : mémoire 3D sur le GPU pour dépasser les limites de la HBM

Samsung travaille sur une évolution en profondeur de la mémoire HBM pour les accélérateurs d’intelligence artificielle. Son ambition culmine avec zHBM, une architecture visant à placer la mémoire verticalement au-dessus du processeur, à réduire la distance que parcourent les données et à éliminer certains éléments de l’emballage 2.5D actuel. Le fabricant prévoit jusqu’à 230 % […]
NVIDIA investit 7 milliards de dollars dans Poolside et renforce son activité au-delà des GPU

NVIDIA prépare l’une de ses plus grosses initiatives hors hardware : un accord lié à Poolside pour environ 7 milliards de dollars comprenant 6 milliards pour une licence non exclusive de sa technologie, l’intégration prévue de plus d’une centaine d’employés et un investissement additionnel d’1 milliard dans la société. Cette démarche pourrait accélérer le développement […]
Alibaba amène Qwen à son RISC-V XuanTie C950 et réduit sa dépendance aux GPU

Alibaba continue d’intégrer deux piliers de sa stratégie technologique qui, jusqu’à récemment, évoluaient séparément : ses modèles d’intelligence artificielle et ses propres processeurs. Le XuanTie C950, architecture RISC-V haute performance dévoilée en mars, peut désormais exécuter nativement des modèles Qwen. Cette avancée permet à l’entreprise de concevoir des systèmes où elle contrôle une part beaucoup […]
Les GPU A100 résistent à la retraite : la nouvelle valeur du vieux matériel d’IA

La rapidité avec laquelle Nvidia présente de nouvelles générations d’accélérateurs peut laisser penser qu’une GPU dédiée à l’intelligence artificielle devient obsolète en quelques années. Cependant, l’expérience de CoreWeave indique une autre réalité. Le fournisseur d’infrastructure a signé un contrat pour continuer à louer des GPU Nvidia A100 jusqu’en 2029, selon ses déclarations récemment rapportées par […]
SanDisk veut associer la NAND aux GPU d’IA, mais HBF ne remplacera pas le HBM

SanDisk s’efforce d’ouvrir une nouvelle catégorie de mémoire pour l’intelligence artificielle avec la High Bandwidth Flash (HBF), une technologie qui vise à rapprocher de grandes quantités de NAND des accélérateurs, sans supporter le coût et les limitations de capacité de la mémoire HBM. Sa proposition a gagné en visibilité lors de l’Investor Day organisé le […]
Le trou des puces de Nvidia : la Chine accède aux GPU interdites sans les importer

Un chip Nvidia soumis à des contrôles à l’exportation pour la Chine peut ne jamais pénétrer sur le territoire chinois, tout en finissant par fournir une capacité en intelligence artificielle à une entreprise du pays. La croissance des centres de données équipés de GPU américains en Malaisie, à Singapour et sur d’autres marchés d’Asie du […]
NPU vs GPU : différences, performances et lequel vous avez vraiment besoin pour l’IA locale

Les Unités de Traitement Neural (UTN ou NPU) ne sont plus une simple curiosité réservée aux mobiles : elles deviennent une composante standard du hardware dans les ordinateurs portables et de bureau. Qualcomm atteint déjà 80 TOPS avec Snapdragon X2, AMD tourne autour de 50-55 TOPS avec Ryzen AI, Intel propose jusqu’à 50 TOPS avec […]
AMD achète Taalas pour renforcer sa stratégie en inférence d’IA et rivaliser au-delà des GPU

AMD a annoncé un accord définitif pour l’acquisition de la startup canadienne Taalas, spécialisée dans le développement de puces d’inférence pour l’intelligence artificielle. Cette opération renforce la stratégie de l’entreprise pour concurrencer dans l’un des segments à la croissance la plus rapide du marché de l’IA : l’exécution de modèles préalablement entraînés. Cette phase, qui […]