AMD achète Taalas pour renforcer sa stratégie en inférence d’IA et rivaliser au-delà des GPU

AMD a annoncé un accord définitif pour l’acquisition de la startup canadienne Taalas, spécialisée dans le développement de puces d’inférence pour l’intelligence artificielle. Cette opération renforce la stratégie de l’entreprise pour concurrencer dans l’un des segments à la croissance la plus rapide du marché de l’IA : l’exécution de modèles préalablement entraînés. Cette phase, qui […]
Intel à Computex 2026 : Xeon 6+, IA agentive et reconquête du marché data center

Intel a utilisé Computex 2026 pour répondre à une question que le marché lui pose depuis deux ans : quel rôle veut-elle jouer dans un secteur IA dominé par NVIDIA en accélérateurs, TSMC en fabrication avancée et les hyperscalers en déploiement d’infrastructure ? La réponse de Lip-Bu Tan n’est pas un pivot unique, mais une […]
FuriosaAI et Broadcom préparent une puce IA à 2 nm pour l’ère de l’inférence

FuriosaAI a annoncé un partenariat avec Broadcom pour développer sa troisième génération d’accélérateurs d’IA. Objectif : une plateforme conçue exclusivement pour l’inférence à grande échelle et les charges agentives. La société sud-coréenne n’emprunte pas la voie des GPU généralistes. Elle mise sur une architecture chiplet avec un die de calcul à 2 nanomètres, de la […]
Les ASIC gagnent du terrain dans l’IA : les GPU sous pression

Au cours des trois dernières années, la trajectoire de l’IA a été largement dominée par un mot : GPU. NVIDIA s’est imposée comme l’entreprise la plus influente du secteur, ses accélérateurs étant la solution la plus rapide et la plus accessible pour entraîner et déployer des modèles. Mais le marché commence à s’intéresser sérieusement à une […]
Cerebras défie NVIDIA sur la vitesse d’inférence

Cerebras remet sur la table une question gênante pour l’industrie de l’IA : et si le problème ne résidait pas dans le nombre de GPU, mais dans une dépendance excessive à une architecture conçue à l’origine pour d’autres types de charges ? Andrew Feldman, cofondateur et CEO de Cerebras, défend depuis longtemps cette thèse : […]
AMD : l’IA agentique amplifie la demande CPU en datacenter

Au premier trimestre 2026, AMD a réalisé 10,25 milliards de dollars de chiffre d’affaires, soit +38 % sur un an. Le segment data center a dépassé 5,8 milliards, en hausse de 57 %. Lisa Su, PDG de la société, a choisi la conférence de résultats pour trancher un débat récurrent dans le secteur : l’IA […]
Meta et Broadcom : des puces IA maison en 2 nm à l’échelle du gigawatt

Meta franchit un cap dans sa stratégie de silicium propriétaire. Le géant des réseaux sociaux a annoncé le 14 avril une extension majeure de sa collaboration avec Broadcom pour co-développer plusieurs générations de ses accélérateurs MTIA (Meta Training and Inference Accelerator). L’accord ne se limite pas au silicium : il couvre aussi l’emballage avancé et […]
Meta et CoreWeave : 21 milliards pour dominer l’inférence IA

Meta a renforcé sa collaboration avec CoreWeave à travers un nouveau contrat d’infrastructure dédié à l’IA, d’une valeur approximative de 21 milliards de dollars avec une échéance fixée à décembre 2032. Annoncée conjointement par CoreWeave et détaillée dans un document soumis à la SEC, cette opération consolide la position de l’entreprise en tant que l’un […]
IONOS lance un serveur GPU NVIDIA Blackwell pour l’IA en Europe

IONOS, une entreprise européenne spécialisée dans la digitalisation et les services cloud, a annoncé le lancement du serveur dédié IP4-50 GPU, conçu spécifiquement pour les applications d’intelligence artificielle. Ce modèle intègre l’architecture Blackwell de NVIDIA, qui domine le marché GPU IA en 2026, via la carte NVIDIA RTX PRO 6000, dotée de 96 Go de […]
Intel et SambaNova : redéfinir l’inférence pour l’IA agentique

Le domaine de l’IA se concentre désormais sur l’efficacité de l’exécution en production. Intel et SambaNova ont annoncé une architecture conjointe pour l’IA agentique — des modèles qui compilent du code, appellent des outils, consultent des bases et orchestrent des workflows complexes. Cette proposition remet en question l’idée que tout le futur de l’inférence repose […]