Samsung arrache la Groq 3 à TSMC : Nvidia rebat la carte des puces d’inférence

Bataille Samsung TSMC pour les puces d'inference Nvidia

L’inférence est devenue le terrain où se joue désormais la bataille de l’IA. Les modèles ne se contentent plus d’être entraînés dans des fermes de GPU, ils doivent répondre, raisonner et alimenter des millions d’agents en temps réel. Dans cette nouvelle économie, Samsung tente un retour spectaculaire dans la chaîne d’approvisionnement de Nvidia, et TSMC […]

IBM et Groq s’associent pour mettre l’IA générative en production : watsonx Orchestrate ajoutera une inférence « ultrarapide » via LPU et GroqCloud

IBM et Groq s'associent pour mettre l'IA générative en production : watsonx Orchestrate ajoutera une inférence « ultrarapide » via LPU et GroqCloud

IBM et Groq ont annoncé une alliance stratégique en marketing et technologie, avec un objectif clair : permettre aux entreprises de passer des pilotes à la production en IA agentique, sans rencontrer les obstacles habituels liés à la latence, au coût et à l’échelle. L’accord intègre GroqCloud — la plateforme d’inférence accélérée par la LPU […]