Samsung 4 nm : 80 % de yield et nouvelles commandes d’IA

Samsung Foundry tiendrait peut-être enfin un argument commercial solide face à TSMC. D’après Seoul Economic Daily, la division fonderie sous contrat de Samsung Electronics aurait franchi la barre des 80 % de rendement sur son procédé 4 nanomètres, un seuil que le quotidien sud-coréen qualifie de « processus mature ». L’entreprise n’a rien officialisé, mais […]
Samsung arrache la Groq 3 à TSMC : Nvidia rebat la carte des puces d’inférence

L’inférence est devenue le terrain où se joue désormais la bataille de l’IA. Les modèles ne se contentent plus d’être entraînés dans des fermes de GPU, ils doivent répondre, raisonner et alimenter des millions d’agents en temps réel. Dans cette nouvelle économie, Samsung tente un retour spectaculaire dans la chaîne d’approvisionnement de Nvidia, et TSMC […]
NVIDIA Groq 3 LPX : le nouveau moteur pour l’inférence à faible latence

La grande course de l’IA ne se limite plus à la maîtrise de modèles de plus en plus gros. De plus en plus, le véritable goulet d’étranglement réside dans l’inférence: le temps nécessaire à un système pour commencer à répondre, la latence accumulée lorsque plusieurs agents interagissent et le coût pour maintenir cette rapidité à […]
OpenAI renforce son engagement dans l’inférence : NVIDIA prépare une puce avec la technologie de Groq et la société réserverait 3 GW de capacité

La course à l’intelligence artificielle ne se résume plus uniquement à l’entraînement de modèles massifs. L’attention s’est déplacée vers un domaine moins visible, mais crucial pour le secteur : l’inférence, c’est-à-dire la capacité de répondre à des millions de requêtes en temps réel avec de faibles latences et des coûts maîtrisés. Dans cette optique, plusieurs […]
NVIDIA embauche le fondateur de Groq et license sa technologie d’inférence : un mouvement qui accélère la guerre pour fournir une IA à l’échelle
La course à l’Intelligence Artificielle est en train de changer de cap. Pendant des années, l’attention médiatique et technique s’est concentrée sur le training — modèles toujours plus grands, plus coûteux et davantage dépendants de capacités de calcul —. Mais à mesure que l’IA devient un produit intégré, le véritable goulot d’étranglement se déplace vers […]
IBM et Groq s’associent pour mettre l’IA générative en production : watsonx Orchestrate ajoutera une inférence « ultrarapide » via LPU et GroqCloud

IBM et Groq ont annoncé une alliance stratégique en marketing et technologie, avec un objectif clair : permettre aux entreprises de passer des pilotes à la production en IA agentique, sans rencontrer les obstacles habituels liés à la latence, au coût et à l’échelle. L’accord intègre GroqCloud — la plateforme d’inférence accélérée par la LPU […]
Groq inaugure son premier centre de données en Europe pour dominer l’ère de l’inférence en intelligence artificielle

Alors que de nombreux géants de la technologie continuent de se concentrer sur la formation de modèles de plus en plus volumineux, une nouvelle course discrète mais tout aussi stratégique émerge : celle de l’exécution rapide, efficace et durable de ces modèles. Dans ce domaine, la startup américaine Groq gagne du terrain. Cette semaine, elle […]