Samsung 4 nm : 80 % de yield et nouvelles commandes d’IA

Samsung dépasse 80 % de rendement en 4 nm et décroche des commandes d'IA

Samsung Foundry tiendrait peut-être enfin un argument commercial solide face à TSMC. D’après Seoul Economic Daily, la division fonderie sous contrat de Samsung Electronics aurait franchi la barre des 80 % de rendement sur son procédé 4 nanomètres, un seuil que le quotidien sud-coréen qualifie de « processus mature ». L’entreprise n’a rien officialisé, mais […]

Samsung arrache la Groq 3 à TSMC : Nvidia rebat la carte des puces d’inférence

Bataille Samsung TSMC pour les puces d'inference Nvidia

L’inférence est devenue le terrain où se joue désormais la bataille de l’IA. Les modèles ne se contentent plus d’être entraînés dans des fermes de GPU, ils doivent répondre, raisonner et alimenter des millions d’agents en temps réel. Dans cette nouvelle économie, Samsung tente un retour spectaculaire dans la chaîne d’approvisionnement de Nvidia, et TSMC […]

NVIDIA Groq 3 LPX : le nouveau moteur pour l’inférence à faible latence

NVIDIA renforce son engagement dans l'infrastructure IA avec BlueField-4 STX, une architecture de stockage conçue pour les agents et les contextes longs

La grande course de l’IA ne se limite plus à la maîtrise de modèles de plus en plus gros. De plus en plus, le véritable goulet d’étranglement réside dans l’inférence: le temps nécessaire à un système pour commencer à répondre, la latence accumulée lorsque plusieurs agents interagissent et le coût pour maintenir cette rapidité à […]

OpenAI renforce son engagement dans l’inférence : NVIDIA prépare une puce avec la technologie de Groq et la société réserverait 3 GW de capacité

Le Royaume-Uni accélère son pari sur l'IA souveraine avec NVIDIA : supercalcul, robotique, santé et modèles en langues celtiques

La course à l’intelligence artificielle ne se résume plus uniquement à l’entraînement de modèles massifs. L’attention s’est déplacée vers un domaine moins visible, mais crucial pour le secteur : l’inférence, c’est-à-dire la capacité de répondre à des millions de requêtes en temps réel avec de faibles latences et des coûts maîtrisés. Dans cette optique, plusieurs […]

NVIDIA embauche le fondateur de Groq et license sa technologie d’inférence : un mouvement qui accélère la guerre pour fournir une IA à l’échelle

NVIDIA embauche le fondateur de Groq et license sa technologie d'inférence : un mouvement qui accélère la guerre pour fournir une IA à l'échelle

La course à l’Intelligence Artificielle est en train de changer de cap. Pendant des années, l’attention médiatique et technique s’est concentrée sur le training — modèles toujours plus grands, plus coûteux et davantage dépendants de capacités de calcul —. Mais à mesure que l’IA devient un produit intégré, le véritable goulot d’étranglement se déplace vers […]

IBM et Groq s’associent pour mettre l’IA générative en production : watsonx Orchestrate ajoutera une inférence « ultrarapide » via LPU et GroqCloud

IBM et Groq s'associent pour mettre l'IA générative en production : watsonx Orchestrate ajoutera une inférence « ultrarapide » via LPU et GroqCloud

IBM et Groq ont annoncé une alliance stratégique en marketing et technologie, avec un objectif clair : permettre aux entreprises de passer des pilotes à la production en IA agentique, sans rencontrer les obstacles habituels liés à la latence, au coût et à l’échelle. L’accord intègre GroqCloud — la plateforme d’inférence accélérée par la LPU […]