Akamai lance AI Grid Intelligent Orchestration pour l’inférence distribuée dans 4 400 emplacements périphériques

Akamai lance AI Grid Intelligent Orchestration pour l'inférence distribuée dans 4 400 emplacements périphériques

Akamai Technologies (NASDAQ : AKAM) franchit une étape majeure dans le développement de l’intelligence artificielle en annonçant la première mise en œuvre mondiale du Design de Référence NVIDIA AI Grid. Cette initiative intègre l’infrastructure d’IA de NVIDIA au sein du réseau mondial d’Akamai et exploite des systèmes d’orchestration intelligente des charges de travail pour couvrir […]

AWS amènera Cerebras à Bedrock pour accélérer l’inférence IA

AWS amènera Cerebras à Bedrock pour accélérer l'inférence IA

Amazon Web Services souhaite renforcer l’un des aspects les plus sensibles de la course actuelle à l’intelligence artificielle : la rapidité de l’inférence. AWS et Cerebras ont annoncé une collaboration dans laquelle la plateforme cloud d’Amazon déployera des systèmes Cerebras CS-3 dans ses centres de données, les rendant accessibles aux clients via Amazon Bedrock. Selon […]

Akamai mise sur l’ère de l’inférence et déploiera des milliers de GPU NVIDIA Blackwell sur une plateforme d’IA distribuée

Rapport sur les ransomwares 2025 : Résilience dans un paysage de menaces alimenté par l'IA

Historiquement associée au monde du CDN et à la distribution de contenus, Akamai cherche à se repositionner d’ici 2026 sous une nouvelle identité : GPU, inférence et intelligence artificielle distribuée. La société a annoncé l’acquisition de des milliers de GPUs NVIDIA Blackwell dans le but de créer l’une des plateformes d’IA les plus déployées au […]

OpenAI renforce son engagement dans l’inférence : NVIDIA prépare une puce avec la technologie de Groq et la société réserverait 3 GW de capacité

Le Royaume-Uni accélère son pari sur l'IA souveraine avec NVIDIA : supercalcul, robotique, santé et modèles en langues celtiques

La course à l’intelligence artificielle ne se résume plus uniquement à l’entraînement de modèles massifs. L’attention s’est déplacée vers un domaine moins visible, mais crucial pour le secteur : l’inférence, c’est-à-dire la capacité de répondre à des millions de requêtes en temps réel avec de faibles latences et des coûts maîtrisés. Dans cette optique, plusieurs […]

Intel et SambaNova unissent leurs forces pour l’inférence : Xeon comme base d’un « centre de données hétérogène » pour l’ère agentique

Intel et SambaNova unissent leurs forces pour l'inférence : Xeon comme base d'un « centre de données hétérogène » pour l'ère agentique

La pulsación de la Intelligence Artificielle ne se limite plus à l’entraînement de modèles gigantesques, mais s’étend à des enjeux plus quotidiens et, pour de nombreuses entreprises, plus coûteux à long terme : l’inférence. Exécuter des modèles en production — en temps réel, avec une latence maîtrisée et des coûts prévisibles — pousse les responsables […]

Cloudera apporte l’inférence AI au centre de données : plus de contrôle, moins de déplacement des données, et Trino aussi en local

Le cloud privé revient sur le devant de la scène avec l'IA : coût, contrôle et souveraineté en Europe

Le discours sur l’intelligence artificielle en entreprise évolue vers une nouvelle phase. Ces dernières années, de nombreuses sociétés ont expérimenté avec des modèles, des assistants et de l’analytique avancée dans des environnements isolés. Cependant, lorsque l’IA passe en production, le débat ne tourne plus autour du choix du modèle, mais se concentre sur quelque chose […]

Lenovo mise sur l’inférence en temps réel avec de nouveaux serveurs d’entreprise au CES 2026 et un « pack » de déploiement hybride prêt pour la production

OpenText renforce sa détection et sa réponse avec l'IA : intégrations approfondies avec Microsoft Defender, Entra ID et Copilot pour réduire le bruit et accélérer la réponse

La course mondiale de l’Intelligence Artificielle (IA) en 2026 ne se limite plus à ceux qui entraînent les plus grands modèles, mais s’oriente désormais vers ceux qui parviennent à faire travailler des modèles déjà entraînés dans le monde réel : en magasins, usines, hôpitaux, centres de service client ou infrastructures critiques. Dans ce contexte, Lenovo […]

Qualcomm présente AI200 et AI250 : accélérateurs « rack-scale » pour l’inférence générative avec plus de mémoire, un TCO réduit et une augmentation de la bande passante effective

Qualcomm présente AI200 et AI250 : accélérateurs « rack-scale » pour l'inférence générative avec plus de mémoire, un TCO réduit et une augmentation de la bande passante effective

Qualcomm a fait une avancée significative dans la course à l’inférence IA à l’échelle des centres de données. La société a annoncé les solutions AI200 et AI250, deux plateformes d’accélération vendues sous forme de cartes ou de racks complets, promettant un rendement à l’échelle du rack, une capacité mémoire accrue et un coût total de […]

Intel annonce « Crescent Island » : une nouvelle GPU pour l’ère de l’inférence IA avec 160 Go de LPDDR5X et une microarchitecture Xe3P

Intel confirme que le microcode 0x12B est responsable de l'instabilité dans Raptor Lake.

Intel a introduit une nouvelle pièce sur l’échiquier de l’intelligence artificielle dans les centres de données. Lors du sommet mondial OCP 2025, l’entreprise a annoncé Crescent Island, nom de code de sa prochaine GPU pour centres de données optimisée pour l’inférence, avec un objectif clair : plus de capacité mémoire par watt, refroidissement à l’air […]