NVIDIA veut transformer les centres de données en usines d’IA

NVIDIA veut transformer les centres de données en usines d'IA

NVIDIA redéfinit la façon dont l’industrie parle des centres de données. Fini le vocabulaire des GPU, serveurs ou clusters accélérés : l’entreprise préfère désormais le terme usines d’IA, des installations pensées pour produire des tokens en continu, à la manière d’une usine qui génère de l’électricité ou de l’acier. La métaphore est commerciale, mais elle […]

L’IA d’entreprise entre dans sa phase inconfortable : quelqu’un doit payer les tokens

Liferay reconnu comme leader dans le IDC MarketScape pour les systèmes de gestion de contenu full-stack avec capacités d'IA

La première étape de l’intelligence artificielle générative en entreprise s’est vendue comme une promesse d’amélioration de la productivité quasi inévitable : plus de code, plus de documents, plus d’automatisation et moins de temps perdu dans des tâches répétitives. La deuxième étape est beaucoup moins « épique » : vérification des factures, définition de limites de […]

La facture IA : chez NVIDIA, le calcul a déjà dépassé le coût des salaires

Centres de données pour l'IA : la facture infrastructure dépasse les salaires chez NVIDIA

L’intelligence artificielle a été vendue pendant des mois comme un levier pour réduire les coûts, automatiser les tâches et accélérer la productivité. La réalité qui émerge dans certaines entreprises technologiques est plus dérangeante : utiliser une IA avancée peut aussi coûter très cher. Pas seulement en abonnements aux modèles, mais en tokens, en GPU, en […]

Anthropic loue Colossus de SpaceX : 300 MW pour doper Claude

Le Pentagone accélère l'« IA en production » : Claude, ChatGPT, Gemini et Grok rivalisent pour le cœur (et le contrôle) de la défense des États-Unis

Anthropic vient de signer un accord avec SpaceX pour louer l’intégralité de la capacité du centre de calcul Colossus 1 à Memphis, Tennessee. Résultat concret : plus de 220 000 GPU NVIDIA (H100, H200 et GB200) et 300 MW de puissance électrique disponibles en moins d’un mois. Pour les utilisateurs de Claude Code et les […]

Cloudflare lance « Markdown pour les Agents » : moins de tokens, plus de contexte et une nouvelle couche pour le web de l’intelligence artificielle

Cloudflare et Mastercard préparent une alliance pour renforcer la protection des PME et des infrastructures critiques contre les cyberattaques

Cloudflare propose une idée simple avec des implications considérables pour tous ceux qui travaillent avec des modèles de langage : fournir une version en Markdown d’une page Web à la demande, sans modifier le site ni maintenir des “versions doubles”. La solution s’appelle Markdown for Agents et son efficacité peut être résumée par une statistique […]

Broadcom présente Thor Ultra, la première NIC Ethernet 800G pour l’IA : ouverte, compatible avec l’UEC et prête pour des clusters à l’échelle de millions de tokens

Mise à jour urgente de l'URL pour les services Horizon : Action requise avant le 27 août 2024

Broadcom a annoncé Thor Ultra, qu’il présente comme la première carte réseau Ethernet (NIC) de 800G spécialement conçue pour l’IA. Ce lancement vise un objectif clair : interconnecter des centaines de milliers d’XPUs (GPU, CPU et autres accélérateurs) afin de entraîner et déployer des modèles ultramassifs de milliards de paramètres sur des réseaux Ethernet ouverts […]

NVIDIA et OpenAI portent l’inférence à 1,5 million de tokens par seconde avec les modèles GPT-OSS sur l’architecture Blackwell

NVIDIA et OpenAI portent l'inférence à 1,5 million de tokens par seconde avec les modèles GPT-OSS sur l'architecture Blackwell

NVIDIA et OpenAI ont franchi une nouvelle étape dans la performance de l’intelligence artificielle avec le lancement des modèles open source gpt-oss-20b et gpt-oss-120b, optimisés pour l’architecture Blackwell. Selon la société, le plus grand modèle atteint jusqu’à 1,5 million de tokens par seconde (TPS) sur un système NVIDIA GB200 NVL72, ce qui permettrait de servir […]

NVIDIA établit un record mondial avec Llama 4 Maverick : plus de 1 000 tokens par seconde par utilisateur grâce à Blackwell

NVIDIA établit un record mondial avec Llama 4 Maverick : plus de 1 000 tokens par seconde par utilisateur grâce à Blackwell

La société atteint une vitesse sans précédent dans l’inférence de modèles LLM, combinant optimisation matérielle, logicielle et techniques avancées de décodage spéculatif. NVIDIA a établi un nouveau record en matière de performance pour les modèles de langage de grande échelle (LLM). Un seul nœud NVIDIA DGX B200, équipé de huit GPU Blackwell, a atteint une […]