Qualcomm en négociation pour racheter Tenstorrent : un pari à 10 milliards sur l’inférence IA

Qualcomm serait en négociation avancée pour racheter Tenstorrent, la startup de Jim Keller spécialisée dans les accélérateurs IA, pour un montant compris entre 8 et 10 milliards de dollars. Aucun accord officiel n’a été annoncé, mais selon des sources financières citées par The Information, les discussions sont réelles. Si cette opération aboutit, elle constituerait le […]
EAGLE 3.1 : l’optimisation qui rappelle que l’IA ne vit pas uniquement grâce aux GPU

La trajectoire de l’intelligence artificielle est généralement racontée sous l’angle du hardware. Plus de GPU, plus de mémoire HBM, plus de centres de données, davantage de mégawatts et des racks spécialisés. C’est logique : entraîner et déployer des modèles de grande taille nécessite une infrastructure conséquente. Mais EAGLE 3.1 remet sur la table une vérité […]
NVIDIA veut transformer les centres de données en usines d’IA

NVIDIA redéfinit la façon dont l’industrie parle des centres de données. Fini le vocabulaire des GPU, serveurs ou clusters accélérés : l’entreprise préfère désormais le terme usines d’IA, des installations pensées pour produire des tokens en continu, à la manière d’une usine qui génère de l’électricité ou de l’acier. La métaphore est commerciale, mais elle […]
Passer de consommer des tokens à en produire : le nouveau défi économique de l’IA d’entreprise

Les modèles de raisonnement consomment entre 10 et 20 fois plus de tokens que les modèles standard pour traiter un même problème. Quand les agents IA enchainent des tâches et utilisent des outils de façon autonome, ce chiffre grimpe encore. Pour les DSI et les directeurs techniques, le problème n’est plus de savoir si adopter […]
Rackspace et AMD misent sur un cloud IA gouverné pour les secteurs réglementés

Rackspace Technology et AMD ont signé un protocole d’accord pour bâtir une infrastructure d’IA d’entreprise taillée pour les secteurs réglementés. Pas un cloud générique : une plateforme dédiée, gérée et gouvernée, tournant sur des GPU AMD Instinct et des processeurs AMD EPYC, avec Rackspace en charge de l’ensemble du stack, du matériel à l’inférence en […]
NVIDIA et SPAN veulent amener les centres de données d’IA chez les particuliers

La bataille de l’IA ne se joue plus uniquement sur les modèles : l’infrastructure électrique est devenue le vrai goulot d’étranglement. SPAN, connue pour ses panneaux électriques intelligents, propose une réponse peu orthodoxe à la pénurie de puissance de calcul : distribuer de petits nœuds de calcul dans des logements et petits locaux commerciaux. L’initiative, […]
Panthalassa veut faire flotter les data centers d’IA en pleine mer

Panthalassa, startup basée en Oregon, vient de boucler une série B de 140 millions de dollars menée par Peter Thiel pour fabriquer des nœuds flottants capables d’exécuter du calcul d’IA en pleine mer, alimentés par l’énergie des vagues. Objectif affiché : déployer la série Ocean-3 dans le Pacifique Nord en 2026, avec un lancement commercial […]
HPE durcit sa gamme ProLiant pour l’IA en périphérie

HPE étoffe sa gamme ProLiant pour un cas d’usage qui prend de l’épaisseur côté entreprises, administrations et industries critiques : faire tourner de l’intelligence artificielle et des applications sensibles loin du centre de données, dans des sites où la chaleur, la poussière, les vibrations ou l’absence d’équipe technique rendent le déploiement classique impraticable. Le constructeur américain […]
Samsung 4 nm : 80 % de yield et nouvelles commandes d’IA

Samsung Foundry tiendrait peut-être enfin un argument commercial solide face à TSMC. D’après Seoul Economic Daily, la division fonderie sous contrat de Samsung Electronics aurait franchi la barre des 80 % de rendement sur son procédé 4 nanomètres, un seuil que le quotidien sud-coréen qualifie de « processus mature ». L’entreprise n’a rien officialisé, mais […]
NVIDIA Nemotron 3 Nano Omni : un modèle unifié pour des agents IA multimodaux

NVIDIA vient de lancer Nemotron 3 Nano Omni, un modèle d’intelligence artificielle multimodal open source de 30 milliards de paramètres qui traite simultanément vidéo, audio, images, documents et texte dans une seule couche de raisonnement. Le chiffre mis en avant par la société est éloquent : jusqu’à neuf fois plus de débit que d’autres modèles […]