Le PDG d’IBM avertit : la course aux mégacentres de données IA ne sera pas rentable avec les coûts actuels

L’engouement pour l’investissement dans l’intelligence artificielle envahit le monde avec des projets de mégapoles de données alimentées par des GPU, des puces spécialisées et des centaines de mégawatts de puissance électrique. Cependant, selon le PDG d’IBM, Arvind Krishna, ces investissements ne sont pas viables économiquement. Il exprime cette réalité avec une franchise peu courante dans […]
Red Hat et AWS s’associent pour réduire les coûts et faire évoluer l’IA générative dans le cloud

Red Hat annonce avoir renforcé sa collaboration avec Amazon Web Services (AWS) afin de rendre l’inférence des modèles d’intelligence artificielle générative à grande échelle plus efficace et économique. La société open source souhaite permettre aux entreprises d’exécuter leurs modèles d’IA « sur n’importe quel matériel », en s’appuyant désormais également sur les puces spécifiques d’AWS […]
CloudSpend fait un bond en FinOps : gestion multi-portails des coûts cloud pour MSP et grandes entreprises

La facturation cloud est devenue l’une des sources de frustration majeures pour les fournisseurs de services et les grandes entreprises. Avec la croissance de l’utilisation d’AWS, Azure et Google Cloud, la complexité s’accroît : dizaines de comptes, environnements, projets et clients différents… sans oublier la pression constante pour maîtriser les coûts tout en maintenant l’innovation. […]
TSMC freine ses améliorations de son nœud de 2 nm pour contenir les coûts : une bouffée partielle pour Apple, Qualcomm et MediaTek

La transition vers la technologie 2 nanomètres est devenue synonyme de défis financiers majeurs pour l’ensemble de l’industrie. Récemment, on évoquait des wafers à environ 30 000 dollars l’unité, produits par TSMC, des chiffres difficilement soutenables même pour des géants comme Apple, Qualcomm ou MediaTek. Cependant, de nouvelles rumeurs provenant de sources du secteur en […]
Quand l’IA augmente le coût de la RAM : la prochaine secousse des coûts dans l’infrastructure « de toujours »

Ces derniers mois, l’attention médiatique s’est concentrée sur les GPU pour l’intelligence artificielle. Chaque nouveau déploiement de clusters d’entraînement se chiffre en milliards d’unités et en mégawatts, et la conversation tourne principalement autour de qui obtiendra le plus de cartes et la capacité de calcul la plus importante. Mais alors que les gros titres évoquent […]
SUSE veut devenir la “piste d’atterrissage” de l’IA en production : pile unifiée, observabilité approfondie et contrôle des coûts — désormais face à RHEL et Ubuntu

SUSE ha anunciado SUSE AI, una solución especializada basada en SUSE Rancher Prime que busca solucionar uno de los mayores obstáculos en la adopción empresarial de la inteligencia artificial: ejecutar modelos y aplicaciones de IA a escala, garantizando seguridad, observabilidad y gestión de costos bajo control en entornos de nubes públicas, privadas, on-prem y incluso […]
2026 sera l’année de l’IA « opérationnelle » : priorités, coûts et risques selon le rapport de Flexera

L’intelligence artificielle n’est plus seulement un pilote, mais s’impose désormais comme une architecture. C’est la lecture principale du Rapport sur les Priorités IT 2026 de Flexera: pour la troisième année consécutive, l’intégration de l’IA domine l’agenda technologique mondial. Un responsable IT sur trois (33 %) en fait sa priorité absolue pour l’année à venir. L’ambition […]
Google lance Ironwood (TPU v7) et de nouvelles VM Axion : inférence à l’échelle mondiale et réduction des coûts

Google Cloud a dévoilé Ironwood, sa septième génération de TPU, accompagnée de nouvelles instances Axion basées sur ARM Neoverse — N4A (en avant-première) et C4A métal (bare metal ARM, « prochainement » en aperçu) —, marquant ainsi un changement de cycle dans le domaine de l’Intelligence Artificielle : un déplacement du focus du entraînement vers […]
Dell présente le PowerEdge XR8720t : un tout-en-un pour Open RAN et Cloud RAN qui promet de réduire les coûts et de simplifier le bord

La société annonce un serveur conçu pour transformer l’infrastructure edge et des télécommunications : il s’agit, selon son analyse interne, de la première solution de serveur unique pour déploiements Open RAN et Cloud RAN, avec jusqu’à 72 cœurs, 24 ports SFP28 (25G) et des fonctions de synchronisation de précision pour des réseaux exigeants. Sa disponibilité […]
Imec accélère la transition du GaN à 300 mm : vers des dispositifs de puissance plus avancés et à coûts de fabrication réduits

Imec, le centre renommé de R&D en nanoélectronique et technologies numériques, a lancé une nouvelle étape dans son programme d’innovation ouverte dédiée à la technologie de nitrures de galium (GaN) sur wafer de 300 mm pour l’électronique de puissance à basse et haute tension. Cette initiative, intégrée dans le Industrial Affiliation Program (IIAP) de GaN, […]