Comment utiliser un seul serveur de sauvegarde Proxmox pour plusieurs clusters sans perdre l’ordre

Lorsqu’une infrastructure s’étend pour inclure plusieurs clusters Proxmox VE et quelques nœuds indépendants, il peut être tentant de créer un datastore Proxmox Backup Server (PBS) pour chacun d’eux. C’est simple à comprendre et cela offre une certaine isolation, mais cela divise également le domaine de déduplication. Les espaces de noms (namespaces) de sauvegarde permettent d’envisager […]
QNAP renforce son NAS distribué avec des snapshots et une récupération entre clusters

QNAP a présenté QuTS MEGA 2.0, une nouvelle version du système d’exploitation de sa plateforme MEGA Scale-out NAS, conçue pour le stockage d’entreprise de grande capacité. La mise à jour intègre deux fonctionnalités particulièrement importantes pour la continuité des activités : snapshots et Cross-Cluster Mirroring. Ces outils permettent de capturer des copies à des moments […]
Une GPU fiable ne suffit pas : pourquoi les grands clusters d’IA échouent autant

Un nœud équipé de huit GPU peut fonctionner pendant des semaines sans problème, mais reste une pièce peu fiable pour un entraînement distribué impliquant des milliers de machines simultanément. La contradiction est apparente : lorsqu’une tâche synchronisée dépend de la disponibilité continue de tous ses participants, une faible probabilité de panne individuelle se multiplie pour […]
Proxmox VE 9.2 arrive avec équilibrage dynamique et davantage de contrôle pour les clusters

Proxmox Server Solutions annonce la disponibilité immédiate de Proxmox Virtual Environment 9.2, une mise à jour majeure de sa plateforme open source de virtualisation d’entreprise. La nouvelle version introduit un changement particulièrement significatif pour les environnements multi-nœuds : un équilibrage de charge dynamique capable de prendre en compte l’utilisation réelle des ressources avant de décider […]
Google et NVIDIA rapprochent les clusters d’IA du million de GPUs Rubin

Google Cloud et NVIDIA ont renforcé leur partenariat afin de déployer la prochaine génération de GPU Vera Rubin dans l’infrastructure AI Hypercomputer de Google. L’annonce concerne la famille d’instances bare metal A5X, conçue pour des charges de travail en intelligence artificielle agéntique et physics, avec une promesse d’échelle impressionnante : jusqu’à 80 000 GPUs NVIDIA […]
Huawei présente ses SuperPoD au MWC 2026 : des clusters jusqu’à 8 192 NPU, une faible latence et un engagement en faveur de l’open source pour l’ère de l’IA

Lors du Mobile World Congress (MWC) 2026 de Barcelone, Huawei a mis en avant une idée centrale dans le débat technologique : l’avenir de la connectivité et de l’Intelligence Artificielle ne dépend pas uniquement de réseaux plus rapides, mais aussi de la construction de l’infrastructure informatique qui alimente des modèles toujours plus sophistiqués. Sa réponse […]
Intel cherche à exploiter NVMe sur Linux : un correctif « compatible avec les clusters » promet jusqu’à 15 % de plus sur les systèmes multi-cœurs

Dans le domaine de la performance, ce ne sont pas toujours les réécritures majeures qui la boostent. Parfois, le saut intervient grâce à un détail apparemment mineur : où se concentrent les “interruptions”. C’est précisément là qu’ingénieurs de chez Intel s’attellent à modifier le noyau Linux pour optimiser la gestion du stockage NVMe sur des […]
Broadcom présente Thor Ultra, la première NIC Ethernet 800G pour l’IA : ouverte, compatible avec l’UEC et prête pour des clusters à l’échelle de millions de tokens

Broadcom a annoncé Thor Ultra, qu’il présente comme la première carte réseau Ethernet (NIC) de 800G spécialement conçue pour l’IA. Ce lancement vise un objectif clair : interconnecter des centaines de milliers d’XPUs (GPU, CPU et autres accélérateurs) afin de entraîner et déployer des modèles ultramassifs de milliards de paramètres sur des réseaux Ethernet ouverts […]
Alternatives à AWS ParallelCluster pour la gestion de clusters HPC

Le calcul haute performance (HPC) est un pilier stratégique dans des secteurs tels que la recherche scientifique, l’ingénierie, l’intelligence artificielle ou l’analyse de gros volumes de données. Bien que AWS ParallelCluster soit devenu une référence pour le déploiement et la gestion de clusters sur Amazon Web Services, il n’est pas la seule option disponible. Il […]
Cologix et Lambda déploient les premiers clusters d’IA avec NVIDIA HGX B200 à Columbus

Annonce de l’Infrastructure d’IA de Pointe dans le Midwest Américain Cologix, l’un des principaux fournisseurs de centres de données et d’interconnexion en Amérique du Nord, a récemment dévoilé, en collaboration avec Lambda et Supermicro, le déploiement de ses premiers clusters d’intelligence artificielle accélérés par NVIDIA HGX B200 dans son centre de données COL4 ScalelogixSM à […]