Microsoft présente Maia 200 : l’accélérateur d’inférence avec lequel elle veut réduire le coût de la « économie du jeton »

Microsoft présente Maia 200 : l'accélérateur d'inférence avec lequel elle veut réduire le coût de la "économie du jeton"

Microsoft a dévoilé Maia 200, son nouvel accélérateur dédié à l’inférence (génération de tokens), conçu pour réduire significativement les coûts et améliorer l’efficacité de l’exécution de modèles d’IA à grande échelle dans les centres de données. La société le présente comme un élément central de son infrastructure hétérogène destinée à supporter multiples modèles — y […]

Les SSD de 8 To approchent du prix de l’or en Europe tandis que la crise de mémoire explose le coût du montage d’un PC en 2026

Les SSD de 8 To approchent du prix de l’or en Europe tandis que la crise de mémoire explose le coût du montage d’un PC en 2026

Monter un PC « classique » en 2026 devient un exercice de patience pour l’utilisateur moyen. Pendant des années, le marché a supposé que la mémoire et le stockage poursuivraient leur croissance habituelle : davantage de capacité, plus d’efficacité et des prix en baisse. Cependant, le début de 2026 bouleverse cette logique avec des hausses abruptes des […]

NVIDIA Rubin : six puces, un « superordinateur » et la course à la réduction du coût du jeton à l’ère de l’IA de raisonnement

NVIDIA Rubin : six puces, un « superordinateur » et la course à la réduction du coût du jeton à l’ère de l’IA de raisonnement

NVIDIA a profité de l’enceinte du CES de Las Vegas pour annoncer le lancement de sa nouvelle plateforme de calcul dédiée à l’Intelligence Artificielle. Appelée Rubin, en hommage à l’astronome Vera Florence Cooper Rubin, cette plateforme véhicule un message fort : la demande en puissance de calcul pour l’entraînement et l’inférence « explose », entraînant […]

LevelBlue et Tenable misent sur le « scan illimité » de vulnérabilités sans coût supplémentaire : un coup porté aux barrières de visibilité en cybersécurité

F5 acquiert CalypsoAI pour renforcer la sécurité de l'intelligence artificielle dans les grandes entreprises

Dallas (Texas) a été choisi comme scène pour une annonce claire : si la visibilité est la base de la sécurité, elle ne devrait pas dépendre du montant du budget. Le 16 décembre 2025, LevelBlue a annoncé l’élargissement de son partenariat avec Tenable afin d’offrir une analyse illimitée des vulnérabilités, de niveau entreprise, au sein […]

Quand l’IA augmente le coût de la RAM : la prochaine secousse des coûts dans l’infrastructure « de toujours »

Quand l'IA augmente le coût de la RAM : la prochaine secousse des coûts dans l'infrastructure "de toujours"

Ces derniers mois, l’attention médiatique s’est concentrée sur les GPU pour l’intelligence artificielle. Chaque nouveau déploiement de clusters d’entraînement se chiffre en milliards d’unités et en mégawatts, et la conversation tourne principalement autour de qui obtiendra le plus de cartes et la capacité de calcul la plus importante. Mais alors que les gros titres évoquent […]