Oracle et AMD stimulent la supercalculativité d’IA : OCI déploiera plus de 130 000 GPU MI355X pour accélérer l’entraînement et l’inférence de modèles à grande échelle.

Oracle et AMD s’associent pour proposer des superclusters IA dans le cloud Oracle a annoncé une alliance stratégique avec AMD afin d’intégrer la dernière génération des accélérateurs AMD Instinct MI355X dans son infrastructure cloud (Oracle Cloud Infrastructure, OCI). Ce partenariat vise à positionner Oracle en tête du marché de la superinformatique dédiée à l’intelligence artificielle […]
NVIDIA réinvente l’inférence en IA : grands clusters, silicium photonique et réseaux ultra-efficaces pour un avenir dominé par des modèles de raisonnement.

NVIDIA Redéfinit l’Infrastructure des Centres de Données pour l’IA Générative NVIDIA se positionne comme un acteur clé de la transition vers des infrastructures centralisées de haute performance, répondant au besoin croissant de modèles génératifs avancés et de charges d’inférence. Sa technologie d’optique co-intégrée redéfinit les normes d’efficacité énergétique dans les centres de données. Traditionnellement, la […]
LM Studio propulse l’IA locale : comment il accélère l’inférence avec les GPUs RTX et CUDA 12.8

LM Studio 0.3.15 : Une Révolution dans l’Exécution Locale des Modèles IA Dans un monde où l’intelligence artificielle générative s’intègre progressivement dans le quotidien des développeurs, chercheurs et utilisateurs avancés, l’exécution locale des modèles de langage (LLM) passe d’une option expérimentale à une solution robuste et performante. Avec la version 0.3.15, LM Studio s’affirme comme […]
Ironwood : la nouvelle TPU de Google pour diriger l’ère de l’inférence dans le cloud

Google lance sa septième génération de TPU, "Ironwood", pour révolutionner l’inférence en IA Lors de l’événement Google Cloud Next 2025, la célèbre entreprise technologique a présenté "Ironwood", son nouveau TPU (Tensor Processing Unit) de septième génération. Conçu entièrement pour accélérer l’inférence des modèles d’intelligence artificielle dans le cloud, "Ironwood" représente un saut technologique sans précédent […]
Oracle et NVIDIA collaborent pour accélérer l’inférence d’IA agentique dans les entreprises

Partenariat stratégique entre Oracle et NVIDIA pour l’IA Oracle et NVIDIA ont annoncé une alliance stratégique visant à intégrer pour la première fois les capacités de calcul accéléré et d’inférence de NVIDIA avec l’infrastructure d’intelligence artificielle et les services génératifs d’Oracle Cloud Infrastructure (OCI). L’objectif est clair : accélérer le développement et le déploiement d’applications […]
DeepSeek R1 utilise les puces Ascend 910C de Huawei pour l’inférence, montrant les avancées de la Chine en IA.

DeepSeek révolutionne le paysage mondial de l’IA avec les puces Ascend 910C de Huawei La société chinoise d’intelligence artificielle DeepSeek a récemment marqué un tournant dans le domaine de l’IA en intégrant les puces Ascend 910C de Huawei pour les tâches d’inférence dans son modèle R1. Ce développement souligne non seulement les progrès technologiques de […]