Catégorie : Cloud

Apple présente la puce M5 : saut en IA avec GPU de 10 cœurs, mémoire unifiée de 153 Go/s et disponibilité immédiate sur MacBook Pro, iPad Pro et Vision Pro

Apple présente la puce M5 : saut en IA avec GPU de 10 cœurs, mémoire unifiée de 153 Go/s et disponibilité immédiate sur MacBook Pro, iPad Pro et Vision Pro

Apple a annoncé aujourd’hui le M5, sa nouvelle puce système sur module (SoC) pour ordinateurs et appareils de réalité mixte. Son objectif est clair : augmenter la puissance de l’intelligence artificielle directement sur l’appareil, en réduisant la dépendance au cloud. La société confirme que le M5 sera présent dans le nouveau MacBook Pro 14 pouces, l’iPad Pro ainsi que dans l’Apple Vision Pro, tous disponibles en précommande à partir d’aujourd’hui, le 15 octobre 2025. Le M5 est construit avec une technologie de 3 nm de troisième génération et inaugure une architecture graphique à 10 cœurs intégrant un Neural Accelerator dans chaque unité de la GPU. Avec cette approche, Apple garantit plus de 4 fois l’augmentation des performances GPU pour les

Mise à jour urgente de l'URL pour les services Horizon : Action requise avant le 27 août 2024

Broadcom présente Thor Ultra, la première NIC Ethernet 800G pour l’IA : ouverte, compatible avec l’UEC et prête pour des clusters à l’échelle de millions de tokens

Broadcom a annoncé Thor Ultra, qu’il présente comme la première carte réseau Ethernet (NIC) de 800G spécialement conçue pour l’IA. Ce lancement vise un objectif clair : interconnecter des centaines de milliers d’XPUs (GPU, CPU et autres accélérateurs) afin de entraîner et déployer des modèles ultramassifs de milliards de paramètres sur des réseaux Ethernet ouverts et normalisés. La clé stratégique réside dans son adhérence complète à la spécification du Ultra Ethernet Consortium (UEC), modernisant le RDMA pour des architectures de commutation à grande échelle et évitant la dépendance à des solutions propriétaires. Les solutions apportées par Thor Ultra : un RDMA « repensé » pour une IA à grande échelle Dans les réseaux IA massifs, le RDMA traditionnel présente des

Le marché mondial des puces IA connaîtra une croissance significative jusqu'en 2029

« Tout n’est pas Rubin »

Avec NVIDIA dominant le marché du hardware dédié à l’intelligence artificielle — de Blackwell à la toute nouvelle plateforme Rubin, supportée par des CPUs Vera et des contextes allant jusqu’à “un million de tokens”, on pourrait croire que tout est dit. Pourtant, Positron AI n’est pas de cet avis. Son PDG, Mitesh Agarwal, insiste sur le fait qu’il existe de la place pour des alternatives axées sur des inférences plus économiques et plus performantes, adaptées aux centres de données en air cooling (air-cooled) et sans la nécessité d’un passage à la refroidissement liquide exigé par les GPU NVIDIA de dernière génération. La stratégie de Positron se concrétise à travers Atlas, sa première génération, et Asimov, la prochaine. Ces accélérateurs, selon

Starcloud veut emmener les centres de données dans l'espace : premier satellite avec GPU H100 et promesse d'une énergie 10 fois moins chère

Starcloud veut emmener les centres de données dans l’espace : premier satellite avec GPU H100 et promesse d’une énergie 10 fois moins chère

La course à la montée en puissance de l’informatique en intelligence artificielle ouvre un nouveau champ de jeu : l’orbite terrestre. Starcloud, start-up du programme NVIDIA Inception, prépare pour novembre le lancement de Starcloud-1, un satellite de 60 kg — de la taille d’un « petit réfrigérateur » — qui marquera les débuts d’une GPU NVIDIA H100 dans l’espace. Son objectif est de démontrer que l’inférence et le prétraitement des données peuvent s’effectuer directement là où ces dernières sont générées, sans passer par un centre de traitement terrestrial. La société affirme également que les centres de données spatiaux pourraient réduire de 10 fois leur consommation énergétique et soulager la pression sur le réseau électrique terrestre. Le plan est aussi ambitieux

Arcep souligne l’urgence de l’adoption d’IPv6 pour le web français

L’Arcep, l’autorité de régulation des communications électroniques, a récemment mis à jour sa carte interactive IPv6, mettant en lumière l’évolution de cette technologie en matière d’utilisation à travers le monde depuis l’année 2023. L’outil, enrichi et plus précis, propose désormais de nouvelles fonctionnalités pour mieux saisir l’étendue de l’adoption d’IPv6. Parmi les améliorations notables, l’historique des données s’étend à présent à partir d’octobre 2013, offrant une rétrospective enrichie de la transition vers IPv6. La couverture géographique a été significativement élargie pour passer de 100 à 229 pays, fournissant ainsi une analyse globale de la situation. De plus, les mises à jour s’effectueront mensuellement, promettant une actualisation plus fréquente et une évaluation plus réactive des changements. À la recherche d’une plus

Red Hat amène l'inférence d'IA distribuée aux charges de travail productives d'IA avec Red Hat AI 3

Red Hat amène l’inférence d’IA distribuée aux charges de travail productives d’IA avec Red Hat AI 3

Red Hat, leader mondial dans les solutions logicielles open source, a présenté Red Hat AI 3, une mise à jour majeure de sa plateforme d’intelligence artificielle dédiée aux entreprises. Cette nouvelle version combine les innovations de Red Hat AI Inference Server, Red Hat Enterprise Linux AI (RHEL AI) et Red Hat OpenShift AI, dans le but de simplifier la complexité de l’inférence à haute performance à grande échelle. Les organisations peuvent ainsi accélérer la transition des prototypes aux environnements de production et optimiser le développement d’applications propulsées par l’IA. Alors que les entreprises dépassent le stade purement expérimental, elles rencontrent des défis importants : confidentialité des données, maîtrise des coûts et gestion de multiples modèles. Le rapport The GenAI Divide:

Apple présente la puce M5 : saut en IA avec GPU de 10 cœurs, mémoire unifiée de 153 Go/s et disponibilité immédiate sur MacBook Pro, iPad Pro et Vision Pro

Apple présente la puce M5 : saut en IA avec GPU de 10 cœurs, mémoire unifiée de 153 Go/s et disponibilité immédiate sur MacBook Pro, iPad Pro et Vision Pro

Apple a annoncé aujourd’hui le M5, sa nouvelle puce système sur module (SoC) pour ordinateurs et appareils de réalité mixte. Son objectif est clair : augmenter la puissance de l’intelligence artificielle directement sur l’appareil, en réduisant la dépendance au cloud. La société confirme que le M5 sera présent dans le nouveau MacBook Pro 14 pouces, l’iPad Pro ainsi que dans l’Apple Vision Pro, tous disponibles en précommande à partir d’aujourd’hui, le 15 octobre 2025. Le M5 est construit avec une technologie de 3 nm de troisième génération et inaugure une architecture graphique à 10 cœurs intégrant un Neural Accelerator dans chaque unité de la GPU. Avec cette approche, Apple garantit plus de 4 fois l’augmentation des performances GPU pour les

Mise à jour urgente de l'URL pour les services Horizon : Action requise avant le 27 août 2024

Broadcom présente Thor Ultra, la première NIC Ethernet 800G pour l’IA : ouverte, compatible avec l’UEC et prête pour des clusters à l’échelle de millions de tokens

Broadcom a annoncé Thor Ultra, qu’il présente comme la première carte réseau Ethernet (NIC) de 800G spécialement conçue pour l’IA. Ce lancement vise un objectif clair : interconnecter des centaines de milliers d’XPUs (GPU, CPU et autres accélérateurs) afin de entraîner et déployer des modèles ultramassifs de milliards de paramètres sur des réseaux Ethernet ouverts et normalisés. La clé stratégique réside dans son adhérence complète à la spécification du Ultra Ethernet Consortium (UEC), modernisant le RDMA pour des architectures de commutation à grande échelle et évitant la dépendance à des solutions propriétaires. Les solutions apportées par Thor Ultra : un RDMA « repensé » pour une IA à grande échelle Dans les réseaux IA massifs, le RDMA traditionnel présente des

Le marché mondial des puces IA connaîtra une croissance significative jusqu'en 2029

« Tout n’est pas Rubin »

Avec NVIDIA dominant le marché du hardware dédié à l’intelligence artificielle — de Blackwell à la toute nouvelle plateforme Rubin, supportée par des CPUs Vera et des contextes allant jusqu’à “un million de tokens”, on pourrait croire que tout est dit. Pourtant, Positron AI n’est pas de cet avis. Son PDG, Mitesh Agarwal, insiste sur le fait qu’il existe de la place pour des alternatives axées sur des inférences plus économiques et plus performantes, adaptées aux centres de données en air cooling (air-cooled) et sans la nécessité d’un passage à la refroidissement liquide exigé par les GPU NVIDIA de dernière génération. La stratégie de Positron se concrétise à travers Atlas, sa première génération, et Asimov, la prochaine. Ces accélérateurs, selon

Starcloud veut emmener les centres de données dans l'espace : premier satellite avec GPU H100 et promesse d'une énergie 10 fois moins chère

Starcloud veut emmener les centres de données dans l’espace : premier satellite avec GPU H100 et promesse d’une énergie 10 fois moins chère

La course à la montée en puissance de l’informatique en intelligence artificielle ouvre un nouveau champ de jeu : l’orbite terrestre. Starcloud, start-up du programme NVIDIA Inception, prépare pour novembre le lancement de Starcloud-1, un satellite de 60 kg — de la taille d’un « petit réfrigérateur » — qui marquera les débuts d’une GPU NVIDIA H100 dans l’espace. Son objectif est de démontrer que l’inférence et le prétraitement des données peuvent s’effectuer directement là où ces dernières sont générées, sans passer par un centre de traitement terrestrial. La société affirme également que les centres de données spatiaux pourraient réduire de 10 fois leur consommation énergétique et soulager la pression sur le réseau électrique terrestre. Le plan est aussi ambitieux

Arcep souligne l’urgence de l’adoption d’IPv6 pour le web français

L’Arcep, l’autorité de régulation des communications électroniques, a récemment mis à jour sa carte interactive IPv6, mettant en lumière l’évolution de cette technologie en matière d’utilisation à travers le monde depuis l’année 2023. L’outil, enrichi et plus précis, propose désormais de nouvelles fonctionnalités pour mieux saisir l’étendue de l’adoption d’IPv6. Parmi les améliorations notables, l’historique des données s’étend à présent à partir d’octobre 2013, offrant une rétrospective enrichie de la transition vers IPv6. La couverture géographique a été significativement élargie pour passer de 100 à 229 pays, fournissant ainsi une analyse globale de la situation. De plus, les mises à jour s’effectueront mensuellement, promettant une actualisation plus fréquente et une évaluation plus réactive des changements. À la recherche d’une plus

Red Hat amène l'inférence d'IA distribuée aux charges de travail productives d'IA avec Red Hat AI 3

Red Hat amène l’inférence d’IA distribuée aux charges de travail productives d’IA avec Red Hat AI 3

Red Hat, leader mondial dans les solutions logicielles open source, a présenté Red Hat AI 3, une mise à jour majeure de sa plateforme d’intelligence artificielle dédiée aux entreprises. Cette nouvelle version combine les innovations de Red Hat AI Inference Server, Red Hat Enterprise Linux AI (RHEL AI) et Red Hat OpenShift AI, dans le but de simplifier la complexité de l’inférence à haute performance à grande échelle. Les organisations peuvent ainsi accélérer la transition des prototypes aux environnements de production et optimiser le développement d’applications propulsées par l’IA. Alors que les entreprises dépassent le stade purement expérimental, elles rencontrent des défis importants : confidentialité des données, maîtrise des coûts et gestion de multiples modèles. Le rapport The GenAI Divide: