Snowflake optimise le coût de l’IA grâce à la sélection dynamique des modèles

Snowflake, société spécialisée dans le AI Data Cloud, a annoncé l’intégration du routage dynamique des modèles à Cortex AI Gateway ainsi qu’à ses principaux produits d’intelligence artificielle. Par la même occasion, l’entreprise a élargi son offre en intégrant certains des modèles open source les plus performants du marché. Avec ces nouveautés, Snowflake vise à aider […]
Modèles d’IA ouverts en 2026 : comment choisir sans dépenser davantage

Le marché des modèles d’intelligence artificielle téléchargeables a assez mûri pour que de nombreuses entreprises n’aient plus à dépendre systématiquement d’une API propriétaire. En juillet 2026, il existe des options capables de tourner sur un ordinateur portable, une seule GPU professionnelle ou un cluster complet. Mais le choix ne devrait pas se faire sur le […]
Jensen Huang demande aux États-Unis de ne pas interdire les modèles d’IA chinois

Jensen Huang, le CEO de NVIDIA, affirme que les entreprises américaines doivent pouvoir exploiter des modèles d’intelligence artificielle ouverts, développés en Chine. Selon lui, des systèmes tels que Kimi, DeepSeek ou ceux d’Alibaba peuvent favoriser une adoption plus large de cette technologie. Il rejette l’idée que leur origine géographique soit une raison suffisante pour les […]
L’IA européenne commence lorsque les fournisseurs sont capables de fournir des modèles en production

L’Europe parle d’intelligence artificielle depuis des années. Elle aborde le sujet à travers la réglementation, la recherche académique, les fonds publics et la souveraineté numérique. Toutes ces dimensions sont importantes, mais la véritable compétitivité se mesure à un niveau bien moins confortable : la production. Il s’agit de servir des modèles à de vrais clients, […]
Anthropic lance Claude pour les Startups pour intégrer ses modèles dès le premier jour

Anthropic lance Claude for Startups, un programa destinado a fundadores y startups en etapa inicial que desarrollan productos, agentes o flujos de trabajo basados en Claude. Esta iniciativa combina acceso a comunidades, eventos, recursos técnicos y, para las empresas que cumplen ciertos requisitos, créditos gratuitos de API y límites de uso prioritarios. El enfoque va […]
Claude Fable 5 met les modèles frontière à l’usage général, mais avec des limites

Anthropic a lancé Claude Fable 5, son nouveau modèle polyvalent le plus avancé, accompagné de Claude Mythos 5, une version restreinte initialement destinée aux cyberdéfenseurs, fournisseurs d’infrastructures critiques et programmes d’accès fiable. La société cherche à résoudre une tension toujours plus évidente dans l’industrie de l’intelligence artificielle : comment ouvrir les capacités de pointe à […]
la Chine accélère sa souveraineté technologique avec des puces post-Moore et des modèles ouverts
La Chine joue simultanément deux parties dans sa course à la technologie : les semi-conducteurs et l’intelligence artificielle. Huawei vient de dévoiler une feuille de route visant à approcher une densité équivalente à 1,4 nm dans ses puces haut de gamme d’ici 2031, non pas par une simple réduction géométrique des transistors, mais via une […]
L’IA véridique de Musk relance la guerre technique sur le biais des modèles

Elon Musk a transformé une idée simple en l’un des débats les plus épineux de l’intelligence artificielle : créer une IA « aussi véridique que possible ». xAI l’a formulé dans le cadre de sa mission, liée à la compréhension de la véritable nature de l’univers, et Musk insiste sur le fait qu’un tel système doit privilégier […]
Skymizer promet de porter des modèles de 700 milliards de paramètres sur une seule carte PCIe

Skymizer a présenté HTX301, son premier composant de référence basé sur la plateforme HyperThought, avec une promesse très attrayante pour le marché de l’inférence en intelligence artificielle : exécuter des modèles de langage jusqu’à 700 milliards de paramètres localement, sur une seule carte PCIe équipée de six puces HTX301, avec 384 Go de mémoire et […]
HetCCL : la pièce manquante pour entraîner des modèles avec des GPU NVIDIA et AMD dans le même cluster

La course à la formation de modèles de langage de plus en plus grands rencontre un problème moins visible que la taille des paramètres ou la qualité des données : la logistique du matériel informatique. En pratique, déployer une infrastructure de machine learning à grande échelle ne consiste plus seulement à “acheter plus de GPU”, […]