Gemini 3.5 Flash : Google redéfinit la course IA sur le terrain des agents

Abstract visualization of AI agents and multi-step workflows: interconnected nodes and data flows forming a complex networ...

Google DeepMind a dévoilé Gemini 3.5 Flash, portant un message clair pour le marché technologique : la prochaine étape de l’intelligence artificielle se jouera au niveau des agents intelligents. Fini le temps où répondre correctement dans une conversation était l’étalon de mesure. Les nouveaux modèles doivent agir, intégrer des outils, consulter des données, exécuter des […]

QNAP lance QAI-h1290FX, un serveur edge pour l’IA privée en entreprise

QNAP lance QAI-h1290FX, un serveur edge pour l'IA privée en entreprise

QNAP vient de dévoiler le QAI-h1290FX, un serveur conçu pour faire tourner en local des charges d’IA générative (LLM, RAG, génération d’images, automatisation) sans dépendre du cloud. La machine associe stockage all-flash NVMe sur douze baies U.2, processeur AMD EPYC 7302P (16 cœurs, 32 threads), support GPU NVIDIA RTX et le système QuTS hero basé […]

Cloudflare et Wiz : une alliance pour sécuriser l’IA en entreprise

Cloudflare et Wiz annoncent leur partenariat en matière de sécurité basé sur l'intelligence artificielle

La multiplication des déploiements d’intelligence artificielle en entreprise dépasse la capacité de contrôle des équipes de sécurité. Chaque chatbot, copilote ou endpoint basé sur l’IA représente un vecteur d’attaque potentiel — vulnérable à l’injection d’instructions malveillantes, à la fuite de données sensibles ou à un usage non contrôlé. Cloudflare et Wiz (désormais intégré à Google […]

Anthropic et CoreWeave : un accord pluriannuel pour Claude dans le cloud IA

CoreWeave valide le "Platinum ClusterMAX™" de SemiAnalysis : ce qui se cache derrière la performance qui la couronne comme le cloud d'IA numéro 1

Anthropic a conclu un accord pluriannuel avec CoreWeave pour utiliser son infrastructure cloud dans le développement et le déploiement de la famille de modèles Claude. CoreWeave a confirmé que la capacité contractée commencera à être déployée plus tard cette année. Anthropic possède déjà un partenariat stratégique avec Amazon (8 milliards investis, AWS comme fournisseur cloud […]

Citrix NetScaler AI Gateway : gouvernance et coûts de l’IA en entreprise

Citrix lance NetScaler AI Gateway pour organiser, gérer les coûts et sécuriser le trafic d'IA en entreprise

Citrix a présenté NetScaler AI Gateway, une couche de gouvernance dédiée aux applications d’IA. L’objectif : maîtriser coûts, performance et sécurité lors des déploiements de LLM et flux agentiques. De nombreuses entreprises sont passées de l’expérimentation à la production sans que leurs infrastructures ne gèrent le volume de trafic, les coûts par token ou les […]

Meta Muse Spark : la réponse stratégique face à OpenAI et Google

Meta joue sa carte avec Muse Spark et redéfinit sa stratégie face à OpenAI et Google

Meta a présenté Muse Spark, premier modèle de la famille Muse de Meta Superintelligence Labs. Modèle multimodal de raisonnement avec outils, chaîne de pensée visuelle et orchestration multi-agent. Déjà déployé sur meta.ai et dans l’app Meta AI, avec API privée pour partenaires. Bientôt sur WhatsApp, Instagram, Facebook, Messenger et lunettes IA. Ce lancement s’accompagne d’une […]

Anthropic Mythos : l’IA offensive devient une affaire industrielle

Anthropic conserve Mythos et transforme l'IA offensive en une affaire industrielle

Anthropic conserve Claude Mythos en accès fermé via Project Glasswing réunissant Apple, Google, Microsoft, NVIDIA, CrowdStrike et Palo Alto Networks. L’IA offensive passe du laboratoire à l’industrie. Mythos est trop puissant en sécurité offensive pour une diffusion large. Ce positionnement complète l’entrée d’OpenAI et Anthropic en cybersécurité et le partenariat Anthropic-CoreWeave pour Claude. Questions fréquentes […]

Google alerte : la mémoire freine les grands modèles d’IA

TurboTax : Google met en garde contre la mémoire qui entrave les grands modèles

Google alerte : la mémoire, pas le calcul, est le vrai goulot d’étranglement des grands modèles d’IA. La bande passante mémoire est souvent le facteur limitant pour l’inférence, pas la puissance GPU. Solutions : architectures HBM plus rapides, quantification, caches KV optimisés. Cela explique pourquoi SK hynix mise sur la HBM5 hybride et pourquoi la […]

Gartner avertit : l’IA explicable stimulera la surveillance des LLM

L'essor des LLM open source : vers une intelligence artificielle plus démocratique et durable

La course pour déployer une intelligence artificielle générative dans les environnements professionnels entre dans une nouvelle phase. Il ne suffit plus de lancer des copilotes, des assistants ou des flux automatisés : il est désormais essentiel de prouver la fiabilité de ces systèmes, leur conformité aux attentes et la possibilité d’auditer leurs réponses. Dans ce […]