MongoDB intègre des embeddings et le reranking à Atlas pour simplifier le RAG des agents

MongoDB a étendu Atlas en intégrant de nouvelles fonctionnalités destinées à transformer la plateforme de données en une couche de mémoire, de contexte et de récupération d’informations pour les applications et agents d’intelligence artificielle. La société incorpore désormais des embeddings automatisés via les modèles de Voyage AI, une API indépendante pour les embeddings et le […]
L’usine d’IA : pourquoi le modèle seul ne crée pas de valeur en entreprise

La discussion sur l’IA en entreprise tourne depuis trop longtemps autour d’une seule question : quel modèle est le meilleur ? GPT, Claude, Gemini, Llama, Mistral, Qwen, DeepSeek. Plus de contexte, plus de raisonnement, des coûts par token réduits. Ces facteurs comptent, mais ils ne couvrent qu’une partie du problème. Les applications d’IA qui produisent des […]
NetApp et Cisco adaptent FlexPod aux workloads IA en production

Annoncée le 3 juin 2026 lors de Cisco Live! à Las Vegas, la nouvelle génération de solutions FlexPod marque un pivot clair pour NetApp et Cisco. Les deux fabricants ne vendent plus une architecture convergente générique : ils livrent des configurations validées pour des charges précises, RAG, recherche sémantique, inférence, edge computing, avec sécurité et […]
QNAP lance QAI-h1290FX, un serveur edge pour l’IA privée en entreprise

QNAP vient de dévoiler le QAI-h1290FX, un serveur conçu pour faire tourner en local des charges d’IA générative (LLM, RAG, génération d’images, automatisation) sans dépendre du cloud. La machine associe stockage all-flash NVMe sur douze baies U.2, processeur AMD EPYC 7302P (16 cœurs, 32 threads), support GPU NVIDIA RTX et le système QuTS hero basé […]
QNAP QAI-h1290FX : LLM privés et RAG en local sans cloud

QNAP a sorti le QAI-h1290FX, un serveur pensé pour faire tourner des LLM privés et des recherches RAG sans envoyer une ligne de données à un fournisseur cloud externe. La machine combine 12 baies NVMe, un AMD EPYC 7302P et une option GPU NVIDIA RTX PRO 6000 Blackwell qui peut grimper jusqu’à 96 Go de […]
OpenAI Privacy Filter : un modele leger open weights pour filtrer les PII en local

OpenAI vient d’ouvrir une breche inattendue dans le marche de la confidentialite des donnees : Privacy Filter, un modele open weights publie sous licence Apache 2.0 qui detecte et masque les informations personnelles identifiables (PII) directement sur la machine de l’utilisateur. Avec 50 millions de parametres actifs sur un total de 1,5 milliard, une fenetre […]
VAST Data et NVIDIA intègrent l’« AI OS » dans le serveur : CNode-X vise à simplifier la pile IA et à accélérer RAG ainsi que la recherche vectorielle

L’infrastructure de Intelligence Artificielle entre dans une nouvelle phase : la bataille ne se joue plus uniquement sur la puissance des GPU, mais sur le chemin des données. Dans ce contexte, VAST Data et NVIDIA ont annoncé une intégration qui cible directement le point de friction le plus courant dans les déploiements d’entreprise : la […]
Zendesk achète Unleash pour renforcer son engagement « IA d’abord » dans le support interne : recherche d’entreprise, RAG avec permissions et agents dans Slack/Teams

Zendesk a annoncé l’acquisition de Unleash, une plateforme de recherche d’entreprise alimentée par l’IA. Conçue pour connecter la connaissance dispersée à travers plusieurs systèmes, elle permet de fournir des réponses fiables directement dans les canaux où travaillent les employés. Annoncé le 18 décembre 2025, cet investissement vise un objectif précis : rendre le support interne […]
MariaDB 2026 aspire à devenir la base de données « tout-en-un » pour l’ère de l’IA argumentée : transactionnelle, analytique, vecteur, RAG et copilotes en une seule plateforme

MariaDB a annoncé Enterprise Platform 2026 avec un message clair pour les développeurs, équipes de données et administrateurs de bases : unifier en une plateforme unique les moteurs transactionnels, analytique et vectoriels, intégrer RAG natif et agents IA, et déployer le tout dans un environnement serverless dans le cloud. L’objectif ? répondre à des charges […]
Dell renforce sa plateforme de données IA : meilleure performance pour RAG, recherche vectorielle et données non structurées avec Elastic, Starburst et NVIDIA

Dell Technologies a annoncé de nouvelles capacités dans sa AI Data Platform, le pilier de gestion des données de l’écosystème Dell AI Factory, visant à aider les entreprises à transformer données dispersées et en silos en résultats d’IA mesurables. La solution met en avant un point critique pour toute organisation souhaitant passer de pilotes à […]