VMware amène Nemotron, Gemma, Qwen et GLM vers son cloud privé pour l’IA

Broadcom a élargi les capacités d’intelligence artificielle de VMware Cloud Foundation (VCF) avec la validation de plusieurs modèles de NVIDIA, Google DeepMind, NEC, Alibaba Cloud et Z.ai pour leur déploiement sur une infrastructure privée. Annoncé lors de VMware Explore 2026, cet enjeu vise à permettre aux entreprises d’offrir de l’inférence et des modèles en tant […]
Cloudflare révèle comment Kimi et GLM fonctionnent avec moins de mémoire sans perdre de précision

Cloudflare a expliqué certains des changements qu’elle a introduits dans Workers AI pour exécuter des modèles ouverts de grande taille tels que Kimi K2.6 de Moonshot AI et GLM 5.2 de Z.ai, en utilisant des techniques d’optimisation plus efficaces. La société assure avoir réduit la consommation de mémoire GPU et le coût par inférence grâce […]
Databricks teste les agents de code en production et GLM 5.2 entre dans la ligue première

Databricks a publié l’un des benchmarks les plus intéressants du moment pour les agents de programmation, pas parce qu’il utilise une batterie d’exercices publics, mais parce qu’il s’appuie sur son propre code. La société a évalué modèles et harnesses d’agents sur des tâches réelles extraites de pull requests internes, sur une base de code de […]