Ollama dépasse presque la vitesse des LLM sur Mac avec MLX, mais à une condition

Ollama a opéré une modification majeure de son architecture pour exécuter des modèles d’intelligence artificielle sur les Mac équipés de la puce Apple Silicon. Depuis la version 0.19, il intègre en phase pilote un moteur basé sur MLX, le framework d’apprentissage automatique développé par Apple, capable de faire passer la vitesse de génération du modèle […]
L’IA devient moins chère, mais les agents font grimper le coût par tâche

Le prix du jeton s’effondre plus vite qu’aucune technologie avant lui. Un graphique diffusé par Andreessen Horowitz, construit sur des chiffres de Goldman Sachs et du département du Commerce américain, montre que l’IA a comprimé ses coûts unitaires en trois ans, là où l’informatique personnelle avait mis près de vingt ans pour y arriver. Les […]
L’usine d’IA : pourquoi le modèle seul ne crée pas de valeur en entreprise

La discussion sur l’IA en entreprise tourne depuis trop longtemps autour d’une seule question : quel modèle est le meilleur ? GPT, Claude, Gemini, Llama, Mistral, Qwen, DeepSeek. Plus de contexte, plus de raisonnement, des coûts par token réduits. Ces facteurs comptent, mais ils ne couvrent qu’une partie du problème. Les applications d’IA qui produisent des […]
Fugu (Sakana AI) : l’IA multi-agents bat les modèles géants

Sakana AI a présenté Fugu, une famille d’orchestrateurs de modèles qui remet en débat un des sujets les plus chargés de l’IA moderne : la progression des performances viendra-t-elle de l’entraînement de modèles monolithiques toujours plus grands, ou de la coordination de plusieurs modèles spécialisés via des systèmes multi-agents ? Ce concept n’est pas nouveau […]
Pourquoi Claude s’appelle Claude : Shannon, MiniVac et la racine mathématique des LLM

Claude est l’un des noms les plus emblématiques de la nouvelle génération d’assistants en Intelligence Artificielle. Anthropic en a fait une marque associée à des modèles de langage soigneusement déployés : Haiku, Sonnet, Opus, et plus récemment, des familles comme Fable ou Mythos. Mais derrière ce nom principal se pose une question qui revient constamment […]
OVHcloud veut concurrencer Mistral : l’IA européenne entre dans la guerre de l’infrastructure

OVHcloud a décidé d’entrer dans un domaine qui, jusqu’à récemment, semblait réservé à des laboratoires comme Mistral AI, OpenAI, Anthropic ou Google DeepMind : le développement de modèles d’IA de pointe. Ce mouvement ne fait pas d’OVHcloud un concurrent direct de Mistral — le groupe français n’a encore publié ni modèle comparable ni métriques de […]
Le blocage de Claude Fable 5 révèle le risque de dépendre d’une seule IA

Anthropic a suspendu l’accès à Claude Fable 5 et Claude Mythos 5 après avoir reçu une directive du gouvernement américain basée sur des motifs de sécurité nationale. La restriction, liée au contrôle des exportations, interdirait l’utilisation de ces modèles par tout citoyen étranger, aux États-Unis ou ailleurs. Pour éviter tout risque juridique, Anthropic a opté […]
Claude Opus 4.8 : Anthropic accélère la course aux agents IA autonomes

Anthropic a lancé Claude Opus 4.8, une nouvelle version de son modèle phare qui se concentre sur le terrain où se joue l’essentiel de la compétition IA actuelle : les agents capables de travailler sur de longues périodes, d’utiliser des outils, de réviser du code, d’interagir avec des terminaux et de réaliser des tâches complexes […]
Cerebras défie NVIDIA sur la vitesse d’inférence

Cerebras remet sur la table une question gênante pour l’industrie de l’IA : et si le problème ne résidait pas dans le nombre de GPU, mais dans une dépendance excessive à une architecture conçue à l’origine pour d’autres types de charges ? Andrew Feldman, cofondateur et CEO de Cerebras, défend depuis longtemps cette thèse : […]
Akamai lance AI Brand Presence : gérer sa visibilité dans la recherche agentique

Akamai a lancé AI Brand Presence, une solution conçue pour aider les entreprises à adapter leur présence numérique à un contexte de recherche dominé par l’IA. Le produit optimise le contenu pour les grands modèles de langage et les agents d’IA, surveille le trafic automatisé et renforce la sécurité à l’edge. Un lancement qui répond […]