Ollama dépasse presque la vitesse des LLM sur Mac avec MLX, mais à une condition

Ollama dépasse presque la vitesse des LLM sur Mac avec MLX, mais à une condition

Ollama a opéré une modification majeure de son architecture pour exécuter des modèles d’intelligence artificielle sur les Mac équipés de la puce Apple Silicon. Depuis la version 0.19, il intègre en phase pilote un moteur basé sur MLX, le framework d’apprentissage automatique développé par Apple, capable de faire passer la vitesse de génération du modèle […]

L’IA devient moins chère, mais les agents font grimper le coût par tâche

L'IA devient moins chère, mais les agents font augmenter le coût par tâche

Le prix du jeton s’effondre plus vite qu’aucune technologie avant lui. Un graphique diffusé par Andreessen Horowitz, construit sur des chiffres de Goldman Sachs et du département du Commerce américain, montre que l’IA a comprimé ses coûts unitaires en trois ans, là où l’informatique personnelle avait mis près de vingt ans pour y arriver. Les […]

L’usine d’IA : pourquoi le modèle seul ne crée pas de valeur en entreprise

L'Intelligence Artificielle est déjà dans l'entreprise… mais cela ne se voit pas encore dans la productivité

La discussion sur l’IA en entreprise tourne depuis trop longtemps autour d’une seule question : quel modèle est le meilleur ? GPT, Claude, Gemini, Llama, Mistral, Qwen, DeepSeek. Plus de contexte, plus de raisonnement, des coûts par token réduits. Ces facteurs comptent, mais ils ne couvrent qu’une partie du problème. Les applications d’IA qui produisent des […]

Fugu (Sakana AI) : l’IA multi-agents bat les modèles géants

L'essor des LLM open source : vers une intelligence artificielle plus démocratique et durable

Sakana AI a présenté Fugu, une famille d’orchestrateurs de modèles qui remet en débat un des sujets les plus chargés de l’IA moderne : la progression des performances viendra-t-elle de l’entraînement de modèles monolithiques toujours plus grands, ou de la coordination de plusieurs modèles spécialisés via des systèmes multi-agents ? Ce concept n’est pas nouveau […]

Pourquoi Claude s’appelle Claude : Shannon, MiniVac et la racine mathématique des LLM

Le Pentagone accélère l'« IA en production » : Claude, ChatGPT, Gemini et Grok rivalisent pour le cœur (et le contrôle) de la défense des États-Unis

Claude est l’un des noms les plus emblématiques de la nouvelle génération d’assistants en Intelligence Artificielle. Anthropic en a fait une marque associée à des modèles de langage soigneusement déployés : Haiku, Sonnet, Opus, et plus récemment, des familles comme Fable ou Mythos. Mais derrière ce nom principal se pose une question qui revient constamment […]

Le blocage de Claude Fable 5 révèle le risque de dépendre d’une seule IA

Le blocage de Claude Fable 5 met en évidence le nouveau risque de dépendre d'une seule IA

Anthropic a suspendu l’accès à Claude Fable 5 et Claude Mythos 5 après avoir reçu une directive du gouvernement américain basée sur des motifs de sécurité nationale. La restriction, liée au contrôle des exportations, interdirait l’utilisation de ces modèles par tout citoyen étranger, aux États-Unis ou ailleurs. Pour éviter tout risque juridique, Anthropic a opté […]

Claude Opus 4.8 : Anthropic accélère la course aux agents IA autonomes

Le Pentagone accélère l'« IA en production » : Claude, ChatGPT, Gemini et Grok rivalisent pour le cœur (et le contrôle) de la défense des États-Unis

Anthropic a lancé Claude Opus 4.8, une nouvelle version de son modèle phare qui se concentre sur le terrain où se joue l’essentiel de la compétition IA actuelle : les agents capables de travailler sur de longues périodes, d’utiliser des outils, de réviser du code, d’interagir avec des terminaux et de réaliser des tâches complexes […]

Cerebras défie NVIDIA sur la vitesse d’inférence

OpenAI regarde Cerebras pour renforcer sa puissance d'inférence et réduire sa dépendance à d'autres fournisseurs

Cerebras remet sur la table une question gênante pour l’industrie de l’IA : et si le problème ne résidait pas dans le nombre de GPU, mais dans une dépendance excessive à une architecture conçue à l’origine pour d’autres types de charges ? Andrew Feldman, cofondateur et CEO de Cerebras, défend depuis longtemps cette thèse : […]

Akamai lance AI Brand Presence : gérer sa visibilité dans la recherche agentique

Akamai AI Brand Presence optimise le contenu et augmente la visibilité dans la recherche agéntica

Akamai a lancé AI Brand Presence, une solution conçue pour aider les entreprises à adapter leur présence numérique à un contexte de recherche dominé par l’IA. Le produit optimise le contenu pour les grands modèles de langage et les agents d’IA, surveille le trafic automatisé et renforce la sécurité à l’edge. Un lancement qui répond […]