Jusqu’où se souviennent les modèles de langage ? Une analyse révèle la véritable capacité de contexte des LLM.

Red Hat présente Ramalama : Rendre l'Intelligence Artificielle ennuyeuse pour en faciliter l'utilisation

Concurrence pour étendre la fenêtre contextuelle des modèles de langage : une nouvelle étude remet en question les claims de performance Dans la bataille technique pour élargir la fenêtre contextuelle des modèles de langage, des entreprises éclairées telles qu’OpenAI, Google, Anthropic et Meta s’affrontent pour proposer des modèles capables de traiter une quantité croissante de […]

Gradient AI réussit à étendre le contexte de Llama 3 à plus d’un million de jetons

Gradient AI réussit à étendre le contexte de Llama 3 à plus d'un million de jetons

Gradient AI, une entreprise spécialisée dans l’intelligence artificielle, a réalisé une avancée importante dans le domaine du traitement du langage naturel en étendant le contexte des modèles Llama 3 de Meta à plus d’un million de tokens. Cette réussite positionne ces modèles comme ayant le contexte le plus large dans le domaine de l’open source. […]