5 min de lecture·Hugging Face Blog·4 août 2026IA générative9/10Élevé
LFM2.5-2.6B est un modèle d'IA conçu pour fonctionner entièrement sur appareil, avec des performances compétitives face à des modèles 4x plus grands. Il atteint 220 tok/s sur un Apple M5 Max et 113 tok/s sur un AMD Ryzen CPU, tout en conservant les données privées.
« Competitive with models 4x larger on tool use, instruction following, and multi-step agentic tasks. »
— Hugging Face Blog
Il surpasse des modèles plus grands sur les benchmarks d'instruction following et tool use.
Il supporte le tool calling et les workflows multi-étapes tout en restant léger.
Pourquoi cette nouvelle compte-t-elle ?
Ce modèle permet aux développeurs de déployer des agents IA localement, sans dépendre du cloud, garantissant confidentialité et réduction des coûts. Ses performances compétitives avec des modèles plus grands en font une solution viable pour des applications variées.
220 tokens/s sur un Apple M5 Max
Public concerné : développeurs, entreprises
Quels sont les avantages de LFM2.5-2.6B par rapport aux modèles cloud ?
LFM2.5-2.6B permet un déploiement local, garantissant la confidentialité des données et évitant les coûts d'inférencecloud. Il offre des performances compétitives avec des modèles 4x plus grands.
Reçois chaque semaine le meilleur de l'actualité IA, directement dans ta boîte.
Pas de pourriel, désinscription en 1 clic.
✉️
Restez informé
Recevez nos sélections d'outils et articles directement dans votre boîte courriel.
🔐 Connexion rapide
Entrez votre courriel pour recevoir un code à 6 chiffres.
Pas besoin de mot de passe ni d'inscription. Entrez votre courriel, recevez un code par courriel, et c'est tout !
✓
Paramètres de confidentialité
Nous utilisons des témoins (cookies) pour assurer le bon fonctionnement du site, analyser le trafic et personnaliser le contenu. Vous pouvez gérer vos préférences ci-dessous.
Politique de confidentialité