Alibaba et DeepSeek révolutionnent les coûts des modèles d'IA
Alibaba a lancé Qwen3.8-Max, son modèle d'IA le plus puissant avec 2,4 billions de paramètres, activant seulement 95 milliards à la fois pour réduire les coûts. DeepSeek propose V4-Flash à des prix d'inférence inférieurs à ceux de plusieurs systèmes concurrents.
Que faut-il retenir ?
- Qwen3.8-Max a 2,4 billions de paramètres et active 95 milliards à la fois.
- DeepSeek V4-Flash coûte 0,14$ par million de tokens d'entrée et 0,28$ par million de tokens de sortie.
- Qwen3.8-Max peut traiter jusqu'à un million de tokens de contexte.
- Kimi K3 de Moonshot AI coûte 3$ par million de tokens d'entrée et 15$ par million de tokens de sortie.
Pourquoi cette nouvelle compte-t-elle ?
Les nouveaux modèles d'IA comme Qwen3.8-Max et V4-Flash réduisent les coûts d'inférence, ce qui impacte directement les entreprises utilisant ces technologies. Ces avancées permettent une meilleure efficacité et des économies significatives pour les applications d'IA générative.
2,4 billions de paramètres pour Qwen3.8-Max
Public concerné : entreprises
Quel est l'impact des nouveaux modèles d'IA sur les coûts d'inférence ?
Les nouveaux modèles comme Qwen3.8-Max et V4-Flash réduisent les coûts d'inférence grâce à des architectures optimisées, permettant des économies significatives pour les entreprises utilisant ces technologies.
🔧 Outils mentionnés