DiffusionGemma : le modèle de diffusion rapide de Google
Google a développé DiffusionGemma en convertissant le modèle Gemma-4-26B-A4B, atteignant une vitesse de sortie plusieurs fois supérieure avec une précision comparable. Le modèle utilise deux étapes d'entraînement pour équilibrer qualité et vitesse, et permet des corrections bidirectionnelles.
« DiffusionGemma delivers several times the output speed of the Gemma 4 models and previous diffusion models while maintaining comparable accuracy. » — The Decoder
Que faut-il retenir ?
- DiffusionGemma utilise moins de 10% du budget d'entraînement original du modèle Gemma-4-26B-A4B.
- Le modèle atteint une vitesse de sortie d'environ 1 500 tokens par seconde.
- DiffusionGemma résout près de 85% des puzzles Sudoku correctement après un léger ajustement.
- Le modèle est déjà utilisé par la startup Interfaze pour la reconnaissance vocale multilingue.
Pourquoi cette nouvelle compte-t-elle ?
DiffusionGemma représente une avancée majeure dans les modèles de diffusion textuelle, offrant une vitesse accrue et une efficacité énergétique. Cela ouvre des possibilités pour des applications en temps réel et des adaptations spécialisées, tout en réduisant les coûts d'entraînement.
1 500 tokens par seconde
Public concerné : développeurs, entreprises
Quels sont les avantages de DiffusionGemma par rapport aux modèles traditionnels ?
DiffusionGemma offre une vitesse de sortie plusieurs fois supérieure, une correction bidirectionnelle des erreurs et une efficacité énergétique accrue, tout en utilisant moins de 10% du budget d'entraînement original.
🔧 Outils mentionnés