Xiaomi dévoile HySparse2 pour réduire le coût des longs contextes
Xiaomi a présenté HySparse2, une technologie clé intégrée à son futur modèle MiMo-V3, qui vise à réduire les coûts d'inférence pour les longs contextes. Selon Fuli Luo, responsable du projet, HySparse2 permet de diviser par 5,02 le calcul de préremplissage (prefill) pour un contexte d'un million de tokens, et de réduire de 4,5 fois la mémoire cache KV. Les scores MRCRv2 et RULER-v2 s'améliorent, tandis que les métriques AgentPPL et LongPPL baissent. Cette innovation répond à la demande croissante d'applications agentiques (agents IA) et de traitement de longs documents, où les coûts de calcul explosent. Pour Xiaomi, cela lui permet de concurrencer OpenAI et Google sur le créneau des modèles capables de gérer des contextes très longs à moindre coût, renforçant sa position dans l'IA embarquée (smartphones, assistants). L'impact immédiat : les développeurs et entreprises utilisant des agents IA pourront déployer des applications plus complexes sans exploser leur budget cloud.