DeepSeek lance V4.1 Flash, son modèle MoE de 552B avec vision native
DeepSeek, la start-up chinoise d'IA, a mis en disponibilité générale son modèle V4.1 Flash, un modèle de langage massif de 552 milliards de paramètres utilisant une architecture Mixture-of-Experts (MoE) combinée à un encodeur-décodeur causal et une vision native. La tarification du nouveau modèle a débuté le 10 septembre, et le précédent V4 Pro sera redirigé vers Flash à partir du 14 septembre. L'application DeepSeek fusionne également ses différents modes en un seul mode intelligent, simplifiant l'expérience utilisateur. Pour les entreprises et développeurs chinois, ce déploiement signifie un accès à un modèle plus puissant et économique, capable de traiter texte et images sans modules séparés, ce qui réduit les coûts d'infrastructure et accélère le déploiement d'applications d'IA multimodales. En retirant progressivement le V4 Pro, DeepSeek impose Flash comme son nouveau standard, forçant les clients à migrer sous peine de perdre l'accès à l'ancienne version.