Tencent présente ProLaViT : un cadre pour l'apprentissage visuel progressif des grands modèles multimodaux
Chine · Pandaily · il y a 9 h
Le laboratoire BAC de Tencent a développé le cadre ProLaViT, permettant aux grands modèles langagiers multimodaux d'effectuer une réflexion visuelle étape par étape dans l'espace latent sans outils externes. Cette innovation, présentée lors du Congrès Européen sur la vision computationnelle (ECCV), résout les problèmes de compréhension visuelle globale précédente. ProLaViT améliore significativement l'efficacité et la précision des modèles d'intelligence artificielle dans leur traitement des données visuelles complexes, ouvrant ainsi la voie à une meilleure intégration du texte et de l'image dans les applications pratiques.
À retenir
→ ProLaViT de Tencent promet d'améliorer radicalement le raisonnement visuel des grands modèles multimodaux en éliminant les erreurs liées à la compréhension globale insuffisante des images.
Partager cet article
Dans la même rubrique
Tech & Souveraineté · Chine
Alibaba présente Qwen3.8 avec 2,4 trillions de paramètres
L'équipe Alibaba a dévoilé la version prévue Qwen3.8, dotée de 2,4 trillions de paramètres, dont les poids seront prochainement libérés. Une version préliminair…
il y a 9 hTech & Souveraineté · Taïwan
TSMC envisage d'augmenter de 5 à 10 % les prix des puces en 2027
Selon des sources, TSMC, le leader mondial dans la fabrication de semi-conducteurs, songe à une hausse de 5 à 10 % du prix de ses composants pour l'année 2027.…
il y a 7 hTech & Souveraineté · Chine
Lancement de l'organisation mondiale sur l'intelligence artificielle chinoise WAICO
Le World Artificial Intelligence Cooperation Organization (WAICO), initiative chinoise pour collaborer à l'innovation et au développement de l'IA, a été lancée…
il y a 6 h