AsiaLens
Dossiers Podcast Archives À propos S'abonner
ÉconomieMarchés & MonnaiesCrypto & Actifs numériquesEntreprises & IndustrieTech & SouverainetéGéopolitique & Diplomatie
Tech & Souveraineté

Tencent présente ProLaViT : un cadre pour l'apprentissage visuel progressif des grands modèles multimodaux

Chine · Pandaily · il y a 9 h

Le laboratoire BAC de Tencent a développé le cadre ProLaViT, permettant aux grands modèles langagiers multimodaux d'effectuer une réflexion visuelle étape par étape dans l'espace latent sans outils externes. Cette innovation, présentée lors du Congrès Européen sur la vision computationnelle (ECCV), résout les problèmes de compréhension visuelle globale précédente. ProLaViT améliore significativement l'efficacité et la précision des modèles d'intelligence artificielle dans leur traitement des données visuelles complexes, ouvrant ainsi la voie à une meilleure intégration du texte et de l'image dans les applications pratiques.

À retenir
→ ProLaViT de Tencent promet d'améliorer radicalement le raisonnement visuel des grands modèles multimodaux en éliminant les erreurs liées à la compréhension globale insuffisante des images.
Lire la source · Pandaily ↗
Partager cet article
𝕏 Posterin LinkedInWhatsApp✉ Email

Dans la même rubrique