Tutoriel publié le 21/08/2024. Les outils et leurs interfaces peuvent avoir évolué. Cet exemple pédagogique ne constitue pas une réalisation client ni une garantie de résultat.
Description
LLaVa-NeXT 1.6 est un modèle conçu pour des tâches telles que la légende d'images, la réponse à des questions basées sur des images, et peut servir de base à des chatbots qui interagissent à la fois avec du texte et des images. L'optimisation technique du modèle inclut des options comme la quantisation en 4 bits et l'utilisation de Flash-Attention 2 pour des performances améliorées. Ce modèle représente une avancée notable dans le traitement et l'intégration des capacités multimodales en IA. Cette version, LLaVa-1.6, utilise le checkpoint Mistral-7B et améliore ses performances par rapport à LLaVa-1.5.Technologies Utilisées
- Langage de programmation : Python
- Modèles de traitement d’image : LLaVa-1.6, https://huggingface.co/llava-hf/llava-v1.6-mistral-7b-hf
Comment ça marche ?
Chargement de LLaVa-1.6 :
Description de produits avec de LLaVa-1.6 :
- Test sur lien image
- Test upload sur une seule image
- Test upload sur plusieurs images

