Grand modèle de langues multimodal


Révision datée du 27 janvier 2024 à 21:43 par Pitpitt (discussion | contributions) (Remplacement de texte : « ↵<small> » par «  ==Sources== »)

Définition

Grand modèle de langues qui admet plusieurs modalités de représentation de l'information des données (texte, son, image, vidéo, données issues de capteurs, etc.) en entrée et en sortie.

Voir modèle multimodal.

Français

grand modèle de langue multimodal

grand modèle de langage multimodal

GMLM

grand modèle multimodal

Anglais

multimodal large language model

MLLM

large multimodal model


Sources

Source : bdtechtalks

Source : Huang et al. (2023)

Source: Developpez.com