« MiMo » : différence entre les versions
Aucun résumé des modifications |
Aucun résumé des modifications |
||
| Ligne 1 : | Ligne 1 : | ||
== Définition == | == Définition == | ||
'''[[Grand modèle de langues]]''' pour les tâches de | '''[[Grand modèle de langues]]''' pour les tâches de résolution de problèmes qui peut être optimisé à la fois lors des étapes de '''[[préentraînement]]''' et de post-entraînement. Mimo-7B-Base est pré-entraîné sur 25 trillions de '''[[jeton génératif|jetons génératifs]]''' et intègre la prédiction de plusieurs jetons en tant qu'objectif d'entraînement supplémentaire, ce qui améliore les performances du modèle et accélère l''''[[inférence]]'''. | ||
Voir aussi '''[[OpenAI]]''' | Voir aussi '''[[OpenAI]]''' | ||
| Ligne 17 : | Ligne 17 : | ||
[[Catégorie:Intelligence artificielle]] | [[Catégorie:Intelligence artificielle]] | ||
[[Catégorie:GRAND_LEXIQUE_FRANÇAIS]] | [[Catégorie:GRAND_LEXIQUE_FRANÇAIS]] | ||
[[Catégorie:Publication]] | |||
Dernière version du 29 septembre 2026 à 15:19
Définition
Grand modèle de langues pour les tâches de résolution de problèmes qui peut être optimisé à la fois lors des étapes de préentraînement et de post-entraînement. Mimo-7B-Base est pré-entraîné sur 25 trillions de jetons génératifs et intègre la prédiction de plusieurs jetons en tant qu'objectif d'entraînement supplémentaire, ce qui améliore les performances du modèle et accélère l'inférence.
Voir aussi OpenAI
Français
MiMo-7B
Anglais
MiMo-7B
Sources
Contributeurs: Arianne Arel, Claude Coulombe, wiki





