« MiMo » : différence entre les versions


(Page créée avec « ==en construction== == Définition == XXXXXXXXX == Français == ''' MiMo-7B'' == Anglais == '''MiMo-7B''' MiMo-7B, a large language model specifically designed for reasoning tasks. The model is optimized across both pre-training and post-training stages to unlock its reasoning potential. Despite having only 7 billion parameters, MiMo-7B achieves superior performance on mathematics and code reasoning tasks, outperforming even much larger models including Open... »)
 
Aucun résumé des modifications
 
(6 versions intermédiaires par 3 utilisateurs non affichées)
Ligne 1 : Ligne 1 :
==en construction==
== Définition ==
'''[[Grand modèle de langues]]''' pour les tâches de résolution de problèmes qui peut être optimisé à la fois lors des étapes de '''[[préentraînement]]''' et de post-entraînement. Mimo-7B-Base est pré-entraîné sur 25 trillions de '''[[jeton génératif|jetons génératifs]]''' et intègre la prédiction de plusieurs jetons en tant qu'objectif d'entraînement supplémentaire, ce qui améliore les performances du modèle et accélère l''''[[inférence]]'''.


== Définition ==
Voir aussi '''[[OpenAI]]'''
XXXXXXXXX


== Français ==
== Français ==
''' MiMo-7B''
''' MiMo-7B'''


== Anglais ==
== Anglais ==
'''MiMo-7B'''
'''MiMo-7B'''
<!--MiMo-7B, a large language model specifically designed for reasoning tasks. The model is optimized across both pre-training and post-training stages to unlock its reasoning potential. Despite having only 7 billion parameters, MiMo-7B achieves superior performance on mathematics and code reasoning tasks, outperforming even much larger models including OpenAI's o1-mini.-->


MiMo-7B, a large language model specifically designed for reasoning tasks. The model is optimized across both pre-training and post-training stages to unlock its reasoning potential. Despite having only 7 billion parameters, MiMo-7B achieves superior performance on mathematics and code reasoning tasks, outperforming even much larger models including OpenAI's o1-mini.
== Sources ==
 
== Source ==
[https://arxiv.org/html/2505.07608v1  Source : arxiv]
[https://arxiv.org/html/2505.07608v1  Source : arxiv]




 
[[Catégorie:Intelligence artificielle‏‎]]
[[Catégorie:vocabulary]]
[[Catégorie:GRAND_LEXIQUE_FRANÇAIS]]
[[Catégorie:Publication]]

Dernière version du 29 septembre 2026 à 15:19

Définition

Grand modèle de langues pour les tâches de résolution de problèmes qui peut être optimisé à la fois lors des étapes de préentraînement et de post-entraînement. Mimo-7B-Base est pré-entraîné sur 25 trillions de jetons génératifs et intègre la prédiction de plusieurs jetons en tant qu'objectif d'entraînement supplémentaire, ce qui améliore les performances du modèle et accélère l'inférence.

Voir aussi OpenAI

Français

MiMo-7B

Anglais

MiMo-7B

Sources

Source : arxiv

Contributeurs: Arianne Arel, Claude Coulombe, wiki