Apprentissage par renforcement avec borne de confiance supérieure


La version imprimable n’est plus prise en charge et peut comporter des erreurs de génération. Veuillez mettre à jour les signets de votre navigateur et utiliser à la place la fonction d’impression par défaut de celui-ci.

Domaine


Intelligence artificielle
Apprentissage automatique
Apprentissage par renforcement
Coulombe

Définition

L'algorithme d'apprentissage par renforcement avec borne de confiance supérieure est basé sur le principe d'optimisme face à l’incertitude qui consiste à utiliser une borne supérieure sur l’espérance des récompenses pour chaque action.


Français

Apprentissage par renforcement avec borne de confiance supérieure n.m.


Anglais

Reinforcement Learning with the Upper Confidence Bound


Source: corpus.ulaval.ca

source : opendatascience.com