TD3


Révision datée du 7 octobre 2026 à 13:23 par Pitpitt (discussion | contributions) (Page créée avec « == '''<span style="font-family:arial black;font-size:24px; color:#1880a6;">ROBOTIQUE</span>'''== == Définition == Twin Delayed DDPG — un algorithme RL hors-politique qui résout le biais de surestimation de DDPG en : (1) utilisant deux réseaux Q et prenant le minimum, (2) retardant les mises à jour de politique par rapport aux mises à jour du réseau Q, et (3) ajoutant du bruit de politique cible lissé. TD3 est plus stable que... »)
(diff) ← Version précédente | Voir la version actuelle (diff) | Version suivante → (diff)

ROBOTIQUE

Définition

Twin Delayed DDPG — un algorithme RL hors-politique qui résout le biais de surestimation de DDPG en : (1) utilisant deux réseaux Q et prenant le minimum, (2) retardant les mises à jour de politique par rapport aux mises à jour du réseau Q, et (3) ajoutant du bruit de politique cible lissé. TD3 est plus stable que DDPG et constitue une référence standard pour les tâches d'apprentissage de contrôle continu de robots.

Français

TD3

Anglais

TD3

Twin Delayed DDPG

Sources

Source : Robotic Center


LEXIQUE DE LA ROBOTIQUE Ligne robot.jpg Robotique.jpg

Contributeurs: wiki