DDPG


Révision datée du 23 septembre 2026 à 22:33 par Pitpitt (discussion | contributions) (Page créée avec « == '''<span style="font-family:arial black;font-size:24px; color:#1880a6;">ROBOTIQUE</span>'''== == Définition == Deep Deterministic Policy Gradient — un algorithme RL hors-politique pour les espaces d'action continus qui utilise une politique déterministe et une fonction Q, entraînées via le théorème du gradient de politique déterministe. DDPG utilise la relecture d'expérience et les réseaux cibles pour la stabilité. Il a... »)
(diff) ← Version précédente | Voir la version actuelle (diff) | Version suivante → (diff)

ROBOTIQUE

Définition

Deep Deterministic Policy Gradient — un algorithme RL hors-politique pour les espaces d'action continus qui utilise une politique déterministe et une fonction Q, entraînées via le théorème du gradient de politique déterministe. DDPG utilise la relecture d'expérience et les réseaux cibles pour la stabilité. Il a été largement appliqué aux tâches de contrôle robotique mais peut être sensible aux hyperparamètres. TD3 (Twin Delayed DDPG) résout son biais de surestimation.

Français

DDPG

Anglais

DDPG

Deep Deterministic Policy Gradient

Sources

Source : Robotic Center


LEXIQUE DE LA ROBOTIQUE Ligne robot.jpg

Robotique.jpg

Contributeurs: wiki